Transformer Encoder

Latest papers 80

All topics
CardsList
  1. DeBERTa-ConPara: Attack-Aware and Deployment-Realistic Detection of AI-Generated Text

    Oct 1, 2026Mohamed Mady, Yupei Li, Johannes Reschke +1Machine-Generated Text DetectionBert-Based Models

  2. Predictive Geometry of Hidden Trajectories in Transformers

    Sep 29, 2026Timur Mudarisov, Mikhail Burtsev, Tatiana Petrova +1Transformer EncoderTransformer Architectures

  3. Self-Supervised Learning for Robust Resonance Mass Regression in Cascade Decays

    Sep 15, 2026Ho Fung Tsoi, Alex Yang, Luis Felipe Gutierrez Zagazeta +2Self-Supervised LearningTransformer Encoder

  4. Same path, different: a mechanistic comparison of looped and stacked transformer encoders on 12-lead ECG

    Sep 14, 2026Pawel Olszowiec, Michal Byra, Grzegorz Gruszczynski +2Transformer EncoderAdult-To-Pediatric Electrocardiogram Transfer

  5. Breaking the Token Ceiling: Distilling Smaller, Stronger Byte Models

    Sep 14, 2026Kalyani Marathe, Artidoro Pagnoni, Tomasz Limisiewicz +4Small Large Language ModelsTransformer Encoder

  6. Towards a knowledge-enhanced single-cell foundation model

    Sep 14, 2026Hanqing Zhang, Jie Bao, Mei Ma +7Regulatory NetworksPretraining

  7. Sparse Weight and Edge Circuit Discovery in Transformer-based Acoustic Models

    Sep 11, 2026Jiankun Wei, Ewan Dunbar, Gerald PennTransformer EncoderNeural Audio

  8. Stride-k Subsampling: Train-Free Audio Token Reduction for Whisper

    Aug 31, 2026Chanhee Cho, Junhyuk Choi, Bugeun KimAudio TokenizersSubsampling

  9. AQ3D: Adaptive Query Transformer for 3D Instance Segmentation

    Aug 31, 2026Keno Moenck, Thorsten Schüppstuhl3D GenerationTransformer Encoder

  10. LabelFusion-TS: Fusing Large Language Models, Transformer Encoders, and Financial Time Series for Monetary-Policy Stance Classification

    Aug 12, 2026Michael Schlee, Fabian Lukassen, Christoph WeisserFinancial Sentiment AnalysisCnn-Lstm

  11. ODE-Based Transformer Decoders for Iterative Sign Language Translation

    Aug 11, 2026Tuğçe Kızıltepe, Hacer Yalim KelesGloss-Free Sign Language TranslationSign Language Translation

  12. Why Post-Norm Transformers Collapse: Attention Amplification and Gradient Repair Failure

    Aug 10, 2026Xingjian Wang, Qingyu Han, Xiaodong Luo +1Batch NormalizationTransformer Encoder

  13. ZIPBrain: Can EEG Foundation Models Be Faster, Locally Deployable, but Accurate?

    Aug 7, 2026Lingwei Li, Yirong Kan, Peng Chen +3Electroencephalography Foundation ModelsElectroencephalography

  14. Separating quantum circuits from classical LLMs

    Aug 4, 2026Srinivasan Arunachalam, Arkopal Dutt, Hari Krovi +1Quantum CircuitsLarge Language Model Quantization

  15. Divergent large language model predictions from convergent representations in ambiguous word pairs

    Aug 3, 2026K. Jack Scott, Narun Pat, Veronica LiesaputraTransformer EncoderLayer-Wise

  16. Enhancing Transformer-based Routing by Encoding Distance via Relative Positional Encoding

    Jul 21, 2026Leyre Encío, Daniel Fuertes, Carlos R. del-Blanco +1Multiplex Graph TransformersPositional Encoding

  17. A Controlled Study of Attention-Only Transformers

    Jul 20, 2026Henry Ndubuaku, Karen Mosoyan, Jakub Mroz +5Transformer AttentionTransformer Encoder

  18. An Explainable FFT-Based Spatial-Frequency Fusion Framework for Deepfake Detection

    Jul 19, 2026Pamela Kirui, Cho Hyuk, Qingzhong Liu +1Deepfake DetectionTwo-Level Spatial-Frequency Fusion Strategy

  19. Do Transformer Temporal Heads and Post-Pooling Motion Gates Help CorrNet-based CSLR? An Empirical Study

    Jul 10, 2026Lisi Wang, Zhidong Xiao, Jianjun PengTransformer EncoderSign Language Translation

  20. DDStereo: Efficient Dual Decoder Transformers for Stereo 3D Road Anomaly Detection

    Jun 23, 2026Shiyi Mu, Zichong Gu, Zhiqi Ai +23D Object DetectionAutonomous Driving Perception

  21. moBERTo: A Modern Encoder for Portuguese via Continued Pretraining of ModernBERT

    Jun 21, 2026Thiago Laitz, Thales Sales Almeida, João Guilherme Alves Santos +1Bert-Based ModelsTransformer Encoder

  22. Short-Term Electricity Demand Forecasting for New England Using a Hybrid Transformer-XGBoost Framework with Weather, Calendar, and COVID-19 Indicators

    Jun 18, 2026Reza Ghanavati, Behrooz MosallaeiAccurate Short-Term Electricity Load ForecastingForecasting Backbone

  23. Dual Dimensionality for Local and Global Attention

    Jun 17, 2026Zhiyuan Wang, Xuan Luo, Sirui Zeng +1Transformer EncoderRepresentational Capacity

  24. Binary Black Hole Parameter Estimation with Hybrid CNN-Transformer Neural Networks

    Jun 11, 2026Panagiotis N. Sakellariou, Spiros V. Georgakopoulos, Sotiris Tasoulis +1Gravitational WavesGeneral Relativity

  25. SpikeDecoder: Realizing the GPT Architecture with Spiking Neural Networks

    Jun 10, 2026Claas Beger, Florian Walter, Alois KnollSpiking Neural NetworksTransformer Encoder

  26. GeoMetric: Injecting Metric Geographic Structure into Worldwide Image Geo-Localization

    Jun 8, 2026Junchao Cui, Xuanzi Ma, Wenqi Shi +3Cross-View Geo-LocalizationGeogs-Slam

  27. Where does Absolute Position come from in decoder-only Transformers?

    Jun 4, 2026Valeria Ruscio, Umberto Nanni, Fabrizio SilvestriTransformer EncoderRotary Position Embedding

  28. A Training-Efficient Transformer-Based Anti-Spoofing Network for Logical Access in ASVspoof 5

    Jun 2, 2026Sidan Yin, Bo ZhaoSpoofingAutomatic Speaker Verification

  29. Evaluating Transformer and LSTM Frameworks for Prediction in Ungauged Basins

    Jun 1, 2026Taye Akinrele, James Halgren, Noorbakhsh Amiri Golilarz +2Forecasting BackboneSen1Floods11

  30. GIRL-DETR: Gradient-Isolated Reinforcement Learning for Video Moment Retrieval

    May 30, 2026Shihang Zhang, Mingjin Kuai, Ye Wei +2Detection TransformerTransformer Encoder

  31. Giving Sensors a Voice: Multimodal JEPA for Semantic Time-Series Embeddings

    May 29, 2026Utsav Dutta, Gerardo Pastrana, Sina Khoshfetrat Pakazad +1Timestep EmbeddingsJoint-Embedding Predictive Architectures

  32. Reliable Multilingual Orthopedic Decision Support from Clinical Narratives: Language-Aware Adaptation and Verification-Guided Deferral

    May 29, 2026Danish Ali, Li Xiaojian, Sundas Iqbal +1Multilingual Healthcare Q&ALanguage Pairs

  33. Give it Space! Explicit Disentangling of Positional and Semantic Representations in Encoders

    May 28, 2026Pierre-Antoine Lequeu, Camille Barboule, Benjamin PiwowarskiPositional EncodingTransformer Encoder

  34. Benchmarking Positional Encoding Strategies for Transformer-Based EEG Foundation Models

    May 28, 2026Ayse Betul Yuce, Sebastian StoberElectroencephalography Foundation ModelsElectroencephalography

  35. BandVQ: Band-Wise Vector-Quantized EEG Foundation Model

    May 24, 2026Jamiyan Sukhbaatar, Satoshi Imamura, Toshihisa TanakaElectroencephalography Foundation ModelsElectroencephalography

  36. FastTab: A Fast Table Recognizer with a Tiny Recursive Module and 1D Transformers

    May 21, 2026Laziz Hamdi, Amine Tamasna, Pascal Boisson +1Transformer EncoderRecursive Models

  37. Post-Hoc Understanding of Metaphor Processing in Decoder-Only Language Models via Conditional Scale Entropy

    May 20, 2026Lawhori Chakrabarti, Jennifer Johnson-Leung, Bert Baumgaertner +3Transformer EncoderTransformer Architectures

  38. TERDNet: Transformer Encoder-Recurrent Decoder Network for Scene Change Detection

    May 20, 2026Jiae Yoon, Ue-Hwan KimDecoder LayersTransformer Encoder

  39. Chronicle: A Multimodal Foundation Model for Joint Language and Time Series Understanding

    May 18, 2026Paul Quinlan, Jeremy Levasseur, Qingguo Li +1Time Series Foundation ModelsTime Series

  40. Chessformer: A Unified Architecture for Chess Modeling

    May 18, 2026Daniel Monroe, George Eilender, Philip Chalmers +2ChessTransformer Encoder

  41. SAGA: A Sequence-Adaptive Generative Architecture for Multi-Horizon Probabilistic Forecasting with Adaptive Temporal Conformal Prediction

    May 18, 2026Gustav Olaf Yunus Laitinen-Fredriksson Lundström-Imanov, Hafize Gonca CömertRetrieval-Augmented ForecastingOnline Conformal Prediction

  42. Transformer-like Inference from Optimal Control

    May 15, 2026Aditya Kudre, Heng-Sheng Chang, Prashant G. MehtaTransformer EncoderTransformer Architectures

  43. Ghosted Layers: Unconstrained Activation Alignment for Recovering Layer-Pruned LLMs

    May 15, 2026Vincent-Daniel Yun, Junhyuk Jo, Sai Praneeth Karimireddy +1Model ActivationsTransformer Encoder

  44. Exploiting Pre-trained Encoder-Decoder Transformers for Sequence-to-Sequence Constituent Parsing

    May 13, 2026Daniel Fernández-González, Cristina Outeiriño CidTransformer EncoderSequence Modeling

  45. HEPA: A Self-Supervised Horizon-Conditioned Event Predictive Architecture for Time Series

    May 11, 2026Jonas Petersen, Gian-Alessandro Lombardi, Riccardo Maggioni +3Forecasting BackboneMultivariate Time-Series

  46. Quantifying Concentration Phenomena of Mean-Field Transformers in the Low-Temperature Regime

    May 11, 2026Albert Alcalde, Leon Bungert, Konstantin Riedl +1Transformer EncoderTransformer Architectures