Hybrid Mamba-Transformer Model

Momentum

3 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 22

All topics
CardsList
  1. Physics and Data Driven Transformer-Mamba Framework for Flow Field

    Sep 24, 2026Zhuo Zhang, Shun Zou, Canqun Yang +1Computational Fluid DynamicPartial Differential Equations

  2. MambaVoice: Lightweight Audiovisual Singing Voice Separation Via A Hybrid Mamba-Transformer Model

    Sep 22, 2026Adithi Shankar, Gopika Krishnan, Gloria Haro +2Speech SeparationHybrid Mamba-Transformer Model

  3. SLICEChat: Progressive In-Encoder Token Pruning for Whole-Slide Pathology Language Models

    Sep 21, 2026Ali Kerem Bozkurt, Baris Cem Bakay, Ibrahim Kulac +3Whole-Slide ImagesPathology Foundation Models

  4. Motif 3: Technical Report

    Aug 10, 2026Junghwan Lim, Joon Son Chung, Sungmin Lee +24Mixture-Of-Experts Large Language ModelsHybrid Mamba-Transformer Model

  5. AraSSM: A bidirectional state-space encoder for Arabic masked language modeling

    Aug 8, 2026Ahmed Amine Aliane, Hassina Aliane, Nasredine SemmarArabic Natural Language ProcessingHybrid Mamba-Transformer Model

  6. Multi-level context Modeling for consistent expert selection in Mixture-of-Experts

    Jul 17, 2026Shuhan Huang, Naifan Zhang, Yuanbo Tang +2Hybrid Mamba-Transformer ModelTransformer Architectures

  7. CHASE: Cache-Hole-Adapted Skip Exit for Looped State-Space Language Models

    Jul 11, 2026Zhenxuan Yu, Takeshi Kojima, Yutaka Matsuo +1Hybrid Mamba-Transformer ModelRecurrence

  8. A Sovereign, Open-Source Foundation Model for German and English

    Jul 10, 2026The Soofi-Team, :, Benedikt Droste +29Hybrid Mamba-Transformer ModelWireless Foundation Models

  9. L3Cube-MahaPOS: A Marathi Part-of-Speech Tagging Dataset and BERT Models

    Jun 23, 2026Hariom Ingle, Ronit Ghode, Ishwari Gondkar +2Natural Language DatasetsTagging

  10. Zamba2-VL Technical Report

    May 29, 2026Hassan Shapourian, Kasra Hejazi, Olabode M. Sule +1Hybrid Mamba-Transformer ModelRecent Vision-Language Models

  11. Rethinking Efficient Crack Segmentation with Task-Aligned Structural-Directional Modeling

    May 29, 2026Shipeng Liu, Liang Zhao, Dengfeng Chen +1Hybrid Mamba-Transformer Model

  12. Mixture of Experts for Low-Resource LLMs

    May 17, 2026Ori Bar Joseph, Smadar Arvatz, Noam Kayzer +2Mixture-Of-ExpertsMultilingual Language Models

  13. 3DTMDet: A Dual-Path Synergy Network of Transformer and SSM for 3D Object Detection in Point Clouds

    May 15, 2026Bingwen Qiu, Yuan Liu, Junqi Bai +53D Object DetectionPoint Clouds

  14. Linear-Time and Constant-Memory Text Embeddings Based on Recurrent Language Models

    Apr 20, 2026Tobias Grantner, Emanuel Sallinger, Martin FlechlHybrid Mamba-Transformer ModelTransformer Architectures

  15. Stateful Token Reduction for Long-Video Hybrid VLMs

    Feb 27, 2026Jindong Jiang, Amala Sanjay Deshmukh, Kateryna Chumachenko +7Hybrid Mamba-Transformer ModelVideo-Language Models

  16. Hidden State Poisoning Attacks against Mamba-based Language Models

    Jan 5, 2026Alexandre Le Mercier, Chris Develder, Thomas DemeesterHybrid Mamba-Transformer ModelAttacker Large Language Model

  17. Data Efficient Any Transformer-to-Mamba Distillation via Attention Bridge

    Oct 22, 2025Penghao Wang, Yuhao Zhou, Mengxuan Wu +3Hybrid Mamba-Transformer ModelDataset Distillation

  18. A Multimodal Feature Distillation with Mamba-Transformer Network for Brain Tumor Segmentation with Incomplete Modalities

    Apr 22, 2024Ming Kang, Fung Fung Ting, Shier Nee Saw +3Brain Tumor SegmentationAmodal Segmentation