Qwen3

Momentum

13 papers in the last four weeks, up 160% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 87

All topics
CardsList
  1. JARQ: Joint Alternating Refinement for Quantization

    Sep 29, 2026Xinyu Wang, Sicheng Lyu, Xiao-Wen ChangPost-Training QuantizationLanguage Model Perplexity

  2. Program-Verified Self-Evolution for Vision-Language Models

    Sep 27, 2026Ahmed Heakl, Sungik Choi, Moontae Lee +1Recent Vision-Language ModelsQwen3

  3. Reasoning Instructions Can Break Answer Decoding in Vision--Language Models

    Sep 24, 2026Zeyan Li, Siyuan Qiu, Jianfeng XuQwen3Answer

  4. Global Ranks Survive, Selected Heads Shift: BOS-Sink Topology under 4-bit Weight-Only Quantization

    Sep 20, 2026Kuanlin Chen, Chen-Wei Kuo, Cheng-En OuPost-Training QuantizationMatched Fp16 Intermediate

  5. OmniVChat: Synthesizing, Benchmarking, and Training for Native Audio-Visual Dialogue

    Sep 18, 2026Haolin He, Yunfei Chu, Qi Chen +15Omni-ModalQwen3

  6. Layer-wise Curriculum Learning for Efficient LLM Compression

    Sep 16, 2026Donggeon Lee, Dooyeon Na, Seungmin Oh +1Large Language Model CompressionAdaptive Curriculum

  7. ActionPiece: Rethinking Action Tokenization for Autoregressive Vision-Language-Action Models

    Sep 16, 2026Shijie Lian, Bin Yu, Zhaolong Shen +5Discrete Action TokenizersDiffusion-Based Vision-Language-Actions

  8. Repair Before Reinforce: Context-Augmented Knowledge Graph Reasoning for Multi-Hop Question Answering

    Sep 14, 2026Tharaka D. Fonseka, Niraj K. JhaMulti-Hop ReasoningKnowledge Graphs

  9. From Parameters to Answers: How LLMs Retrieve and Use Their Internal Knowledge

    Sep 12, 2026Wenkang Wei, Yuan Fang, Renhe Jiang +2Qwen3Answer

  10. XVAE-WMT: Explainable Wavelet-Temporal Variational Autoencoder for Blind Source Separation of Heart and Lung Sounds

    Aug 31, 2026Yasaman Torabi, Shahram Shirani, James P. ReillySpeech SeparationQwen3

  11. When Models Hear What They Expect: Diagnosing Prosodic Heuristics in Multimodal Sarcasm Detection

    Aug 31, 2026Yongjian Chen, Pengfei Wei, Yiqun Sun +2HumorProsody

  12. Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090

    Aug 27, 2026Kairong Luo, Jiarui Cui, Yaorui Yin +8Large Language Model PretrainingQwen3

  13. Agentic Router: An Execution-Grounded Continual Learning Approach With Memory

    Aug 10, 2026Yuxuan Chen, Rongpeng Li, Zhifeng Zhao +3Qwen3Data Generation

  14. How Much Does It Cost to Answer My Question? Benchmarking Cloud VLM-based VQA Systems

    Aug 8, 2026Henri Vanhuynegem, Weitao Xu, Yiran Shen +1Recent Vision-Language ModelsQwen3

  15. KV-Skill: Forging Expertise in the Model's Native Language

    Aug 5, 2026Zhaowei Han, Xiang Zhang, Bing Han +3Qwen3Frozen Language Model

  16. Recursive Vision Language Models for General Symbolic Reasoning

    Aug 2, 2026Omid Nejati Manzari, Guillaume Lajoie, Hassan RivazLarge Reasoning ModelsQwen3

  17. Evaluating VLMs on Multimodal Aristotelian Persuasion Tasks

    Aug 2, 2026Khondoker Ittehadul IslamQwen3Persuasion

  18. Meta-Task: Turning Terminal Task Synthesis into a Terminal Task for Scalable Agent Training

    Jul 30, 2026Zhihong Pan, Jiyuan He, Kai Zhang +5Synthetic TaskAgentic Benchmarks

  19. Kimi K3: Open Frontier Intelligence

    Jul 27, 2026Kimi Team, Tongtong Bai, Yifan Bai +399Qwen3Intelligence

  20. Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models

    Jul 21, 2026Mahdiyeh Farajidizaji, Vatsal RainaInstruction-Tuned ModelsInstruction

  21. Benchmarking Deep Learning Approaches for AEC Engineering Drawing Layout Detection and Information Extraction

    Jul 21, 2026Tianyang Huang, Alessio Lombardi, Ahmed Elnagar +7Deep Learning ArchitecturesDeep Learning

  22. Out-of-Distribution Generalization of Risk Aversion in Language Models

    Jul 2, 2026Kristina Zhang, Junior Chinomso Okoroafor, Benjamin Maltbie +3RiskLarge Language Model Safety

  23. Enhancing Fitness Intelligence through Domain-Specific LLM Post-Training

    Jul 2, 2026Xingtao Zhao, Tian Yang, Han JiangPhysical ActivitiesAthleticism

  24. SimpleSearch-VL: A Simple Recipe for Multimodal Agentic Deep Search

    Jun 30, 2026Ming Dai, Zhihong Lu, Jinjie Gu +5Multimodal Search AgentsQwen3

  25. How Far Do On-Prem Open LLMs Get on Text-to-SQL? A Cross-Family Size x Technique Frontier on BIRD

    Jun 29, 2026Vladimir BeskorovainyiText-To-SqlQwen3

  26. Discovering Millions of Interpretable Features with Sparse Autoencoders

    Jun 25, 2026XinYang He, Wei Wang, Bing Zhao +5Qwen3Refusals

  27. Evaluating LLMs for Real-World Web Vulnerability Detection

    Jun 19, 2026Sebastian Neef, Luca Jungnickel, Antonio Benjamin Buchholz +2Model VulnerabilitiesAttacker Large Language Model

  28. Displacement Is Not Direction: Evaluating Fidelity Metrics for Quantized LLM Deployment

    Jun 17, 2026Miloš Nikolić, Ali Hadi Zadeh, Enrique Torres Sanchez +1Large Language Model QuantizationKullback-Leibler Divergence

  29. LLM Judges Have Dark Current: A Psychometric Datasheet for LLM-as-a-Judge Evaluation

    Jun 14, 2026Hiroyasu Usami, Keisuke Hara, Ayato Tsuboi +1Llm-As-A-JudgeLarge Language Model Judges

  30. Ouroboros-Spatial: Closing the Data-Model Loop for Spatial Reasoning

    Jun 10, 2026Enhan Zhao, Wei Wu, Yuanrui Zhang +2Spatial ReasoningMultimodal Reasoning Benchmarks

  31. IS-CoT: Breaking the Long-form Generation Collapse via Interleaved Structural Thinking

    Jun 8, 2026Zechen Sun, Yuyang Sun, Zecheng Tang +6Long-Form GenerationLarge Language Model Generation

  32. Failure-Aware Refinement of Vision-Language Model for Lithography Defect Detection

    Jun 8, 2026Pangyun Jeong, Jiyeong Kong, Yuehua Hu +2Defect DetectionLithography

  33. EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering

    Jun 5, 2026Xiaopeng Yuan, Zebin Wang, Suwen Wang +3Efficient Long-Context InferenceQuestion-Answering Benchmarks

  34. Ryze: Evidence-Enriched Data Synthesis from Biomedical Papers

    May 30, 2026Yeqi Huang, Yue Chen, Yanwei Ye +2Biomedical TextQwen3

  35. CASTLE2026 Team WDL Technical Report

    May 30, 2026Zhengyang Li, Zhenglin Du, Yi Wen +3Long Video Question AnsweringEgocentric Video

  36. LinguIUTics at PsyDefDetect: Iterative Imbalance-Aware Fine-tuning of Qwen3-8B for Psychological Defense Mechanism Classification

    May 30, 2026Shefayat E Shams Adib, Ahmed Alfey Sani, Md Hasibur Rahman Alif +1LLM Defense MechanismsQwen3