Reasoning Gaps

Momentum

5 papers in the last four weeks, down 17% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 53

All topics
CardsList
  1. Abstention and Noise Filtering: Two Missing Primitives of Softmax Attention

    Sep 18, 2026Richard Zhe WangGumbel-Softmax RelaxationGating

  2. Diagnosing the Fact-Grounding Gap in Multi-Hop Question Answering

    Sep 15, 2026Kevin Mo, Nathan Mo, Richard ZhuMulti-Hop ReasoningQuestion-Answering Benchmarks

  3. IdeaAMBIG: Benchmarking Implementation-Critical Gaps in Research-Idea Specifications

    Sep 9, 2026Yiling Ma, Yilun Zhao, Sihong Wu +2ReproducibilityResearch Automation

  4. Clean Engineering, Unstable Measurement: A Preregistered Reliability Failure of Black-Box LLM Observers on Shared Endpoints

    Sep 3, 2026Haoyaun Zhu, Jie ZhangJudgesMeasures

  5. Knowledge Acquisition During Pre-training? Large Language Models Learn Better With Auxiliary Views

    Sep 3, 2026Joseph Lee, Yidi Huang, Dokyoon Kim +2Large Language Model PretrainingReasoning Gaps

  6. CulturalMenuBench: Probing the Knowledge-Application Gap in Multimodal Culinary Reasoning

    Sep 3, 2026Bo Zeng, Linfeng Gao, Peiqin Lin +9Cultural AwarenessRecipe

  7. Toward a Gricean Retreat: Probing LLMs for Knowledge Boundaries and Referent Specificity

    Aug 13, 2026Dananjay Srinivas, Saksham Khatwani, Maria PachecoReasoning Gaps

  8. VeriForge: Mitigating Latent Knowledge Gaps in Narrative Drafting via Mixed-Initiative Scaffolding

    Aug 10, 2026Ruqi Sun, Jiaping Li, Wenhui Tao +4Ai-Assisted WritingWriting

  9. From SQL Errors to Concept Gaps: An AI-Powered Knowledge Graph Analytics Platform for Personalized Feedback

    Aug 4, 2026Abdulrahman AlRabah, Weijian Zhou, Xing Gao +1Knowledge GraphsReasoning Gaps

  10. Diagnosing Search Behavior and Failure Modes in Long-Horizon Search Agents

    Aug 3, 2026Qi Liu, Jiaxin Mao, Fengbin Zhu +1Search AgentsRelevance

  11. MemeBench: What LVLMs Miss When Interpreting Culture-Dependent Memes

    Jul 30, 2026Weihang Wang, Kainan Tu, Jielei Zhang +9MemesInterpretation

  12. Towards Trustworthy and Cost-Efficient Data Integration: From Naïve RAG to Agentic RAG

    Jul 24, 2026Chuangtao Ma, Arijit KhanAgentic Retrieval-Augmented Generation SystemsData Science Agents

  13. Bridging the Information Gap: Semantic Densification and Hindsight Distillation for Cold-Start Prediction

    Jul 19, 2026Hao Duong Le, Yifei Gao, Huan Li +4Cold-StartDataset Distillation

  14. AI advice suppresses people's willingness to say "I don't know", even when the advice is wrong and accuracy is incentivized

    Jul 15, 2026Chiara Marcoccia, Walter Quattrociocchi, Valerio CapraroAdviceStudent Misconceptions

  15. AutoTrace: From Patches to Triggers via Agentic Interprocedural Exploration

    Jul 13, 2026Arastoo Zibaeirad, Marco Vieira, Thomas ZimmermannTracesAgentic Discovery

  16. A Multimodal Reasoning Typology for Grounding Chart-Image Coherence in Science Communication

    Jul 6, 2026Avina Nakarmi, Sohom Sen, Xun Song +2Scientific FigureChart

  17. Is GraphRAG Needed? From Basic RAG to Graph-/Agentic Solutions with Context Optimization

    Jun 24, 2026Long Chen, Ryan Razkenari, Yuxuan Zhou +5Graph-Based Retrieval Augmented GenerationGraph-Llm Integrations

  18. SoK: AI Secure Code Generation: Progress, Pitfalls, and Paths Forward

    Jun 23, 2026Rupam Patir, Keyan Guo, Haipeng Cai +1Code GenerationArtificial Intelligence Safety

  19. Information Gap and Feasibility-Aware Inference in Binomial Logistic Mixtures

    Jun 14, 2026Yuta Hayashida, Shonosuke SugasawaMixture ModelsLogistic Regression

  20. Detecting Knowledge Gaps from Conversational AI Interactions Using Curriculum Prerequisite Graphs

    Jun 9, 2026Youssef Medhat, Junsoo Park, Ploy Thajchayapong +1TutorsConversational Artificial Intelligence

  21. Revisiting Ripple Effects in Knowledge Editing through Pressure-Aware Joint Neighborhood Optimization

    Jun 1, 2026Haoben Huang, Shuxin Liu, Ou Wu +1Multimodal Knowledge EditingCross-Task Knowledge Transfer

  22. SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes

    May 29, 2026Tianhui Liu, Jie Feng, Zhiheng Zheng +6Spatial ReasoningRecent Vision-Language Models

  23. The Future of Facts: Tracing the Factual Generation-Verification Gap

    May 26, 2026Tim R. Davidson, Anja Surina, Caglar GulcehreFactsReasoning Gaps

  24. Going PLACES: Participatory Localized Red Teaming for Text-to-Image Safety in the Global South

    May 18, 2026Charvi Rastogi, Mukul Bhutani, Minsuk Kahng +13Multilingual SafetyRed-Teaming

  25. Model-Adaptive Tool Necessity Reveals the Knowing-Doing Gap in LLM Tool Use

    May 13, 2026Yize Cheng, Chenrui Fan, Mahdi JafariRaviz +2Large Language Model Tool UseReasoning Gaps

  26. Latent Causal Void: Explicit Missing-Context Reconstruction for Misinformation Detection

    May 12, 2026Hui Li, Zhongquan Jian, Jinsong Su +1Misinformation DetectionNatural Language Inference

  27. LLMs are not (consistently) Bayesian: Quantifying internal (in)consistencies of LLMs' probabilistic beliefs

    May 7, 2026Chacha Chen, Matthew Jörke, Adam Goliński +4LLM Reasoning StrategiesBayesian

  28. From Awareness to Action: Understanding and Overcoming the Research-Practice Gap in Algorithmic Fairness for Public Health

    May 2, 2026Sara Altamirano, Tijs Portegies, Sennay GhebreabAlgorithmic FairnessMulti-Model Study

  29. Programming with Data: Test-Driven Data Engineering for Self-Improving LLMs from Raw Corpora

    Apr 27, 2026Chenkai Pan, Xinglong Xu, Yuhang Xu +6Training DataNatural Language Datasets

  30. IGADA-IoT: IoT Sensor Energy Optimization in Wireless Sensor Networks Driven by Automatic Data Augmentation

    Apr 22, 2026Mingchun Sun, Rongqiang Zhao, Muhammad Abdul Munnaf +1Internet Of ThingData Augmentation

  31. Bridging the Reasoning Gap in Vietnamese with Small Language Models via Test-Time Scaling

    Apr 20, 2026Bui The Trung, Do Minh Duc, Nguyen Van Vinh +1Small Large Language ModelsLLM Reasoning Strategies

  32. KnowledgeBerg: Evaluating Systematic Knowledge Coverage and Compositional Reasoning in Large Language Models

    Apr 19, 2026Xiao Zhang, Qianru Meng, Yongjian Chen +2Reasoning Gaps

  33. Closing the Theory-Practice Gap in Spiking Transformers via Effective Dimension

    Apr 17, 2026Dongxin Guo, Jikun Wu, Siu Ming YiuNeuromorphic ComputingTransformer Architectures

  34. GRADE: Probing Knowledge Gaps in LLMs through Gradient Subspace Dynamics

    Apr 3, 2026Yujing Wang, Yuanbang Liang, Yukun Lai +2Reasoning GapsGradient

  35. With Argus Eyes: Assessing Retrieval Gaps via Uncertainty Scoring to Detect and Remedy Retrieval Blind Spots

    Feb 10, 2026Zeinab Sadat Taghavi, Ali Modarressi, Hinrich Schutze +1Retrieval LayerBlind Spots

  36. Decomposed Prompting Does Not Fix Knowledge Gaps, But Helps Models Say "I Don't Know"

    Feb 4, 2026Dhruv Madhwal, Lyuxin David Zhang, Dan Roth +2Reasoning Gaps