Downstream Reasoning

Momentum

11 papers in the last four weeks, up 267% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 69

All topics
CardsList
  1. Evaluating Biomedical Reranking for LLM-Based Question Answering over Longitudinal Clinical Notes

    Oct 1, 2026Maryam Shahbaz Ali, Laura B. Strachan, Caitlin Sherman +3Biomedical TextReranking

  2. Pretraining Latent Information Feedback Transformers with Teacher Supervision

    Sep 29, 2026Dor Tirosh, Ido Amos, Mor GevaTransformer ArchitecturesPretraining

  3. From Judgment Quality to Downstream Utility: Rethinking LLM-as-a-Judge for Open-Ended Tasks

    Sep 29, 2026Zheng Zhang, Lufei Li, Xinyue Tan +4Llm-As-A-JudgeDownstream Reasoning

  4. When Upstream Messages Override Correct Answers: A Controlled Study of Multi-Agent LLM Collaboration

    Sep 29, 2026Yaxin Gong, Gangyi Zhang, Chongming Gao +7Multi-Agent Large Language Model SystemsDownstream Reasoning

  5. Scaling Video Generation for Reasoning: At What Cost?

    Sep 29, 2026Weihang Guo, Xiaoyu Wu, Yifei Wang +2Generative Video ModelsLong Video Generation

  6. Can Generative AI Automate Data Extraction for Meta-Analysis? A Case Study on Intercropping Research

    Sep 28, 2026Zehao Lu, Xingguo Xiong, Wopke van der Werf +2Research AutomationPrecision Agriculture

  7. Geometric Identification in Predict-Then-Optimize Learning

    Sep 27, 2026Jiaxiao Xu, Changhong Mou, Keji Liu +2NonconvexDownstream Reasoning

  8. Breaking the Environment Wall: A Unified Framework for Preparing and Evolving Agent-Native Environments

    Sep 24, 2026Yukai Wu, Yuanjing Yang, Le Zhou +8Self-Improving AgentsLarge Language Model Agents

  9. When the World Lies: Backdoor Attacks on Latent World Models for Downstream Control

    Sep 14, 2026Roberto Riaño, Gorka Abad, Stjepan Picek +1Latent World ModelsWorld Models

  10. Learning Representations through Token Prediction: Geometry, Approximation, and Downstream Guarantees

    Aug 30, 2026Shulei WangNext-Token PredictionToken Embeddings

  11. Debiased Inference for AI-Generated Data without Gold-Standard Labels: Identification via Multiple Imperfect Measurements

    Aug 18, 2026Naoki Egami, Sooahn ShinStatistical InferenceLarge Language Model Annotations

  12. TSDS-Toolbox: A Toolbox for Measuring Time-Series Dataset Similarity

    Aug 8, 2026Yen-Ku Liu, Hongjie Chen, Ryan A. Rossi +1Time SeriesSimilarity and Metrics

  13. TRAJDEBUG: Tracing Error Lifecycle to Identify Critical Failures in Long-Horizon Agent Trajectories

    Aug 6, 2026Yunjia Qi, Zehua Yin, Xintong Shi +10Long-Horizon TrajectoriesTraces

  14. ContextWeave: A Real-World Workflow Benchmark

    Aug 5, 2026Bo Wang, Yuqian Yao, Enxi Wang +25Agentic Workflow DesignWeave

  15. Pin Once, Swap Light: Subspace-Aligned Centroid-Residual Training for Efficient Ultra-LoRA Serving

    Aug 4, 2026Xiang Li, Pengcheng Wang, Huazheng Wang +1Low-Rank Adaptation AdaptersHip-Lora

  16. Decoupling semantics from vision: A framework for faithful visual-text compression evaluation

    Aug 3, 2026Yonghan Gao, Zehong Chen, Lijian Xu +3Token CompressionMultimodal Large Language Models

  17. Retrieval Augmented Biomedical Question Answering with Weak Question Recovery and Neural Reranking for BioASQ Task 14b

    Aug 2, 2026Xueying Zhao, Lee Mai, Balaji AnandganeshCross-Encoder RerankingText Corpora

  18. ββ-OPSD: Deriving with Policy Optimization, Training with Self-Distillation

    Jul 30, 2026Jiawei Xu, Minghui Liu, Juzheng Zhang +2Unsupervised On-Policy Self-DistillationRp-Opsd

  19. WikiLoop: Jointly Learning to Build and Navigate Agent-Native Wikis with Downstream Feedback

    Jul 29, 2026Haoliang Ming, Feifei Li, Wenhui QueWikipediaAgent Loop

  20. DataOrchestra: Learning to Orchestrate Per-Example Curation of Pretraining Data

    Jul 27, 2026Zhen Huang, Yikun Wang, Shijie Xia +1Data-CurationPretraining

  21. Beyond Scale and Generation: Understanding Language Model-based Entity Matching

    Jul 27, 2026Zeyu Zhang, Xue Li, Iacer Calixto +2Cross-EncoderLanguage Modeling

  22. Sparse Autoencoders Encode Both Concepts and Functions: The Downstream Geometry of Feature Effects

    Jul 27, 2026Phu Gia Hoang, Anwoy Chatterjee, Tanmoy Chakraborty +2Sparse Autoencoder FeaturesInterpretability

  23. Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking

    Jul 22, 2026Kailin Jiang, Lei Liu, Jian Xi +7RelevanceDocument

  24. LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior

    Jul 21, 2026Meena Jagadeesan, Tatsunori Hashimoto, Jon KleinbergAnalyticsDownstream Reasoning

  25. CFM-Bench: A Unified Multi-Domain, Multi-Task Benchmark for Channel Foundation Models

    Jul 16, 2026Yuan Gao, Wenjun Yu, Jun Jiang +3Wireless Foundation ModelsDownstream Reasoning

  26. Causal ASCEND: Scalable Two-tier Causal Discovery on High Dimensional Multi-omics Data

    Jul 5, 2026Stephen Asiedu, David WatsonCausal Discovery MethodsRegulatory Networks

  27. Joint distribution of upstream runoff governs downstream river-discharge prediction uncertainty in distributed ML models

    Jul 3, 2026Karan Ruparell, Tristan Hascoet, Takemasa Miyoshi +4Probabilistic Basin-Scale Runoff LstmsAccurate Flood Prediction

  28. MemSyco-Bench: Benchmarking Sycophancy in Agent Memory

    Jul 1, 2026Zhishang Xiang, Zerui Chen, Yunbo Tang +5SycophancyArtificial Intelligence Agents

  29. Predict, Reuse, and Repair: Accelerating Dynamic Sparse Attention for Long-Context LLM Decoding

    Jun 29, 2026Tianyu Wang, Gourav Rattihalli, Aditya Dhakal +4Dynamic Sparse AttentionLarge Language Model Decoding

  30. Improved Multi-Dimensional Forecasting for Swap Regret

    Jun 28, 2026Joey Rivkin, Ramiro N. Deo-Campo Vuong, Robert Kleinberg +3RegretDownstream Reasoning

  31. Pseudo-Text-Conditioned 3D Grounding DINO for Organ Localization in Abdominal CT

    Jun 25, 2026Siqi Chen, Han Gong, Keyi Hou +3Cone-Beam Computed Tomography3D Visual Grounding

  32. Refusal Lives Downstream of Persona in Chat Models

    Jun 24, 2026Viola Zhong, Qirui LiRefusalsPersona Consistency

  33. How Far Can Machine Translation Quality Take You? Extrinsic Discourse Evaluation in Goal-Oriented Setups

    Jun 15, 2026Wafaa Mohammed, Kata Naszadi, Vlad NiculaeMachine Translation QualityMachine Translation

  34. TAKE: Trajectory-Aware Knowledge Estimation for Text Dataset Distillation

    Jun 13, 2026Tri-Nhan Vo, Dang Nguyen, Sunil GuptaDownstream ReasoningTrajectory-Aware Hidden-State Analyses

  35. How do Self-Supervised Remote Sensing Vision Models Transfer to Downstream Tasks?

    Jun 11, 2026Julia Romero, Qin Lv, Morteza KarimzadehGeospatial Foundation ModelsVision Foundation Models

  36. SWE-Explore: Benchmarking How Coding Agents Explore Repositories

    Jun 5, 2026Shaoqiu Zhang, Yuhang Wang, Jialiang Liang +8Repository-Level Code UnderstandingCoding Agents

  37. HARP: Efficient Data Selection for Finetuning Large Language Models

    Jun 5, 2026Ning Wang, Zhengxin Zhang, Maosen Tang +3Alignment-Aware SelectionDownstream Reasoning

  38. From Risk Classification to Action Plan Remediation: A Guardrail Feedback Driven Framework for LLM Agents

    Jun 4, 2026Yuhao Sun, Jiacheng Zhang, Shaanan Cohney +3GuardrailLarge Language Model Safety

  39. QueryAgent-R1: Bridging Query Generation and Product Retrieval for E-Commerce Query Recommendation

    Jun 4, 2026Dike Sun, Zheng Zou, Jingtong Zang +3RecommendationRelevance

  40. Tailoring Strictly Proper Scoring Rules for Downstream Tasks: An Application to Causal Inference

    Jun 2, 2026Roman Plaud, Alexandre Perez-Lebel, Antoine Saillenfest +4Causal InferencesImportance Weighting

  41. Conformal Certification of Reasoning Trace Prefixes

    May 28, 2026Matt Y. Cheung, Ashok Veeraraghavan, Hanjie Chen +1Reasoning TracesCertification

  42. RA-MoE: Routing-Aligned Fine-Tuning for Multilingual Adaptation of Mixture-of-Experts Models

    May 27, 2026Guanzhi Deng, Kuan Wu, Haibo Wang +6Multilingual Language ModelsDownstream Reasoning

  43. Simulating Human Memory with Language Models

    May 25, 2026Qihan Wang, Nicholas Tomlin, Michael Hu +2Large Language Model MemorySemantic Memory

  44. State commitment learning: training language models to distinguish computation from memory

    May 22, 2026Fei Ding, Yongkang Zhang, Runhao Liu +3Transition LearningLanguage Modeling

  45. What Do Agents Communicate? Characterizing Information Exchange in Multi-Agent Systems

    May 19, 2026Yong Jin Chun, Iftekhar AhmedDownstream Reasoning

  46. From pre-training to downstream performance: Does domain-specific pre-training make sense?

    May 9, 2026Felix KronesMultimodal PretrainingPretraining

  47. GeoDecider: A Coarse-to-Fine Agentic Workflow for Explainable Lithology Classification

    May 5, 2026Jiahao Wang, Mingyue Cheng, Yitong Zhou +4Lithology ClassificationGeogs-Slam

  48. Beyond Semantic Similarity: Rethinking Retrieval for Agentic Search via Direct Corpus Interaction

    May 3, 2026Zhuofeng Li, Haoxiang Zhang, Cong Wei +16Agentic SearchText Corpora

  49. Rethinking Layer Redundancy: Calibration Matters More Than Search in LLM Depth Pruning

    Apr 27, 2026Minkyu Kim, Vincent-Daniel Yun, Youngrae Kim +3Language Model PerplexityLayer-Wise

  50. Learning Evidence Highlighting for Frozen LLMs

    Apr 24, 2026Shaoang Li, Yanhang Shi, Yufei Li +10LLM Reasoning StrategiesFrozen Language Model