Precision Recall

Momentum

10 papers in the last four weeks, up 150% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 76

All topics
CardsList
  1. EvoGen-Harness: Learning Where and How to Evolve Image-Generation Harnesses

    Sep 30, 2026Jiabin Luo, Yinan Liu, Chunlei Meng +1Multi-Reference Image GenerationMultimodal Generation

  2. Mixed-Prior Decision Risk for Open-Set Recognition

    Sep 28, 2026L. A. Erlygin, P. D. Proskura, A. A. ZaytsevOpen-Set RecognitionUncertainty Score

  3. ARGUS: Role-Aware Event Knowledge Graphs for U.S. Employment-Discrimination Complaints

    Sep 24, 2026Sriram Kannan, Swetha Saseendran, Vishnu Vardhan Reddy Kandi +3Knowledge GraphsEvidence-Grounded Questions

  4. Beyond Class Marginals: Bounding Rehearsal Gaps without Freezing Class Co-occurrence

    Sep 22, 2026Congren Dai, Nat Roongjirarat, Fei YeLayer-Selective Rehearsal StrategyDeterministic Replay

  5. Efficiently Linking Unstructured Data for Multi-step Reasoning

    Sep 16, 2026Jiaming Liang, Haydn Jones, Jacob R. Gardner +2Unstructured DataPrecision Recall

  6. The record is part of the task: matched-record evaluation of text classifiers across maintenance, safety and recall reporting

    Sep 14, 2026Hisham Ihshaish, Peter Mayhew, Tasnim M. A. Zayet +1ReportPrecision Recall

  7. MessyMem: Learning-from-Doing Memory for Mobile Manipulation

    Sep 14, 2026Anuva Banwasi, William Muckelroy, Priya Sundaresan +3Spatial MemoryPrecision Recall

  8. ROAM: Robust Organization of Atomic Memories for Agents through Semantic Relations

    Sep 9, 2026Jianjie Zheng, Peng Lai, Sijie Cheng +3Language-Model AgentsPrecision Recall

  9. X-amine509: Predicting the Practical Risk Level of Enterprise X.509 Certificates

    Sep 8, 2026Cameron Keith, Shubh Patel, JD Kilgallin +1CertificatesSecurity Evaluation

  10. Efficient Semantic Understanding from Digital Foveation

    Sep 3, 2026Caterina Caccavella, Vittorio Fra, Andreas Ziegler +2Dense PredictionSaliency

  11. Contextual Tamil Spelling and Grammar Correction Using Progressively Fine-Tuned Sequence-to-Sequence Transformers

    Sep 3, 2026Karthikeyan A, Jaya Nirmala S, Sangeetha Sivanesan +4Grammatical Error CorrectionTransformer Architectures

  12. SAM3-LoRA: Parameter-Efficient Adaptation of a Concept-Promptable Foundation Model for Multi-Class Structural Defect Segmentation

    Aug 31, 2026P. Malaisree, S. Youwai, S. Janrungautai +3Few-Shot SegmentationWireless Foundation Models

  13. Finding Change in Satellite Archives from Text: How to Combine Before-and-After Images Efficiently

    Jul 30, 2026Simon Roy, Mark Bong, Giovanni BeltrameSatellite ImagerySatellite Data

  14. MedLLM: An Open Medical Language Model at the Sub-Billion Scale

    Jul 29, 2026Maxx Richard Rahman, Asim Ahmed, Mihan Mohagheghzadeh +1Mllm-BasedPrecision Recall

  15. OneShot: Index-in-Ranking with Neural Scoring for Large-Scale Retrieval

    Jul 29, 2026Ziwei Li, Shuyao Li, Xufeng Cai +12Real-World Content Recommendation ProblemRetrievers

  16. Keep It InMind: Benchmarking the Implicit-Association Blind Spot in Agent Memory

    Jul 27, 2026Ruizhe Li, Mingxuan Du, Benfeng Xu +1Agentic MemoryPrecision Recall

  17. Finite-Sample Coverage Audits for High-Recall Candidate Generation: Certification and Learning-Theoretic Design

    Jul 23, 2026Martin Anthony, Kaveh Salehzadeh NobariModel AuditingCertification

  18. Knowledgeless Language Models: Suppressing Parametric Recall for Evidence-Grounded Language Modeling

    Jul 14, 2026Roi Cohen, Yvan Carré, Nick Lechtenbörger +5Factual RecallPrecision Recall

  19. Confidence Scores in Open-Vocabulary Detection Are a Biased Mixture of Scale and Semantics

    Jul 13, 2026Yi Tang Soon, Jun-Wei HsiehOpen-Vocabulary Object DetectionOpen-Vocabulary

  20. Drift-Aware Temporal Graph Rewiring (DATGR) for Adaptive Semantic Modeling in Biomedical Text

    Jul 9, 2026Bharathwaj Vijayakumar, Sahana K. VaradarajuTemporal Graph Neural NetworksBiomedical Text

  21. Abductive Corroboration of Probabilistic AI Models for Forensic Synthetic Media Detection

    Jul 3, 2026Junade AliSynthetic Image DetectionDigital Forensics

  22. One Retrieval to Cover Them All: Co-occurrence-Aware Knowledge Base Reorganization for Session-Level RAG

    Jun 30, 2026Shivam Ratnakar, Yixuan Zhu, Cecilia Cheng +1Hievi-RagPrecision Recall

  23. Entity Resolution via Batched Oracle Queries

    Jun 23, 2026Lorenzo Balzotti, Donatella Firmani, Luca Gagliardelli +1OraclesEntities

  24. DeepDiscovery: A Location-Inference Framework for Task-Level Repository Understanding

    Jun 22, 2026Jiawei He, Weisong Sun, Mengyu Shi +4CodebasesModel Discovery

  25. MedHal-Loc: Are "Explainable-by-Architecture" Medical Hallucination Detectors Faithful Localizers? A Localization Benchmark

    Jun 19, 2026Minmin Chen, Daojian Lu, Yining Dai +2Citation Hallucination DetectionVisual Hallucinations

  26. Precision Recall Controllable Radiology Report Generation via Hybrid Natural Language and Clinical Reward Learning

    Jun 19, 2026Ling Chen, Ruinan Jin, Jun Luo +6Radiology Report GenerationReport

  27. Learning Burst-Aware Early Warning Models for Capacity Stress under AI Workload Surges in Hyperscale Data Centers

    Jun 19, 2026Zihan Yu, Xianling Zeng, Zhiming Xue +2Artificial Intelligence InfrastructureWorkload

  28. Benchmarking Agentic Review Systems

    Jun 18, 2026Dang Nguyen, Wanqing Hao, Yanai Elazar +1Peer ReviewPrecision Recall

  29. Closing the Operational Gap in Semantic Caching

    Jun 18, 2026Aditeya Baral, Radoslav Ralev, Iliya Sotirov Zhechev +2CacheSemantic Gap

  30. CAMI: Cost-Aware Agent-Guided Multi-Indexing for Semantic Retrieval

    Jun 14, 2026Adnan Qidwai, Anand Eswaran, Sonam Mishra +2Precision RecallCost-Aware

  31. SalArt-VQA: Diagnosing Whether VLMs Understand Salient Artifacts in Generated Images

    Jun 10, 2026Ruotian Zhang, Xiaoxiao Sun, Junzhe Huang +2Ai-Generated Image DetectionTextvqa

  32. From Regulatory Approvals to Patents: Cross-Domain Linking for Cardiovascular Device Traceability

    Jun 6, 2026Yang Qingqing, Liu Haijiang, Li MoyanPatentRegulation

  33. EMBER: Efficient Memory via Budgeted Evidence Retention for Long-Horizon Agents

    Jun 4, 2026Yilong Li, Suman Banerjee, Tong CheRetentionPrecision Recall

  34. ANN Search: Recall What Matters

    Jun 3, 2026Dimitris Dimitropoulos, Nikos MamoulisApproximate Nearest-Neighbor SearchPrecision Recall

  35. SkillDAG: Self-Evolving Typed Skill Graphs for LLM Skill Selection at Scale

    Jun 2, 2026Tong Bai, Zhenglin Wan, Pengfei Zhou +3Unsupervised Skill DiscoverySkills

  36. LLMs Need Encoders for Semantic IDs Too

    May 29, 2026Xiangyi Chen, Zelun Wang, Xinyi Li +3Multimodal Large Language ModelsToken Embeddings

  37. Beyond Agreement: Scoring Panel-Surfaced Biomedical Entity Candidates for Curator Triage

    May 29, 2026Shuheng Cao, Ruiqi Chen, Renjie Cao +3Medical OntologyNamed-Entity Recognition

  38. Learning to Assess the Reliability of Number-of-Runs Estimation in Stochastic Optimization

    May 27, 2026Sara Gjorgjieva, Eva Tuba, Tome EftimovStochastic OptimizationLarge-Scale Benchmark

  39. When Mean CE Fails: Median CE Can Better Track Language Model Quality

    May 23, 2026Hao Guo, Simon Dennis, Rivaan Patil +1Cross-Entropy LossesMean

  40. DeliCIR: Deliberative Test-Time Evolutionary Hierarchical Multi-Agents for Composed Image Retrieval

    May 21, 2026Xingtian Pei, Yukun Song, Changwei Wang +4Composed Image RetrievalMultimodal Retrieval

  41. MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems

    May 18, 2026Hyunji Lee, Justin Chih-Yao Chen, Joykirat Singh +3Long-Horizon Task PlanningPrecision Recall

  42. Evidence-Guided Unknown Rejection for High-Confidence Near-Known Unknowns

    May 18, 2026Xi Chen, Yingjun Xiao, Gang FangRejectionOpen-Set Recognition

  43. MARQUIS: A Three-Stage Pipeline for Video Retrieval-Augmented Generation

    May 17, 2026Debashish Chakraborty, Dengjia Zhang, Jialiang Jin +7Multimodal Retrieval Augmented GenerationLong Video Question Answering

  44. GRID: Graph Representation of Intelligence Data for Security Text Knowledge Graph Construction

    May 15, 2026Liangyi Huang, Zichen Liu, Fei Shao +5Knowledge GraphsGraph Representations