New Tasks

Momentum

8 papers in the last four weeks, up 33% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 46

All topics
CardsList
  1. Do Self-Evolving Skills Generalize to Held-Out Tasks?

    Sep 30, 2026Xihao Piao, Zifeng Wang, Zhen ChenSkill EvolutionSkills

  2. Refusals That Bend: Measuring and Predicting Task Malleability in Embodied VLM Planners

    Sep 30, 2026Leo Y. Lin, Mikhail Kuznetsov, Muslum Ozgur Ozmen +1Safety AlignmentRefusals

  3. Compressing Value Predictions for Learning-Augmented Metrical Task Systems

    Sep 27, 2026Sizhe Li, Yecheng Li, Kun HeLearning-Augmented AlgorithmsValue

  4. Turning Safety into Competence: Minimally Exploitable Robot Policies via Safety-Filtered Reinforcement Learning

    Sep 23, 2026Ruihan Wu, Rui Yang, Donggeon David Oh +2Safety FiltersRobot Policies

  5. Multitask Reinforcement Learning for Assisting Choice Model Specification

    Sep 16, 2026Gabriel Nova, Stephane Hess, Sander Van CranenburghMulti-Turn Reinforcement LearningNew Tasks

  6. When Does AI Augment Work? A Workflow-Level Framework for Human-Agent Collaboration

    Sep 14, 2026AI Collaboration, Jiaying Wu, Caleb Ziems +19Human-Ai CollaborationAgentic Workflows

  7. Actuator Dynamics Curricula for Narrow-Viability Tasks in Legged Robot Learning

    Sep 8, 2026Kousheek Chakraborty, Chandan K. Rajendra, Ayham Alharbat +1ActuatorAgile Locomotion

  8. The Unreliable Progress Bar: Can LLM Agents Reliably Report Task Progress Throughout Execution?

    Sep 8, 2026Boyang Wang, Yunhan Wang, Yalun WuLarge Language Model AgentsNew Tasks

  9. One Adapter, Many Tasks: Task-Conditioned Feature Transformations for Continual Learning

    Aug 31, 2026Yunxiang Fu, Meng Lou, Yizhou YuClass-Incremental LearningContinual Learning

  10. Decentralized Multitask Learning over Learned Task Graphs

    Aug 27, 2026Zirui Wan, Stefan VlaskiGraph Representation LearningDecentralized Learning

  11. A Taxonomy of Construction Task Activities for Robot Workers

    Aug 26, 2026Sadman Sakib, Zhangyi None Peng, Yujie Pang +2ConstructionNew Tasks

  12. Multitask Scanning Probe Microscopy

    Aug 10, 2026Aditya Raghavan, Yu Liu, Ian Mercer +2Electron MicroscopyMicroscopy

  13. Coordinated Multi-Robot Disassembly for Makespan Optimization of Large-Scale Assemblies

    Aug 6, 2026Niklas Hargus, Andreas Orthey, Marc ToussaintMulti-Robot Motion PlanningMulti-Robot Systems

  14. Optimal Training-Time Scaling in Gradual Adaptation

    Aug 5, 2026Zonghuan Xu, Krishna HarishBatchTraining Time

  15. Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks

    Aug 4, 2026Shunfan Zheng, Dongsheng Shi, Yue Li +3Text-To-SqlLarge Language Model Benchmarks

  16. Verified Tool Calls Improve LLM Agent Reliability Under Non-Atomic Failures

    Jul 31, 2026Isham Kalappurackal Mansoor, Abhishek Phadke, Pratip RanaLarge Language Model AgentsCall

  17. Sign Language Question Answering: A New Task, Benchmark, and Baseline for Sign Language Understanding

    Jul 30, 2026Shiwei Gan, Lichen Wang, Xiao Liu +4Sign Language TranslationNew Tasks

  18. Benchmarking Generalization in Financial Statement Fraud Detection: robust evaluation and novel tasks

    Jul 21, 2026Guy Stephane Waffo Dzuyo, Gaël Guibon, Christophe Cerisara +1Fraud DetectionFinancial Question Answering

  19. Decoding Insect Song: A Multitask Semisupervised Orthoptera Bioacoustic Classifier

    Jun 11, 2026Olga Isupova, Danil Kuzin, Ella Browning +2Passive Acoustic MonitoringSpecies Identification

  20. Not Just After One: Sleep-Inspired Replay Prevents Catastrophic Forgetting After Sequential Tasks

    Jun 7, 2026Anthony Bazhenov, Jean Erik Delanois, Giri P. KrishnanCatastrophic ForgettingContinual Learning

  21. Learning-Augmented Online Minimization with Dual Predictions

    Jun 3, 2026Christian Coester, Alexa Tudose, Alexander TuroczyLearning-Augmented AlgorithmsFlat Minima

  22. Aggregating LLM-Based Weak Verifiers for Spatial Layout Generation

    Jun 3, 2026Sharon Zhang, R. Kenny Jones, Jiajun Wu +1LayoutsNew Tasks

  23. CoEval: Ranking Language Models for Custom Tasks Without Labeled Data or Trustworthy Benchmarks

    Jun 2, 2026Alexander Apartsin, Yehudit ApersteinLanguage ModelingLeaderboard

  24. DeskCraft: Benchmarking Desktop Agents on Professional Workflows and Human-in-the-Loop Collaboration

    Jun 2, 2026Wenkai Wang, Tao Xiong, Jingchen Ni +6Agentic Workflow DesignNew Tasks

  25. Hedging on the Frontier: Learning New Tasks with Few Samples

    May 29, 2026Tobias Wegel, Federico Di Gennaro, Geelon So +1LearnabilityMonotonicity

  26. Learning to Extrapolate to New Tasks: A Relational Approach to Task Extrapolation

    May 28, 2026Adam Ousherovitch, Yixin WangExtrapolationEfficient Task Adaptation

  27. Multitask learning with semiempirical orbital charges enables sample-efficient MLIPs

    May 22, 2026Ihor Neporozhnii, Sjoerd Hoogland, Oleksandr VoznyyInteratomic PotentialsQuantum Chemistry

  28. Agent JIT Compilation for Latency-Optimizing Web Agent Planning and Scheduling

    May 20, 2026Caleb Winston, Ron Yifeng Wang, Azalia Mirhoseini +1Smooth ExecutionNew Tasks

  29. Active multiple matrix completion with adaptive confidence sets

    May 4, 2026Andrea Locatelli, Alexandra Carpentier, Michal ValkoTensor CompletionMatrix

  30. A Comparative Study of QSPR Methods on a Unique Multitask PAMPA dataset

    May 1, 2026Andrs Formanek, Anna Vincze, Richrd Bicsak +3Molecular Property PredictionDeep Learning

  31. WindowsWorld: A Process-Centric Benchmark of Autonomous GUI Agents in Professional Cross-Application Environments

    Apr 30, 2026Jinchao Li, Yunxin Li, Chenrui Zhao +3Graphical User Interface AgentsNew Tasks

  32. Defective Task Descriptions in LLM-Based Code Generation: Detection and Analysis

    Apr 27, 2026Amal Akli, Mike Papadakis, Maxime Cordy +1Code GenerationLarge Language Model Generation

  33. LLMs Gaming Verifiers: RLVR can Lead to Reward Hacking

    Apr 16, 2026Lukas Helff, Quentin Delfosse, David Steinmann +6Reinforcement Learning With Verifiable RewardVerifiable Rewards

  34. A Multitask Large Reasoning Model for Molecular Science

    Mar 13, 2026Pengfei Liu, Shuang Ge, Xiaobo Wang +6MoleculenetLarge Reasoning Models

  35. Narrative Consolidation: Formulating a New Task for Unifying Multi-Perspective Accounts

    Dec 19, 2025Roger A. Finger, Eduardo G. Cortes, Sandro J. Rigo +1NarrativesSummarization

  36. Memento No More: Coaching AI Agents to Master Multiple Tasks via Hints Internalization

    Feb 3, 2025Minttu Alakuijala, Ya Gao, Georgy Ananov +4Artificial Intelligence AgentsInternalization