Finance Benchmarks

Momentum

3 papers in the last four weeks, level with the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 40

All topics
CardsList
  1. FinAutoRubric: Expert-Guided Automatic Rubric Generation for Evaluating Financial Research Agents

    Sep 28, 2026Hoyoung Lee, Suyeol Yun, Jack Haverty +17Finance BenchmarksTask-Specific Rubrics

  2. ETH-TraceBench: A Large-Scale Event-Stream Benchmark for Ethereum DeFi under Temporal, Protocol, and Contract Shift

    Sep 20, 2026Kemal Kirtac, Carsten MapleDecentralized FinanceFinance Benchmarks

  3. EXAONE Forecast for Finance

    Sep 7, 2026Seunghan Lee, Jaehoon Lee, Jun Seo +9Finance BenchmarksConvolutional

  4. QuoteBench: How Matched Scores Can Hide Command-Path Failures

    Aug 13, 2026Shangao Li, Yao Zhang, Volker Tresp +1ScoresFinance Benchmarks

  5. V-FiLLM: Verified Financial LLM Reasoning Benchmark

    Aug 11, 2026Alicia Larsen, Victoire Laurent, Aulia Kharis Rakhamsari +2Finance Benchmarks

  6. FinEvo-Bench: A Longitudinal Benchmark for Self-Evolving Agents in Professional Financial Workflows

    Aug 6, 2026Bo Deng, Kang Zhou, Lifan Guo +6Finance BenchmarksSelf-Evolving Agents

  7. FinVerse: Financial Time-Series Benchmark

    Aug 4, 2026Jaehoon Lee, Jun Seo, Seunghan Lee +9Finance BenchmarksTime Series Foundation Models

  8. FinDeepIndicator: Benchmarking Deep Research Agents in End-to-End Financial Indicator Construction

    Aug 1, 2026Chaoqun Yang, Fengbin Zhu, Xinyu Lin +5Finance BenchmarksDeep Research

  9. FinanceHarness: Autonomous Financial Deep Research Framework

    Jul 30, 2026Yijia Xiao, Rujun Han, Yanfei Chen +8Finance BenchmarksDeep Research

  10. GAUGE: Grading Agent-Built Financial Models Without a Golden Answer

    Jul 27, 2026Jiacheng Lu, Sinuo Wang, Wentao Zhao +12Finance BenchmarksGrading

  11. Earnings25: A Comprehensive 500-Hour Speech Benchmark for Finance

    Jul 26, 2026Denglin Jiang, Haoran Zhou, Anshul Wadhawan +7Automatic Speech Recognition EvaluationFinance Benchmarks

  12. Meta-Benchmarks for Financial-Services LLM Evaluation

    Jul 2, 2026Blair HudsonFinance BenchmarksBanking

  13. FinInvest-GTCN: Explainable Graph-Temporal-Causal Modeling for Risk-Aware Investment Decision Optimization

    Jun 27, 2026Junyan Tan, Yifan Li, Minghao Wang +2Causal GraphFinance Benchmarks

  14. InvestPhilBench: A Multi-Layer Benchmark for Evaluating Large Language Model Procedural Reasoning in Expert Investment Philosophy

    Jun 24, 2026Mingguang Chen, Bo QuFinancial Strategy ResearchFinance Benchmarks

  15. RAVEN: A Regime-Aware Variable-context Expert Network for Financial Time Series Forecasting

    Jun 23, 2026Cheng He, Zhenyu Guan, Xijie Liang +6Time Series ForecastingVolatility

  16. Robust Transformer-Based One-Step Stock Index Forecasting via Shifted Data Augmentation

    Jun 14, 2026Tien Thanh ThachForecasting BackboneData Augmentation

  17. Hedge-Bench: Benchmarking Agents on Hard, Realistic Tasks Pertaining to Financial Reasoning

    Jun 2, 2026Eric Cho, Shawn Huang, Alice Lu +1Finance BenchmarksAgentic Benchmarks

  18. BigFinanceBench: A Workflow-Grounded Benchmark for Financial-Research Agents

    Jun 2, 2026Alex Wang, Georg Meinhardt, Jacob Katz +4Finance BenchmarksFinancial Question Answering

  19. FinStressTS: A Parametric Synthetic Benchmark for Time-Series Forecasting in Finance

    Jun 2, 2026Jiaze Sun, Kelvin J. L. Koa, Ruiyang Ni +3Time Series ForecastingFinance Benchmarks

  20. From Long News to Accurate Forecast: Importance-Aware Fusion and PRM-Guided Reflection for Time Series Forecasting

    Jun 2, 2026Mingyang Liu, Qingcan Kang, Yuke Wang +6Large Language Model ForecastingTime Series Forecasting

  21. DynaTree: Dynamic Agentic Retrieval Tree for Time-Sensitive News Retrieval

    May 29, 2026Siyuan Qi, Xinyuan Wang, Yingxuan Yang +5HeadlinesAgentic Reasoning

  22. Hierarchical Synthetic Tabular Data Generation: A Hybrid Top-Down and Bottom-Up Framework

    May 27, 2026Junfeng Nie, Alvin Jin, Xiaohui ChenSynthetic Tabular DataSynthesis

  23. FinBoardBench: Benchmarking Dynamic Wealth Management and Strategic Financial Reasoning of LLMs via Board Game Simulations

    May 27, 2026Xuesi Hu, Peng Wang, Jinpeng Miao +7Finance BenchmarksLarge Language Model Decisions

  24. The Alpha Illusion: Reported Alpha from LLM Trading Agents Should Not Be Treated as Deployment Evidence

    May 16, 2026Yuxuan Ye, Jun Han, Ao Hu +7TradingFinance Benchmarks

  25. Fin-Bias: Comprehensive Evaluation for LLM Decision-Making under human bias in Finance Domain

    May 9, 2026Xiaoyu Hu, Jinman ZhaoLarge Language Model BiasFinancial Strategy Research

  26. ASDA: Automated Skill Distillation and Adaptation for Financial Reasoning

    Mar 17, 2026Tik Yu Yim, Wenting Tan, Sum Yee Chan +2Large Language Model AdaptationUnsupervised Skill Discovery

  27. BizFinBench.v2: Towards Reliable LLMs in Finance via Real-User Data and Offline/Online Bilingual Evaluation

    Jan 10, 2026Xin Guo, Rongjunchen Zhang, Guilong Lu +4Finance BenchmarksLarge Language Model Benchmarks

  28. CostNav: A Navigation Benchmark for Real-World Economic-Cost Evaluation of Physical AI Agents

    Nov 25, 2025Haebin Seong, Sungmin Kim, Yongjun Cho +20Artificial Intelligence AgentsFinance Benchmarks

  29. No Free Labels: Limitations of LLM-as-a-Judge Without Human Grounding

    Mar 7, 2025Michael Krumdick, Charles Lovering, Varshini Reddy +2Llm-As-A-JudgeGrading