Vista

Momentum

7 papers in the last four weeks, up 133% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 40

All topics
CardsList
  1. VISTA: A Visual Harness for Reasoning in an Interactive World

    Oct 1, 2026Qiushi Han, Keya Hu, Linlu Qiu +2Multimodal AgentsMultimodal Reasoning

  2. Is Better Teacher Supervision Enough? Unlocking Student-side Learning in Multimodal On-Policy Distillation

    Sep 30, 2026Siyuan Liu, Kanghui Tian, Yue Duan +4PerceptuallyVista

  3. Visual Jev: Accurate and Efficient Decisions from Shared Visual Context

    Sep 22, 2026Guanxu Yu, Yuhang YaoVisual RepresentationsVista

  4. VISTA: Video-Injected Stylized Text-to-Animation

    Sep 20, 2026Monseej Purkayastha, Anindita Ghosh, Philipp SlusallekMotion CaptureVista

  5. Label-free steering: Compressing test-time reinforcement learning into bias-only subspaces

    Sep 16, 2026Naveen Vakada, Mingyuan Li, Shaoxiong JiStable Test-Time AdaptationTest-Time Adaptation

  6. MEgoVista: Multi-view Ego-aware Motion Estimation for Metric 4D Hands and Head in the Wild

    Sep 15, 2026Jiangong Xiao, Zhihao Zhang, Yifei Dong +73D HandEgocentric Motion Generation

  7. Vision And Text Transformer For Predicting Answerability On Visual Question Answering

    Sep 15, 2026Tung Le, Huy Tien Nguyen, Le Minh NguyenSelf-Supervised Vision TransformersTransformer Architectures

  8. First Things First: Teaching LLM-Based Agents to Prioritize Must-Haves before Nice-to-Haves

    Sep 4, 2026Tianjie Ju, Xinyue Xu, Wanxuan Sun +4Vista

  9. VisLens: Single-Pass Interpretable Visual Search for Multimodal LLMs

    Aug 31, 2026Jingyi He, Sanghwan Kim, Zeynep AkataMultiple Vision TasksRecent Vision-Language Models

  10. VisER: Visual Evidence and Reliance for Object Hallucination Detection in LVLMs

    Aug 31, 2026Afsaneh Hasanebrahimi, Hanxun Huang, Christopher Leckie +1Citation Hallucination DetectionVisual Evidence

  11. VISTA-DZ: Visual Semantic Trajectory Adaptation for Personalized Dilemma Zone Prediction

    Jun 28, 2026Chuheng Wei, Ziye Qin, Ziran Wang +1VistaJourney

  12. Curvature-aware 3D length estimation of greenhouse cucumbers using RGB-D imaging and cubic spline arc-length integration

    Jun 21, 2026Manveen Kaur, Rajmeet Singh, Saeed Mozaffri +1Robust Geometric Model EstimationRgb-Depth Cameras

  13. VisDom: Sparse Novel View Synthesis with Visible Domain Constraint

    Jun 18, 2026Mariia Gladkova*, Tarun Yenamandra*, Edmond Boyer +3Novel View SynthesisGeometric Reconstruction

  14. VIMPO: Value-Implicit Policy Optimization for LLMs

    Jun 18, 2026Zhewei Kang, Aosong Feng, Sergey Levine +2Reinforcement Learning With Verifiable RewardFrictive Policy Optimization

  15. VISTA: Scale-Aware Visual Navigation via Action History Conditioning

    Jun 15, 2026Maeva Guerrier, Koki Kobayashi, Simon Roy +2Recent Vision Foundation ModelsDynamic Environments

  16. TimeVista: Exploring and Exploiting Vision-Language Models as Judges for Time Series Forecasting

    Jun 15, 2026Zhi Chen, Yuxuan Wang, Jialong Wu +5Time Series ForecastingTime Series

  17. VISTA: A Versatile Interactive User Simulation Toolkit for Agent Evaluation

    Jun 9, 2026Yunan Lu, Ryan Shea, Yusen Zhang +1Agentic EvaluationsUser Simulation

  18. Inside the Visual Mind: Neuroscience-Motivated Concept Circuits for Interpreting and Steering Vision Transformers

    Jun 4, 2026Tang Li, Yanlin Chen, Mengmeng Ma +1Self-Supervised Vision TransformersVision Transformer

  19. VISTA: Vision-Grounded and Physics-Validated Adaptation of UMI data for VLA Training

    Jun 3, 2026Siyuan Yang, Linzheng Guo, Ouyang Lu +10Vision-Language-Action FrameworkRobotic Data Acquisition

  20. Federated Learning over Human-Body Communication for On-Body Edge Intelligence: A Survey, Taxonomy, and BODYFED-HBC Scheduling Vignette

    May 22, 2026Koffka KhanFederated LearningIntelligent Edge

  21. VisAnalog: A Diagnostic Suite for Visual Concept Transfer on Natural Images

    May 22, 2026Zhaonan Li, Kyle R. Chickering, Bangzheng Li +13Vision DatasetsVista

  22. VISTA: Validation-Guided Integration of Spatial and Temporal Foundation Models with Anatomical Decoding for Rare-Pathology VCE Event Detection -- after competition results

    May 21, 2026Bo-Cheng Qiu, Fang-Ying Lin, Ming-Han Sun +3ColonoscopyVista

  23. VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026

    May 20, 2026Qiaohui Chu, Haoyu Zhang, Yisen Feng +4Temporal Action LocalizationVideo Joint Embedding Predictive Architecture

  24. VISTAQA: Benchmarking Joint Visual Question Answering and Pixel-Level Evidence

    May 20, 2026Mozhgan Nasr Azadani, Yimu Wang, Yongpeng Zhu +5Weak Visual GroundingVisual Evidence

  25. VISAFF: Speaker-Centered Visual Affective Feature Learning for Emotion Recognition in Conversation

    May 18, 2026Linan ZHU, Zihao Zhai, Xiao Han +4Emotion RecognitionAutomatic Speaker Verification

  26. CANSURF: An ASV-View Can Dataset and Benchmark for Detection and Tracking of Surface-Level Debris

    May 16, 2026Zaid Aljundi, Zahra F. Rahmatullah, Mostafa Elemam +1Ship DetectionWaste

  27. Viverra: Text-to-Code with Guarantees

    May 14, 2026Haoze Wu, Rocky Klopfenstein, Keith Farkas +1Code GenerationFormal Verification

  28. VISTA: A Generative Egocentric Video Framework for Daily Assistance

    May 11, 2026Yu-Hsiang Liu, Yu-Chien Tang, An-Zi YenVideo AgentEgocentric Video

  29. ViSRA: A Video-based Spatial Reasoning Agent for Multi-modal Large Language Models

    May 11, 2026Tingshu Mou, Jiabo He, Renying Wang +53D Spatial ReasoningMultimodal Large Language Models

  30. VISTA: A Benchmark for Real-Time Video Streaming under Network Impairments in Surgical Teleoperation

    May 9, 2026Zexin Deng, Zhenhui Yuan, Tian Lu +3Surgical VideosVideo Quality

  31. \mathsf{VISTA}: Decentralized Machine Learning in Adversary Dominated Environments

    May 8, 2026Hanzaleh Akbari Nodehi, Parsa Moradi, Soheil Mohajer +1Bounded AdversaryAdversarial Robustness

  32. Toward Visually Realistic Simulation: A Benchmark for Evaluating Robot Manipulation in Simulation

    May 7, 2026Yixin Zhu, Zixiong Wang, Jian Yang +4Robotic Manipulation3D Assets

  33. TableVista: Benchmarking Multimodal Table Reasoning under Visual and Structural Complexity

    May 7, 2026Zheyuan Yang, Liqiang Shang, Junjie Chen +6VistaStructural Complexity

  34. TabSurv: Adapting Modern Tabular Neural Networks to Survival Analysis

    May 5, 2026Stanislav Kirpichenko, Andrei Konstantinov, Lev UtkinSurvival AnalysisTabular Learning

  35. CuraView: A Multi-Agent Framework for Medical Hallucination Detection with GraphRAG-Enhanced Knowledge Verification

    May 5, 2026Severin Ye, Xiao Kong, Xiaopeng He +2Citation Hallucination DetectionElectronic Health Records

  36. ViewSAM: Learning View-aware Cross-modal Semantics for Weakly Supervised Cross-view Referring Multi-Object Tracking

    May 4, 2026Jiawei Ge, Xintian Zhang, Jiuxin Cao +9Multi-Object TrackingCross-Modal

  37. VISTA: Video Interaction Spatio-Temporal Analysis Benchmark

    May 2, 2026Alejandro Aparcedo, Akash Kumar, Aaryan Garg +5Fine-Grained Video UnderstandingSpatio-Temporal Reasoning

  38. Vista4D: Video Reshooting with 4D Point Clouds

    Apr 23, 2026Kuan Heng Lin, Zhizheng Liu, Pablo Salamanca +94D Reconstruction4D

  39. VISTA: Validation-Informed Trajectory Adaptation via Self-Distillation

    Apr 13, 2026Eli Corn, Daphna WeinshallParameter-Efficient AdaptationRobust Trajectory