Omnichem

Momentum

5 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 39

All topics
CardsList
  1. OmniSeek: Native Tool Integration for Multi-turn Audio-Visual Reasoning

    Oct 1, 2026Haibo Wang, Jiteng Mu, Jialu Li +5Audio-Visual ReasoningOmni-Modal

  2. OmniFabric: Coherent UV Space Texture Synthesis for 3D Garment Reconstruction

    Sep 24, 2026Ding-Jiun Huang, Yuanhao Wang, Cheng Zhang +4TextureGarments

  3. OmniRisk: Omnidirectional Trajectory-Risk Learning for Agile Quadrotor Dynamic Avoidance

    Sep 16, 2026Yifan He, Yang Liu, Wenhao Zhao +8Obstacle AvoidanceQuadrotor

  4. OmniPoint: Universal Monocular Metric Pointcloud from Any Camera

    Sep 8, 2026Botao Ye, Marc Pollefeys, Ming-Hsuan Yang +1Camera IntrinsicsPoint Clouds

  5. Exploring the Potential of Contrastive Language-Image Pre-training for Multi-Source Remote Sensing Data

    Sep 3, 2026Xiangyang Miao, Kelu Yao, Yekai Huang +7Remote SensingContrastive Language-Image Pre-Training Model

  6. OmniScientist: An Omni-Modal Omni-Discipline AI Scientist

    Aug 13, 2026Bobo Li, Hao Fei, Tianjie Ju +2Scientific DiscoveryOmni-Modal

  7. Omni-modal decomposition autoencoders learn full-stack wearable disentangled representations

    Aug 7, 2026Ioannis Ziogas, Ensieh Khazaei, Bilal Taha +4Multimodal Deep LearningHuman Activity Recognition

  8. OmniMech: All-in-one Multimodal Mechanical Benchmark for 3D Reconstruction

    Aug 6, 2026Taiting Lu, Runze Liu, Ziwei Dong +18Large-Scale Benchmark3D Reconstruction

  9. OmniPhys: Knowledge-Graph-Driven Benchmarking and Collective Optimization for Physical Commonsense in Text-to-Image Generation

    Jul 28, 2026Yajing Xu, Yarong Lan, Jiaoyan Chen +6Text-To-ImageOmnichem

  10. OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation

    Jul 26, 2026Jun Zhan, Chen Yang, Yitian Gong +23Audio-Video GenerationCross-Modal Alignment

  11. OmniMate: Open-Ended Real-Time Streaming Audio-Visual Generation for Interactive Avatars

    Jul 25, 2026Quanyue Song, Yishan He, Yanbo Ding +4Audio-Video GenerationAudio-Visual Consistency

  12. OmniReasoner: Thinking with Long Audio-Video via Native Tool Use

    Jul 21, 2026Yu Chen, Caorui Li, Ziyu Xiong +8Audio-Visual ReasoningOmni-Modal

  13. OmniX: Any-view and Any-time 4D Reconstruction via Feed-forward Trajectory Fields

    Jul 12, 2026Yanqin Jiang, Tengfei Wang, Zhengwei Wang +64D ReconstructionMotion Model

  14. Game Theory Driven Multi-Agent Framework Mitigates Language Model Hallucination

    Jul 9, 2026Runzhe Liu, Biquan Bie, Zihao Wang +7Multi-Agent Large Language Model SystemsScientific Discovery

  15. OmniSCS: Omni Safety-Critical Scenario Synthesis for Autonomous Driving via a Fully Editable Driving World

    Jul 7, 2026Xiaoyun Dong, Qian Xu, Yang Lu +3Autonomous Driving SimulationAutonomous Driving

  16. OmniFocus: Query-Guided Modality-Balanced Token Compression for Omni-Modal Large Language Models

    Jul 3, 2026Shijie Cao, Qingyu Zhang, Boxi Yu +6Token CompressionAudio-Visual Reasoning

  17. OmniDS: Dual-Stream Context Fusion for Omnidirectional Depth from Fisheye Cameras

    Jul 3, 2026Chaesong Park, Jihyeon Hwang, Muyeol Sung +1Cross-View FusionCamera

  18. Tastes without distinction: silicon samples and the synthetic construction of tastes

    Jun 29, 2026Xiangyu Ma, Mengmi Zhang, Shannon Ang +1Large Language Model BiasSurvey

  19. OmniV2X: A Generative Foundation Planner for Efficient End-to-End Cooperative Driving

    Jun 19, 2026Juntong Peng, Juanwu Lu, Yupeng Zhou +3V2XCausality-Aware End-To-End Autonomous Driving

  20. OmniTraffic: A Controllable Generation Pipeline and Benchmark for Spatio-Temporal Traffic Reasoning

    Jun 14, 2026Maonan Wang, Zhengyan Huang, Kemou Jiang +13TrafficSpatio-Temporal Reasoning

  21. OmniPMNet: Bridging discrete and gridded PM10 forecasts via omni-query neural processes

    Jun 12, 2026Shuangshuang He, Shuo WangAir PollutionSpatio-Temporal Forecasting

  22. OmniBioTwin: A System-of-Twinned-Systems Framework for Health Digital Twins

    Jun 9, 2026Zhaohui Wang, Yu Huang, Jiang BianDigital TwinsTwins

  23. OmniGen-AR: AutoRegressive Any-to-Image Generation

    Jun 8, 2026Junke Wang, Xun Wang, Qiushan Guo +4Autoregressive Image GenerationVisual Generation

  24. OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration

    May 27, 2026Xinchen Zhang, Bowei Liu, Jiale Liu +7Reference-Guided Multimodal In-Context VerificationRecent Vision-Language Models

  25. OmniGF: A Dual-Branch Vision-Language Framework for Unified Gaze Following

    May 26, 2026Qiaomu Miao, Haoyu Wu, Jingyi Xu +2Gaze BehaviorRecent Vision-Language Models

  26. OmniPro: A Comprehensive Benchmark for Omni-Proactive Streaming Video Understanding

    May 18, 2026Ruixiang Zhao, Jie Yang, Zijie Xin +4Omni-ModalAudio-Visual Reasoning

  27. OmniRefine: Alignment-Aware Cooperative Compression for Efficient Omnimodal Large Language Models

    May 12, 2026Yuchen Deng, Zidang Cai, Hai-Tao Zheng +3Token CompressionAudio-Visual Reasoning

  28. OmniVTG: A Large-Scale Dataset and Training Paradigm for Open-World Video Temporal Grounding

    Apr 28, 2026Minghang Zheng, Zihao Yin, Yi Yang +2Video Temporal GroundingMultimodal Large Language Models

  29. OmniFit: Multi-modal 3D Body Fitting via Scale-agnostic Dense Landmark Prediction

    Apr 23, 2026Zeyu Cai, Yuliang Xiu, Renke Wang +8Body3D Generation

  30. OmniVLA-RL: A Vision-Language-Action Model with Spatial Understanding and Online RL

    Apr 20, 2026Haoxiang Jie, Yaoyuan Yan, Xiangyu Wei +4Omnichem

  31. OmniGCD: Abstracting Generalized Category Discovery for Modality Agnosticism

    Apr 16, 2026Jordan Shipard, Arnold Wiliem, Kien Nguyen Thanh +2Generalized Category DiscoveryModality-Specific Encoders

  32. VIGIL: Part-Grounded Structured Reasoning for Generalizable Deepfake Detection

    Mar 23, 2026Xinghan Li, Junhao Xu, Jingjing ChenDeepfake DetectionDigital Forensics

  33. SocialOmni: Benchmarking Audio-Visual Social Interactivity in Omni Models

    Mar 17, 2026Tianyu Xie, Jinfa Huang, Yuexiao Ma +11Dialogue BenchmarksOmnichem

  34. OmniGAIA: Towards Native Omni-Modal AI Agents

    Feb 26, 2026Xiaoxi Li, Wenxiang Jiao, Jiarui Jin +10Omni-ModalMultimodal Agents

  35. OmniNWM: Omniscient Driving Navigation World Models

    Oct 21, 2025Bohan Li, Zhuang Ma, Dalong Du +10Efficient World-Action ModelAutonomous Driving

  36. OmniFall: From Staged Through Synthetic to Wild, A Unified Multi-Domain Dataset for Robust Fall Detection

    May 26, 2025David Schneider, Zdravko Marinov, Moritz Mistol +6Robust Fall DetectionMultimodal Dataset