3D ViTs

ViT: Vision Transformer

Momentum

13 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 81

All topics
CardsList
  1. Long-Term Prediction of Local and Global Human Motion with Occlusion Recovery

    Jun 26, 2026Qiaoyue Yang, Sven Heutger, Christopher Niemann +33D ViTsHuman Motion Prediction

  2. Modeling Local, Global, and Cross-Modal Context in Multimodal 3D MRI

    Jun 25, 2026Minh Duc Do, Tillmann Rheude, Noel Kronenberg +23D ViTsBrain Age Prediction

  3. DDStereo: Efficient Dual Decoder Transformers for Stereo 3D Road Anomaly Detection

    Jun 23, 2026Shiyi Mu, Zichong Gu, Zhiqi Ai +23D ViTsAutonomous Driving Perception

  4. Visual Geometry Transformer in the Wild: Distractor-Free 3D Reconstruction

    Jun 22, 2026Tianbo Pan, Xingyi Yang, Shizun Wang +13D ViTs3D Reconstruction

  5. DINO-Med3D: Bridging Dimension and Domain Gaps in Volumetric Segmentation via Progressive Adaptation

    Jun 17, 2026Haoyu Hu, Xiyao Ma, Shiqi Liu +43D ViTsDomain Adaptation

  6. RegimeVGGT: Layer-Wise Spatially Preserving Redundancy Removal for Visual Geometry Grounded Transformer

    Jun 16, 2026Jinhao You, Shuo Lyu, Zhuohang Lyu +53D ViTsMulti-View 3D Reconstruction

  7. Uncertainty Quality of VGGT: An Analysis on the DTU Benchmark Dataset

    Jun 15, 2026Markus Hillemann, Robert Langendörfer, Steven Landgraf +13D ViTs3D Reconstruction

  8. Point-Wise Geometry-Aware Transformer for Partial-to-Full Point Cloud Registration in Computer-Assisted Surgery

    Jun 11, 2026Siyu Zhou, Zhongliang Jiang3D ViTsPoint Cloud Registration

  9. PT-WNO: Point Transformer with Wavelet Neural Operator for 3D Point Cloud Semantic Segmentation

    Jun 9, 2026Nhut Le, Maryam Rahnemoonfar3D Point Cloud Segmentation3D ViTs

  10. Distortion-Aware PETR for BEV Object Detection with Mixed Pinhole-Fisheye Cameras

    Jun 7, 2026Xiangzhong Liu3D ViTsAutonomous Driving Perception

  11. LiAuto-GeoX: Efficient Grounded Driving Transformer

    Jun 4, 2026Jiawei Lian, Haoyi Sun, Yang Wu +83D ViTs3D Reconstruction

  12. BA-T: An Iterative Transformer for Two-View Bundle Adjustment

    Jun 2, 2026Ganlin Zhang, Weirong Chen, Daniel Cremers +1Multi-View Consistency3D ViTs

  13. Edge Prediction for Roof Wireframe Reconstruction with Transformers

    Jun 1, 2026Gustav Hanning, Ludvig Dillén, Jonathan Astermark +23D ViTs3D Reconstruction

  14. PillarDETR: YOLO-Backbone and RT-DETR Head for Real-Time 3D Object Detection

    Jun 1, 2026Smit Kadvani, Shriya Gumber, Kriti Faujdar +13D ViTsLidar-Based 3D Object Detection

  15. RayDer: Scalable Self-Supervised Novel View Synthesis from Real-World Video

    May 29, 2026Ulrich Prestel, Stefan Andreas Baumann, Nick Stracke +13D ViTsNovel View Synthesis

  16. Vanilla ViT for Automotive Point Cloud Semantic Segmentation

    May 29, 2026Gilles Puy, Nermin Samet, Alexandre Boulch +33D Point Cloud Segmentation3D ViTs

  17. QVGGT: Post-Training Quantized Visual Geometry Grounded Transformer

    May 29, 2026Zhizhen Pan, Hesong Wang, Huan WangMixed-Precision Quantization3D ViTs

  18. vSV-ViT: Variable-size SuperVertex Vision Transformer for Cortical Surface Learning in Alzheimer's Disease

    May 26, 2026Geonwoo Baek, Ikbeom JangAlzheimer's Disease3D ViTs

  19. Unified Panoramic Geometry Estimation via Multi-View Foundation Models

    May 25, 2026Vukasin Bozic, Isidora Slavkovic, Dominik Narnhofer +43D Foundation Models3D ViTs

  20. PQDT: Pseudo-Query Dual Transformer for Robust Point Cloud Restoration

    May 24, 2026Haoqing Wu, Alexa Nawotki, Jochen GarckePoint Cloud Completion3D ViTs

  21. Good Token Hunting: A Hitchhiker's Guide to Token Selection for Visual Geometry Transformers

    May 22, 2026Shuhong Zheng, Michael Oechsle, Erik Sandström +33D ViTsMulti-View 3D Reconstruction

  22. HorizonStream: Long-Horizon Attention for Streaming 3D Reconstruction

    May 22, 2026Chong Cheng, Peilin Tao, Nanjie Yao +93D ViTsStreaming 3D Reconstruction

  23. STELLAR: Scaling 3D Perception Large Models for Autonomous Driving

    May 19, 2026Yingwei Li, Xin Huang, Yang Liu +133D ViTsAutonomous Driving

  24. Rethinking Point Clouds as Sequences: A Causal Next-Token Predictive Learning Framework

    May 17, 2026Yumeng Yao, Jingzhi Dong, Haowen Gu +43D ViTsSelf-Supervised Pre-Training

  25. Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory

    May 17, 2026Tianchen Deng, Zhenxiang Xiong, Nailin Wang +43D ViTs3D Reconstruction

  26. VolTA-3D: Self-Supervised Learning for Brain MRI using 3D Volumetric Token Alignment

    May 16, 2026Amy Makawana, Abhijeet Parida, Marius George Linguraru +23D ViTsSelf-Supervised Pre-Training

  27. IVGT: Implicit Visual Geometry Transformer for Neural Scene Representation

    May 15, 2026Yuqi Wu, Tianyu Hu, Wenzhao Zheng +43D ViTsImplicit Neural Representations

  28. 3DTMDet: A Dual-Path Synergy Network of Transformer and SSM for 3D Object Detection in Point Clouds

    May 15, 2026Bingwen Qiu, Yuan Liu, Junqi Bai +53D ViTs3D Object Detection

  29. Learned Suppression for 3D Keypoint Detection with a Graph-Transformer Backbone

    May 14, 2026Batuhan Arda Bekar, Can Sarı, Hüseyin Can Gülkan +13D ViTsGraph Neural Networks

  30. TurboVGGT: Fast Visual Geometry Reconstruction with Adaptive Alternating Attention

    May 14, 2026David Huang, Guile Wu, Chengjie Huang +23D ViTsMulti-View 3D Reconstruction