3D Generation

Momentum

67 papers in the last four weeks, up 131% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 465

All topics
CardsList
  1. SILSA: Sliding-Window Slice Latents for Topology-Preserving High-Resolution 3D Generation

    Oct 1, 2026Tianjiao Yu, Xinzhuo Li, Yifan Shen +43D GenerationVideo Latents

  2. Generative Cinematographer: Composing Camera and Object Motion in 3D

    Oct 1, 2026Jiahan Zhang, Chaohao Yang, Namitha Guruprasad +43D MotionCamera Control

  3. 4Director: Controlling Video World Models with Rigid 3D Geometry

    Oct 1, 2026Wei Cao, Hao Zhang, Vikram Voleti +53D MotionVideo World Models

  4. GeoLatent: Geometry-Guided Latent Structuring with Routed Optimization for 3D Reasoning

    Oct 1, 2026Yakun Zhu, Yi Bin, Yujuan Ding +53D Spatial ReasoningDiscriminative Congruence Transform

  5. DiDE:Direct Injection with Color-Texture DEcoupling for 3D Stylization

    Oct 1, 2026Tao Wu, Alexandra Gomez-Villa, Senmao Li +33D Generative Models3D Assets

  6. VoxelSynth3D: Interpretable Volumetric Image-Domain Metal Artifact Reduction with a Paired Synthetic CLINIC-Metal Benchmark

    Oct 1, 2026Amritesh Banerjee, Abdul Basit, Renil Renji Joseph +2Cone-Beam Computed TomographyCompression Artifacts

  7. HierGF: Hierarchical Gaussian Fields via Geometry-perception Message Passing for Sparse-view 3D Reconstruction

    Oct 1, 2026Bi'an Du, Zhimin Zhang, Daizong Liu +2Sparse-View3D Reconstruction

  8. An Island-Based Parallel Biased Random-Key Genetic Algorithm for the Three-Dimensional Trailer Loading Problem

    Sep 30, 2026A. del Río, L. Díaz, L. C. de Vicente +2LogisticsGenetic Algorithms

  9. TrackFish3D: Self-Supervised 3D Tracking of Schooling Fish from Multi-view Videos

    Sep 29, 2026Patt Phurtivilai, Zhiyang Dou, Yifan Wu +53D TrackingMulti-Object Tracking

  10. FurE: Efficient Instance-Specific 3D Fur Reconstruction without Animal-Fur Datasets

    Sep 28, 2026Srinjay Sarkar, Prakhar Kaushik, Soumava Paul +1Avatar Reconstruction3D Reconstruction

  11. Many Eyes, One World: Feed-Forward 3D Reconstruction from Mixed Cameras

    Sep 28, 2026Qiaoge Li, Yifan Zhan, Haijun Yang +3Feed-Forward 3D ReconstructionCamera

  12. Spatial Grafting: Grounding 3D Features for Flow-Matching Robot Policies

    Sep 28, 2026Dingsheng Liu, Yangzheng Wu, Mahboubeh Asadi +5Robotic Manipulation PoliciesRobot Policies

  13. Long Time No See: Benchmarking VLMs for Out-of-Sight Spatiotemporal Reasoning in Egocentric Videos

    Sep 28, 2026Fangzhou Ma, Ivo Alexander Ban, Eren Homburg +5Spatio-Temporal ReasoningVisibility

  14. BMND: Direct Poisson Denoising by N-Dimensional Block Matching and Collaborative Filtering

    Sep 28, 2026Christof Duhme, Lars Schiefelbein, Florian Büther +1Iterative Denoising MethodsPoisson

  15. Scaling Versatile 3D Assets Editing with a Million-Scale Dataset

    Sep 28, 2026Badi Li, Tianxin Huang, Yu Zhou +33D AssetsLarge-Scale 3D Editing Dataset

  16. 3D Point Tracking with State Space Models

    Sep 27, 2026Masahiro Ogawa, Qi An, Atsushi Yamashita3D TrackingMonocular Depth Estimation

  17. A Study of the Limits of Collaborative DCT-Based Image Denoising via Interpretable Neural Networks

    Sep 24, 2026Cristian Comellas, Julia Navarro, Antoni BuadesIterative Denoising MethodsVisual Priors

  18. PHOSA: Photorealistic 3D Sign Avatar Modeling and Benchmark

    Sep 24, 2026Haodong Wang, Hezhen Hu, Wengang Zhou +1Sign Language TranslationHumanml3D

  19. SARFusion: Scene-Aware Routing Fusion for Robust Camera-LiDAR 3D Object Detection

    Sep 24, 2026Yuting Zhao, Ziyi Zheng, Shuxiao Li3D Object DetectionMulti-Sensor Fusion

  20. PePESeg3D: Perception Prior Enhances Multi-Scale Segmentation for 3D Gaussian Splatting

    Sep 23, 2026Sungjae Choi, Seunghee Koh, Junmo Kim3D Generation

  21. AstraLOD3: Zero-shot multimodal agentic reconstruction of LOD3 building models

    Sep 23, 2026Bryan G. Pantoja-Rosero3D Reconstruction3D Generation

  22. SGDet3D++: Geometry-Grounded Semantics for 4D Radar and Camera 3D Object Detection

    Sep 23, 2026Xiaokai Bai, Zhenyu Fan, Lianqing Zheng +33D Object Detection4D Radar

  23. KATOsuper: Surrogate-accelerated neural topology optimization with sensitivity-consistent Fourier neural operators

    Sep 23, 2026Shengyu Yan, Jasmin JelovicaTopology OptimizationFourier Neural Operators

  24. nnFoundation: 3D Foundation Models for Radiology

    Sep 22, 2026Constantin Ulrich Harsy, Tassilo Wald, Karol Gotkowski +803D Foundation ModelsRadiomics

  25. A 3D Pose-Based Ensemble Framework for Cricket Shot Classification and Automated Biomechanical Analysis

    Sep 22, 2026Sourav Shome, M. D. Ashiquzzaman Rahad, Rameswar DebnathWifi-Csi 3D Human Pose EstimationBiomechanics

  26. Leveraging Vision-Based Point Cloud Map Priors for Camera-Based 3D Object Detection and Online Vectorized HD Mapping

    Sep 22, 2026Markus Käppeler, Rohit Mohan, Abhinav Valada3D Object DetectionLane-Level Map Generation

  27. SAMI3D-DW: Interactive Segmentation of Any 3D Medical Images

    Sep 22, 2026Ping Gong, Shiyuan Su, Fandong Zhang +43D Medical Image Segmentation3D Generation

  28. When Wider Views Fail: Stress-Testing Feed-Forward 3D Reconstruction

    Sep 21, 2026Daisy Li, Kyle Gao, Quanyun Wu +3Feed-Forward 3D ReconstructionSparse-View

  29. Bridge3D: Enabling Vision-Language-Action Models to See and Act in 3D

    Sep 21, 2026Haoxuan Li, Sixu Yan, Lianghui Zhu +3Diffusion-Based Vision-Language-ActionsRobotic Manipulation

  30. A Monolithic Force-Proprioception Soft Acutuator Enabled by Single-Material 3D printing

    Sep 21, 2026Nan Huang, Lele Liu, Junfeng Lu +3Soft Pneumatic ActuatorsAsymmetric Origami Bending

  31. StenoVLA-3D: 3D-Aware Reasoning VLA for Navigation Through Gastrointestinal Stenoses

    Sep 21, 2026Tamima Tabassum, Yiming Huang, Tianchun Wu +7Robotic Soft Esophagus3D Generation

  32. Towards robust multimodal 3D object detection via visual foundation models

    Sep 20, 2026Ziying Song, Lin Liu, Hongyu Pan +43D Object DetectionAutonomous Driving Perception

  33. PosEviLoc: Position-Conditioned Spatial Evidence for Language-Based 3D Localization

    Sep 20, 2026Tianyi Shang, Yike Shi, Zhenyu LiIndoor LocalizationPoint Clouds

  34. GAPS: Generative Active Pseudo-view Selection for Sparse-View 3D Gaussian Splatting

    Sep 20, 2026Hongfei Zhu, Haochen Deng, Sitao Zhang +1Novel View Synthesis3D Generation

  35. ProxyBuild: Text-Guided Structured 3D Building Generation with Mesh-Anchored Procedural Proxies

    Sep 20, 2026Xiang Tang, Ruotong Li, Xiaopeng FanBuilding Information Modeling3D Generation

  36. PhGS: Post-Hoc Pruning and Refinement of Single-View Feed-Forward 3D Gaussian Reconstructions

    Sep 17, 2026Rinto Yagawa, Han Cheng, Dieter Schmalstieg +2Feed-Forward 3D Gaussian SplattingSparse-View

  37. NeuSOGA3D: A Neuro-Symbolic Framework for Explainable 3D Geometric Reconstruction

    Sep 17, 2026Qingde Li, Qingqi Hong, Zihan Li +13D ReconstructionObject Geometry

  38. GAPrompt++: Multi-Granular Geometry-Aware Point Cloud Prompt for 3D Vision Model

    Sep 17, 2026Zixiang Ai, Zhenyu Cui, Yufei Guo +4Point Clouds3D Geometry

  39. Design and Experimental Validation of a 3D Printed Torsional Series Elastic Actuator for Safe Human Robot Interaction

    Sep 16, 2026Joel Hidalgo Pisco, Melissa Cobos Condo, Luigi Miranda +1Soft Pneumatic ActuatorsHuman-Robot Interaction

  40. Open-vocabulary 3D object detection with promptable segmentation

    Sep 16, 2026Ömer Faruk Deniz, Mustafa Taha Koçyiğit3D Object DetectionObject Detection

  41. Geometry beneath the Waves: Dense Priors for Sparse-View Underwater 3D Gaussian Splatting

    Sep 16, 2026Harvey Caldeira, Haoran Wang, Guoxi Huang +3Underwater Image Enhancement MethodsUnderwater Object Detection

  42. Toward 3D Printable Non-Planar Electroadhesive Structures for Active Anchoring

    Sep 16, 2026Mostafa A. Atalla, Carol R. Derla, Pep Canyelles Pericàs +13D Generation

  43. MAETrack: Unleashing the Potential of Pretrained Geometric Priors for 3D Single Object Tracking

    Sep 15, 2026Sifan Zhou, Qiwei Wang, Linyue Tan +33D Generation

  44. Efficient 3D Whole-Body PET Image Denoising via Conditional Rectified Flow With Optimized Sampling Strategy

    Sep 15, 2026Jiale Shen, Guolin Wang, Chenhao Wang +3Positron Emission TomographyRectified Flow

  45. SceneBench: A Hierarchical Benchmark for Vision-Language Understanding of 3D Scenes

    Sep 14, 2026Anubhav Khanal, Prabigya Acharya, Roshni Poudel +53D Spatial Reasoning3D Generation

  46. SyntheticDoc: A Large Synthetic Dataset for Document Unwarping and Illumination Correction

    Sep 14, 2026Daniel Woortmann, Tanguy Magne, Olga Sorkine-HornungSynthetic-To-Real Domain GapLarge-Scale 3D Editing Dataset

  47. Partition-Invariant Tuning for 3D Scene Understanding

    Sep 14, 2026Hongqiang Lin, Tianle Wang, Shuiwang Li +4Point Clouds3D Scene Understanding

  48. Multimodal Floorplan Encoding: Learning Dense Modality-Invariant Representations

    Sep 14, 2026Xavier Anadón, Rémi Pautrat, Rui WangUnimodal EncodersLatent Space

  49. SNAP3D: Physically Grounded 3D Parts for Assembly from a Single Image

    Sep 14, 2026Yu-Rou Tuan, Hao-Tang Tsui, Nicolas Ugrinovic +23D Models3D Generation

  50. An Automated Thickness Evaluation Procedure Using an Integrated Structured Light 3D Camera in a Robotic Bioprinting Framework

    Sep 14, 2026Ehsan Zobeidi, Omid Rezayof, Farshid Alambeigi3D Generation

  51. GeomVLA: Unifying Scene, Motion, and Action in 3D

    Sep 12, 2026Ziyin Xiong, Nikolaos Gkanatsios, Moritz Reuss +1Perception PipelineHuman Motion Prediction

  52. UBone3D: Physics-Rectified Conditional Flow Matching for Anatomical 3D Shape Completion from Ultrasound

    Sep 11, 2026Weiying Chen, Yuchong Gao, Siyuan Li +3UltrasoundPoint Clouds

  53. MHE-Former: Multi-Hypothesis Transformers via Entropy Maximization for 3D Mesh Recovery

    Sep 11, 2026Boshu Jia, Rongyu Chen, Linlin Yang +9Human Mesh Recovery3D Hand

  54. Scale-Aware 3D Deep Learning for Robust Brain Metastasis Detection in Multimodal MRI

    Sep 9, 2026Sylvain Jaume, Hongming Wang, Simon K. WarfieldBrain Tumor SegmentationMagnetic Resonance Imaging

  55. Programmable World Model

    Sep 9, 2026Zheng-Hui Huang, Guixu Lin, Jiacheng Lin +8Video World ModelsWorld Models