Projection Heads

Momentum

1 paper in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 24

All topics
CardsList
  1. AHMAD: Adaptive Hybrid Multi-task Vision Learning with Assisted Distillation for Keypoint Detection

    Sep 28, 2026Mohammad Mahdi, Nedyalko Prisadnikov, Yuqian Fu +3Multi--Task LearningKeypoint Detection

  2. Sample, Simulate, Select: Physics-in-the-Loop Text-to-Motion for Humanoids Without Training

    Sep 22, 2026Raphael Memmesheimer, Sven BehnkeText-To-Motion GenerationHumanoid

  3. Resolution Meets Reduction: Efficient Visual Context for 3D Radiology Report Generation

    Aug 9, 2026Jonathan Suprijadi, Raphael Stock, Moritz Langenberg +10Radiology Report GenerationCone-Beam Computed Tomography

  4. Hear to See: Discerning Stateful Listening for Audio-Visual Instance Segmentation

    Aug 4, 2026Leiye Liu, Miao Zhang, Jiahong Jiang +7Video Object SegmentationAudio-Visual Consistency

  5. Progressive Decision-Making for Localizing Open-Ended AI-Generated Image Forgeries

    Jul 31, 2026Jingyi Hou, Xiaoxia Chen, Leyu Zhou +2ForgeriesLocalization

  6. MEUSLI: a Multilingual Projector for LLM-based ASR and Beyond

    Jul 24, 2026Lorenzo Concina, Seraphina Fong, Marco Matassoni +1Multilingual Automatic Speech RecognitionSpeech Translation

  7. The Twist Decomposition of Serial Robots Under Lower-Mobility Tasks

    Jul 21, 2026Luc Baron, Damien ChablatInverse KinematicsEnd-Effector Pose

  8. Ray-based phase error correction for miniaturized DOE projector-based FPP under single-directional hyperbolic projection

    Jul 16, 2026Seung-Jae Son, Yatong An, Jae-Sang HyunVision-Language Reprojection ConsistencyProjection Heads

  9. CARD: Cross-component Audio Representation Distillation for Encoder-Free Audio Captioning

    Jul 6, 2026Ganesh Pavan Kartikeya Bharadwaj Kolluri, Yuchen Zhang, Michael Kampouridis +1OpencodeSentence Encoders

  10. Text-to-Image Generation for Projector-Camera System Registration

    Jul 3, 2026Xinyu Chen, Yuqi Li, Jiabao Li +3Camera IntrinsicsProjection Heads

  11. Radial Basis Function Networks as Projection Heads in Self-Supervised Learning

    Jun 19, 2026Andreas Schliebitz, Heiko Tapken, Martin AtzmuellerSelf-Supervised LearningRadial Basis Function

  12. Neural Acquisition & Representation of Subsurface Scattering

    Jun 1, 2026Arjun Majumdar, Raphael Braun, Hendrik LenschSubsurface ScatteringSurface Reconstruction

  13. Projecting Latent RL Actions: Towards Generalizable and Scalable Graph Combinatorial Optimization

    May 19, 2026Franco Terranova, Guillermo Bernardez, Albert Cabellos-Aparicio +2Combinatorial OptimizationGraph Representations

  14. A More Word-like Image Tokenization for MLLMs

    May 18, 2026Hyun Lee, Hyemin Jeong, Yejin Kim +4Long Visual-Token SequencesVisual Tokenizers

  15. The Geometry of Projection Heads: Conditioning, Invariance, and Collapse

    May 16, 2026Faris ChaudhryProjection HeadsSelf-Supervised Learning

  16. Tracing the Arrow of Time: Diagnosing Temporal Information Flow in Video-LLMs

    May 8, 2026Peitao Han, Fei Cheng, Lis K. Pereira +2Fine-Grained Video UnderstandingSpatial Encoding

  17. Cross-Stage Coherence in Hierarchical Driving VQA: Explicit Baselines and Learned Gated Context Projectors

    Apr 24, 2026Gautam Kumar Jain, Carsten Markgraf, Julian StählerAva-VlmNatural Language Inference

  18. Local Neighborhood Instability in Parametric Projections: Quantitative and Visual Analysis

    Apr 23, 2026Frederik L. Dennig, Daniel A. KeimProjectionProjection Heads

  19. ProjLens: Unveiling the Role of Projectors in Multimodal Model Safety

    Apr 21, 2026Kun Wang, Cheng Qian, Miao Yu +6Multimodal Large Language ModelsProjection Heads

  20. Guided Prompt Evolution for Vision-Language Models Adaptation

    Mar 10, 2026Enming Zhang, Jiayang Li, Yanlong Wang +3Vision-Language Model AdaptationMultiple Prompt Learning Frameworks

  21. AdaDim: Dimensionality Adaptation for SSL Representational Dynamics

    May 18, 2025Kiran Kokilepersaud, Mohit Prabhushankar, Ghassan AlRegibSelf-Supervised RepresentationsSelf-Supervised Learning