Text-Driven

Momentum

3 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 28

All topics
CardsList
  1. SuperMotion: Source-Preserving Denoising for Text-Driven Human Motion Editing

    Oct 1, 2026Fa-Ting Hong, Peter WonkaDiffusion-Based Image EditingText-To-Motion Generation

  2. VTR-Bench: A Systematic Benchmark for Evaluating Visual Text Rendering in Video Generation

    Oct 1, 2026Yu Huang, Jungang Li, Zhiyuan Wang +8Text-To-Video Generation ModelVideo Generation

  3. FocusVTC: Efficient and High-Performance Visual Text Compression with Adaptive Resolution

    Sep 29, 2026FangZhi Zhong, Xuerui Qiu, Yuqi Pan +4Text-Driven

  4. When Text Matters: Design Principles for Visual Token Pruning in Vision-Language Model

    Sep 28, 2026Minchan Kang, Kyeonghye Park, Seoyoung Cho +2Visual Token PruningRecent Vision-Language Models

  5. Compile by Training: Turning Natural-Language Specifications into Local Neural Functions

    Sep 3, 2026Yuntian Deng, Pengyu Nie, Stuart ShieberNatural LanguageText-Driven

  6. Subjective Multi-Bias Detection with Large Language Models

    Aug 10, 2026Ruiyu Li, Zhiying ZhuLarge Language Model BiasText Corpora

  7. Text Dictates, Music Decorates: Energy-based Attention for Editable Dance Motion Generation

    Jun 22, 2026Seong Jong Yoo, Siyuan Peng, Felix Gu +2DuetDiffusion Transformers

  8. Text2DSL: LLM-Based Code Generation for Domain-Specific Languages

    Jun 21, 2026Alexander V. Kozachok, Alexander M. Nazimov, Shamil G. MagomedovCode GenerationDomain-Specific Language

  9. Context-Aware Distillation and Ablation for Text2DSL

    Jun 21, 2026Alexander V. Kozachok, Alexander M. Nazimov, Shamil G. MagomedovText-DrivenDomain-Specific Language

  10. HDSL: A Hierarchical Domain-Specific Language for Structured 3D Indoor Scene Generation and Localized Editing with LLM Agents

    Jun 8, 2026Letian Li, Chao Shen, Shuzhao Xie +63D Scene GenerationIndoor Scene Generation

  11. MIND: Multi-Scale Intent Diffusion for Text-Driven Physics-Based Humanoid Control

    May 25, 2026Bin Li, Ruichi Zhang, Han Liang +4Full-Body Humanoid ControlHuman Motion Generation

  12. Structure Retention in Embedding Spaces as a Predictor of Benchmark Performance

    May 21, 2026Amanda Myntti, Jenna Kanerva, Veronika Laippala +1Text EmbeddingsIndependent Component Analysis

  13. TextReg: Mitigating Prompt Distributional Overfitting via Regularized Text-Space Optimization

    May 20, 2026Lucheng Fu, Ye Yu, Yiyang Wang +4OverfittingText-Driven

  14. Assessing socio-economic climate impacts from text data

    May 20, 2026Mariana Madruga de Brito, Brielen Madureira, Taís Maria Nunes Carvalho +15Disaster ResponseText-Driven

  15. HRM-Text: Efficient Pretraining Beyond Scaling

    May 20, 2026Guan Wang, Changling Liu, Chenyu Wang +6Large Language Model PretrainingPretraining

  16. Subject-level Inference for Realistic Text Anonymization Evaluation

    Apr 23, 2026Myeong Seok Oh, Dong-Yun Kim, Hanseok Oh +6AnonymizationTamper Localization

  17. Decoding Text Spans for Efficient and Accurate Named-Entity Recognition

    Apr 22, 2026Andrea Maracani, Savas Ozkan, Junyi Zhu +2Named-Entity RecognitionInformation Extraction

  18. Text-to-Distribution Prediction with Quantile Tokens and Neighbor Context

    Apr 22, 2026Yilun Zhu, Yuan Zhuang, Nikhita Vedula +6Multi-Quantile RegressionQuantile Regression

  19. Do LLMs Need to See Everything? A Benchmark and Study of Failures in LLM-driven Smartphone Automation using Screentext vs. Screenshots

    Apr 20, 2026Shiquan Zhang, Tianyi Zhang, Le Fang +3Large Language Models FailDial

  20. DanceCrafter: Fine-Grained Text-Driven Controllable Dance Generation via Choreographic Syntax

    Apr 20, 2026Hang Yuan, Xiaolin Hu, Yan Wan +8Human Motion GenerationDuet

  21. FunHOI: Annotation-Free 3D Hand-Object Interaction Generation via Functional Text Guidance

    Feb 28, 2025Yongqi Tian, Xueyu Sun, Haoyuan He +2Hand-Object Interaction DetectionRobotic Grasping

  22. Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs

    Date pendingGuiqiu Liao, Matjaz Jogan, Daniel A. HashimotoLong Visual-Token SequencesMultimodal Large Language Models