cs.CVSep 12, 2026

SignMimic: Robust High-Quality Sign Language Motion Generation via Human-Shape-Oblivious Pose Transfer Guidance

Authors: Zhewen He, Junyi Yu, Haomian Huang, Zhenhua Li, Yi Fang

Organizations: New York University Abu Dhabi · ChatSign Technology

Abstract

We study the challenge of sign language video mimicking: given a driving video and a single reference frame, synthesize a video where the target signer reproduces the source motion while preserving identity and linguistic form. Prior pipelines entangle rigid motion, non-rigid deformation, and view-dependent completion in a monolithic generator, causing handshape drift and spatio-temporal instability. We present SignMimic, which (i) applies a TNet-based model to study SE(3) rigid canonicalization to stabilize global pose, (ii) performs non-rigid adaptation in a canonical space to preserve fine-grained articulators (hands/face) and coarticulation via NIF2D, and (iii) uses Pose-MAE-style completion before conditional video diffusion. This factorization injects geometric and linguistic priors, yielding shape and spatio-temporal consistency. On several large-scale datasets (ASL 50K, How2Sign, CSL News), SignMimic achieves state-of-the-art-level performance on video quality, identity similarity, and frame continuity while also achieving minimal loss when performing back translation (SLT) on generated videos. Ablations confirm the role of rigid canonicalization, non-rigid adaptation, and completion. Code is available at https://anonymous.4open.science/r/UniSignMimicTurbo-6088; model checkpoints and video examples will be released.

Figures & tables

Explore similar work

CardsList
  1. SignRefine: Adapting Foundational Video Models for Sign Language Generation

    Sep 8, 2026Anton Pelykh, Edward Fish, Ozge Mercanoglu Sincan +1Sign Language TranslationOnline Signature Verification

  2. SignRR: Retrieve and Refine Real Motion for Sign Language Production

    Aug 28, 2026Fidel Omar Tito Cruz, Angie Sanchez Marquina, Summy Farfan +1Sign Language TranslationObject Articulation

  3. Physics-Informed Diffusion for Biomechanically Plausible 3D Sign Language Generation

    Jul 16, 2026Emanuele Colonna, Moises Diaz, Gennaro Vessio +2Contrastive AlignmentMotion