Multimodal Foundation Models

Latest papers 303

All topics
CardsList
  1. Do Multimodal LLMs See Before They Read? Diagnosing Contextual Sycophancy

    Date pendingYi-Cheng Lai, Hen-Hsen HuangLLM SycophancyEvidence-Grounded Reasoning

  2. Video2Reaction: Training Foundation Video Models to Predict Audience Reaction

    Date pendingSidong Zhang, Trang Nguyen, Shiv Shankar +4VLM AdaptationVideo-Language Models

  3. Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization

    Date pendingAyan Majumdar, Shounak Paul, Pushpdeep Singh +6VLM EvaluationLLM Prompting