LLM Alignment

LLM: Large Language Model

Latest papers 422

All topics
CardsList
  1. A Recipe for Long-Context Reasoning in Large Language Models via On-Policy Optimization and Distillation

    Date pendingMiguel Moura Ramos, Duarte M. Alves, André F. T. MartinsLLM AlignmentRL for Language Model Reasoning

  2. Beyond Single-Negative Preference: Multi-Negative DPO for LLM-Centric Historical Entity Linking

    Date pendingTien Nam Nguyen, Emanuela Boros, Ahmed Hamdi +3LLM AlignmentDirect Preference Optimization