Multi-Objective Language Model Alignment

Latest papers 62

All topics
CardsList
  1. Navigating the Alignment-Calibration Trade-off: A Pareto-Superior Frontier via Model Merging

    Oct 20, 2025Tiancheng Hu, Benjamin Minixhofer, Nigel CollierLLM AlignmentModel Calibration

  2. Adaptive Helpfulness-Harmlessness Alignment with Preference Vectors

    Apr 27, 2025Ren-Wei Liang, Chin-Ting Hsu, Chan-Hung Yu +6LLM AlignmentLLM Safety Alignment