alignment-handbook

對齊語言模型與人類及AI偏好的穩健配方

alignment-handbook 是什麼?

對齊語言模型與人類及AI偏好的穩健配方。提供可複現的策略與模組化元件,支援偏好最佳化及純粹 RLHF 等各種訓練方法。授權條款:Apache-2.0。