宪法 AI Constitution AI
学习 Anthropic 的宪法 AI 方法,通过一套自然语言原则让模型自我批评和修订输出,实现基于规则的对齐。
11
0
0
2026-06-30
RLHF 人类反馈强化学习
完整梳理 RLHF 三阶段:监督微调、奖励模型训练与 PPO 强化学习,理解如何利用人类偏好数据让大模型输出更符合期望与价值观。
44
0
0
2026-06-13