Stanford Alpaca 微调方法的局限
Stanford Alpaca 用 Self-Instruct 方法用 GPT API 生成训练数据微调 LLaMA。但生成的数据质量问题限制了模型效果。本文分析 Alpaca 方法的优缺点和改进方向。
14
0
0
2026-07-09
合成数据生成 Self-Instruct
深入 Self-Instruct 算法,让大模型根据少量种子任务自主生成新的指令-输入-输出三元组,并经过过滤构建大规模合成指令数据集。
37
0
0
2026-06-14