免费编程教程

大模型社会影响

全面审视大规模语言模型的广泛应用对劳动市场、信息传播、文化多样性和社会权力结构带来的变革与挑战。

31 0 0
2026-06-30
弱到强泛化

利用弱小监督信号训练的强模型可能超越其监督者的表现,探索此现象在超人类模型对齐中的潜力。

18 0 0
2026-06-30
模型编辑技术

学习在不重新训练的情况下,对大语言模型中的特定事实或行为进行精准的插入、修改和删除。

14 0 0
2026-06-29
内存优化技巧

综合应用梯度检查点、CPU 卸载、混合精度训练和优化器状态分片,突破 GPU 显存限制。

14 0 0
2026-06-28
AI 政策解读

借助大语言模型自动梳理和解读各国 AI 相关政策与法规,提炼核心要求与合规要点。

21 0 0
2026-06-26
剧情生成

使用大语言模型为游戏或互动小说生成连贯、引人入胜的剧情、对话和分支叙事树。

21 0 0
2026-06-25
AI 在游戏 NPC

从经典游戏 AI 技术(FSM、行为树)到用大模型驱动 NPC 产生自然对话和自适应行为。

22 0 0
2026-06-25
大模型处理表格

学习将表格数据转换为大模型可理解的序列化文本,或设计结构感知的编码器处理表格任务。

19 0 0
2026-06-23
联邦大模型微调

将联邦学习应用于大模型微调,利用本地数据更新并在服务端聚合,实现隐私保护的个性化模型适配。

21 0 0
2026-06-22
数学推理大模型

探索专门增强数学推理能力的大模型,了解其训练数据、思维链和形式化验证等提升手段。

21 0 0
2026-06-22
混元大模型

了解腾讯混元大模型的技术架构,包括其 MoE 结构、多模态能力和在腾讯生态各产品中的落地实践。

21 0 0
2026-06-22
Qwen 模型系列

了解阿里通义千问 Qwen 系列模型,包括基础语言模型、MoE 和视觉语言版本,以及其训练特色与使用。

33 0 0
2026-06-22
大模型训练稳定性

分析大模型训练中常见的损失突刺与发散问题,学习通过降低学习率、回滚检查点、修正数据等策略恢复训练并提升整体稳定性。

29 0 0
2026-06-14
Megatron-LM 训练框架

解读 NVIDIA Megatron-LM 如何精巧地组合张量并行、流水线并行和数据并行,实现 GPT、T5 等架构的高效万卡级训练。

31 0 0
2026-06-14
大模型评估框架 LM-Eval-Harness

使用 EleutherAI 的开源评估框架,一站式在大量标准基准(如 MMLU, ARC, HellaSwag)上对大模型进行零样本和少样本自动化测试。

32 0 0
2026-06-14
函数调用 Function Calling

深入 LLM 的 Function Calling 能力,如何定义 JSON Schema 函数描述,稳定输出结构化调用参数,将模型连接至搜索、计算等外部工具。

33 0 0
2026-06-14
大模型安全性评估

了解大模型安全评估的多维度指标,使用 Toxicity、Bias、Truthfulness 等基准对模型进行系统性安全审计,支撑上线前风险把控。

30 0 0
2026-06-13
低秩分解 LoRA 深入

深度解析 LoRA 的数学原理:通过低秩矩阵分解近似权重更新,在冻结原模型参数的情况下实现高效的大模型微调与任务适配。

24 0 0
2026-06-13