免费编程教程

Ollama 本地 LLM 运行

Ollama 一条命令运行本地 LLM 模型。模型文件管理。OpenAI 兼容 API 接口。本文用 Ollama 运行 Qwen 和 Phi 模型。

15 0 0
2026-07-13
Dify 开源 LLM 应用开发平台

Dify 是开源 LLM 应用平台可视化编排 Prompt 和 RAG 工作流。支持多模型 Provider。内置 Agent 和工具调用。本文搭建一个知识库问答应用。

23 0 0
2026-07-10
大模型微调 LoRA

使用 LoRA 技术在小数据上微调大模型,降低显存占用。

16 0 0
2026-07-02
LangChain 应用开发

使用 LangChain 连接模型、工具和记忆,构建复杂的语言应用。

22 0 0
2026-07-02
提示词工程 Prompt Eng

学习 Chain-of-Thought、Few-Shot 等技巧,获取大模型最佳输出。

25 0 0
2026-07-02
生成式 AI 入门

了解生成式 AI 的分类,包括语言模型、图像生成与多模态。

14 0 0
2026-07-02
大模型成本监控

建立大模型 API 调用的成本追踪仪表板,按用户、应用和模型维度统计 Token 消耗和费用。

15 0 0
2026-06-29
负载均衡 LLM

使用网关或反向代理将大模型推理请求均衡地分发到多个推理实例,配合健康检查和会话保持。

17 0 0
2026-06-29
法律文书生成

使用大语言模型根据关键信息自动生成标准格式的法律文书草稿,提升法律从业者效率。

24 0 0
2026-06-26
结构化提取指令

设计有效的指令和 Schema 约束,引导大模型从任意非结构化文本中提取并输出预定义结构的 JSON。

25 0 0
2026-06-23
电子表格 LLM

探索专门处理电子表格的模型,如 SheetGPT,实现根据自然语言指令生成公式、填充数据和图表。

18 0 0
2026-06-23
语义缓存 GPTCache

部署 GPTCache 对 LLM 请求进行语义级缓存,通过向量相似度匹配历史响应,大幅减少重复请求的 API 调用费用与响应延迟。

20 0 0
2026-06-14