免费编程教程

二进制授权

在 Kubernetes 中使用准入控制器强制验证镜像签名。

13 0 0
2026-07-04
TFLite 移动端部署

转换 TensorFlow 模型为 TFLite 格式,在手机上运行高效推理。

22 0 0
2026-07-02
模型量化与压缩

将模型权重转换为低精度,使用 llama.cpp 或 GPTQ 在消费级硬件运行。

28 0 0
2026-07-02
Terraform 云部署

使用 Terraform Cloud 或 Backend 存储状态,模块化代码复用。

19 0 0
2026-07-01
Ray Serve 部署

使用 Ray Serve 将 ML 模型封装为服务,支持在线更新、流量拆分和自动扩缩,与 Ray 训练无缝对接。

21 0 0
2026-06-29
手机端 LLM 部署实例

实践在 Android 或 iOS 设备上运行量化后的大模型,如使用 MLCChat 或 llama.cpp 的移动端口。

12 0 0
2026-06-27
大模型压缩到移动端

综合应用量化、剪枝、蒸馏和层融合等技术,将大模型压缩到可在手机上实时运行的尺寸。

14 0 0
2026-06-27
本地模型微调实战

在本地 GPU 环境下完整复现大模型微调过程,涵盖数据收集与清洗、训练配置、损失监控与模型导出。

27 0 0
2026-06-22
深度学习编译器 TVM

掌握 Apache TVM 的编译流程,将模型从高级框架编译为目标硬件的高效代码,通过自动调优实现极致性能。

20 0 0
2026-06-21
YOLOv8 应用

使用 Ultralytics YOLOv8 进行目标检测、实例分割和姿态估计,学习数据配置、模型训练与导出到 ONNX 等部署格式。

29 0 0
2026-06-20
HTTPS 证书配置

在 Nginx/Apache 上安装 SSL/TLS 证书,启用 HTTPS 并强制跳转。

20 0 0
2026-06-18
BentoML 模型打包

使用 BentoML 将任意框架模型打包为标准化 bento,并通过 BentoServer 和容器一键部署为高性能推理 API,简化工程化流程。

20 0 0
2026-06-14
模型压缩与部署

总结模型压缩技术栈,串联量化、剪枝、蒸馏和硬件特定优化,设计适配服务端、边缘与移动端的轻量级部署方案。

33 0 0
2026-06-14
llamafile 单文件分发

学习如何使用 llamafile 将 LLM 权重和运行时打包为单个多平台可执行文件,一键在 Windows、macOS 和 Linux 上运行大模型。

31 0 0
2026-06-14
ArgoCD GitOps

使用 ArgoCD 实现以 Git 仓库为单一事实来源的 Kubernetes 应用自动同步与部署。

23 0 0
2026-06-13
Kubernetes 集群部署

使用 kubeadm 工具部署生产级 Kubernetes 集群,包含控制平面、网络插件及高可用配置。

22 0 0
2026-06-13
Docker 容器化应用部署入门到实践

从零掌握 Docker 核心概念,编写高效 Dockerfile,使用 Docker Compose 编排多服务应用,并优化镜像体积与构建速度。

25 0 0
2026-06-12