Skip to content
KnoAI 技术站
搜索文档
K
Main Navigation
首页
🎮 游戏
解决方案
k8s
零基础教材
进阶教材
RKE2 实战
大规模集群
K3s + Rancher Prime
— 专题深入 —
污点与容忍
K8s 网络与 DNS
Service 网络
大模型
大模型部署运维
LLM 零基础到精通
— GPU & 算力 —
GPU 集群运维
K3s+HAMi vGPU 实战
实战
云平台运维实战
故障案例
运维平台
🤖 rebot 每日文章
RKE2 部署手册
🎯 面试专区
更多
NFS 高可用存储
Traefik 网关实战
安全与权限
DevOps 基础工具
Harvester HCI 超融合
虚拟机管理
工具
Open WebUI
Ollama API
GPU 监控
Harvester HCI
主题
菜单
回到顶部
本页目录
大模型部署运维
大模型部署与运维实战:V100 多卡/多节点 vLLM 集群、AMD 消费卡本地推理与微调(LoRA/QLoRA)、MoE offload 部署的完整落地方案。
文档导读
GLM-5.2 模型部署交付完整操作文档
GLM-5.2(MTP-Mix)部署教程、性能优化与压测方案
AMD 24G 显卡 + 256G 内存 MoE 模型部署指南
AMD 24G + 256G 工作站模型微调(炼丹)计划与实操手册
6×(8×V100 32G + 200G 网卡)大模型集群落地方案
V100×8(32G)+ vLLM 部署 Qwen3.5-27B 实战记录
vllm-readme