Skip to content
KnoAI 技术站
搜索文档
K
Main Navigation
首页
解决方案
K8s 运维教程
零基础教材
进阶教材
RKE2 实战
大规模集群
专题深入
污点与容忍
K8s 网络与 DNS
Service 网络
GPU 集群运维
大模型部署
运维实战
云平台运维实战
运维平台
虚拟机管理
故障案例
RKE2 部署手册
主题
菜单
回到顶部
本页目录
大模型部署运维
大模型部署与运维实战:V100 多卡/多节点 vLLM 集群、AMD 消费卡本地推理与微调(LoRA/QLoRA)、MoE offload 部署的完整落地方案。
文档导读
GLM-5.2(MTP-Mix)部署教程、性能优化与压测方案
AMD 24G 显卡 + 256G 内存 MoE 模型部署指南
AMD 24G + 256G 工作站模型微调(炼丹)计划与实操手册
6×(8×V100 32G + 200G 网卡)大模型集群落地方案
V100×8(32G)+ vLLM 部署 Qwen3.5-27B 实战记录