本栏目以服务器或集群上的自托管部署为主,H3 页面还提供 ComfyUI 本地工作流路径。你需要自行准备硬件、运行推理环境、按需配置访问控制并实施内容安全措施。需要托管服务、弹性扩缩容或 MiniMax 平台完整能力时,请使用 MiniMax API。
选择模型
状态表示本文档部署基线的成熟度,不表示模型本身的产品生命周期:
- Stable:使用固定版本的运行时,并提供可复现的参考命令。
- Preview:已有官方部署路径,但上游安装方式或部分能力仍在变化。
- Experimental:依赖预发布运行时,或部分硬件组合尚未完成端到端验证。
自托管部署的边界
自托管后,模型权重、输入数据和推理服务运行在你控制的基础设施上,同时也意味着:- 你负责容量规划、扩缩容、监控、故障恢复和升级。
- 快速开始默认只监听本机;对外提供服务前,需要配置鉴权、TLS、网络隔离和远程媒体访问限制。
- 开放权重不包含 MiniMax 平台的托管文件、缓存、内容安全和平台专属工作流。
- 社区量化、转换权重和其他推理框架不属于本栏目已验证范围,除非模型页明确列出。
部署前准备
- 阅读目标模型的 License、开放范围和已验证能力。
- 按模型页准备指定的 GPU、主机内存、磁盘、驱动和 CUDA 环境。
- 固定模型 revision、推理框架版本或镜像 digest,不要在生产环境跟随
main、dev或latest漂移。 - 准备 Hugging Face 缓存或离线权重;使用中国大陆镜像时,以模型页列出的官方入口为准。
- 先完成健康检查和最小请求,再进行量化、并行、卸载或吞吐优化。