推理模板
概念介绍
推理模板为推理服务预设可复用的运行配置。创建 推理部署 时选择模板,即可复用类型、镜像、CPU、内存、GPU、数据盘、挂载模型与端口映射等规格。
与部署、模型、镜像的关系如下:
- 推理部署:基于模板创建。修改模板后,对已关联的已有部署执行 重启,新配置即可生效;新建部署会直接使用最新模板。
- 模型文件:经 导入模型(从模型库 / Hugging Face / ModelScope / 本地路径)生成模板时,通常会一并处理可挂载的模型相关资源。
- 推理镜像:须与模板类型一致。
控制台路径为 人工智能 → 推理 → 推理模板。新增模板通过 导入模型 完成,列表不提供「新建」。端到端导入与部署见 快速开始。
常用操作
导入模型
列表主入口。可选从模型库、Hugging Face、ModelScope 或本地路径导入,生成推理模板。

导入抽屉中可配置下列字段(对已有模板执行 修改 时,字段含义相同)。类型须与镜像、挂载模型一致,否则无法保存。

- 指定项目:模板所属项目;修改时通常只读。
- 名称:模板名称;支持
#有序后缀;修改时通常只读。 - 类型:推理引擎类型;须与镜像、挂载模型一致。从 Hugging Face / ModelScope / 本地路径导入时,可在 导入配置 中选择 vLLM 或 SGLang(默认 vLLM);从模型库导入或 修改 已有模板时通常只读。
- 镜像:推理容器运行时镜像。导入时可选手动/自动来源:
- 本地镜像:选用当前环境中已存在的推理镜像。