场景概览 - 发布模型
帮助模型提供方将上游模型发布为可体验、可调用、可审核的模型服务。
适用角色
- 模型提供方
- 运营管理员,如涉及审批或预设置
场景目标
用户完成本场景后,可以发布一个可体验、可调用、可审核的模型服务。
场景流程
主线: 准备发布条件 → 配置并测试模型 → 提交审核 → 上架并验证调用
| 阶段 | 核心结果 |
|---|---|
| 1. 准备发布条件 | 元模型、来源、模板、标签和币种可用 |
| 2. 配置并测试 | 模型信息、协议、计费和限流通过校验 |
| 3. 提交审核 | 发布申请进入审核流程并可跟踪处理意见 |
| 4. 上架验证 | 目标用户能找到、体验并调用已发布模型 |
开始前准备
- 已完成模型发布预设置
- 已确定使用平台托管部署还是 BYOK;BYOK 已准备第三方接口地址、模型标识、协议和密钥
- 已确认计费和限流策略
推荐阅读顺序
文档索引
| 文档 | 说明 |
|---|---|
| 发布公有模型 | 选择平台托管或 BYOK,从填写模型信息、协议测试到提交审核的通用发布流程 |
| 发布文本模型 | 文本 / 对话模型发布;从模型来源、协议测试到计费和限流 |
| 发布多模态(对话)模型 | 多模态对话模型发布;支持 OpenAI-ChatCompletions / OpenAI-Responses / Anthropic-Messages 协议;阶梯计费 + 缓存命中独立计价 + 联网搜索 |
| 发布嵌入模型 | 嵌入模型发布;仅 OpenAI-Embeddings 协议;输入模态为文本;无输出模态 / 输出 Token 限制 / 回调配置 |
| 发布图片模型 | 图片模型发布;OpenAI-Images 协议;支持按张计费(识别字段 n);可配置异步返回结果解析 |
| 发布语音模型 | 语音(TTS)模型发布;OpenAI-Audio 协议;按字符计费;支持异步返回结果解析 |
| 发布视频模型 | 视频模型发布;通常为异步调用,需配置回调地址、厂商模板与 6 项返回结果解析;按分辨率等多维组合定价 |
| 我的模型 | 查看模型发布入口、字段和操作说明 |
相关场景
- 发布模型(预设置):发布前需由运营管理员完成元模型、模型来源、模板、标签、币种与审核配置
- 模型发布审批:提交审核后由管理员完成审批流程
- 发布聚合模型:聚合模型路由策略的独立场景说明
- 模型的体验与调用:发布完成后,最终用户如何检索、体验与 API 调用
完成检查
用途: 以下检查是本场景的退出条件,用于判断是否已经取得可观察、可复核的结果,以及是否可以进入下一场景。它不是操作步骤的重复;任一项不满足时,请返回对应功能文档的“常见失败分支”排查。
| 检查项 | 通过标准 |
|---|---|
| 1 | 协议测试通过,模型来源和请求参数可用。 |
| 2 | 计费、限流、发布区域和发布时间符合计划。 |
| 3 | 提交审核后能查看审批状态和处理意见。 |
| 4 | 发布完成后,目标用户能找到、体验并调用模型。 |
常见失败分支
| 现象 | 优先检查 |
|---|---|
| 无法选择元模型或模型来源 | 运营方预配置、状态和账号可见范围 |
| 协议测试失败 | 接口地址、请求头、模型源 ID、协议和返回解析 |
| 无法提交审核 | 必填项、计费、限流、发布区域和测试状态 |
| 发布后不可见 | 审批状态、发布时间、公有/私有范围和租户权限 |