模型管理

功能解释
模型管理分成两个层面:提供商 页签负责接入和维护模型服务,角色配置 页签负责把基础模型、复杂模型等角色绑定到具体 provider。它管的是“默认用谁来答、不同任务走什么模型”,不是某个单独任务的临时选择。
使用场景
- 需要给不同类型任务分配不同模型时。
- 想控制成本、上下文长度或推理能力时。
- 新接一个供应商,想先验证连接再投入使用时。
- 需要切换默认模型、调整上下文上限或更换鉴权方式时。
这类配置通常由管理员维护,尤其是当你需要统一基础回答和复杂推理的模型选择时。普通成员一般只会感受到模型变了、回答风格变了,不会直接改这里。
操作入口
进入模型管理页面后,先确认当前环境接了哪些提供商和模型,再决定是否要新增、切换角色或调整上限。页面里的三个高频动作是新增提供商、测试已保存配置、编辑已保存配置。

说明 测试按钮测的是已经保存的配置,不是弹窗里还没提交的临时输入。
使用方法
- 进入
提供商页签,确认列表里有没有你要用的供应商。 - 点击 添加提供商,把服务地址、密钥、模型名和协议填完整。
- 保存后先点 测试,确认连接成功再继续。
- 如果要微调配置,点 编辑 修改参数后再次测试。
- 切到
角色配置页签,把基础模型、复杂模型绑定到具体 provider,并设置上下文上限。 - 保存后用代表性问题验证效果,再决定是否放量使用。
实际使用时,通常先确认当前环境已经接了哪些提供商,再看这些提供商下有哪些模型可选。然后再把模型分到基础回答、复杂推理这类角色里。这样做的好处是,普通任务和更费脑子的任务可以走不同模型。
如果某个模型被停用,后续任务可能会切到备用配置;如果把 Token 上限调得太低,回答会变短,太高则会增加成本。
如果你在做环境切换或成本控制,先从模型管理下手通常最有效;如果只是某条回答有问题,先去看知识、技能或任务本身,未必是模型配置的问题。
新增供应商配置
先把通用字段填对,再按供应商补充接口地址、模型 ID 和鉴权方式。下面以豆包、通义千问、DeepSeek 三类常用供应商为例。
通用字段
| 字段 | 作用 | 常见填写方式 |
|---|---|---|
| 提供商名称 | 页面里的唯一名称,方便后续切换和排查 | 尽量短而明确,例如 doubao、qwen、deepseek |
| API 协议 | 指定这家供应商按什么兼容协议接入 | 大多数场景选 OpenAI 兼容 |
| 默认模型 | 该 provider 默认使用的模型 ID | 填官方给出的完整模型名,不要自己随意缩写 |
| API 密钥 | 访问供应商接口的凭证 | 先在平台上创建并复制 |
| 接口地址 | 接口根地址 | 按供应商文档填写兼容接口根路径 |
| 代理 | 需要走公司代理或本地代理时填写 | 直连可填 none,需要代理时填完整地址 |
| Wire API | 选择请求走 Chat Completions 还是 Responses API | 默认选 Chat Completions;明确支持 Responses 再切换 |
| 鉴权 Header | API Key 放在哪个 header 里 | 默认先用 Bearer;如平台要求再改成 x-api-key 或 api-key |
| 上下文长度 | 单次请求的最大上下文档位 | 选供应商官方支持的档位,不要盲目拉满 |
| Temperature | 生成随机性 | 不确定时可留空,沿用默认值 |
解析内联 <think> 标签 |
是否把 <think> 当作推理内容解析 |
只有模型真的输出这类标签时才勾选 |
豆包(Doubao)
前置准备
- 拥有火山引擎账号。
- 完成实名认证。
- 开通豆包大模型服务。
获取 API Key
- 登录火山引擎控制台。
- 在「开通管理」里开通豆包系列模型。
- 进入「API Key 管理」,创建 API Key 并立即复制保存。
在模型管理里填写
| 字段 | 值 |
|---|---|
| 提供商名称 | doubao |
| API 协议 | OpenAI 兼容 |
| 接口地址 | https://ark.cn-beijing.volces.com/api/v3 |
| 鉴权 Header | Bearer |
| 默认模型 | doubao-1.5-pro-32k-250115 |
常用模型 ID 参考:
| 模型 | 模型 ID | 上下文长度 |
|---|---|---|
| Doubao Seed 2.0 Pro | volcengine/doubao-seed-2.0-pro |
- |
| Doubao 1.5 Pro (32K) | doubao-1.5-pro-32k-250115 |
32K |
| Doubao 1.5 Pro (256K) | doubao-1.5-pro-256k-250115 |
256K |
| Doubao Lite 32K | doubao-lite-32k |
32K |
通义千问(Qwen)
前置准备
- 拥有阿里云账号。
- 开通阿里云百炼服务。
获取 API Key
- 进入阿里云百炼大模型服务平台并完成开通。
- 在右上角账号头像里打开「API-KEY 管理」。
- 点击「创建 API Key」,设置备注后创建并复制保存。
在模型管理里填写
| 字段 | 值 |
|---|---|
| 提供商名称 | qwen |
| API 协议 | OpenAI 兼容 |
| 接口地址 | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| 鉴权 Header | Bearer |
| 默认模型 | qwen-plus |
如果使用特定地域,Base URL 中可能需要包含业务空间 ID(WorkspaceId)。
常用模型 ID 参考:
| 模型 | 模型 ID | 说明 |
|---|---|---|
| Qwen3.7 Max | qwen3.7-max |
旗舰推理模型 |
| Qwen3.7 Plus | qwen3.7-plus |
多模态均衡款 |
| Qwen Plus | qwen-plus |
能力均衡,中等复杂任务 |
| Qwen Max | qwen-max |
千问系列效果最好 |
DeepSeek
前置准备
- 注册 DeepSeek 开放平台账号。
- 建议先充值足够余额,再开始测试调用。
获取 API Key
- 打开 DeepSeek 开放平台并登录。
- 进入控制台后点击左侧菜单「API keys」。
- 创建 API key 并立即复制保存。
在模型管理里填写
| 字段 | 值 |
|---|---|
| 提供商名称 | deepseek |
| API 协议 | OpenAI 兼容 |
| 接口地址 | https://api.deepseek.com |
| 鉴权 Header | Bearer |
| 默认模型 | deepseek-v4-pro |
常用模型 ID 参考:
| 模型 | 模型 ID | 说明 |
|---|---|---|
| DeepSeek V4 Pro | deepseek-v4-pro |
旗舰模型 |
| DeepSeek V4 Flash | deepseek-v4-flash |
轻量高速模型 |
| DeepSeek Chat(旧版别名) | deepseek-chat |
通用对话,旧别名 |
| DeepSeek Reasoner(旧版别名) | deepseek-reasoner |
推理专用,旧别名 |
deepseek-chat和deepseek-reasoner是旧版别名,建议新项目直接使用deepseek-v4-pro或deepseek-v4-flash。
保存和验证
- 先保存 provider,再点 测试。
- 测试通过后,再去改
角色配置。 - 角色配置里主要看两个东西:provider 和上下文上限。
- 保存后重新打开页面,确认配置还能回读出来。
- 如果测试失败,优先检查接口地址、密钥、鉴权 Header 和 Wire API。
不同供应商怎么用
- OpenAI 兼容类供应商:优先用平台提供的兼容接口地址,
API 协议选 OpenAI 兼容,鉴权 Header默认先用 Bearer。 - 如果供应商要求
x-api-key或api-key:在鉴权 Header里切过去,再点测试确认。 - 如果文档写的是 Responses API:把
Wire API切到 Responses,再验证保存后的调用链路。 - 如果模型会输出
<think>:打开内联 think 解析,避免正文把推理标记带出来。 - 如果同一供应商下有多条模型线:通常保持 provider 名称稳定,只替换默认模型和角色绑定。
联动价值
它和新建任务、技能管理、评测验证是连起来的。模型决定回答底层能力,评测负责看效果,任务负责实际使用。
操作后影响
- 切换默认模型后,新任务会按新配置执行。
- 调低 Token 上限可能让回答更短,调太高会增加成本。
- 停用模型后,依赖它的任务可能切到备用配置。