聊天模型配置
适用场景
模型管理决定前台聊天模型的名称、上游 model 值、算力消耗和使用哪个 API-KEY。AI 生图与视频模型不在这里添加。
前置条件
先完成API-KEY 配置,并在上游模型列表确认准确的模型 ID。
后台入口
进入 模型管理(/admin/chat/model),点击 新增。

截图用 gpt-4o-mini 演示字段关系。实际配置时,模型值、最大响应、最大上下文和绑定 API-KEY 必须以你的上游渠道为准。
操作步骤
- 选择后台提供的模型类型。
- 模型名称填写用户可见名称,例如
GPT-4o Mini。 - 模型值填写上游要求的精确 ID,例如
gpt-4o-mini。 - 设置每次请求消耗的算力。
- 绑定刚创建的
对话类型 API-KEY。 - 保持启用并提交。
- 打开前台
/chat,新建对话并选择该模型验证。
字段说明
| 字段 | 说明 |
|---|---|
| 模型类型 | 控制模型在前端的交互类别 |
| 模型名称 | 用户看到的名称,可使用中文 |
| 模型值 | 原样发送给上游的 model,必须精确匹配 |
| 消耗算力 | 单次聊天请求的基础扣费 |
| 绑定 API-KEY | 指定调用渠道,只能绑定已有凭证 |
| 启用状态 | 关闭后前台不可选 |
编辑页还会根据模型类型展示最大响应长度、上下文长度、创意度或音色等选项。不了解供应商限制时保留合理默认值,不要把上游上下文窗口全部用于单次回复。
验证方法
在无历史消息的新对话中发送短问题。成功标准是:前台能选中模型、收到完整回复、算力日志产生记录、中转站调用日志显示相同模型值。
常见错误
- 前台找不到模型:检查启用状态和绑定的 API-KEY 是否启用。
- model not found:模型值写成了展示名称,或中转站未开放该模型。
- 回复中断:降低最大响应长度,检查上游余额和超时日志。
- 扣费不合理:模型页的消耗算力是业务定价,不等同于上游货币价格,需按运营成本换算。
