模型与厂商¶
模型设置负责厂商与模型表,功能分配负责每个任务的候选模型;改完点「保存配置」,
再点「重启后端」才生效。文件本体是 config/models.toml 与 config/providers.toml,
字段语义见配置体系。
页面顶部三个按钮贯穿两个标签页:「重新读取」丢弃当前改动,「保存配置」写文件, 「重启后端」弹确认框后重启后端进程并刷新页面。顶部还有两个视觉开关:「桌面视觉」 控制桌宠截图识别,「QQ 图片识别」控制聊天图片的视觉描述;两者都要求 vision 任务 里有可用的视觉模型。
模型设置¶
左栏是厂商列表,显示名称、接口地址与名下模型数,「添加厂商」新增;点某一行选中它, 右栏顶部出现该厂商的卡片,四个按钮:
- 测试连接:用当前配置向厂商发一次真实请求,验证地址与 API Key 是否可用, 结果直接显示在页面上(例如「连通正常,API Key 有效」)。编辑中的草稿参数也能测, 保存前就能确认这组连接参数对不对。
- 拉取模型:向厂商查询可用模型列表,用于往模型表里挑标识符,不用手抄。
- 编辑:打开厂商对话框。可从预设模板自动填充地址与客户端类型,支持搜索;
客户端类型
openai覆盖绝大多数兼容接口;另有最大重试(默认 2)、超时(秒, 默认 30)、重试间隔(秒,默认 10)。API Key 有显示 / 复制按钮,保存后密钥留在 本机配置文件里。 - 删除:删除厂商;名下还有模型引用它时,配置校验不会放行。
右下是模型列表表格:使用状态(已使用 / 未使用——是否被某个任务候选引用)、模型 名称、模型标识符、提供商、视觉、思考、温度、输入 / 输出价格、操作。「搜索模型」按 名称或标识符过滤,「添加模型」新建,行内「编辑」打开完整对话框:
- 基本信息:模型名称(功能分配里显示的名字,需要唯一)、API 提供商、模型标识符
(厂商侧的真实模型 ID,可从拉取列表选择或手输)、视觉能力开关、思考模式开关
(控制请求体里的
enable_thinking,未显式设置时沿用模型默认)、输入 / 输出 价格。 - 高级设置:模型级温度覆盖(启用后压过功能分配里的任务温度)、模型级最大 token
(留空继承任务配置)、思考内容解析(解析思考字段 / 解析 think 标签 / 不解析,
只决定怎么读模型已返回的思考内容)、Embedding 维度(仅嵌入模型需要)、
extra_body(要透传给厂商请求体的额外参数,JSON 对象)。
加一个新模型的完整流程:先在厂商卡片点「拉取模型」确认该厂商真的提供这个标识符, 再点「添加模型」,选提供商、从标识符输入框旁的列表选中或手填,按需开视觉与思考, 保存;回到功能分配把新模型补进某个任务的候选。价格两列按厂商牌价填(单位是 元 / 百万 token),作记录与对照用。
功能分配¶
「模型类别」按钮列出全部十二个任务:日常对话 chat、行动决策 planner、回复生成 replyer、情景分析 scene、主动搭话 proactive、对话摘要 summary、日程安排 schedule、 屏幕视觉 vision、表达选择 expression、记忆抽取 memory、语音合成 tts、向量嵌入 embedding。每个按钮带当前候选预览、选模倾向(基线 / 宜快 / 重质量 / 专用)和候选 数量;候选为空的任务显示「未配置模型」,需要先在模型设置里建好模型再回来分配。
点进一个任务:
- 候选列表:
#1起排列。第一位是主力模型,后续是故障切换备用;每个槽位可 移除,底部下拉从未入列的模型里补。日常对话是基线任务——其它槽位留空时都继承 它,所以它要能决策、能写、能概括,只配这一个也能跑。 - 模型选择策略:按顺序优先(sequential)、随机选择(random)、负载均衡 (balance)。balance 按轮次稳定分摊给健康模型;顺序优先适合「主力加备用」。
- 采样参数:首字超时(毫秒)、慢响应(毫秒)、温度、最大 Token(0 表示不设 限)。模型级设置里显式覆盖过的温度,优先于这里的任务温度。
保存并重启后,启动横幅会按任务打印当前主力模型与备选数,可对照确认改动已生效; 某次调用实际用了哪个模型,在会话观察的分阶段调用记录里逐条可查。