模型配置
模型是工作流、对话流、智能体与知识库的能力底座。本篇介绍如何在蓝域(LanSphere)中接入模型供应商、管理可用模型、设置系统默认模型,以及保障调用稳定性的配置方法,并给出按场景选型的建议。适合管理员与所有者阅读。
提示:「模型列表」的查看面向开发人员及以上角色;凭证管理、模型增删与默认模型设置仅管理员和所有者可用。
入口
个人中心 → 系统设置 →「模型列表」。
模型列表按供应商分组展示已接入的模型,包含模型名称、模型类型与启用状态。
添加供应商凭证
- 在模型列表中找到目标供应商,点击「设置」或「添加凭证」;
- 填写该供应商的 API Key 等凭证信息(部分供应商页面提供凭证获取指引,按页面提示完成);
- 保存后,该供应商下的模型即可在平台内使用。
注意:API Key 是调用模型服务的计费凭证,请妥善保管,不要泄露给无关人员。凭证在平台内加密存储,列表中不明文展示。
管理模型
- 添加模型:在供应商卡片中选择需要使用的模型并启用;
- 启用 / 停用:停用后,该模型不再出现在应用编排的模型选择列表中,已引用该模型的应用需切换其他模型后再运行;
- 删除凭证:删除后该供应商下所有模型不可用,请确认无应用依赖后再操作。
系统默认模型
平台为不同用途分别提供默认模型设置,未在应用中单独指定模型时按默认模型执行:
| 默认模型 | 用途 |
|---|---|
| 默认对话模型 | 工作流与对话流的大模型节点、智能体推理等生成场景 |
| 向量模型 | 知识库文档分段向量化与语义检索 |
| 重排序模型 | 知识库召回结果的精排,提升检索准确度 |
默认模型仅管理员和所有者可设置。调整默认对话模型后,新建应用与新节点按新默认执行;已配置模型的既有应用不受影响。
负载均衡与稳定性
针对生产环境的高频调用,平台提供两项保障能力:
- 多密钥负载均衡:为同一模型配置多个 API Key,调用按权重在各 Key 之间分担,避免单个 Key 触发供应商的频率限制。例如为同一模型配置两个 Key,可按 6:4 分配调用量。
- 超时与重试:为模型调用设置超时时间与失败重试次数,供应商服务抖动时自动重试,提升应用运行稳定性。
按场景的选型建议
不同场景对模型能力的要求差异较大,建议按以下思路选型:
| 场景 | 建议 |
|---|---|
| 复杂推理、长文撰写、数据分析 | 选择推理与长文本能力更强的高档位模型 |
| 高频简单问答、格式转换、意图识别 | 选择响应快、成本低的轻量模型,兼顾速度与费用 |
| 知识库语义检索 | 向量模型与重排序模型搭配使用,召回阶段保证覆盖、精排阶段保证准确 |
| 对外服务的生产应用 | 优先选择服务稳定性高的模型,并配置多 Key 负载均衡 |
提示:正式选用前,建议在应用编排页对候选模型进行实际问题的调试对比,以真实业务问题的回答质量作为选型依据。
常见问题
| 问题 | 排查方向 |
|---|---|
| 应用中选不到某个模型 | 检查模型列表中该模型是否已启用、供应商凭证是否有效 |
| 调用频繁失败 | 检查 API Key 额度与频率限制,配置多 Key 负载均衡或增大重试次数 |
| 知识库检索效果差 | 确认向量模型已正确配置,尝试开启重排序模型 |

