模型配置 | LanSphere 使用手册

模型配置

模型是工作流、对话流、智能体与知识库的能力底座。本篇介绍如何在蓝域(LanSphere)中接入模型供应商、管理可用模型、设置系统默认模型,以及保障调用稳定性的配置方法,并给出按场景选型的建议。适合管理员与所有者阅读。

提示:「模型列表」的查看面向开发人员及以上角色;凭证管理、模型增删与默认模型设置仅管理员和所有者可用。

入口

个人中心 → 系统设置 →「模型列表」。

模型列表按供应商分组展示已接入的模型,包含模型名称、模型类型与启用状态。

添加供应商凭证

  1. 在模型列表中找到目标供应商,点击「设置」或「添加凭证」;
  2. 填写该供应商的 API Key 等凭证信息(部分供应商页面提供凭证获取指引,按页面提示完成);
  3. 保存后,该供应商下的模型即可在平台内使用。

注意:API Key 是调用模型服务的计费凭证,请妥善保管,不要泄露给无关人员。凭证在平台内加密存储,列表中不明文展示。

管理模型

  • 添加模型:在供应商卡片中选择需要使用的模型并启用;
  • 启用 / 停用:停用后,该模型不再出现在应用编排的模型选择列表中,已引用该模型的应用需切换其他模型后再运行;
  • 删除凭证:删除后该供应商下所有模型不可用,请确认无应用依赖后再操作。

系统默认模型

平台为不同用途分别提供默认模型设置,未在应用中单独指定模型时按默认模型执行:

默认模型 用途
默认对话模型 工作流与对话流的大模型节点、智能体推理等生成场景
向量模型 知识库文档分段向量化与语义检索
重排序模型 知识库召回结果的精排,提升检索准确度

默认模型仅管理员和所有者可设置。调整默认对话模型后,新建应用与新节点按新默认执行;已配置模型的既有应用不受影响。

负载均衡与稳定性

针对生产环境的高频调用,平台提供两项保障能力:

  • 多密钥负载均衡:为同一模型配置多个 API Key,调用按权重在各 Key 之间分担,避免单个 Key 触发供应商的频率限制。例如为同一模型配置两个 Key,可按 6:4 分配调用量。
  • 超时与重试:为模型调用设置超时时间与失败重试次数,供应商服务抖动时自动重试,提升应用运行稳定性。

按场景的选型建议

不同场景对模型能力的要求差异较大,建议按以下思路选型:

场景 建议
复杂推理、长文撰写、数据分析 选择推理与长文本能力更强的高档位模型
高频简单问答、格式转换、意图识别 选择响应快、成本低的轻量模型,兼顾速度与费用
知识库语义检索 向量模型与重排序模型搭配使用,召回阶段保证覆盖、精排阶段保证准确
对外服务的生产应用 优先选择服务稳定性高的模型,并配置多 Key 负载均衡

提示:正式选用前,建议在应用编排页对候选模型进行实际问题的调试对比,以真实业务问题的回答质量作为选型依据。

常见问题

问题 排查方向
应用中选不到某个模型 检查模型列表中该模型是否已启用、供应商凭证是否有效
调用频繁失败 检查 API Key 额度与频率限制,配置多 Key 负载均衡或增大重试次数
知识库检索效果差 确认向量模型已正确配置,尝试开启重排序模型