首页 / 操作手册 / 模型管理

模型管理

最后更新时间:2026年8月15日

模型管理用于接入与管理平台可调用的模型,包括大语言模型、向量模型等。在创建和编排智能体时, 你可根据场景选择合适的模型,并统一维护其连接信息与调用参数。

支持的模型类型

平台支持接入多类模型,常见的有:

  • 大语言模型:用于对话、生成、总结等通用任务,如 DeepSeek、Qwen、文心一言等。
  • 向量模型:用于知识库文档的向量化与检索。
  • 图片 / 视频生成模型:用于图片编辑、图片生成与视频生成等场景。

接入方式上,平台支持两类:

  • 平台预置模型:已由平台完成基础配置,可直接选用。
  • 自定义接入模型:通过填写 API 地址与密钥,接入外部或私有化部署的模型服务。
兼容性说明 多数遵循 OpenAI 兼容接口规范的大语言模型服务均可接入。如遇连接异常,请优先核对 API 地址、密钥与模型标识是否填写正确。

新增模型

进入「模型管理」页面,点击「新增模型」,按以下步骤完成配置:

  1. 填写模型名称与描述,便于后续在智能体中选择。
  2. 选择模型类型或服务商。
  3. 填写 API 地址(Base URL)与访问密钥。
  4. 如服务需要指定模型标识,填写对应的模型名称或模型 ID。
  5. 保存后使用「测试」入口发起一次简单对话,确认可正常返回结果。

模型参数

创建智能体时,通常可对模型输出行为进行微调。常用参数如下:

参数 说明
temperature(温度) 控制输出的随机性。值越低,输出越稳定保守;值越高,输出越多样。
top_p(核采样) 与 temperature 配合控制采样范围,通常二者调整其一即可。
max_tokens(最大输出长度) 限制单次回复可生成的最大 token 数,避免过长或截断。
上下文窗口 模型可接收的最大上下文长度,影响长文档与多轮对话能力。
调参建议 需要事实性、一致性回答时(如知识问答、数据提取),建议使用较低的 temperature;需要创意与多样性时(如文案生成),可适当调高。

模型测试

在模型详情或编辑页,可通过测试对话窗口发送消息,验证模型连通性与基础回答效果。建议重点确认:

  • 模型能够正常返回且无明显延迟或超时。
  • 返回内容语言、格式符合预期。
  • 涉及长文本时,是否出现截断或上下文丢失。

相关章节