模型管理
最后更新时间:2026年8月15日
模型管理用于接入与管理平台可调用的模型,包括大语言模型、向量模型等。在创建和编排智能体时, 你可根据场景选择合适的模型,并统一维护其连接信息与调用参数。
支持的模型类型
平台支持接入多类模型,常见的有:
- 大语言模型:用于对话、生成、总结等通用任务,如 DeepSeek、Qwen、文心一言等。
- 向量模型:用于知识库文档的向量化与检索。
- 图片 / 视频生成模型:用于图片编辑、图片生成与视频生成等场景。
接入方式上,平台支持两类:
- 平台预置模型:已由平台完成基础配置,可直接选用。
- 自定义接入模型:通过填写 API 地址与密钥,接入外部或私有化部署的模型服务。
兼容性说明
多数遵循 OpenAI 兼容接口规范的大语言模型服务均可接入。如遇连接异常,请优先核对 API 地址、密钥与模型标识是否填写正确。
新增模型
进入「模型管理」页面,点击「新增模型」,按以下步骤完成配置:
- 填写模型名称与描述,便于后续在智能体中选择。
- 选择模型类型或服务商。
- 填写 API 地址(Base URL)与访问密钥。
- 如服务需要指定模型标识,填写对应的模型名称或模型 ID。
- 保存后使用「测试」入口发起一次简单对话,确认可正常返回结果。
模型参数
创建智能体时,通常可对模型输出行为进行微调。常用参数如下:
| 参数 | 说明 |
|---|---|
| temperature(温度) | 控制输出的随机性。值越低,输出越稳定保守;值越高,输出越多样。 |
| top_p(核采样) | 与 temperature 配合控制采样范围,通常二者调整其一即可。 |
| max_tokens(最大输出长度) | 限制单次回复可生成的最大 token 数,避免过长或截断。 |
| 上下文窗口 | 模型可接收的最大上下文长度,影响长文档与多轮对话能力。 |
调参建议
需要事实性、一致性回答时(如知识问答、数据提取),建议使用较低的 temperature;需要创意与多样性时(如文案生成),可适当调高。
模型测试
在模型详情或编辑页,可通过测试对话窗口发送消息,验证模型连通性与基础回答效果。建议重点确认:
- 模型能够正常返回且无明显延迟或超时。
- 返回内容语言、格式符合预期。
- 涉及长文本时,是否出现截断或上下文丢失。