FastGPTFastGPT
配置说明/模型配置方案

模型配置说明

FastGPT 模型配置说明

介绍

FastGPT 借助 AI Proxy 服务,可以连接到不同的模型提供商。同时 AI Proxy 还提供了负载均衡、模型日志、数据看板等能力,方便检测模型调用情况。

🤖

注意事项:

  1. 目前语音识别模型仅会生效一个,所以配置时候,只需要配置一个即可。
  2. 系统至少需要一个语言模型和一个索引模型才能正常使用。

运行流程图

alt text

模型类型

  1. 语言模型 - 进行文本对话,多模态模型支持图片识别。
  2. 索引模型 - 对文本块进行索引,用于相关文本检索。
  3. 重排模型 - 对检索结果进行重排,用于优化检索排名。
  4. 语音合成 - 将文本转换为语音。
  5. 语音识别 - 将语音转换为文本。

特殊术语介绍

  • 模型 ID:接口请求时候,Body 中 model 字段的值,全局唯一。
  • 模型名: 用于展示的模型名称,可以自定义。
  • 模型渠道:不同的模型提供商协议,例如 OpenAI、Anthropic、Google 等。大部分自建渠道都遵守 OpenAI 的协议。一个模型可以在配置在不同渠道中,实现负载均衡。
  • 自定义请求地址/Key:如果需要绕过 模型渠道,可以设置自定义请求地址和 Token。一般情况下不需要。(不推荐使用,不方便管理)

添加渠道/模型

可以在 FastGPT 的 管理员-模型提供商 页面中进行模型配置。

1. 创建渠道

切换到 模型渠道 标签页。注意,这里只能增加 模型配置 里有的模型,系统仅内置了主流的模型,如果需要增加其他模型,需要先在 模型配置 中增加。

aiproxy1

点击右上角的“新增渠道”,即可进入渠道配置页面

alt text

以阿里百炼的模型为例,进行如下配置

alt text

  1. 渠道名:展示在外部的渠道名称,仅作标识;
  2. 协议类型:模型对应的协议类型,一般哪家提供的模型就选对于服务商即可。大多数都提供了 OpenAI 的协议,也可以选择 OpenAI 协议类型。
  3. 模型:当前渠道具体可以使用的模型,系统内置了主流的一些模型,如果下拉框中没有想要的选项,可以点击“新增模型”,增加自定义模型;
  4. 模型映射:将 FastGPT 请求的模型,映射到具体提供的模型上。例如:
{
  "gpt-4o-test": "gpt-4o"
}

FatGPT 中的模型为 gpt-4o-test,向 AI Proxy 发起请求时也是 gpt-4o-test。AI proxy 在向上游发送请求时,实际的 model 为 gpt-4o。

  1. 代理地址:不要填完整的模型请求地址,要填写 BaseUrl,注意是否需要增加 /v1
  2. API 密钥:从模型厂商处获取的 API 凭证。注意部分厂商需要提供多个密钥组合,可以根据提示进行输入。

最后点击“新增”,就能在“模型渠道”下看到刚刚配置的渠道

aiproxy4

2. 渠道测试

然后可以对渠道进行测试,确保配置的模型有效

aiproxy5

点击“模型测试”,可以看到配置的模型列表,点击“开始测试”

aiproxy6

等待模型测试完成后,会输出每个模型的测试结果以及请求时长

aiproxy7

3. 启用模型

系统内置了目前主流厂商的模型,如果你不熟悉配置,直接点击 启用 即可。模型 ID 是和 模型渠道 中的 模型 一致。

点击启用模型,即可使用。

启用模型模型 ID 映射说明
alt textalt text

4. 测试模型

FastGPT 页面上提供了每类模型的简单测试,可以初步检查模型是否正常工作,会实际按模板发送一个请求。

alt text

模型配置

修改模型配置

点击模型右侧的齿轮即可进行模型配置,不同类型模型的配置有区别。

alt textalt text

新增自定义模型

如果系统内置的模型无法满足你的需求,你可以添加自定义模型。如果 模型 ID 与系统内置的模型 ID 重复,则会被认为是修改系统模型,而不是新增模型。

  1. 通过表单添加模型
alt textalt text
  1. 通过配置文件配置

如果你觉得通过页面配置模型比较麻烦,你也可以通过配置文件来配置模型。或者希望快速将一个系统的配置,复制到另一个系统,也可以通过配置文件来实现。

alt textalt text

模型状态探测

说明

FastGPT 提供了开箱即用的系统模型健康探测与监控功能。开启后,系统会周期性地对所有已启用的模型进行可用性测试,生成 48 小时稳定性图表,并在模型发生故障或恢复时通过 Webhook 发送实时告警。

模型状态监控面板

  1. 探测范围:仅针对系统中当前「已启用」的系统模型。未启用的模型不会参与探测,也不会产生历史记录。
  2. 重试机制:探测请求首次失败后,系统最多自动重试 3 次(即单轮最多尝试 4 次)。只要有一次调用成功即判定为有效;只有 4 次尝试全部失败时,才最终判定为异常,有效防止因网络瞬间抖动导致的误报。
  3. 三种健康状态:
    • 正常(绿色):模型测试成功,且响应延迟 ≤ 30s。
    • 高延迟(黄色):模型测试成功,但响应延迟 > 30s。
    • 异常(红色):模型连续 4 次请求均发生错误。
  4. 前端监控特性:
    • 48 小时状态图:以时间线细刻度直观展示历史探测结果,鼠标悬浮至任一刻度条时伴随微动高亮,并通过 Tooltip 展示对应时间点、状态(正常 / 延迟过高 / 错误原因)及延迟。
    • 稳定性百分比:统计 48 小时内的成功率(精确保留 2 位小数)。
    • 最近错误保留:异常卡片底部直接保留并高亮显示最近一次的详细报错信息,方便直接排查上游问题。
    • 无感自动刷新:在自动探测开启的状态下,模型状态页面每 1 分钟自动在后台静默刷新最新数据。

启用方式

管理员可在 FastGPT 管理后台中配置并开启模型探测:

  1. 进入状态面板:登录管理员账号,点击左侧菜单 系统模型,在顶部标签页中切换至 模型探测。
  2. 打开探测配置:点击页面右上角的 探测配置 按钮。

模型探测配置弹窗

  1. 设置探测参数:
    • 启用自动探测:开启开关(配置项显示为“启用所有模型自动探测”)。开启后,系统内置定时任务按配置间隔自动调度;未开启时,页面将呈现「未启用自动探测」空状态。
    • 探测间隔(分钟):填写探测周期,支持配置 5~60 分钟之间的整数。
    • 告警 Webhook 地址(可选):接收告警通知的回调 URL(支持 HTTP / HTTPS)。配置后可点击输入框右侧的 测试 按钮验证连通性,系统会依次推送模拟异常和模拟恢复两条测试消息。
    • 告警 Token(可选):如果你的 Webhook 接收端需要鉴权,可在此配置 Token。系统在发起推送时会通过请求头携带。
  2. 保存配置:点击 确认 完成保存。
  3. 立即探测(可选):在开启探测的状态下,右上角会显示 立即探测 按钮。管理员可随时点击该按钮主动触发一轮全量探测,快速验证所有渠道与模型的实时连通性。

Webhook 标准

当配置了「告警 Webhook 地址」后,系统会在模型状态发生边沿变化时触发推送,每个模型独立发送一条通知,不合并发送。

触发规则

  • 故障告警:模型状态由非红色(正常或高延迟)变为红色(异常)时触发,事件类型为 model_status_error。
  • 恢复通知:模型状态由红色(异常)恢复为正常或高延迟时触发,事件类型为 model_status_recovered。
  • 防风暴机制:如果模型持续处于异常状态,后续探测不会重复推送,避免告警刷屏。

协议规范

  • 请求方法:POST
  • 超时时间:5 秒
  • 请求头(Headers):
    • Content-Type: application/json
    • Authorization: Bearer <告警Token>(仅在配置了 Token 时携带)

请求体参数说明

参数路径类型说明
eventstring告警事件类型:model_status_error(模型异常)或 model_status_recovered(模型恢复)
statusstring当前探测结果状态:red(异常)、green(正常)、yellow(高延迟)
model.modelIdstring模型在系统中的唯一数据库 ID
model.namestring模型别名/展示名称
model.modelstring真实模型标识
model.providerstring模型厂商标识(如 OpenAI、DeepSeek 等)
model.typestring模型类型(llm、embedding、rerank、tts、stt)
probe.attemptsnumber本轮探测实际尝试的次数(1~4)
probe.latencyMsnumber响应耗时(毫秒,异常状态时通常不存在)
probe.errorstring发生异常时的具体错误信息(恢复或正常时通常不存在)
probe.startedAtstring单模型探测任务开始的 ISO 8601 时间戳,包含重试等待
probe.requestStartedAtstring最后一次模型请求开始的 ISO 8601 时间戳
probe.requestEndedAtstring最后一次模型请求结束的 ISO 8601 时间戳,也是状态记录时间

Webhook 请求示例

1. 模型异常告警报文
{
  "event": "model_status_error",
  "status": "red",
  "model": {
    "modelId": "6732f10283c7ab1289de4567",
    "name": "gpt-5.4-mini",
    "model": "gpt-5.4-mini",
    "provider": "OpenAI",
    "type": "llm"
  },
  "probe": {
    "attempts": 4,
    "error": "404 The model `gpt-5.4-mini` does not exist or you do not have access to it.",
    "startedAt": "2026-09-23T01:44:00.000Z",
    "requestStartedAt": "2026-09-23T01:45:14.000Z",
    "requestEndedAt": "2026-09-23T01:45:15.000Z"
  }
}
2. 模型恢复正常报文
{
  "event": "model_status_recovered",
  "status": "green",
  "model": {
    "modelId": "6732f10283c7ab1289de4567",
    "name": "gpt-5.4-mini",
    "model": "gpt-5.4-mini",
    "provider": "OpenAI",
    "type": "llm"
  },
  "probe": {
    "attempts": 1,
    "latencyMs": 1630,
    "startedAt": "2026-09-23T01:50:13.000Z",
    "requestStartedAt": "2026-09-23T01:50:13.000Z",
    "requestEndedAt": "2026-09-23T01:50:15.000Z"
  }
}

其他

渠道优先级

范围 1~100。数值越大,越容易被优先选中。

aiproxy9

启用/禁用渠道

在渠道右侧的控制菜单中,还可以控制渠道的启用或禁用,被禁用的渠道将无法再提供模型服务

aiproxy10

模型调用日志

通过渠道调用的模型,可以在 调用日志 页面,会展示发送到模型处的请求记录,包括具体的输入输出 tokens、请求时间、请求耗时、请求地址等等。错误的请求,则会详细的入参和错误信息,方便排查,但仅会保留 1 小时(环境变量里可配置)。

aiproxy11

私有部署模型

点击查看部署 ReRank 模型教程

从 OneAPI 迁移到 AI Proxy

对于旧版使用 OneAPI 的用户,可以通过脚本将 OneAPI 里的渠道配置迁移到 AI Proxy。

可以从任意终端,发起 1 个 HTTP 请求。其中 {{host}} 替换成 AI Proxy 地址,{{admin_key}} 替换成 AI Proxy 中 ADMIN_KEY 的值。

Body 参数 dsn 为 OneAPI 的 mysql 连接串。

curl --location --request POST '{{host}}/api/channels/import/oneapi' \
--header 'Authorization: Bearer {{admin_key}}' \
--header 'Content-Type: application/json' \
--data-raw '{
    "dsn": "mysql://root:s5mfkwst@tcp(dbconn.sealoshzh.site:33123)/mydb"
}'

执行成功的情况下会返回 "success": true

脚本目前不是完全准,仅是简单的做数据映射,主要是迁移 代理地址、模型 和 API 密钥,建议迁移后再进行手动检查。

在 GitHub 上编辑

文件更新时间