FastRouter:支持智能路由与成本管理的大模型 API 网关

用统一 API 接入多家模型,集中管理路由、用量与成本

访问官网 ↗fastrouter.ai
fastrouter.ai
FastRouter screenshot

FastRouter 是面向开发者和企业 AI 团队的大模型 API 网关:用一套兼容 OpenAI 的接口连接多家模型服务商,集中处理模型选择、故障回退、调用记录和预算控制。它适合已经在开发 AI 应用、智能体或内部工具,并希望减少多模型接入与运维负担的团队。

通俗解释:FastRouter 这个网站是干什么用的?

可以把 FastRouter 理解成应用与各家 AI 模型之间的“统一服务台”。例如,一个应用需要调用不同公司的模型来回答问题、处理图片或生成内容,如果分别接入,就要维护不同的密钥、接口和用量记录。接入 FastRouter 后,应用先把请求交给同一个入口,再由网关按你指定的模型或路由规则转发,最后把结果返回。

它的核心价值是让团队更方便地接入和管理模型。实际生成结果仍由选中的模型完成,答案质量、支持的输入类型和参数也取决于该模型。平台由 AI.tech Ltd 运营,提供网页控制台以及覆盖文本、图像、视频、音频和向量嵌入等用途的 API;具体能力应以当前模型目录和对应接口为准。

自动选模型、挑选供应商与故障回退有什么区别?

FastRouter 提供几种不同层次的路由控制,可以按实际任务选择:

  • 自动模型选择:把 model 设置为 fastrouter/auto,平台依据请求复杂度、主题与成本因素选择模型,适合尚未固定模型的任务。
  • 供应商路由:已经确定模型时,可按价格、延迟或吞吐量偏好选择提供该模型的供应商,也能设置允许列表或调用顺序。
  • 备用模型列表:用 model 指定主模型,用 models 提供备用选项;主模型失败后依次尝试,全部失败时仍会返回错误。
  • 虚拟模型别名:让代码一直调用同一个别名,在控制台调整背后的模型组合和策略,减少切换模型时修改业务代码的工作。

这些能力适合需要兼顾成本、响应速度与可用性的 AI 应用。自动路由和回退并不保证每次都得到最优答案或永不中断,上线前仍应使用真实任务样本检查回答质量、参数兼容性与失败处理。

如何完成第一次 API 接入?

  1. 注册账号并创建项目 API Key。完整密钥只显示一次,应及时安全保存。
  2. 给密钥设置预算,检查它允许访问的模型,以及每分钟请求数、Token 数等限制。
  3. 在兼容 OpenAI 的客户端中,把 Base URL 设置为 https://api.fastrouter.ai/api/v1,使用 FastRouter 密钥认证。
  4. 发送包含有效 model 和 messages 数组的 Chat Completions 请求,先用不含敏感信息的短问题测试。
  5. 查看返回的回答、实际模型和 usage.provider,再到控制台核对 Token、费用与错误记录。基础调用正常后,再增加备用模型或虚拟别名。

官方接入文档提供 SDK 示例。结构化输出、工具调用和多模态输入需要所选模型支持;接口格式兼容不代表每个模型都具备相同能力。

团队怎样查看用量、比较模型并优化费用?

控制台将请求数量、Token 消耗、延迟、错误和费用集中展示,便于按项目、密钥、模型或供应商定位支出。项目权限、模型访问范围与密钥预算可以配合使用,让测试环境与生产环境各自管理。

Playground、Model Council 和评估能力可用于比较模型结果。Insights 则根据过去七天的流量,每周提出缓存、Flex 推理或切换模型等建议,由用户决定是否执行。预计节省金额是估算,不应当作保证收益;其中缓存和 Flex 建议利用现有用量数据,主动开启 Model Switch 后,重放请求和模型评审会产生推理费用。

需要沿用已有供应商账户时,可通过 BYOK 接入自己的凭据,继续受该账户的价格和限额约束。平台还提供提示词管理与 MCP Gateway:后者集中连接外部工具服务、控制项目范围和可用工具。工具定义及执行结果会占用模型上下文,因此也会影响 Token 用量。

FastRouter 怎么收费?免费套餐和免费模型要分开看

截至 2026 年 10 月 7 日,官网公开的美元月付平台价格为 Starter 0 美元、Pro 199 美元、Business 799 美元,Enterprise 需要询价。模型调用成本另外计算,官网称模型费用不加价;年付条件及最新功能表请查看官方定价页。这些美元标价不代表人民币结算价格或中国大陆可用性承诺。

Starter 包含一个 BYOK 密钥、每月一百万次 BYOK 请求额度,以及每月二十万条日志额度。请求额度不等于免费模型推理额度。响应缓存、调用追踪和 Guardrails 等能力从 Pro 开始提供,私有部署属于 Enterprise 范围。

另有独立的免费模型机制:组织的已付费余额必须高于 1 美元,符合条件的免费请求本身不扣积分。文档默认额度是每个组织、每个免费模型每天十次,按 UTC 零点重置;支持的模型、额度和资格可能调整。可以使用符合条件的 :free 模型,或通过 fastrouter/free 选择可用的免费模型。

提示词经过哪里?日志和 ZDR 有哪些边界?

网关需要把提示词及相关请求数据交给上游模型服务商处理,各服务商也有自己的条款。FastRouter 允许在密钥级别关闭内容日志;给模型名添加 :zdr 则用于限制上游供应商选择,找不到符合条件的供应商时会报错。

这两项设置解决的问题不同。:zdr 不会自动关闭 FastRouter 的内容日志,也不会消除响应缓存、插件或有状态会话功能所需的数据存储。处理敏感资料前,应结合实际启用的功能检查整条数据路径。

此外,隐私政策与套餐表对日志保留周期的说明存在差异,不能据此推断所有套餐统一保存或删除多久。对保留期限有明确要求的团队,应向官方核实适用配置和合同条件。模型使用还受对应服务商条款约束,不能把 API 接入理解为可以任意转售密钥或服务。

常见问题

FastRouter 可以免费使用吗?

Starter 的平台费为零,普通模型推理仍按用量计费。免费模型属于另一套机制,有已付费余额高于 1 美元、每日额度和模型资格等条件,并非无限免费调用。

能否继续使用自己的模型服务商 API Key?

可以。组织所有者可在 Setup → External Keys → New Integration 中添加支持的服务商凭据,再选择项目范围和模型。具体步骤见BYOK 配置说明,上游费用与限流仍由相应供应商账户决定。

开启 ZDR 后,提示词就完全不会被保存吗?

不能这样理解。ZDR 约束的是上游供应商选择,网关日志、缓存、插件和有状态功能需要分别检查。可先阅读零数据保留的适用范围,再按业务需要关闭内容日志并调整其他功能。

模型或供应商出故障时会怎样?

配置了备用模型列表时,网关会依次尝试其他选项;如果全部失败,仍会返回错误。需要检查最终实际执行的模型、供应商和费用,而不是假设回退前后输出完全一致。

官方资源与开发者社区