面向生产环境的单一 OpenAI 兼容 AI 网关 —— 跨 200+ 模型的自适应路由、负载均衡、防护栏、智能体防火墙、可观测性与治理。
OrcaRouter 是一款尖端的 AI 路由器和网关,充当连接 200 多个大语言模型和 AI 服务的单一智能接口。通过分析每个用户请求(或称“提示词”),它能动态选择处理任务的最佳模型——无论是像 GPT-5.5 Pro 这样的顶级“前沿”模型,还是更具成本效益的开源替代方案。其核心使命是提供企业级的 AI 性能、可靠性和治理,同时消除代币加价,让用户按直接供应商价格付费,推理成本最高可节省 40%。
OrcaRouter 的旗舰功能是其智能路由引擎。它利用上下文嵌入和来自真实流量的在线学习,在 1 毫秒内对每个提示词进行评分。凭借 75.5% 的路由准确率(截至 2026 年 6 月,在 RouterArena 基准测试中领先),它能确保每个请求根据您选择的策略发送到最优模型:可接受质量下的最便宜选项、最高质量选项,或是从您的使用模式中学习的平衡自适应模式。
该平台遵循零加价的基本原则。您按底层模型供应商(例如 OpenAI、Anthropic、Google)的公开费率付费。每张请求收据都显示精确的成本、所选模型和供应商,确保完全的成本透明度,没有不透明的混合费率。
OrcaRouter 保证高可用性。如果某个供应商发生中断或达到速率限制,系统会在 50 毫秒内自动故障转移到健康的等效模型——通常远在用户请求超时之前。这种内置的负载均衡保护您的应用免受上游不稳定的影响。
该网关包含强大的防护栏,在计费前运行,例如 PII 屏蔽和内容策略强制执行,以清晰的 400 错误阻止不安全请求。针对智能体时代,它配备了风险评分的智能体防火墙,用于评估和控制工具/MCP 调用(允许、审核、阻止),并包含针对成本和速率激增的异常检测。
通过结构化日志获得每个 API 调用的完整可见性,日志详细记录了成本、延迟、模型选择和路由依据。诸如版本控制的提示词管理(A/B 测试、即时回滚)和智能缓存(以更低的缓存费率对重复提示词计费)等功能,提供了无需代码部署的强大控制力。
OrcaRouter 提供完整的 OpenAI 兼容和 MCP 服务器端点。您只需更改现有 OpenAI、Anthropic、Google、LangChain 或 LlamaIndex 设置中的一行代码——即 API base_url——即可完成集成。所有现有的 SDK 调用、流式传输和模型名称均可继续无缝工作。
使用 OrcaRouter 设计得非常简单,只需最少的代码更改:
base_url 更改为 https://api.orcarouter.ai/v1,并将您的 API 密钥替换为 OrcaRouter 密钥。client.chat.completions.create() 调用。您可以使用特殊的模型标识符 "orcarouter/auto" 让路由器选择最佳模型,或直接指定 200 多个受支持模型中的任何一个。OrcaRouter 采用独特的定价模式,核心路由服务免费。您只需按直接供应商费率支付所使用的 AI 模型费用。
orcarouter/auto 开始:对于大多数用例,让路由器自动选择模型是最简单、最具成本效益的开始方式。它能有效平衡质量和成本。AI 路由器是一个位于您的应用程序和多个 AI 模型之间的系统。它智能地分析每个请求(提示词),并将其从庞大的模型池中引导至最合适的模型,通过单一的 API 端点优化成本、质量和可靠性。
提示词评分和路由决策增加的额外开销不到 1 毫秒。总增加的延迟通常低于 50 毫秒,这通常会被更好路由模型带来的更快响应时间以及故障转移和缓存的好处所抵消。
是的,完全可以。OrcaRouter 与 OpenAI SDK 完全兼容。您只需更改 base_url 和 API 密钥。您所有现有的聊天补全、嵌入和流式传输代码都将继续工作,无需修改。
OrcaRouter 的自动故障转移系统会检测到故障,并在原始请求超时之前,立即将请求重试到来自另一供应商的预定义健康备用模型。这确保了最终用户的高可用性。
不会。OrcaRouter 作为安全网关运行。您的提示词和数据不会用于训练其路由模型。他们重视用户隐私,数据仅用于促进 API 请求和路由逻辑的处理。
如果您需要用于协作(多个团队成员)的高级功能、更严格的合规报告(SOC 2、HIPAA),或用于不同服务的无限 API 密钥,请升级到 Team 计划。Enterprise 计划适用于需要最高正常运行时间保证(SLA)、在其自身基础设施内进行私有部署以及专属支持的组织。