这是什么网站?
Auriko 是面向生产环境的 LLM 推理路由层,用一套 OpenAI 兼容 API 接入 OpenAI、Anthropic、Google AI Studio、DeepSeek 等多家供应商。它会把 prompt caching 规则、各 provider 标价与你的调用模式一起建模,再为单次请求挑选更省钱的线路;平台对供应商价格零加成,token 费用按原价另计。已用 LangChain 或 Vercel AI SDK 的团队,往往只改 base_url 和路由参数就能在多模型间切换,而不必维护多套客户端。
核心功能
- 经 OpenAI 兼容端点统一调用多家 LLM 供应商的全部模型
- 结合 prompt caching 与工作负载特征做成本建模并 cache-aware 路由
- 按成本、TTFT、吞吐或自定义约束配置路由与 fallback 策略
- 支持 BYOK、平台密钥或混合模式编排 API Key 与速率
- 请求异常时自动切换备用 provider,配合全球边缘节点降低延迟
- 在工作区或 API Key 级别设置预算上限与消费告警
常见使用场景
- AI 产品团队在 staging 轮换测试 GPT、Claude、DeepSeek,比较质量与单价后再定生产默认模型
- 平台工程把多个 provider 密钥挂到同一网关,做负载均衡并规避单一 Key 的 RPM 瓶颈
- 成本敏感的生产流量启用 cost-focus 路由,在 TTFT 与单价约束下走 cache 更友好的线路
- 已集成 Vercel AI SDK 的应用仅改 base_url 指向 Auriko,保留现有 chat 调用结构
- 需要 SSO、定制 SLA 与 PO 开票的企业通过 Enterprise 方案接入统一路由与策略管控
适合哪些用户?
- 同时对接多家 LLM、希望用配置切换模型而非重写 SDK 的工程与平台团队
- 月 token 量较大、需要在 workspace 级追踪与压缩推理账单的产品负责人
- 已持有各 provider API Key、想集中做 failover 与速率编排的基础设施工程师
- 只固定调用单一模型、日调用量极低的个人脚本(免费层可用,但路由价值有限)
- 期望「月费全包一切 token」、不愿按 provider 原价另付用量的用户(需接受 pay-as-you-go)
与同类工具的对比?
相对直连各厂商 SDK,Auriko 把多模型切换、cache-aware 选路与自动 failover 收进一层网关,学习成本主要在路由配置。与 LiteLLM 等开源代理相比,它更强调实时 provider 健康/cache 信号与量化式成本建模,并公开零 markup 定价;自研网关则灵活但需自行维护监控与切换逻辑。若只需稳定调用单一 provider 且流量很小,直连往往更简单;多 vendor 混用、账单与可用性都要管时,统一路由层更对口。
收费价格明细
官网公开三档(另加 pay-as-you-go API 费用,provider 价格零 markup):
- Free($0):含全部模型、BYOK、成本建模、cache-aware/负载均衡/fallback 路由、自定义路由权重;平台 RPM 1,000、BYOK RPM 10,000、BYOK 月 cap 500 万;社区支持。
- Pro($89/月):含 Free 全部能力,另加 deterministic routing、团队功能、无限 platform/BYOK RPM 与 BYOK 月 cap、邮件支持;提供 14 天免费试用,无需信用卡。
- Enterprise(定制):含 SSO/SAML、定制 SLA、专属支持、发票/PO 计费、定制 RPM 与路由策略。
具体配额与功能以 https://www.auriko.ai/pricing 最新页面为准。
常见问题
Q: Auriko 会在 provider 原价上加价吗?
A: 不会。官网标明 markup 为 0%,你另付的 API 费用按各供应商标价结算,平台订阅费单独计费。
Q: 可以继续使用自己的 OpenAI、Anthropic 等 API Key 吗?
A: 可以。支持 BYOK、平台密钥或两者混用,Free 与 Pro 均开放 BYOK 接入。
Q: 和直接把 OpenAI SDK 指向官方接口有什么不同?
A: 调用形态仍兼容 OpenAI,但可在 extra_body 等参数里指定成本/延迟优化、fallback 与数据策略,由网关跨 provider 选路。
Q: Free 和 Pro 主要差在哪里?
A: Pro 增加 deterministic routing、团队席位与无限 RPM/BYOK cap;高流量生产环境通常需评估 Pro,个人试用可先选 Free。
为什么值得用?
多 vendor 的切换与 failover 被收进一层 OpenAI 兼容网关,工程侧少维护多套客户端与手工比价脚本。账单压力大、又要保留模型试验空间的团队,cache-aware 路由与 workspace 预算告警会更常用到;Pro 为 $89/月且 API 用量仍按 provider 原价另计,上线前要算清总成本。相对只做静态模型映射的代理,实时 cache/健康信号驱动的选路是它更易区分的方向。














