削减 LLM 成本 50–90% · 隐私优先 · 适配任意模型与智能体

自动把每个提示送到合适的模型

接入多个 LLM——经济型与高端型——我们的 API 按任务类型与复杂度路由每个提示。为你的应用和 AI 智能体提供动力,同时在不损失质量的前提下削减 50–90% 的 LLM 开销。

$1 领取 Starter 密钥

输入优惠码和邮箱。我们会生成密钥并发送给你——并在此处仅显示一次。

🎁 上线优惠 LAUNCH1 984 个激活名额剩余
首页

为什么需要路由?

一个接口判断每个提示的需求。用哪些模型,完全由你决定。

💸

成本降低 50–90%

大多数提示其实很简单。别再为「你好」和简单问答支付旗舰价——把它们交给便宜或本地模型,把昂贵模型留给真正困难的任务。

即时且私密

路由即时完成,几乎不增加任何延迟——即使智能体发起数百次调用。提示文本从不存储,未经你同意,任何内容都不会离开你的系统。

🔓

零锁定

我们返回任务类型与复杂度等级——你将其映射到现有的任意模型(OpenAI、Claude、llama.cpp、vLLM、Ollama……)。随时更换模型。

成熟可靠的技术

专利申请中的高精度

我们的路由器不只是猜测任务类型——它能以 94% 的准确率区分相近的类别(如商业与金融),让每个提示都进入合适的模型。

⚖ 专利申请中——美国 USPTO 申请号 19/452,440(2026 年 1 月 19 日提交)
94%

区分相近任务类型的准确率——例如商业与金融

工作原理

1 · 发送提示

携带密钥,将文本(或你自己的向量)POST 到 /v1/route。

2 · 获得决策

返回任务类型、校准后的置信度以及 low / medium / high 复杂度等级——只是一个很小的 JSON。

3 · 选择模型

把等级映射到你的模型:简单→便宜/本地,困难→旗舰。完成。

# one routing decision
{
  "decision": { "task_label": "math", "confidence": 0.93,
                "complexity": { "tier": "low", "score": 0.27 } },
  "scores": [ { "task_label": "math", "probability": 0.93 }, … ]
}
为 AI 智能体打造

为 AI 智能体与编排器而生

自主智能体每个任务会触发数百次 LLM 调用——其中大多很简单。把每次调用路由到合适规模的模型,在不损失质量的前提下把智能体成本削减 50–90%。

🧩

多模型,一个接口

把多个 LLM 接到同一个路由决策后面——简单步骤交给便宜/本地模型,困难推理交给旗舰模型。智能体里无需任何选型逻辑。

🎚️

按任务与复杂度调校

每次调用都按任务类型与复杂度分类,你可以精确控制哪个模型处理什么,并随时更改而无需改动智能体代码。

🤖

融入你的框架

crewAI、AutoGPT、LangGraph、MCP 编排器(Hermes)——任何调用 LLM 的工具。一个接口,完全掌控你的模型池。

价格

简单、诚实的价格

$1 起步,随业务增长。每个套餐都能数倍回本——在模型账单上省下的钱远超它的价格。

Starter
先试试
$1/月
  • 无限 含决策次数
  • 60/分钟 速率上限
$1 获取密钥
Pro
生产流量
$49/月
  • 1M 含决策次数
  • 600/分钟 速率上限
  • $0.05 每千次 超额
申请使用
Scale
大流量与 SLA
$299/月
  • 10M 含决策次数
  • 3000/分钟 速率上限
  • $0.02 每千次 超额
申请使用

所有套餐均含按任务类型与复杂度的路由。可选的「神谕」升级(由高级 LLM 处理新型提示)按成本计费。企业版 / 私有化部署:请联系我们。

申请付费套餐

简单介绍你的使用场景,我们会帮你配置好。