$1 领取 Starter 密钥
输入优惠码和邮箱。我们会生成密钥并发送给你——并在此处仅显示一次。
为什么需要路由?
一个接口判断每个提示的需求。用哪些模型,完全由你决定。
成本降低 50–90%
大多数提示其实很简单。别再为「你好」和简单问答支付旗舰价——把它们交给便宜或本地模型,把昂贵模型留给真正困难的任务。
即时且私密
路由即时完成,几乎不增加任何延迟——即使智能体发起数百次调用。提示文本从不存储,未经你同意,任何内容都不会离开你的系统。
零锁定
我们返回任务类型与复杂度等级——你将其映射到现有的任意模型(OpenAI、Claude、llama.cpp、vLLM、Ollama……)。随时更换模型。
专利申请中的高精度
我们的路由器不只是猜测任务类型——它能以 94% 的准确率区分相近的类别(如商业与金融),让每个提示都进入合适的模型。
区分相近任务类型的准确率——例如商业与金融
工作原理
1 · 发送提示
携带密钥,将文本(或你自己的向量)POST 到 /v1/route。
2 · 获得决策
返回任务类型、校准后的置信度以及 low / medium / high 复杂度等级——只是一个很小的 JSON。
3 · 选择模型
把等级映射到你的模型:简单→便宜/本地,困难→旗舰。完成。
# one routing decision { "decision": { "task_label": "math", "confidence": 0.93, "complexity": { "tier": "low", "score": 0.27 } }, "scores": [ { "task_label": "math", "probability": 0.93 }, … ] }
为 AI 智能体与编排器而生
自主智能体每个任务会触发数百次 LLM 调用——其中大多很简单。把每次调用路由到合适规模的模型,在不损失质量的前提下把智能体成本削减 50–90%。
多模型,一个接口
把多个 LLM 接到同一个路由决策后面——简单步骤交给便宜/本地模型,困难推理交给旗舰模型。智能体里无需任何选型逻辑。
按任务与复杂度调校
每次调用都按任务类型与复杂度分类,你可以精确控制哪个模型处理什么,并随时更改而无需改动智能体代码。
融入你的框架
crewAI、AutoGPT、LangGraph、MCP 编排器(Hermes)——任何调用 LLM 的工具。一个接口,完全掌控你的模型池。
简单、诚实的价格
$1 起步,随业务增长。每个套餐都能数倍回本——在模型账单上省下的钱远超它的价格。
所有套餐均含按任务类型与复杂度的路由。可选的「神谕」升级(由高级 LLM 处理新型提示)按成本计费。企业版 / 私有化部署:请联系我们。
申请付费套餐
简单介绍你的使用场景,我们会帮你配置好。