Отправляйте каждый промпт в нужную модель — автоматически
Подключите несколько LLM — доступные и премиальные — а наш API маршрутизирует каждый промпт по типу задачи и сложности. Питайте приложения и ИИ-агентов, сокращая расходы на LLM на 50–90% без потери качества.
Получите Starter-ключ за $1
Введите промокод и email. Мы создадим ключ, пришлём его вам и покажем здесь один раз.
Зачем вообще маршрутизация?
Один endpoint решает, что нужно каждому промпту. Какие модели запускать — решаете вы.
Экономия 50–90%
Большинство промптов — простые. Хватит платить по цене флагмана за «привет» и простые вопросы — отправляйте их в дешёвую или локальную модель, а дорогую берегите для по-настоящему сложного.
Мгновенно и приватно
Маршрутизация мгновенная и не добавляет заметной задержки — даже когда агент делает сотни вызовов. Текст промпта не сохраняется, и ничего не покидает ваш контур без вашего согласия.
Без привязки
Мы возвращаем тип задачи и уровень сложности — а вы сопоставляете их с любыми своими моделями (OpenAI, Claude, llama.cpp, vLLM, Ollama…). Меняйте модели когда угодно.
Точность на уровне патента
Наш роутер не просто угадывает тип задачи — он различает близкие, смежные категории, например бизнес и финансы, с точностью 94%, чтобы каждый промпт попадал в нужную модель.
точность разделения близких типов задач — например, бизнес и финансы
Как это работает
1 · Отправьте промпт
POST текста (или своего эмбеддинга) на /v1/route с вашим ключом.
2 · Получите решение
В ответ — тип задачи, калиброванная уверенность и уровень сложности low / medium / high, в одном маленьком JSON.
3 · Выберите модель
Сопоставьте уровень с вашими моделями: простое → дешёвая/локальная, сложное → флагман. Готово.
# one routing decision { "decision": { "task_label": "math", "confidence": 0.93, "complexity": { "tier": "low", "score": 0.27 } }, "scores": [ { "task_label": "math", "probability": 0.93 }, … ] }
Создано для ИИ-агентов и оркестраторов
Автономные агенты совершают сотни вызовов LLM на задачу — и большинство из них простые. Направляйте каждый вызов в модель нужного размера и сокращайте расходы агента на 50–90% без потери качества.
Много моделей, один endpoint
Подключите несколько LLM за одним решением о маршрутизации — дешёвые/локальные для простых шагов, флагман для сложных рассуждений. Никакой логики выбора модели в агенте.
Настройка по типу и сложности
Каждый вызов классифицируется по типу задачи и сложности — вы точно решаете, какая модель что обрабатывает, и меняете это в любой момент без правок кода агента.
Встраивается в ваш фреймворк
crewAI, AutoGPT, LangGraph, MCP-оркестраторы (Hermes) — всё, что вызывает LLM. Один endpoint, полный контроль над вашим пулом моделей.
Простые и честные тарифы
Начните за $1 и растите вместе с нагрузкой. Любой тариф окупается многократно — экономия на счетах за модели кратно превышает его цену.
- 100k включено решений
- 120/мин лимит
- $0.10 за 1k сверх лимита
- 1M включено решений
- 600/мин лимит
- $0.05 за 1k сверх лимита
- 10M включено решений
- 3000/мин лимит
- $0.02 за 1k сверх лимита
Во все тарифы входит маршрутизация по типу задачи и сложности. Опциональные эскалации к оракулу (продвинутая LLM решает новые промпты) тарифицируются по себестоимости. Enterprise / on-prem — напишите нам.
Запросить платный тариф
Расскажите немного о вашей задаче — и мы всё настроим.