LLM maliyetini %50–90 azaltın · Tasarımdan gizli · Her model ve ajan

Her istemi doğru modele gönderin — otomatik olarak

Birden fazla LLM bağlayın — uygun ve premium — API’miz her istemi görev türü ve karmaşıklığa göre yönlendirir. Uygulamalarınızı ve yapay zekâ ajanlarınızı güçlendirin, LLM harcamasını kaliteden ödün vermeden %50–90 azaltın.

1 $’a Starter anahtarınızı alın

Promosyon kodunuzu ve e-postanızı girin. Bir anahtar oluşturup size göndeririz — ve burada bir kez gösteririz.

🎁 Lansman fırsatı LAUNCH1 984 aktivasyon kaldı
Ana sayfa

Neden yönlendirme?

Tek bir uç nokta her istemin neye ihtiyacı olduğuna karar verir. Hangi modelleri çalıştıracağınız tamamen sizde.

💸

%50–90 daha ucuz

İstemlerin çoğu kolaydır. «Merhaba» ve basit sorular için amiral fiyatı ödemeyi bırakın — onları ucuz veya yerel bir modele yönlendirin, pahalı modeli gerçekten zor işler için saklayın.

Anında ve gizli

Yönlendirme anında olur ve gözle görülür gecikme eklemez — ajanlar yüzlerce çağrı yapsa bile. İstem metni asla saklanmaz ve onayınız olmadan hiçbir şey sisteminizden çıkmaz.

🔓

Bağımlılık yok

Görev türünü ve bir karmaşıklık düzeyini döndürürüz — siz bunları zaten kullandığınız modellere eşlersiniz (OpenAI, Claude, llama.cpp, vLLM, Ollama…). Modeli istediğiniz zaman değiştirin.

Kanıtlanmış teknoloji

Patent başvurulu doğruluk

Yönlendiricimiz görev türünü yalnızca tahmin etmez — iş ve finans gibi birbirine yakın kategorileri %94 doğrulukla ayırır, böylece her istem doğru modele ulaşır.

⚖ Patent başvurusu — USPTO Başvuru No. 19/452,440 (19 Oca 2026 tarihli)
94%

yakın görev türlerini ayırma doğruluğu — ör. iş ve finans

Nasıl çalışır

1 · İstem gönderin

Metni (veya kendi gömme vektörünüzü) anahtarınızla /v1/route adresine POST edin.

2 · Karar alın

Görev türü, kalibre edilmiş güven ve low / medium / high karmaşıklık düzeyini — küçük bir JSON içinde alırsınız.

3 · Modelinizi seçin

Düzeyi modellerinize eşleyin: kolay → ucuz/yerel, zor → amiral. Bitti.

# one routing decision
{
  "decision": { "task_label": "math", "confidence": 0.93,
                "complexity": { "tier": "low", "score": 0.27 } },
  "scores": [ { "task_label": "math", "probability": 0.93 }, … ]
}
Yapay zekâ ajanları için

Yapay zekâ ajanları ve orkestratörler için tasarlandı

Otonom ajanlar görev başına yüzlerce LLM çağrısı yapar — çoğu basit. Her çağrıyı doğru boyuttaki modele yönlendirin ve ajan maliyetini kaliteden ödün vermeden %50–90 düşürün.

🧩

Çok model, tek uç nokta

Birden fazla LLM’i tek bir yönlendirme kararının arkasına koyun — kolay adımlar için ucuz/yerel, zor akıl yürütme için amiral. Ajanınızda model seçme mantığı yok.

🎚️

Göreve ve karmaşıklığa göre ayarlı

Her çağrı görev türü ve karmaşıklığa göre sınıflandırılır; hangi modelin neyi işleyeceğini tam siz belirler, ajan koduna dokunmadan istediğiniz zaman değiştirirsiniz.

🤖

Framework’ünüze uyar

crewAI, AutoGPT, LangGraph, MCP orkestratörleri (Hermes) — bir LLM çağıran her şey. Tek uç nokta, model havuzunuz üzerinde tam kontrol.

Fiyatlar

Basit ve dürüst fiyatlandırma

1 $’a başlayın, büyüdükçe ölçeklenin. Her plan kendini fazlasıyla amorti eder — model faturalarınızdaki tasarruf, fiyatını fazlasıyla aşar.

Starter
Denemek için
$1/ay
  • Sınırsız dahil karar
  • 60/dk hız limiti
1 $’a anahtar
Pro
Üretim trafiği
$49/ay
  • 1M dahil karar
  • 600/dk hız limiti
  • $0.05 1k başına aşım
Erişim iste
Scale
Yüksek hacim ve SLA
$299/ay
  • 10M dahil karar
  • 3000/dk hız limiti
  • $0.02 1k başına aşım
Erişim iste

Tüm planlar görev türü ve karmaşıklık yönlendirmesini içerir. İsteğe bağlı oracle yükseltmeleri (gelişmiş bir LLM yeni istemleri çözer) maliyetine faturalanır. Kurumsal / şirket içi: bize ulaşın.

Ücretli plan iste

Kullanım senaryonuzdan kısaca bahsedin, her şeyi ayarlayalım.