Her istemi doğru modele gönderin — otomatik olarak
Birden fazla LLM bağlayın — uygun ve premium — API’miz her istemi görev türü ve karmaşıklığa göre yönlendirir. Uygulamalarınızı ve yapay zekâ ajanlarınızı güçlendirin, LLM harcamasını kaliteden ödün vermeden %50–90 azaltın.
1 $’a Starter anahtarınızı alın
Promosyon kodunuzu ve e-postanızı girin. Bir anahtar oluşturup size göndeririz — ve burada bir kez gösteririz.
Neden yönlendirme?
Tek bir uç nokta her istemin neye ihtiyacı olduğuna karar verir. Hangi modelleri çalıştıracağınız tamamen sizde.
%50–90 daha ucuz
İstemlerin çoğu kolaydır. «Merhaba» ve basit sorular için amiral fiyatı ödemeyi bırakın — onları ucuz veya yerel bir modele yönlendirin, pahalı modeli gerçekten zor işler için saklayın.
Anında ve gizli
Yönlendirme anında olur ve gözle görülür gecikme eklemez — ajanlar yüzlerce çağrı yapsa bile. İstem metni asla saklanmaz ve onayınız olmadan hiçbir şey sisteminizden çıkmaz.
Bağımlılık yok
Görev türünü ve bir karmaşıklık düzeyini döndürürüz — siz bunları zaten kullandığınız modellere eşlersiniz (OpenAI, Claude, llama.cpp, vLLM, Ollama…). Modeli istediğiniz zaman değiştirin.
Patent başvurulu doğruluk
Yönlendiricimiz görev türünü yalnızca tahmin etmez — iş ve finans gibi birbirine yakın kategorileri %94 doğrulukla ayırır, böylece her istem doğru modele ulaşır.
yakın görev türlerini ayırma doğruluğu — ör. iş ve finans
Nasıl çalışır
1 · İstem gönderin
Metni (veya kendi gömme vektörünüzü) anahtarınızla /v1/route adresine POST edin.
2 · Karar alın
Görev türü, kalibre edilmiş güven ve low / medium / high karmaşıklık düzeyini — küçük bir JSON içinde alırsınız.
3 · Modelinizi seçin
Düzeyi modellerinize eşleyin: kolay → ucuz/yerel, zor → amiral. Bitti.
# one routing decision { "decision": { "task_label": "math", "confidence": 0.93, "complexity": { "tier": "low", "score": 0.27 } }, "scores": [ { "task_label": "math", "probability": 0.93 }, … ] }
Yapay zekâ ajanları ve orkestratörler için tasarlandı
Otonom ajanlar görev başına yüzlerce LLM çağrısı yapar — çoğu basit. Her çağrıyı doğru boyuttaki modele yönlendirin ve ajan maliyetini kaliteden ödün vermeden %50–90 düşürün.
Çok model, tek uç nokta
Birden fazla LLM’i tek bir yönlendirme kararının arkasına koyun — kolay adımlar için ucuz/yerel, zor akıl yürütme için amiral. Ajanınızda model seçme mantığı yok.
Göreve ve karmaşıklığa göre ayarlı
Her çağrı görev türü ve karmaşıklığa göre sınıflandırılır; hangi modelin neyi işleyeceğini tam siz belirler, ajan koduna dokunmadan istediğiniz zaman değiştirirsiniz.
Framework’ünüze uyar
crewAI, AutoGPT, LangGraph, MCP orkestratörleri (Hermes) — bir LLM çağıran her şey. Tek uç nokta, model havuzunuz üzerinde tam kontrol.
Basit ve dürüst fiyatlandırma
1 $’a başlayın, büyüdükçe ölçeklenin. Her plan kendini fazlasıyla amorti eder — model faturalarınızdaki tasarruf, fiyatını fazlasıyla aşar.
- 100k dahil karar
- 120/dk hız limiti
- $0.10 1k başına aşım
- 10M dahil karar
- 3000/dk hız limiti
- $0.02 1k başına aşım
Tüm planlar görev türü ve karmaşıklık yönlendirmesini içerir. İsteğe bağlı oracle yükseltmeleri (gelişmiş bir LLM yeni istemleri çözer) maliyetine faturalanır. Kurumsal / şirket içi: bize ulaşın.
Ücretli plan iste
Kullanım senaryonuzdan kısaca bahsedin, her şeyi ayarlayalım.