İçeriğe geç
Çok modelli konsensüs ve hakem — tek API

Çıktınızı tek modele bağlamayı bırakın.

Tek bir prompt'u önde gelen sınır modellere paralel olarak yayın, ardından çapraz aile bir hakem bunları güvenebileceğiniz tek yanıtta uzlaştırsın. OpenAI uyumlu. AB'de barındırılır. Harcadığınız tokenlar için ödeme yaparsınız, artı şeffaf bir konsensüs marjı.

Canlı konsensüs, akışlıOpenAI & Anthropic SDK birebir uyumluAB'de barındırılır · GDPR
Ne elde edersiniz

Bir prompt girer. Her modelin yanıtı + gerekçeli karar çıkar.

API'den ve ücretsiz kamuya açık demodan gelen akışlı yanıtla birebir şekillendirilmiş bir konsensüs çalışması.

POST /api/v1/chat/completions · model: tokonomix-consensus · mode: best_of
Prompt

12 kişilik bir SaaS firmasıyız. Önümüzdeki 12 ay için kendi sunucumuza LLM kurmalı mıyız yoksa barındırılan API'lerde mi kalmalıyız? Tek paragrafta öneri verin.

claude-opus-4.8412 tok

Stay on hosted APIs. At 12 people your bottleneck is product velocity, not inference cost; self-hosting adds GPU ops, eval and on-call burden that will not pay back below roughly €8k/mo in spend…

gpt-5.1388 tok

Hosted, with one caveat: route through a gateway so you can switch providers without code changes. Self-hosting only makes sense once a workload is both high-volume and latency-critical…

gemini-3-pro401 tok

Remain on hosted APIs for 12 months. Revisit only if data-residency or a >70% cost reduction at scale becomes a hard requirement; otherwise the operational tax outweighs the savings…

Hakem · best_of

Üçü de "barındırılanda kal" konusunda birleşiyor, güven yüksek. Kazanan, belirsiz kalmak yerine gerçek karar sınırını adlandırdığı ve seçimi ekip boyutuna — en uygulanabilir çerçevelemeye — bağladığı için ödüllendiriliyor.

claude-opus-4.8 94gpt-5.1 89gemini-3-pro 86uyum: yüksek
3 önerici + 1 hakemtoken 1 601çağrı başına maliyet ≈ €0.033gecikme 5.4s

Örnek niteliğinde — sentetik veri, gerçek bir müşteri çağrısı değil

Tek model neden risk

Güvenli görünen yanlış yanıt, doğrudan ayırt edilemez.

01

Tek modelin kör noktaları

Tek model, tek kör nokta demektir. Hiç örneklemediğiniz anlaşmazlığı göremezsiniz — üstelik güvenli bir halüsinasyon, gerçekten ayırt edilemez.

02

Elle karşılaştırma ölçeklenemez

Aynı prompt'u üç sohbet penceresine yapıştırmak bir kez işe yarar. Bir iş akışında, destek sürecinde ya da günde binlerce kez dönen bir ajan döngüsünde işe yaramaz.

03

Birleştirici kod çürür

Fan-out, akışlı çoğullama, hakem prompt'u, model başına maliyet takibi, sağlayıcı yedekleme — bunlar bakım gerektiren bir sistemdir. Ya da tek bir model tanımlayıcısı.

Dört sentez modu

Yanıtların nasıl uzlaştırılacağını seçin.

Aynı yayılma, farklı hakem davranışı. Tek bir alanla değiştirin — yeniden mimari gerekmez.

Konsensüs

Sentezlenmiş anlaşma

"en iyi tek yanıtı ver" için varsayılan

Fark

Anlaşmazlıkları vurgula

araştırma, durum tespiti, risk incelemesi

En iyi

Yargı en iyi yanıtı seçer

tek temiz çıktı gerektiren iş akışları

Ham

Sentez yok, sadece paralel

uzlaştırmayı kendiniz yönetirsiniz

Birebir uyumlu

OpenAI'ı çağırabiliyorsanız konsensüsü de çağırabilirsiniz.

Temel URL'yi ve model tanımlayıcısını değiştirin. Havuzu, hakemi ve modu seçmek için bir x_council bloğu ekleyin. Entegrasyon bu kadar.

cURL — OpenAI uyumlu
curl https://tokonomix.ai/api/v1/chat/completions \
  -H "Authorization: Bearer tok_live_…" \
  -d '{
    "model": "tokonomix-consensus",
    "messages": [{"role":"user","content":"…"}],
    "x_council": {
      "mode": "best_of",
      "models": ["claude-opus-4.8","gpt-5.1","gemini-3-pro"],
      "judge_model": "gpt-5.1"
    }
  }'
MCP — ajanlar için (Claude, Cursor, …)
// tokonomix MCP server
tokonomix_consensus_ask({
  prompt: "…",
  models: ["claude-opus-4.8","gpt-5.1"],
  mode: "full",   // answers + reasoning + verdict
  judge_model: "gpt-5.1"
})

tek araç çağrısı → çok modelli karar, Tokonomix bakiyenizden faturalandırılır

Vision — image consensus (yeni)
IMG=$(base64 -w0 product-shot.png)
curl https://tokonomix.ai/api/v1/chat/completions \
  -H "Authorization: Bearer tok_live_…" \
  -d '{
    "model": "tokonomix-consensus",
    "stream": false,
    "messages": [{"role":"user","content":[
      {"type":"text","text":"Inspect this image for publication-blocking defects. Verdict: DEFECT or CLEAN + findings."},
      {"type":"image_url","image_url":{"url":"data:image/png;base64,'$IMG'"}}
    ]}]
  }'

Yalnızca satır içi base64 (URL fetch yok) · jpeg/png/webp/gif · görsel başına en fazla 5MB · streaming yok · vision modelleri otomatik seçilir

Ne ödersiniz

Tekil çağrılarda ücret yok. Ücret yalnızca konsensüste ödenir.

Tek bir modele sorduğunuzda yalnızca token ücretini ve küçük bir katman marjını ödersiniz — platform ücreti yok. Çağrı başı ücret yalnızca çok modelli konsensüs doğrulamaları için geçerlidir. Her ay 100 konsensüs doğrulaması ücretsiz, kart gerekmez; 500 çağrı için aylık €10'dan başlayan paketler. Her token detaylandırılmış, hiçbir şey gizli değil.

Tekil model çağrısı

token + marj

Çağrı ücreti yok — yalnızca konsensüs doğrulamaları çağrı başı ücret taşır. Model sağlayıcının token fiyatını ve katman marjınızı (+%2–5) ödersiniz. Örnek: ~4k token üzerinde küçük bir model ≈ €0,001.

Konsensüs çağrısı

çağrı ücreti + token + marj

Ücret pakete göre değişir (PAYG kurucu: 2c/proposer + 3c/hakim, 3+1 konsey = 9c; paketlerde: aylık kotanızdan düşer; kota aşımında: 1,5c/çağrı). Bunun üstüne: sağlayıcı tokenları + katman marjınız.

Kendi anahtarınızı getirin (BYOK)

yalnızca çağrı ücreti

Konsensüste yalnızca pakete ait çağrı ücretini ödersiniz — kendi anahtarınız doğrudan sağlayıcıya faturalandırır, bizden token maliyeti veya marj tahsil edilmez. Tekil model BYOK çağrısı ücretsizdir.

AB'de barındırılır

Çıkarım ve günlükler AB'de. Varsayılan olarak GDPR uyumlu.

Bağımlılık yok

Standart SDK'lar. Kodunuza dokunmadan sağlayıcı değiştirin.

Kullandıkça öde

Ön ödemeli bakiye. Koltuk yok, asgari yok, istediğiniz zaman durdurun.

İzlenebilir

Her çağrıda model başına token, maliyet ve gecikme bilgisi.

SSS

Dürüst yanıtlar

Çok modelli konsensüs halüsinasyonu azaltır mı?

Bu bir geri çağırma yükselticisidir, gerçeklik kâhini değil. Birden çok model paralel yanıt verir ve bağımsız bir hakem bunları uzlaştırır; böylece bir modelin hatası daha büyük olasılıkla yakalanır ve anlaşmazlık gizlenmek yerine açığa çıkar. Tek model hatasını azaltır — doğruluğu garanti etmez, çünkü öncü modeller eğitim verisini paylaşır ve birlikte kendinden emin biçimde yanılabilir. Önemli gerçekleri doğrulayın.

Hakem nasıl bağımsız tutulur?

Hakem, önericilerden ayrıdır ve farklı bir model ailesinden seçilir; önericiler kör ve paralel yanıt verir, bu yüzden hakem kendi yanıtını asla puanlamaz. Bu, council'in nasıl kurulduğuna dair bir tasarım özelliğidir, ölçülmüş bir iddia değil.

Verilerimi AB'de tutabilir miyim?

Evet. Bir council'i barındırma bölgesine göre AB'de barındırılan modellere sabitleyebilirsiniz; böylece kişisel veri içeren istemler yalnızca AB'de barındırılan modellere yönlendirilir. Bölge yönlendirmesi çağrı başınadır.

Konsensüsle gönderin

Ücretsiz deneyin. Test için kayıt gerekmez.

Konsensüsü şimdi tarayıcıda çalıştırın, entegre etmeye hazır olduğunuzda bir API anahtarı alın.