Canlı Test
Modelleri doğrudan test edin
Herhangi bir modele prompt gönderin ve yanıtın gerçek zamanlı akışını izleyin. İki modeli hız ve kalite açısından yan yana karşılaştırın.
Etkileşimli model test aracı
Test aracı tarayıcınızda çalışır ve JavaScript gerektirir. Canlı katalogdan bir model seçin, bir prompt gönderin ve yanıtın token token akışını izleyin — gecikme ve token sayıları anlık ölçülür.
- Single — Tek model, tek prompt, zamanlama istatistikleriyle tek akışlı yanıt.
- Compare — İki model aynı prompt'u yan yana, eşzamanlı akışla yanıtlar — hız ve üslup farkları doğrudan görünür.
- Consensus — Birden çok model paralel yanıt verir ve bir hakem model tek bir konsensüs yanıtı sentezler — Consensus API'mizin arkasındaki mekanizmanın aynısı.
Canlı test nasıl çalışır
Bir model seçin
Aşağıda sağlayıcıya göre gruplanmış modellerden seçim yapın. Liste canlı katalogdur — modeller eklendikçe veya emekliye ayrıldıkça güncellenir.
Prompt gönderin
Kendi prompt'unuzu yazın veya topluluğun önerdiği bir test sorusuyla başlayın. İstek, API ağ geçidimiz üzerinden sağlayıcıya gider — ücretli API'mizin kullandığı yolun aynısı.
Akışı izleyin
Tokenlar geldikçe ekrana yansır; gecikme ve token sayıları canlı görünür — bir modelin nasıl yanıt verdiğini görürsünüz, yalnızca tek bir nihai sayıyı değil.
Üç test modu
Single
Tek model, tek prompt, zamanlama istatistikleriyle tek akışlı yanıt.
Compare
İki model aynı prompt'u yan yana, eşzamanlı akışla yanıtlar — hız ve üslup farkları doğrudan görünür.
Consensus
Birden çok model paralel yanıt verir ve bir hakem model tek bir konsensüs yanıtı sentezler — Consensus API'mizin arkasındaki mekanizmanın aynısı.
Model kapsamı
Şu anda canlı test için 5 sağlayıcıdan 30 model etkin:
- Google Gemini: Gemini 3.5 Flash, Gemini 2.5 Flash, Gemini Flash Latest, Gemini 2.5 Pro
- OpenAI: o3-mini-2025-01-31, gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14, gpt-4o, o4-mini-2025-04-16, gpt-4o-mini, gpt-4.1-nano-2025-04-14, gpt-4o-mini-2024-07-18
- OVH AI Endpoints (GRA): gpt-oss-120b, gpt-oss-20b
- OpenRouter: Cohere Command-A, Nous Hermes 3 70B, Llama 4 Scout, MiniMax M2.5, DeepSeek v3.2, Qwen 2.5 VL 72B Instruct, DeepSeek v4 Pro, Mistral Voxtral Small 24B, Qwen 3.6 Plus, NVIDIA Nemotron Super 49B v1.5, Llama 4 Maverick, Llama 3.3 70B Instruct, Qwen 3.7 Max
- Anthropic: Claude Sonnet 4.5, Claude Sonnet 4.6, Claude Haiku 4.5
Ücretsiz demo koşulları
Canlı test ücretsizdir ve kayıt gerektirmez. Misafirler günde sınırlı sayıda çalıştırma alır; ücretsiz bir hesap bu günlük hakkı yükseltir. Limitler her 24 saatte sıfırlanır ve demoyu herkes için erişilebilir tutar.
Sayılar nereden geliyor
- Benchmark metodolojisi — Modelleri her hafta nasıl test ettiğimiz — puanlama, hakemler ve veri kümeleri.
- Consensus API — Çok modelli konsensüs modunun üretim API'si hâli.
- Liderlik tablosu — Aynı test çalıştırmalarından güncel hız ve kalite sıralamaları.