Prueba en vivo
Prueba los modelos directamente
Envía un prompt a cualquier modelo y mira la respuesta llegar en streaming en tiempo real. Compara dos modelos lado a lado en velocidad y calidad.
Probador de modelos interactivo
El probador se ejecuta en tu navegador y necesita JavaScript. Elige un modelo del catálogo en vivo, envía un prompt y observa la respuesta llegar token a token — con latencia y recuento de tokens medidos en directo.
- Single — Un modelo, un prompt, una respuesta en streaming con estadísticas de tiempo.
- Compare — Dos modelos responden al mismo prompt lado a lado, en streaming simultáneo — las diferencias de velocidad y estilo se ven directamente.
- Consensus — Varios modelos responden en paralelo y un modelo juez sintetiza una respuesta de consenso — el mismo mecanismo de nuestra API de Consenso.
Cómo funciona la prueba en vivo
Elige un modelo
Elige entre los modelos listados abajo, agrupados por proveedor. La lista es el catálogo en vivo — cambia cuando se añaden o retiran modelos.
Envía un prompt
Escribe tu propio prompt o parte de una pregunta de prueba sugerida por la comunidad. La petición va al proveedor a través de nuestra pasarela API — el mismo camino que usa nuestra API de pago.
Mira el streaming
Los tokens aparecen según llegan, con latencia y recuento de tokens en directo — ves cómo responde un modelo, no solo una cifra final.
Tres modos de prueba
Single
Un modelo, un prompt, una respuesta en streaming con estadísticas de tiempo.
Compare
Dos modelos responden al mismo prompt lado a lado, en streaming simultáneo — las diferencias de velocidad y estilo se ven directamente.
Consensus
Varios modelos responden en paralelo y un modelo juez sintetiza una respuesta de consenso — el mismo mecanismo de nuestra API de Consenso.
Cobertura de modelos
30 modelos de 5 proveedores están habilitados actualmente para pruebas en vivo:
- Google Gemini: Gemini 3.5 Flash, Gemini 2.5 Flash, Gemini Flash Latest, Gemini 2.5 Pro
- OpenAI: o3-mini-2025-01-31, gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14, gpt-4o, o4-mini-2025-04-16, gpt-4o-mini, gpt-4.1-nano-2025-04-14, gpt-4o-mini-2024-07-18
- OVH AI Endpoints (GRA): gpt-oss-120b, gpt-oss-20b
- OpenRouter: Cohere Command-A, Nous Hermes 3 70B, Llama 4 Scout, MiniMax M2.5, DeepSeek v3.2, Qwen 2.5 VL 72B Instruct, DeepSeek v4 Pro, Mistral Voxtral Small 24B, Qwen 3.6 Plus, NVIDIA Nemotron Super 49B v1.5, Llama 4 Maverick, Llama 3.3 70B Instruct, Qwen 3.7 Max
- Anthropic: Claude Sonnet 4.5, Claude Sonnet 4.6, Claude Haiku 4.5
Condiciones de la demo gratuita
La prueba en vivo es gratuita y no requiere registro. Los invitados tienen un número limitado de ejecuciones al día; una cuenta gratuita amplía ese cupo diario. Los límites se restablecen cada 24 horas y mantienen la demo disponible para todos.
De dónde salen las cifras
- Metodología de benchmarks — Cómo probamos los modelos cada semana — puntuación, jueces y conjuntos de datos.
- API de Consenso — El modo de consenso multimodelo como API de producción.
- Clasificación — Rankings actuales de velocidad y calidad de las mismas ejecuciones de prueba.