Bêta
Tokonomix est en bêta ouverte
Nous construisons en public. Cette page liste — honnêtement — ce qui fonctionne aujourd'hui, ce qui est partiel, et ce qui n'existe pas encore. Utilisez Tokonomix à vos risques pendant cette phase.
Ce que signifie la bêta ici
- Utilisation à vos risques — nous ne proposons pas de contrat de niveau de service (SLA, un engagement garanti sur la disponibilité/le temps de réponse) pendant la bêta.
- Votre solde est en sécurité — nous ne prélevons ni ne réinitialisons jamais les crédits clients.
- Les prix affichés sur la page tarifs peuvent changer une fois la bêta terminée — rien n'est encore fixé.
- Pendant la bêta, aucun frais d'appel n'est facturé pour les appels council. La consommation de tokens de chaque modèle d'un council est facturée au token, comme pour un appel direct.
Fonctionne aujourd'hui
- Points d'accès de la passerelle compatibles OpenAI et natifs Anthropic — pointez votre client existant vers Tokonomix sans le réécrire.
- Un catalogue de plus de 100 modèles chez différents fournisseurs, tenu à jour.
- Modes council — consensus, diff, best-of et full — avec un modèle juge indépendant qui réconcilie les réponses.
- Routage EU-only par clé API, pour les requêtes qui doivent rester dans l'UE.
- Génération et édition d'images, plus embeddings de texte, via la même passerelle.
- Plafonds de budget par clé, pour qu'une seule clé ne puisse pas dépasser son budget.
- Un tableau de bord de facturation en direct qui montre exactement le coût de chaque appel.
- Transcription de la parole en texte via la même passerelle.
- Le téléversement de contexte volumineux par étapes est désormais exploitable par le council — téléversez-le une fois, et chaque proposer et juge lit le même pack de contexte ancré dans la région. Et si vous fournissez un ancrage qu'il ne peut pas utiliser, vous recevez un signal clair au lieu d'une réponse silencieusement non ancrée. Le contexte inline dans le corps de la requête fonctionne aussi.
Bêta / partiel
- Les appels d'outils dans les réponses en streaming sont mis en tampon : ils arrivent d'un coup au lieu de token par token.
- Une fonctionnalité de grounding « contre-question » existe — le modèle peut poser une question de clarification avant de répondre — mais elle est désactivée en attendant calibrage.
- Traiter « le modèle ne peut pas répondre » comme un résultat valide (abstention) est encore en développement.
- Nos propres benchmarks montrent que le council égale le meilleur modèle seul — il ne le bat pas (encore) en précision. Voir les chiffres du benchmark →
Pas encore disponible
- Des webhooks pour les notifications asynchrones.
- Un contrat de niveau de service (SLA) formel.
- Une place de marché pour sous-traiter des tâches à d'autres agents — en développement.
Facturation pendant la bêta, en bref
Aucun frais d'appel pour les appels council pendant la bêta. La consommation de tokens de chaque membre du council (et du judge) est facturée au token, exactement comme les appels directs. Les appels single-model (raw) sont facturés comme avant. Votre solde n'est jamais prélevé ni réinitialisé.