Zum Inhalt

Beta

Tokonomix befindet sich in der offenen Beta

Wir bauen öffentlich. Diese Seite listet ehrlich auf, was heute funktioniert, was teilweise fertig ist und was noch nicht existiert. Nutzen Sie Tokonomix in dieser Phase auf eigenes Risiko.

Was Beta hier bedeutet

  • Nutzung auf eigenes Risiko — während der Beta bieten wir kein Service-Level-Agreement (SLA, eine garantierte Zusage zu Verfügbarkeit/Reaktionszeit).
  • Dein Guthaben ist sicher — wir ziehen niemals Kundenguthaben ein oder setzen es zurück.
  • Die auf der Preisseite gezeigten Preise können sich nach Ende der Beta ändern — noch ist nichts festgelegt.
  • Während der Beta berechnen wir keine Call-Gebühr für Council-Calls. Der Token-Verbrauch jedes Modells in einem Council wird pro Token abgerechnet, genau wie bei einem direkten Call.

Funktioniert heute

  • OpenAI-kompatible und Anthropic-native Gateway-Endpunkte — richten Sie Ihren bestehenden Client auf Tokonomix, ohne ihn umzuschreiben.
  • Ein Modellkatalog mit 100+ Modellen verschiedener Anbieter, laufend aktualisiert.
  • Council-Modi — consensus, diff, best-of und full — mit einem unabhängigen Judge-Modell, das die Antworten zusammenführt.
  • EU-only-Routing pro API-Key für Anfragen, die innerhalb der EU bleiben müssen.
  • Bildgenerierung und -bearbeitung sowie Text-Embeddings über dasselbe Gateway.
  • Budgetobergrenzen pro Key, damit ein einzelner Key nicht überziehen kann.
  • Ein Live-Abrechnungs-Dashboard, das genau zeigt, was jede Anfrage gekostet hat.
  • Sprache-zu-Text-Transkription über dasselbe Gateway.
  • Großer, gestufter Kontext-Upload ist jetzt vom Council nutzbar — einmal hochladen, und jeder Proposer und Judge liest dasselbe regionsgebundene Kontext-Paket. Und wenn Sie Grounding mitschicken, das nicht verwendet werden kann, erhalten Sie ein klares Signal statt einer stillen, ungegroundeten Antwort. Inline-Kontext im Request-Body funktioniert ebenfalls.

Beta / teilweise fertig

  • Tool-Calls in Streaming-Antworten werden gepuffert: Sie kommen auf einmal an, nicht Token für Token.
  • Eine Grounding-"Rückfrage"-Funktion existiert — das Modell kann vor der Antwort eine klärende Rückfrage stellen —, ist aber bis zur Kalibrierung abgeschaltet.
  • "Das Modell kann nicht antworten" als gültiges Ergebnis zu behandeln (Enthaltung), ist noch in Entwicklung.
  • Unsere eigenen Benchmarks zeigen, dass der Council mit dem besten Einzelmodell gleichzieht — er schlägt es (noch) nicht bei der Genauigkeit. Benchmark-Zahlen ansehen →

Noch nicht verfügbar

  • Webhooks für asynchrone Benachrichtigungen.
  • Ein formelles Service-Level-Agreement (SLA).
  • Ein Marktplatz zum Auslagern von Aufgaben an andere Agents — in Entwicklung.

Beta-Abrechnung, kurz gefasst

Keine Call-Gebühr für Council-Calls während der Beta. Der Token-Verbrauch jedes Council-Mitglieds (und des Judges) wird pro Token abgerechnet, genau wie bei direkten Calls. Single-Model-Calls (raw) werden wie bisher abgerechnet. Dein Guthaben wird niemals eingezogen oder zurückgesetzt.

← Zurück zur Startseite