Zum Inhalt
Tabby-Logo (TabbyML)

Tabby via Tokonomix

Zeige Tabbys Chat-Modell in config.toml auf Tokonomix — gib deinem gesamten self-hosted Team 130+ Modelle und eine Consensus-Option auf einem Schlüssel.

HTTP-Chat-Modell (config.toml)Self-Hosted-AssistentApache-2.0 · open sourceDocker · self-hosted
Tabby — self-hosted Coding-Assistent, via Tokonomix

Was ist Tabby?

Tabby ist ein self-hosted KI-Coding-Assistent — Code-Completion und Chat für dein gesamtes Team von einem Server, den du selbst betreibst. Sein Chat-Modell wird als HTTP-Endpunkt in config.toml konfiguriert, sodass du es auf jede OpenAI-kompatible API zeigen kannst, einschließlich Tokonomix.

  • Läuft als Server (Docker) und stellt allen Entwicklern auf der Instanz Completion + Chat bereit.
  • Das Chat-Modell ist ein HTTP-Endpunkt — kind = "openai/chat" mit einem api_endpoint.
  • Eine Änderung in config.toml aktualisiert das Modell für das gesamte Team.
  • Open Source und self-hosted — deine Daten bleiben auf deinem Server.

Warum Tabbys Chat über Tokonomix routen?

  • Gib jedem Entwickler auf der Instanz eine tokonomix-consensus-gestützte Chat-Antwort.
  • Ein Schlüssel, 130+ Modelle — tausche das Chat-Modell zentral aus, ohne pro-User-Schlüssel.
  • Pro-Aufruf-Ausgabenlimits begrenzen die teamweite Nutzung; Kosten werden im Dashboard gemessen.
  • Routen nach hosting_region / origin_country für die gesamte Instanz.

Tokonomix in config.toml verbinden

Setze den HTTP-Endpunkt des Chat-Modells auf Tokonomix. (Tokonomix treibt das Chat-Modell an; Tabbys Completion-Modell ist eine separate Einstellung.)

# config.toml (Tabby server)
[model.chat.http]
kind         = "openai/chat"
api_endpoint = "https://tokonomix.ai/api/v1"
api_key      = "tok_live_your-key"
model_name   = "tokonomix-consensus"

Funktionstest

  • Starte den Tabby-Server nach dem Bearbeiten von config.toml neu.
  • Öffne das Chat-Panel und stelle eine Frage.
  • Prüfe, ob Aufruf und Token-Verbrauch in deinem Tokonomix-Dashboard erscheinen.

Modellauswahl

Welches Modell und welchen Endpunkt soll mein Agent verwenden?

Wähle nach dem, was dein Agent tut, und tausche die Modell-ID jederzeit aus — jedes Modell im Katalog funktioniert über denselben Schlüssel.

Was dein Agent tutVerwende dies
Bearbeitet Dateien / ruft Tools auf und streamt Antworten (die meisten Coding-Agents)Ein Anthropic-Modell über den Anthropic-Endpunkt (Tools + Streaming funktionieren beide)
Ruft Tools auf, benötigt aber kein Streaming (beliebiges Modell)Der OpenAI-kompatible Endpunkt mit einer einzelnen Modell-ID
Benötigt Tools und Streaming auf einem Nicht-Anthropic-ModellVerwende vorerst Non-Streaming — Streaming-Tool-Calls für andere Anbieter sind noch nicht aktiviert
Normaler Chat, keine ToolsBeliebiger Endpunkt; Streaming ist in Ordnung
Möchte ein modellübergreifendes Urteil (Konsens) bei einer wichtigen AntwortModell auf tokonomix-consensus am OpenAI-kompatiblen Endpunkt setzen — Hinweis: Konsens weist Tool-Anfragen ab (kein Tool-Calling)
Endpunkt & API-Referenz (technisch)

anthropic-messages → https://tokonomix.ai/api/anthropic — tools ✓, streaming ✓ (ein Anthropic-Modell verwenden). openai-completions → https://tokonomix.ai/api/v1 — tools ✓ (Single-Model-Passthrough), Streaming mit Tools noch nicht verfügbar. Normaler Chat: Streaming funktioniert auf beiden. Konsens: openai-completions, Modell tokonomix-consensus, keine Tools. Modell-ID gegen einen beliebigen Slug aus GET /api/v1/models austauschen.

Alle Modelle ansehen →

Related agents