Aller au contenu
Logo Tabby (TabbyML)

Tabby via Tokonomix

Pointez le modèle de chat de Tabby vers Tokonomix dans config.toml — donnez à toute votre équipe auto-hébergée 130+ modèles et une option consensus sur une seule clé.

HTTP chat model (config.toml)Assistant auto-hébergéApache-2.0 · open sourceDocker · auto-hébergé
Tabby — assistant de codage auto-hébergé, via Tokonomix

Qu'est-ce que Tabby ?

Tabby est un assistant de codage IA auto-hébergé — complétion de code et chat pour toute votre équipe depuis un seul serveur que vous gérez. Son modèle de chat est configuré comme un endpoint HTTP dans config.toml, ce qui permet de le pointer vers n'importe quelle API compatible OpenAI, y compris Tokonomix.

  • Fonctionne comme un serveur (Docker) et fournit complétion + chat à chaque développeur de l'instance.
  • Le modèle de chat est un endpoint HTTP — kind = "openai/chat" avec un api_endpoint.
  • Une seule modification dans config.toml met à jour le modèle pour toute l'équipe.
  • Open source et auto-hébergé — vos données restent sur votre serveur.

Pourquoi router le chat de Tabby via Tokonomix ?

  • Offrez à chaque développeur de l'instance une réponse de chat appuyée par tokonomix-consensus.
  • Une clé, 130+ modèles — changez le modèle de chat de façon centralisée sans clés par utilisateur.
  • Les plafonds de dépenses par appel encadrent l'usage de toute l'équipe ; les coûts sont mesurés dans votre tableau de bord.
  • Routez par hosting_region / origin_country pour toute l'instance.

Connecter Tokonomix dans config.toml

Définissez l'endpoint HTTP du modèle de chat vers Tokonomix. (Tokonomix alimente le modèle de chat ; le modèle de complétion de Tabby est un paramètre séparé.)

# config.toml (Tabby server)
[model.chat.http]
kind         = "openai/chat"
api_endpoint = "https://tokonomix.ai/api/v1"
api_key      = "tok_live_your-key"
model_name   = "tokonomix-consensus"

Vérifier que ça fonctionne

  • Redémarrez le serveur Tabby après avoir modifié config.toml.
  • Ouvrez le panneau de chat et posez une question.
  • Confirmez que l'appel et l'utilisation des tokens apparaissent dans votre tableau de bord Tokonomix.

Sélection du modèle

Quel modèle et quel endpoint mon agent doit-il utiliser ?

Choisissez selon ce que fait votre agent, puis changez l'identifiant du modèle à tout moment — chaque modèle du catalogue fonctionne avec la même clé.

Ce que fait votre agentUtilisez ceci
Modifie des fichiers / appelle des outils et diffuse les réponses (la plupart des agents de codage)Un modèle Anthropic via l'endpoint Anthropic (outils + streaming fonctionnent tous les deux)
Appelle des outils mais n'a pas besoin du streaming (n'importe quel modèle)L'endpoint compatible OpenAI avec un identifiant de modèle unique
Veut des outils et du streaming sur un modèle non-AnthropicUtilisez le non-streaming pour l'instant — le streaming des appels d'outils sur d'autres fournisseurs n'est pas encore activé
Chat simple, sans outilsN'importe quel endpoint ; le streaming convient
Veut un verdict multi-modèles (consensus) sur une réponse à enjeu élevéDéfinir le modèle sur tokonomix-consensus sur l'endpoint compatible OpenAI — remarque : le consensus rejette les appels d'outils (pas de tool-calling)
Endpoint & référence API (technique)

anthropic-messages → https://tokonomix.ai/api/anthropic — tools ✓, streaming ✓ (utiliser un modèle Anthropic). openai-completions → https://tokonomix.ai/api/v1 — tools ✓ (passthrough modèle unique), streaming avec outils pas encore disponible. Chat simple : le streaming fonctionne sur les deux. Consensus : openai-completions, modèle tokonomix-consensus, sans outils. Remplacez l'identifiant de modèle par n'importe quel slug renvoyé par GET /api/v1/models.

Parcourir tous les modèles →

Related agents