Naar inhoud
Tabby-logo (TabbyML)

Tabby via Tokonomix

Wijs Tabby’s chatmodel in config.toml naar Tokonomix — geef je hele self-hosted team 130+ modellen en een consensusoptie op één sleutel.

HTTP chat model (config.toml)Self-hosted assistentApache-2.0 · open sourceDocker · self-hosted
Tabby — self-hosted coding-assistent, via Tokonomix

Wat is Tabby?

Tabby is een self-hosted AI coding-assistent — codecompletering en chat voor je hele team vanaf één server die jij beheert. Het chatmodel wordt geconfigureerd als een HTTP-endpoint in config.toml, zodat je het kunt laten wijzen naar elke OpenAI-compatible API, inclusief Tokonomix.

  • Draait als een server (Docker) en biedt completering + chat aan elke ontwikkelaar op de instantie.
  • Het chatmodel is een HTTP-endpoint — kind = "openai/chat" met een api_endpoint.
  • Eén wijziging in config.toml werkt het model bij voor het hele team.
  • Open source en self-hosted — je data blijft op je eigen server.

Waarom Tabby’s chat via Tokonomix routeren?

  • Geef elke ontwikkelaar op de instantie een tokonomix-consensus-ondersteund chatantwoord.
  • Eén sleutel, 130+ modellen — wissel het chatmodel centraal zonder sleutels per gebruiker.
  • Bestedingslimieten per aanroep begrenzen het teamwijde gebruik; kosten worden gemeten in je dashboard.
  • Routeer op hosting_region / origin_country voor de hele instantie.

Tokonomix verbinden in config.toml

Stel het HTTP-endpoint van het chatmodel in op Tokonomix. (Tokonomix bedient het chatmodel; het completionmodel van Tabby is een aparte instelling.)

# config.toml (Tabby server)
[model.chat.http]
kind         = "openai/chat"
api_endpoint = "https://tokonomix.ai/api/v1"
api_key      = "tok_live_your-key"
model_name   = "tokonomix-consensus"

Controleer of het werkt

  • Herstart de Tabby-server na het bewerken van config.toml.
  • Open het chatpaneel en stel een vraag.
  • Controleer of de aanroep en het tokengebruik zichtbaar zijn in je Tokonomix-dashboard.

Modelselectie

Welk model en endpoint moet mijn agent gebruiken?

Kies op basis van wat je agent doet en wissel het model id op elk moment — elk model in de catalogus werkt via dezelfde sleutel.

Wat je agent doetGebruik dit
Bewerkt bestanden / roept tools aan en streamt antwoorden (de meeste coding agents)Een Anthropic-model via het Anthropic-endpoint (tools + streaming werken allebei)
Roept tools aan maar heeft geen streaming nodig (elk model)Het OpenAI-compatibele endpoint met één model id
Wil tools én streaming op een niet-Anthropic-modelGebruik voorlopig non-streaming — streaming tool-calls voor andere providers is nog niet beschikbaar
Gewone chat, geen toolsElk endpoint; streaming is prima
Wil een cross-model verdict (consensus) op een antwoord met hoge inzetStel model in op tokonomix-consensus op het OpenAI-compatibele endpoint — let op: consensus weigert tool-aanvragen (geen tool-calling)
Endpoint & API-referentie (technisch)

anthropic-messages → https://tokonomix.ai/api/anthropic — tools ✓, streaming ✓ (gebruik een Anthropic-model). openai-completions → https://tokonomix.ai/api/v1 — tools ✓ (single-model passthrough), streaming met tools nog niet beschikbaar. Gewone chat: streaming werkt op beide. Consensus: openai-completions, model tokonomix-consensus, geen tools. Wissel het model id naar een willekeurige slug die GET /api/v1/models teruggeeft.

Bekijk alle modellen →

Related agents