Naar inhoud
AnythingLLM-logo (Mintplex Labs)

AnythingLLM via Tokonomix

Stel de Generic OpenAI-provider in AnythingLLM in op Tokonomix — gebruik chat, RAG en agents met 130+ modellen en consensus op één sleutel.

Generic OpenAI providerAll-in-one AI-app (RAG + agents)MIT · open sourceDesktop · Docker · self-hosted
AnythingLLM — all-in-one AI-app, via Tokonomix

Wat is AnythingLLM?

AnythingLLM (van Mintplex Labs) is een all-in-one AI-applicatie — chat over je documenten (RAG), agents en workspaces — die je op de desktop uitvoert of self-host. De Generic OpenAI LLM-provider wijst naar elk OpenAI-compatible endpoint, inclusief Tokonomix.

  • Documentchat (RAG), agent-skills en multi-workspace-organisatie.
  • Een Generic OpenAI LLM-provider met een basis-URL, sleutel en modelnaam.
  • Configureerbaar via de UI of omgevingsvariabele.
  • Open source, desktop of Dockerized.

Waarom AnythingLLM via Tokonomix routeren?

  • Één provider, 130+ modellen — kies tokonomix-consensus voor antwoorden op hoge inzet over je documenten.
  • Per-aanroep uitgaveplafonds begrenzen RAG- en agentgebruik.
  • Regio- en herkomstroutering houdt op documenten gebaseerde antwoorden compliant.
  • Wissel van model door één veld aan te passen.

Tokonomix verbinden met AnythingLLM

Kies bij LLM Preference Generic OpenAI en vul de basis-URL, sleutel, chatmodel en tokenlimiet in (of stel de bijbehorende omgevingsvariabelen in).

# LLM Preference → Generic OpenAI  (or env)
GENERIC_OPEN_AI_BASE_PATH=https://tokonomix.ai/api/v1
GENERIC_OPEN_AI_MODEL_PREF=tokonomix-consensus
GENERIC_OPEN_AI_API_KEY=tok_live_your-key
GENERIC_OPEN_AI_MODEL_TOKEN_LIMIT=200000

Controleer of het werkt

  • Sla de Generic OpenAI-instellingen op (of herstart met de omgevingsvariabelen).
  • Stel een vraag in een workspace en bevestig dat er een antwoord terugkomt.
  • Controleer de aanroep en het tokenverbruik in je Tokonomix-dashboard.

Modelselectie

Welk model en endpoint moet mijn agent gebruiken?

Kies op basis van wat je agent doet en wissel het model id op elk moment — elk model in de catalogus werkt via dezelfde sleutel.

Wat je agent doetGebruik dit
Bewerkt bestanden / roept tools aan en streamt antwoorden (de meeste coding agents)Een Anthropic-model via het Anthropic-endpoint (tools + streaming werken allebei)
Roept tools aan maar heeft geen streaming nodig (elk model)Het OpenAI-compatibele endpoint met één model id
Wil tools én streaming op een niet-Anthropic-modelGebruik voorlopig non-streaming — streaming tool-calls voor andere providers is nog niet beschikbaar
Gewone chat, geen toolsElk endpoint; streaming is prima
Wil een cross-model verdict (consensus) op een antwoord met hoge inzetStel model in op tokonomix-consensus op het OpenAI-compatibele endpoint — let op: consensus weigert tool-aanvragen (geen tool-calling)
Endpoint & API-referentie (technisch)

anthropic-messages → https://tokonomix.ai/api/anthropic — tools ✓, streaming ✓ (gebruik een Anthropic-model). openai-completions → https://tokonomix.ai/api/v1 — tools ✓ (single-model passthrough), streaming met tools nog niet beschikbaar. Gewone chat: streaming werkt op beide. Consensus: openai-completions, model tokonomix-consensus, geen tools. Wissel het model id naar een willekeurige slug die GET /api/v1/models teruggeeft.

Bekijk alle modellen →

Related agents