Naar inhoud
Hermes Agent-logo (Nous Research)

Hermes via Tokonomix

Verbind Nous Research's self-improving, self-hosted agent met 132 modellen achter één sleutel — en voeg cross-family consensus toe aan elke autonome run.

OpenAI-compatible base URLMCP-capableTool calling ondersteundSelf-hosted TUI-agentMIT · open sourceWindows · macOS · Linux
Hermes Agent — officiële banner door Nous Research

Wat is Hermes?

Hermes is een open-source, self-hosted AI-agent van Nous Research, uitgebracht in februari 2026 onder een MIT-licentie. Het beschrijft zichzelf als de enige agent met een ingebouwde leerloop: het maakt skills van ervaringen, verbetert ze tijdens gebruik, doorzoekt zijn eigen eerdere gesprekken en bouwt een steeds dieper model van wie je bent over sessies heen. Je draait het op je eigen infrastructuur — een $5 VPS, een GPU-cluster, of serverless backends die vrijwel niets kosten tijdens inactiviteit — en bereikt het via een echte terminal UI of via Telegram, Discord, Slack, WhatsApp en Signal.

Standaard wordt Hermes geleverd met 40+ tools en skills, een ingebouwde cron-scheduler, parallelle sub-agent spawning en zes terminal-backends (local, Docker, SSH, Singularity, Modal, Daytona). Omdat alles op je eigen machine draait, blijven je gegevens lokaal — geen telemetrie, geen verplichte cloud. Dat privacy-first ontwerp maakt de keuze van welk modelbrein Hermes aanstuurt volledig van jou.

En dat is precies waar Tokonomix past. Hermes kan naar elk OpenAI-compatible endpoint wijzen, wat betekent dat één Tokonomix API-sleutel 132 frontier-modellen ontsluit — Anthropic, OpenAI, Google, Mistral, Meta en anderen — zonder dat je bij elke provider apart moet aanmelden, factureren of sleutels roteren. Wissel van brein met één commando: hermes model.

Hermes Agent — open source, self-hosted, persistent geheugen, multi-platform
Hermes Agent door Nous Research — officieel projectmateriaal (MIT, self-hosted, multi-platform).

Waarom Hermes via Tokonomix routeren?

Hermes voert lange, autonome sessies uit: het plant, spawnt sub-agents, roept tools aan en committet werk zonder dat een mens elke stap beoordeelt. Het grootste risico in die lus is een vroege zelfverzekerd-maar-foute beslissing waarop de agent dan vijftig stappen verder bouwt. Tokonomix pakt dit direct aan.

  • Cross-family consensus. Wijs Hermes naar het tokonomix-consensus-model en elke aanroep wordt beantwoord door 2–6 frontier-modellen parallel, vervolgens samengevoegd door een judge-model tot één geverifieerd antwoord. Gehallusineerde API-aanroepen en architectuurdoodlopende wegen worden onderschept voordat de agent erop handelt.
  • Één sleutel, 132 modellen. Wissel van brein — Claude, GPT, Gemini, Mistral — door één model-slug te wijzigen, geen nieuw provideraccount.
  • Soevereiniteitsrouting — jouw keuze, niet alleen EU. Pinning van modellen op locatie (hosting_region) of herkomst (origin_country) — alleen EU, alleen VS, één land of een aangepaste set. Afdwingen per aanroep, of een vooraf gedefinieerde regel instellen (bijv. automatisch EU-modellen selecteren) in je dashboard; je data blijft al lokaal aan de Hermes-kant.
  • Transparante kosten per aanroep. Elke autonome run wordt tot op de cent bijgehouden in je Tokonomix-dashboard — essentieel wanneer een agent duizenden aanroepen onbeheerd kan uitvoeren.

Hermes installeren — Windows, macOS, Linux (ook WSL2 & Termux)

Hermes installeert met één commando en voorziet zichzelf van afhankelijkheden (uv, Python 3.11, Node.js, ripgrep, ffmpeg, plus een draagbare MinGit op native Windows). Native Windows wordt volledig ondersteund — geen WSL vereist.

⊞ Windows
PowerShell (native)
iex (irm https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.ps1)
macOS
Terminal · zsh/bash
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
🐧 Linux
ook WSL2 · Termux
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

Herlaad daarna je shell en start op:

# reload (macOS/Linux) — Windows opens a fresh shell automatically
source ~/.bashrc      # or: source ~/.zshrc
hermes                # start the terminal UI

Je Tokonomix-sleutel instellen

Nog geen sleutel?

Maak een gratis account aan op tokonomix.ai/dashboard/signup — inclusief een gratis startsaldo — genereer vervolgens een sleutel (tok_live_…) en stel deze hieronder in.

Heb je al een sleutel? Hermes behandelt Tokonomix als een aangepaste OpenAI-compatible provider. Genereer een sleutel (tok_live_…) in je Tokonomix-dashboard en stel deze in op een van drie manieren — allemaal gelijkwaardig.

① Configuratiebestand — ~/.hermes/config.yaml

model:
  provider:  custom
  model:     "tokonomix-consensus"
  base_url:  "https://tokonomix.ai/api/v1"
  api_key:   "tok_live_your-key"

② CLI — hermes config set

hermes config set model.provider custom
hermes config set model.model    "tokonomix-consensus"
hermes config set model.base_url "https://tokonomix.ai/api/v1"
hermes config set model.api_key  "tok_live_your-key"

③ Omgeving — ~/.hermes/.env

OPENAI_BASE_URL=https://tokonomix.ai/api/v1
OPENAI_API_KEY=tok_live_your-key
Houd de sleutel buiten git

Geef de voorkeur aan de .env- of hermes config set-route boven het committen van config.yaml. Hermes slaat configuratie op onder ~/.hermes (of %LOCALAPPDATA%\hermes op native Windows) — standaard buiten je repo.

Skills & MCP-tools toevoegen

Er zijn twee complementaire manieren om Tokonomix-consensus in Hermes te krijgen — en Hermes' eigen skill-systeem bouwt er netjes op voort.

Route A — consensus als model

Elke aanroep wordt geverifieerd. Tokonomix is een single-model slot in Hermes (aangepaste providers worden niet opgesomd in de kiezer) — stel de slug rechtstreeks in:

# turn consensus on
hermes config set model.model "tokonomix-consensus"
# or any Tokonomix slug — e.g. a fast direct model
hermes config set model.model "anthropic/claude-sonnet-4-6"
# one-off override for a single run
hermes --model "tokonomix-consensus"
# or switch mid-chat
/model custom:tokonomix-consensus

Route B — consensus als MCP-tool

Hermes ondersteunt MCP. Voeg de Tokonomix MCP-server toe zodat de agent consensus op aanvraag kan aanroepen terwijl hij normaal een snel model gebruikt.

# ~/.hermes/config.yaml
mcp_servers:
  tokonomix:
    command: "npx"
    args: ["-y", "tokonomix-mcp"]
    env:
      TOKONOMIX_API_KEY: "tok_live_your-key"

Herlaad na het bewerken van de MCP-config zonder opnieuw te starten:

# inside a Hermes chat
/reload-mcp
# browse what's now available (Hermes skills + MCP tools)
/skills
Of gewoon vragen — geen handmatige config

Je hoeft config.yaml niet handmatig te bewerken. Hermes installeert MCP-servers vanuit zijn catalogus met hermes mcp install (of blader interactief met hermes mcp), en omdat Hermes een agent is kun je in de chat gewoon zeggen: "Voeg de Tokonomix MCP-server toe — npx -y tokonomix-mcp — met mijn sleutel." Het schrijft de config en herlaadt zijn tools voor je.

De Tokonomix MCP-server biedt tools zoals tokonomix_consensus_ask (multi-model geverifieerd antwoord), tokonomix_single_ask, tokonomix_list_models en tokonomix_get_skill. Hermes kan dan consensus alleen inschakelen bij riskante stappen — een refactor, een beveiligingsbeslissing, een "klopt dit echt?"-moment — terwijl de latentie overal elders laag blijft. Bekijk Hermes’ eigen ingebouwde skills op dezelfde manier met /skills; ze zijn compatibel met de agentskills.io open standaard.

Hermes gebruiken binnen een IDE

Om precies te zijn: Hermes is geen IDE-extensie. Het installeert niet in VS Code, Antigravity of JetBrains als plugin zoals Cline, Continue of Cursor’s agent doen. Hermes is een volwaardige terminal-UI-agent (en berichtengateway) die native draait op Windows, macOS en Linux. Het integreert op twee praktische manieren met je editor:

  • Vanuit de geïntegreerde terminal. Open de ingebouwde terminal in VS Code, Antigravity, Zed of JetBrains en voer hermes daar uit. Het werkt in dezelfde werkmap die je editor open heeft, zodat bestandsbewerkingen en git-commits direct zichtbaar zijn in je bronbeheerpaneel.
  • Als remote agent op je repo. Hermes kan draaien op een SSH-host of serverless backend en committen via zijn GitHub-skill. Je blijft coderen in je IDE terwijl Hermes dezelfde branch bewerkt vanuit zijn eigen omgeving — je bekijkt zijn commits zodra ze binnenkomen.

Dus: wil je een inline-bewerkingsassistent in de editor? Combineer een dedicated IDE-agent (zie gerelateerde hieronder) met Tokonomix. Wil je een autonome teamgenoot die taken van begin tot eind uitvoert en terugrapporteert? Hermes is de juiste tool — en de geïntegreerde terminal van je IDE is de voordeur.

OmgevingHoe Hermes daar werktInline bewerkingen?
VS CodeVoer hermes uit in de geïntegreerde terminal; bewerkingen verschijnen in de open workspaceVia terminal, niet als extensie
AntigravityIdem — geïntegreerde terminal; Hermes deelt de werkmapVia terminal
ZedTerminalpaneel, of SSH-remote uitvoeringshostVia terminal
JetBrainsTerminalvenster; commits zichtbaar in het VCS-paneelVia terminal
Headless / serverThuisomgeving — Docker, SSH, Modal; bereikbaar via Telegram/SlackVolledig autonoom

Controleer of het werkt

Vraag Hermes na het instellen van de provider om een kleine, omkeerbare wijziging — bijvoorbeeld een docstring toevoegen — en bekijk je Tokonomix-dashboard. Je zou een gemeten aanroep tegen tokonomix-consensus moeten zien in je Tokonomix-dashboard, met het multi-model oordeel in de x_council-response. Geef Hermes daarna een echte taak en laat consensus de doodlopende wegen onderscheppen voordat ze je een vijftig stappen lange omweg kosten.

Kort samengevat

Hermes houdt je data en uitvoering lokaal; Tokonomix geeft het één sleutel tot 132 modellen plus een consensus-vangnet voor elke autonome beslissing. Eenmalig instellen, van brein wisselen door een slug te wijzigen — of voeg de MCP-server toe om consensus op aanvraag aan te roepen.

Modelselectie

Welk model en endpoint moet mijn agent gebruiken?

Kies op basis van wat je agent doet en wissel het model id op elk moment — elk model in de catalogus werkt via dezelfde sleutel.

Wat je agent doetGebruik dit
Bewerkt bestanden / roept tools aan en streamt antwoorden (de meeste coding agents)Een Anthropic-model via het Anthropic-endpoint (tools + streaming werken allebei)
Roept tools aan maar heeft geen streaming nodig (elk model)Het OpenAI-compatibele endpoint met één model id
Wil tools én streaming op een niet-Anthropic-modelGebruik voorlopig non-streaming — streaming tool-calls voor andere providers is nog niet beschikbaar
Gewone chat, geen toolsElk endpoint; streaming is prima
Wil een cross-model verdict (consensus) op een antwoord met hoge inzetStel model in op tokonomix-consensus op het OpenAI-compatibele endpoint — let op: consensus weigert tool-aanvragen (geen tool-calling)
Endpoint & API-referentie (technisch)

anthropic-messages → https://tokonomix.ai/api/anthropic — tools ✓, streaming ✓ (gebruik een Anthropic-model). openai-completions → https://tokonomix.ai/api/v1 — tools ✓ (single-model passthrough), streaming met tools nog niet beschikbaar. Gewone chat: streaming werkt op beide. Consensus: openai-completions, model tokonomix-consensus, geen tools. Wissel het model id naar een willekeurige slug die GET /api/v1/models teruggeeft.

Bekijk alle modellen →

Related agents