Aller au contenu
logo llm

llm via Tokonomix

Ajoutez Tokonomix dans extra-openai-models.yaml de llm — accédez à 130+ modèles et au consensus sur une seule clé depuis le CLI de Simon Willison.

extra-openai-models.yamlCLIApache-2.0 · open sourcemacOS · Windows · Linux
llm — client LLM en ligne de commande et bibliothèque, via Tokonomix

Qu'est-ce que llm ?

llm est le client en ligne de commande et la bibliothèque Python de Simon Willison pour les grands modèles de langage. Il enregistre chaque prompt et réponse dans SQLite, prend en charge les plugins, et peut enregistrer n'importe quel modèle compatible OpenAI via un fichier YAML — ce qui est exactement comment Tokonomix s'intègre.

  • Exécute des prompts depuis le shell et pipe stdin dans un modèle.
  • Enregistre des modèles supplémentaires compatibles OpenAI dans extra-openai-models.yaml (model_id, model_name, api_base, api_key_name).
  • Prend en charge l'appel d'outils via le flag supports_tools sur une entrée de modèle.
  • Open source ; les clés sont stockées avec llm keys set, pas dans le YAML.

Pourquoi router llm via Tokonomix ?

  • Une seule clé Tokonomix dans extra-openai-models.yaml donne accès à 130+ modèles sans jongler avec des clés par fournisseur.
  • Pointez un model_id sur tokonomix-consensus pour que les requêtes complexes obtiennent un verdict multi-modèles ; utilisez un slug direct pour les one-liners de routine.
  • Les plafonds de dépense par appel encadrent l'usage, et le routage par région / origine maintient la conformité des prompts sensibles.
  • Chaque appel est mesuré au centime près dans votre tableau de bord Tokonomix.

Connecter Tokonomix dans extra-openai-models.yaml

Ajoutez une entrée de modèle Tokonomix dans extra-openai-models.yaml, puis stockez la clé avec llm keys set.

# ~/.config/io.datasette.llm/extra-openai-models.yaml
- model_id: anthropic/claude-sonnet-4-6
  model_name: anthropic/claude-sonnet-4-6
  api_base: "https://tokonomix.ai/api/v1"
  api_key_name: tokonomix
  supports_tools: true
# Opt-in (planning/review only, no tool-calling): add a second entry with model_id/model_name: tokonomix-consensus

# then: llm keys set tokonomix   (paste tok-your-key)
# llm -m anthropic/claude-sonnet-4-6 "Explain quorum sensing"

Vérifier que ça fonctionne

  • Ajoutez l'entrée de modèle et exécutez llm keys set tokonomix pour stocker votre clé.
  • Envoyez un petit prompt : llm -m tokonomix-consensus "Explain quorum sensing".
  • Confirmez l'appel et l'usage des tokens dans votre tableau de bord Tokonomix.

Sélection du modèle

Quel modèle et quel endpoint mon agent doit-il utiliser ?

Choisissez selon ce que fait votre agent, puis changez l'identifiant du modèle à tout moment — chaque modèle du catalogue fonctionne avec la même clé.

Ce que fait votre agentUtilisez ceci
Modifie des fichiers / appelle des outils et diffuse les réponses (la plupart des agents de codage)Un modèle Anthropic via l'endpoint Anthropic (outils + streaming fonctionnent tous les deux)
Appelle des outils mais n'a pas besoin du streaming (n'importe quel modèle)L'endpoint compatible OpenAI avec un identifiant de modèle unique
Veut des outils et du streaming sur un modèle non-AnthropicUtilisez le non-streaming pour l'instant — le streaming des appels d'outils sur d'autres fournisseurs n'est pas encore activé
Chat simple, sans outilsN'importe quel endpoint ; le streaming convient
Veut un verdict multi-modèles (consensus) sur une réponse à enjeu élevéDéfinir le modèle sur tokonomix-consensus sur l'endpoint compatible OpenAI — remarque : le consensus rejette les appels d'outils (pas de tool-calling)
Endpoint & référence API (technique)

anthropic-messages → https://tokonomix.ai/api/anthropic — tools ✓, streaming ✓ (utiliser un modèle Anthropic). openai-completions → https://tokonomix.ai/api/v1 — tools ✓ (passthrough modèle unique), streaming avec outils pas encore disponible. Chat simple : le streaming fonctionne sur les deux. Consensus : openai-completions, modèle tokonomix-consensus, sans outils. Remplacez l'identifiant de modèle par n'importe quel slug renvoyé par GET /api/v1/models.

Parcourir tous les modèles →

Related agents