Dossier
Modeles et providers
Choisir, connecter et verifier un provider ou un modele local pour Hermes Agent. Guide independant, structure et verifiable.
Sur cette page
Introduction
Hermes Agent a besoin d'au moins un provider d'inference pour fonctionner. La documentation officielle reference 39 providers, allant des API cloud (OpenRouter, Anthropic, Google Gemini) aux solutions OAuth (Nous Portal, OpenAI Codex) en passant par les modeles locaux (Ollama, LM Studio, vLLM).
Cette page vous aide a choisir le bon provider, a le connecter, et a gerer les configurations avancees comme les fallbacks et la detection de contexte.
Les deux commandes de gestion des modeles
Hermes Agent distingue deux commandes pour la gestion des modeles:
| Commande | Ou l'executer | Ce qu'elle fait |
|---|---|---|
hermes model |
Dans le terminal (hors session) | Assistant complet: ajouter des providers, lancer OAuth, entrer des cles API, configurer des endpoints |
/model |
Dans une session de chat Hermes | Changement rapide entre les providers et modeles deja configures |
Si vous voulez utiliser un provider que vous n'avez pas encore configure, quittez votre session (Ctrl+C ou /quit), lancez hermes model, configurez le provider, puis demarrez une nouvelle session.
Providers officiellement pris en charge
La documentation officielle (commit b4f8c491) liste 39 providers. Voici les principaux:
Providers avec OAuth (connexion navigateur)
- Nous Portal: recommande par Nous Research. Un abonnement donne acces a 300+ modeles (Claude, GPT, Gemini, DeepSeek, Qwen, etc.) et a la Tool Gateway.
- OpenAI Codex: authentification ChatGPT OAuth, utilise les modeles Codex.
- Anthropic: Claude Max + credits extra via OAuth, ou cle API directe.
- GitHub Copilot: OAuth device code flow, ou token GitHub.
- xAI Grok OAuth: SuperGrok / Premium+, connexion navigateur.
Providers avec cle API
- OpenRouter:
OPENROUTER_API_KEYdans~/.hermes/.env. Acces a des centaines de modeles. - Google Gemini:
GOOGLE_API_KEYouGEMINI_API_KEY. - DeepSeek:
DEEPSEEK_API_KEY. - OpenAI API (direct):
OPENAI_API_KEY, avecOPENAI_BASE_URLoptionnel. - Fireworks AI, NovitaAI, Hugging Face, NVIDIA Build, et bien d'autres.
Providers auto-heberges / locaux
- Ollama: detection automatique sur
http://localhost:11434. Zero configuration. - LM Studio: modele local via l'application desktop.
- vLLM, llama.cpp, SGLang: compatibles via l'endpoint OpenAI.
- Custom Endpoint: n'importe quel endpoint compatible OpenAI.
Connecter un provider
Methode interactive (recommandee)
hermes modelUn menu interactif vous guide pour choisir un provider, vous authentifier (OAuth ou cle API), et selectionner un modele par defaut.
Methode manuelle
Pour les providers a cle API, ajoutez la cle dans ~/.hermes/.env:
echo 'OPENROUTER_API_KEY=sk-or-v1-...' >> ~/.hermes/.envPuis selectionnez le modele:
hermes model # ou hermes chat --provider openrouter --model "anthropic/claude-sonnet-4-6"Changer de modele en cours de session
Utilisez la commande /model dans le chat:
/modelCela affiche la liste des providers et modeles deja configures. Vous pouvez changer sans quitter la session. Note: /model ne permet pas d'ajouter un nouveau provider; pour cela, utilisez hermes model hors session.
Chaine de fallback entre providers
Hermes Agent peut essayer automatiquement d'autres providers si le modele principal echoue:
hermes fallback add # ajoute un provider de secours
hermes fallback list # liste la chaine de fallback
hermes fallback remove # retire un fallback
hermes fallback clear # vide la listeLa chaine de fallback est essayee dans l'ordre. Si le provider principal retourne une erreur (timeout, 429, modele indisponible), Hermes passe automatiquement au suivant.
Detection de la longueur de contexte
Hermes Agent detecte automatiquement la fenetre de contexte des modeles connus. Pour les providers custom ou les modeles locaux, vous pouvez forcer la valeur:
# Dans config.yaml
model:
default: "mon-modele-local"
context_window: 131072 # force la fenetre de contexteSi la detection automatique est incorrecte (modele qui refuse des prompts trop longs, ou au contraire qui accepte plus que detecte), ajustez context_window.
Questions couvertes
q-051: Quels providers de modeles sont officiellement pris en charge par Hermes Agent ?
La documentation officielle liste 39 providers (commit b4f8c491), incluant: Nous Portal, OpenAI Codex, GitHub Copilot, Anthropic, OpenRouter, Google Gemini, DeepSeek, OpenAI API, AWS Bedrock, Azure AI Foundry, Ollama, LM Studio, vLLM, et de nombreux providers regionaux (Kimi, MiniMax, Qwen, z.ai/GLM, Tencent TokenHub, Xiaomi MiMo, etc.). La liste complete est sur la page AI Providers.
q-056: Comment utiliser GitHub Copilot avec Hermes Agent ?
hermes model # choisir "GitHub Copilot" dans la listeL'authentification se fait par OAuth device code flow. Vous pouvez aussi utiliser un token GitHub (COPILOT_GITHUB_TOKEN ou GH_TOKEN) ou le token de gh auth token. Une variante "GitHub Copilot ACP" lance un processus local copilot --acp --stdio.
q-058: Comment configurer une chaine de fallback entre plusieurs providers ?
hermes fallback add # ajoute un provider de secours (menu interactif)
hermes fallback list # verifie la chaineLes fallbacks sont essayes dans l'ordre d'ajout. Vous pouvez les gerer avec hermes fallback remove et hermes fallback clear. La configuration est stockee dans config.yaml sous fallback_providers.
q-059: Comment corriger une mauvaise detection de longueur de contexte ?
Ajoutez context_window dans la section model de config.yaml:
model:
default: "mon-modele"
context_window: 131072Cette valeur force la fenetre de contexte annoncee au modele. Pour les providers custom, c'est souvent necessaire car Hermes ne peut pas la detecter automatiquement.
q-060: Comment changer de modele en cours de session sans reconfigurer le provider ?
Utilisez la commande /model dans le chat. Elle affiche les providers et modeles deja configures et permet de changer en un choix. Pour ajouter un nouveau provider, quittez la session et utilisez hermes model.
Sources
- Documentation officielle Hermes Agent (https://hermes-agent.nousresearch.com/docs/)
- AI Providers (https://hermes-agent.nousresearch.com/docs/integrations/providers)
- CLI commands reference (https://hermes-agent.nousresearch.com/docs/reference/cli-commands)
- Depot NousResearch/hermes-agent, commit b4f8c491
Liens internes proposes
Preuves et limites
Architecture, corpus officiel et observations publiques sont ingérés au build. Une validation humaine reste nécessaire pour les affirmations publiées.