La réponse en une phrase

Le logiciel Hermès ne coûte rien ; c'est le fournisseur de modèle IA connecté (API directe, Nous Portal ou OpenRouter) qui facture les tokens consommés, avec un budget mensuel qui va de quelques euros pour un usage personnel léger à plusieurs centaines d'euros pour un déploiement en équipe.

Le logiciel Hermès est-il vraiment gratuit ?

Oui, sans nuance sur ce point précis : Hermès est distribué par Nous Research sous licence MIT, une licence open source qui autorise l'installation, la modification et même l'usage commercial sans verser le moindre euro à l'éditeur. Aucun palier payant, aucune fonctionnalité verrouillée derrière un abonnement Hermès n'existe à ce jour.

1Le logiciel

Téléchargement, installation, mises à jour et code source : entièrement gratuits, sans limite de durée ni de nombre de sessions.

2La mémoire et les compétences

Le stockage local de la mémoire persistante et des compétences apprises ne génère aucun coût d'infrastructure propre à Hermès.

3Le modèle IA

Seul poste facturé : chaque appel au modèle de langage connecté, comptabilisé en tokens d'entrée et de sortie.

C'est la même logique que pour la plupart des agents IA construits sur des modèles tiers : le logiciel orchestrateur est souvent gratuit ou peu coûteux, tandis que l'intelligence elle-même — le modèle — reste facturée par son propre éditeur (Anthropic, OpenAI, ou un revendeur comme OpenRouter).

Comment fonctionne la facturation via Nous Portal ?

Nous Portal est le point d'entrée mis en avant par Nous Research lui-même lors de la configuration (hermes setup --portal). Il fonctionne comme un intermédiaire unique donnant accès à plus de 300 modèles de différents éditeurs, sans avoir à créer un compte séparé chez chacun d'eux.

Concrètement, Nous Portal facture la consommation réelle de tokens au fil de l'eau plutôt qu'un forfait fixe mensuel, avec une grille tarifaire propre à chaque modèle proposé dans le catalogue. Le tarif exact évoluant régulièrement à mesure que de nouveaux modèles rejoignent le portail, il est préférable de consulter la page tarifs officielle de Nous Research avant de s'engager, plutôt que de se fier à un chiffre figé.

L'avantage principal reste la simplicité de facturation : un seul point de paiement, une seule clé à configurer dans hermes model, quel que soit le nombre de modèles testés au fil des projets.

Combien coûte une API directe (Claude, GPT, OpenRouter) ?

Passer par une API directe donne accès aux tarifs officiels de l'éditeur du modèle, généralement facturés au million de tokens, avec un prix distinct pour les tokens d'entrée (ce qu'on envoie au modèle) et les tokens de sortie (ce qu'il génère). OpenRouter fonctionne sur le même principe mais agrège plusieurs éditeurs derrière une seule clé, avec une marge modérée ajoutée aux tarifs d'origine.

Voie d'accèsMode de facturationAvantage principal
API Anthropic / OpenAI directeAu token, tarif officiel de l'éditeurPrix le plus bas, accès aux dernières versions
Nous PortalAu token, facturation unifiéeUn seul compte pour 300+ modèles
OpenRouterAu token, léger surcoût vs API directeBascule rapide d'un modèle à l'autre
Modèle local (self-hosted)Coût d'infrastructure (GPU) uniquementAucune donnée envoyée à un tiers

À titre indicatif au 1er août 2026, un modèle de milieu de gamme comme Claude Sonnet ou GPT équivalent facture typiquement de l'ordre de quelques dollars par million de tokens en entrée et un multiple de ce tarif en sortie — les grilles précises se vérifient sur les pages tarifs officielles d'Anthropic et d'OpenAI, ces prix évoluant plusieurs fois par an.

Quel budget mensuel prévoir selon son usage ?

Le budget réel dépend surtout de trois facteurs : le nombre de sessions par mois, la longueur moyenne des tâches confiées à l'agent, et le modèle choisi. Une tâche courte (résumer un email) consomme quelques milliers de tokens ; une tâche longue avec plusieurs allers-retours d'outils (recherche web, lecture de fichiers, écriture de code) peut en consommer plusieurs dizaines de milliers.

Usage personnel légerQuelques sessions courtes par semaine : budget de l'ordre de quelques euros à une dizaine d'euros par mois avec un modèle économique.
Usage professionnel régulierVeille quotidienne, automatisations récurrentes sur un modèle intermédiaire : comptez plutôt entre 20 et 80 € par mois selon le volume.
Usage intensif ou en équipePlusieurs agents actifs en continu, tâches longues : le budget peut dépasser 150 à 300 € par mois, à surveiller de près.

Ces fourchettes restent indicatives : la seule façon d'obtenir un chiffre fiable pour votre cas consiste à activer le suivi de consommation proposé par votre fournisseur de modèle et à l'observer sur deux à trois semaines d'usage réel avant de généraliser.

Comment réduire sa consommation de tokens ?

  • Choisir un modèle économique pour les tâches simples et réserver un modèle plus coûteux aux tâches qui exigent un raisonnement poussé.
  • Limiter les outils activés via hermes tools : chaque outil disponible augmente légèrement le contexte envoyé au modèle à chaque appel.
  • Nettoyer la mémoire régulièrement plutôt que de laisser un historique de session s'accumuler indéfiniment, ce qui alourdit chaque nouvel appel.
  • Découper les tâches longues en plusieurs sessions ciblées plutôt qu'une seule tâche ouverte qui multiplie les allers-retours d'outils.
Une tâche planifiée mal cadrée peut consommer sans surveillance

Une tâche cron confiée à Hermès qui tourne en boucle sur un contenu long (ex. surveillance de fichiers volumineux) peut faire grimper la facture de tokens sans qu'on s'en aperçoive avant la fin du mois. Un plafond de dépense côté fournisseur reste la protection la plus simple.

Ce que nous observons sur notre propre consommation Hermès

Voici un exemple représentatif de notre usage interne, sans donnée client ni chiffre extrapolé au-delà de ce que nous constatons.

Retour d’expérience Amari Agency

Une quinzaine d'euros par mois pour un usage de veille quotidien

Sur notre instance de test, Hermès tourne avec Claude en API directe pour une quinzaine de sessions de veille par jour, principalement des tâches de recherche et de synthèse. Notre consommation observée reste modeste, de l'ordre de 15 à 20 € par mois, très loin des scénarios d'usage intensif en équipe. Le facteur qui a le plus fait varier la facture d'une semaine à l'autre reste la longueur des tâches confiées, bien plus que leur nombre.

HermèsClaude APISuivi de consommation

Quels contenus lire ensuite ?

Ces ressources complètent cet article sans cibler la même requête :

Questions fréquentes sur le coût de Hermès

Existe-t-il un abonnement payant pour Hermès ?

Non, le logiciel Hermès est distribué gratuitement sous licence MIT. Seule la consommation du modèle IA connecté (Claude, GPT, ou via Nous Portal/OpenRouter) génère un coût.

Quel est le moyen le moins cher de faire tourner Hermès ?

Une API directe vers un modèle économique reste généralement le tarif le plus bas au token, à condition d'accepter de gérer une clé API par fournisseur plutôt qu'un point d'accès unique.

Peut-on plafonner ses dépenses avec Hermès ?

Hermès lui-même ne propose pas de plafond de dépense intégré ; ce contrôle se configure du côté du fournisseur de modèle (Anthropic, OpenAI, OpenRouter proposent tous des limites de budget mensuel).

Un modèle local gratuit change-t-il la donne ?

Un modèle auto-hébergé supprime le coût au token mais implique un investissement en matériel (GPU) et une consommation électrique à intégrer au calcul réel, rarement plus économique pour un usage modéré.

Le prix diffère-t-il selon le canal utilisé (terminal, Telegram, Slack) ?

Non, le canal de pilotage n'a pas d'impact sur le tarif : seul le volume de tokens échangé avec le modèle compte, quel que soit le point d'entrée choisi.

Sources officielles

  1. Hermes Agent — Documentation officielle.
  2. OpenRouter — Documentation et tarifs.
  3. GitHub — NousResearch/hermes-agent.