2 / 13Mon premier agent IAPartie I · 25 min de lecture

Lexique

Parlez la langue des agents. Premier passage = les courtes lignes « à retenir » ; le détail attend les leçons suivantes.

Comment lire cette leçon

C’est le dictionnaire du cours. Lisez l’intro et la ligne à retenir de chaque carte, puis passez à la suite.

  • Revenez à une carte quand une leçon plus loin nomme ce mot (installation, SOUL, outils…).
Vous n’avez pas besoin d’apprendre tous les termes aujourd’hui. Il vous faut quatre piliers (la stack), la boucle, et « chat vs harness ». Le reste est là pour que Settings et docs cessent de sonner comme du code alien.

1 · La stack de base

Quatre mots nomment presque tout ce cours.

LLM

Large Language Model — prédit le prochain morceau de texte. Un chat pur, c’est surtout texte qui entre → texte qui sort. Il peut avoir l’air malin sans jamais toucher à vos fichiers. Dans un montage agent, ce n’est que le cerveau.

LLM = le cerveau seulement.

Agent

Un système : cerveau LLM + outils et mémoire, piloté par une boucle que l’application fait tourner (Penser → Agir → Observer). La boucle est autour du modèle, pas une puce secrète dans les poids.

Agent = cerveau + outils + boucle.

Harness

Le cadre applicatif qui fait tourner la boucle : messages, outils, approbations, mémoire, gateway. Hermes Desktop est ce cadre sur votre machine — ce que vous contrôlez.

Harness = l’app qui fait tourner la boucle.

Runtime

Où vit le processus : PC de rechange, VPS, conteneur… On préfère une machine dédiée, pas l’ordinateur qui tient toute votre vie. Autre idée que « cerveau » ou « design de l’app ».

Runtime = la machine.

Une ligne : LLM pense · harness exécute les outils · agent est toute la boucle · runtime est la boîte. Ensuite : la boucle elle-même.

2 · La boucle de l’agent (pas le LLM tout seul)

La boucle n’est pas « à l’intérieur du LLM tout seul ». Ce sont les opérateurs qui décident qui fait Penser, Agir, Observer.

Trois temps. Penser (le modèle planifie) → Agir (l’app exécute un outil ou répond) → Observer (le résultat revient dans le chat pour le prochain Penser).

Ce cycle, c’est comme ça qu’un système agent fonctionne. Ce n’est pas une boucle cachée qui vivrait seulement dans le LLM. Un chat dans le navigateur, sans vrais outils sur la machine, c’est surtout Penser → répondre.

Agent loop — who does each step
01
Think
LLM plans
02
Act
Harness runs tool
03
Observe
Harness → messages
04
Again
LLM thinks next

Penser

Le modèle planifie : quoi ensuite, quel outil, quand s’arrêter. Vous voyez ça en général comme la prochaine réponse ou une demande d’outil — pas une « puce de boucle » séparée dans le modèle.

Penser = le modèle planifie.

Agir

Quelque chose se passe hors du texte pur : écrire un fichier, lancer une commande, appeler un service — ou simplement répondre. Les approbations et la sécurité de la machine s’appliquent ici.

Agir = l’app (ou la réponse finale).

Observer

Le résultat de l’outil, ou l’erreur, est recollé dans le chat pour que le prochain Penser soit ancré. Pas d’observation → plus de risque d’invention.

Observer = le résultat revient dans le chat.

Planification

Choisir des étapes, puis replanifier après chaque Observer. Vous aidez avec un but clair, des contraintes, et un « c’est fini quand ». (Petit caractère ; les trois temps ci-dessus suffisent au premier passage.)

Planifier → agir → vérifier → replanifier.

QuiTempsCe qui se passe
Penser · LLMPlanifie le prochain mouvementPeut demander un outil, ou rédiger une réponse finale. Penser vit dans la réponse du modèle.
Agir · HarnessExécute vraiment l’outil — ou envoie la réponse finaleHarness (+ outils sur la machine). Les approbations peuvent arrêter un acte risqué ici.
Observer · Harness → LLMRemet le résultat de l’outil (ou l’erreur) dans la conversationCette observation nourrit le prochain Penser. Les erreurs comptent aussi comme des observations.
Penser = le modèle planifie. Agir = l’app (ou la réponse finale). Observer = le résultat revient dans le chat.
Moyen mnémotechnique : le LLM pense · le harness agit · le harness observe · le LLM pense à nouveau. Tout ce cycle, c’est l’agent.
  • Je peux raconter Penser → Agir → Observer une fois à voix haute
  • J’attribue Penser au LLM, et l’emballage Agir / Observer au harness
Exercice · Vérifiez-vous

Qui exécute vraiment un appel d’outil qui écrit un fichier ?

Choisissez une réponse — le résultat s’affiche tout de suite.

Exercice · Vérifiez-vous

Un outil revient avec « permission denied ». C’est quoi ?

Choisissez une réponse — le résultat s’affiche tout de suite.

Sources

3 · Modèles, coût, et clés

Comment vous payez le cerveau, et où vivent les secrets. Une règle cloud : le contenu de la conversation peut quitter votre machine.

Token

Unité de facturation pour l’entrée / la sortie du modèle — à peu près un morceau de mot. Les paliers gratuits ont quand même des limites.

Les tokens ≈ le compteur de coût.

Modèle cloud

Le cerveau tourne chez un fournisseur, pas sur votre machine. Pratique ; prompts et réponses quittent l’hôte. Vous choisissez un fournisseur à l’installation (leçon 03).

Cloud = les données peuvent partir.

Modèle local

Les poids tournent sur du matériel que vous contrôlez. Autre coût (GPU / temps). Optionnel plus tard — pas le jour 1.

Local = ça reste de votre côté.

API key

Secret qui prouve « c’est moi » auprès d’un fournisseur. Si elle fuit, quelqu’un peut dépenser en votre nom.

Les clés jamais dans le chat ni dans git.

`.env`

Fichier local pour les secrets, tenu hors de git. Les programmes y lisent les clés.

Les secrets dans .env, pas dans les notes.

4 · Ce dont il se souvient, et ce qu’il oublie

Fermez le chat : la conversation du jour a disparu. Tout ce que l’agent doit encore savoir la semaine prochaine doit être écrit dans un fichier. Cette seule différence — contexte vs mémoire — est celle que les débutants se trompent le plus, et elle explique la moitié des « pourquoi il a oublié ? » qui viennent.

Contexte

Ce qui est dans la fenêtre de chat actuelle pour le modèle — la « RAM » de session. Fermez ou compressez le fil, et ça s’efface.

Contexte = cette session.

Mémoire

Des faits que vous (ou l’agent) écrivez sur disque pour pouvoir les recharger la semaine prochaine — ex. MEMORY.md. Autre chose que « c’était dans le chat hier ».

Mémoire = c’est écrit.

SOUL

Idée simple : un court fichier d’identité — nom, ton, limites strictes (« ne jamais supprimer sans demander »). Vit avec le profil Hermes sur la machine. Vous le réglerez à la leçon 04 ; pour l’instant, sachez seulement que le mot veut dire « qui cet agent est censé être ».

SOUL = fichier de personnalité (leçon 04).

Hallucination

Quand les preuves manquent, le modèle a quand même l’air sûr. Les fichiers et les résultats d’outils réduisent ce risque — ils ne l’effacent pas.

Pas de preuve → risque d’invention.

Contexte vs mémoire, c’est le mélange qui pique le plus les débutants. SOUL, c’est juste « la personnalité permanente » — le mode d’emploi complet vient plus tard.

5 · Outils, compétences, plugins et MCP

Deux mots portent l’essentiel : outil = quelque chose que l’app peut faire (écrire un fichier, lister un dossier). Compétence = un mode d’emploi empaqueté qui apprend à l’agent comment utiliser les outils pour un travail. Le reste peut attendre.

MotCe que ça veut direOn s’y retrouve quand…
OutilAction appelable — l’étape AgirVous ouvrez Tools dans Desktop (leçon 06)
CompétenceFichier mode d’emploi / procédure (SKILL.md)Vous taillez ou ajoutez des compétences (leçon 09)
PluginUI en plus, dans Hermes DesktopVous activez des extras Desktop
MCPPrise pour un service extérieur (docs, dépôts…)Vous avez besoin d’un système externe vivant — pas le jour 1

Outil

Quelque chose que Hermes peut exécuter : un nom, des entrées, un résultat ou une erreur. Les mains de l’agent, listées dans les docs outils Hermes. La sortie nourrit Observer.

Outil = le faire.

Appel d’outil

Le modèle demande un outil avec des entrées structurées ; Hermes l’exécute (parfois après votre accord) ; le résultat revient comme un message d’outil.

Demander → exécuter → résultat → penser à nouveau.

Compétence

Un mode d’emploi réutilisable (souvent SKILL.md). Aide Penser à choisir de bonnes étapes. Ça ne remplace pas les outils — ça enseigne quand et comment les utiliser.

Compétence = le mode d’emploi.

Plugin

Extension Desktop optionnelle (UI ou fonction produit en plus). Pas obligatoire pour finir la Partie I.

Plugin = extra Desktop (plus tard).

MCP

Une façon standard de brancher des services externes. Puissant, et une surface de confiance de plus. Vous pouvez finir les premières leçons sans MCP.

MCP = prise externe (plus tard).

Si vous installez « tout », les sessions vides deviennent chères et le modèle s’éparpille. Préférez peu d’outils, peu de compétences, des jobs clairs.

6 · Sortir de la fenêtre Desktop

Deux mots pour le travail qui se passe quand vous ne regardez pas l’app. Le mode d’emploi est aux leçons 05 et 11.

Gateway

Pont pour que le harness réponde depuis une app de messagerie (Telegram et d’autres). Seules les personnes sur liste d’autorisation peuvent parler. Réglage : leçon 05.

Gateway = accès de poche (plus tard).

Cron

Une tâche sur un horaire (ex. résumé du matin en semaine). Il faut une machine allumée. Leçon 11.

Cron = tâche planifiée (plus tard).

Chat produit vs agent sur harness

Les chats navigateur modernes (ChatGPT et les autres) utilisent déjà certains outils. Le contraste utile n’est pas « ils ne touchent jamais d’outils » — c’est qui possède la boucle, les fichiers, et la machine.

Chat navigateur (ex. ChatGPT)Agent sur votre harness
Les outils sont des fonctions de leur produit, sur leurs serveursLes outils tournent sous votre harness, sur votre runtime (fichiers, shell, …)
L’historique vit dans leur compte — vous exportez s’ils le permettentFaits et reçus peuvent vivre comme des fichiers que vous ouvrez hors ligne
Limites et politiques = défauts vendeurIdentité, approbations, listes d’autorisation : à vous de les poser (SOUL, sécurité)
Très bien pour des réponses rapides et des flux hébergésFait pour la persistance, le travail en plusieurs étapes, et le contrôle local
Motivation, pas dénigrement : quand vous avez besoin de votre disque, de vos règles, et d’une boucle que vous pouvez auditer, vous voulez un agent sur un harness que vous possédez — pas seulement un onglet qui oublie quand le compte oublie.
From chat to agent
Same kind of brain · different ownership
Browser chat
Vendor tools & history
On their servers
Fast answers
Less local control
Harness on your host
Your loop · your tools
Think → Act → Observe
Files · rules · receipts
Open offline
Checklist · cet appareil0/5

Vous avez fini quand

Preuve · cet appareil0/1

Stocké sur cet appareil seulement — n’est envoyé nulle part.