L’architecture complète de mon assistant personnel auto-hébergé — 20 diagrammes pour tout comprendre

L’architecture complète de mon assistant personnel auto-hébergé 20 diagrammes pour tout comprendre — du message utilisateur à la réponse, en passant par la mémoire, les outils, les crons, et la domotique. Introduction J’ai construit un assistant personnel auto-hébergé basé sur Hermes Agent (v3.11.1). Ce n’est pas un chatbot de plus — c’est un orchestrateur qui … Lire la suite

De la scrutation à l’interruption — repenser l’architecture d’un assistant personnel

De la scrutation à l’interruption — repenser l’architecture d’un assistant personnel Le problème du polling Quand on construit un assistant personnel auto-hébergé, la tentation naturelle est de scruter : un cron qui vérifie toutes les X minutes si quelque chose a changé. C’est simple, c’est fiable, ça marche. Mais ça a un coût. Prenons un … Lire la suite

Donner une mémoire à son assistant IA — le Memory Kernel

Donner une mémoire à son assistant IA — le Memory Kernel Le problème de la mémoire plate Si vous utilisez un assistant IA (ChatGPT, Claude, Hermes…), vous avez déjà vécu ça : vous lui dites quelque chose d’important, il répond parfaitement, puis dans la conversation suivante, il a tout oublié. Vous devez tout répéter. C’est … Lire la suite

Ne pas réveiller le LLM pour allumer la lumière — le bypass déterministe

Ne pas réveiller le LLM pour allumer la lumière — le bypass déterministe Le problème : des tokens gaspillés pour des trivialités Quand on construit un assistant personnel augmenté par LLM, la tentation est de tout lui passer par le cerveau. L’utilisateur demande « quelle heure est-il ? », le LLM réfléchit, comprend qu’il faut … Lire la suite