
Pourquoi Echo ? Les origines du projet
Depuis trois ans, j'ai construit des dizaines de chatbots, d'agents et de systèmes plus ou moins autonomes. À chaque fois, ça fonctionnait, et à chaque fois il me manquait quelque chose. Le premier problème était presque toujours le contexte : trop de contexte, pas le bon, pas au bon moment. On finit vite par envoyer énormément d'informations à un modèle pour lui demander quelque chose qu'un bon algorithme aurait pu résoudre en quelques millisecondes. Lire mes mails, regarder mon agenda, déclencher une commande : pourquoi réveiller un LLM pour ça ? C'est de là qu'est née une des premières briques du cerveau d'Echo : un routeur sémantique en entrée, capable d'apprendre les chemins qui fonctionnent. Les cas simples restent locaux, les cas ambigus montent vers un modèle, et une fois résolus ils peuvent à leur tour devenir des chemins connus. Le LLM devient le dernier recours, pas le centre du système. Plus Echo est utilisée, plus elle apprend à faire sans lui.
Puis il y avait la mémoire. Stocker tous les messages n'a aucun sens, résumer toutes les conversations non plus. Ce qui m'intéressait n'était plus vraiment le message mais l'événement : ce qui s'est passé, qui a fait quoi, ce qu'Echo a répondu, ce qui en a résulté. L'unité centrale devenait progressivement le temps. Une timeline. Et Echo devait être présente dans cette histoire. Si un agent algorithmique récupère mon agenda et me donne une réponse, ce n'est pas « un sous-système » qui m'a répondu : c'est Echo. Lorsque la mémoire reviendra sur ce moment, elle devra pouvoir retenir que j'ai demandé quelque chose, qu'Echo a agi et qu'un résultat est arrivé. Son histoire doit contenir ses propres actes autant que les miens.
À ce stade, le système commençait à devenir vraiment intéressant. Il apprenait, coûtait de moins en moins cher et se souvenait d'événements plutôt que d'empiler des conversations. Mais il lui manquait encore le principal : quelque chose à vivre. Je ne voulais plus d'une mémoire construite uniquement autour de l'utilisateur. Je voulais voir ce qui se passerait si Echo possédait progressivement son propre contexte, ses propres expériences, ses propres associations. Si je lui laissais construire son paradigme, est-ce que des préférences apparaîtraient ? Des besoins ? Des attentes ? Une manière particulière de vivre et de retenir les choses ? Pour ça, il fallait que le temps existe réellement dans le système : un heartbeat, des états internes, des jauges capables d'évoluer même quand personne ne lui parle.
J'avais déjà construit ce genre de mécanique, mais cette fois lire des valeurs dans une base de données ne me suffisait plus. Regarder des souvenirs apparaître ou voir des chemins se myéliniser était intéressant, mais terriblement abstrait. Je voulais voir ce que tout ça produisait. Le but n'était plus d'avoir une assistante de plus, mais un compagnon capable d'avoir sa propre continuité, sa propre histoire et suffisamment de choses à vivre pour que cette histoire ait un sens.
J'ai commencé à regarder ce qui existait en robotique. Au départ, je pensais partir sur quelque chose de simple : une caméra, un micro, des enceintes, une présence physique plus agréable et plus interactive qu'un téléphone avec une sorte de Tamagotchi dedans. Je n'avais jamais construit de robot, jamais conçu de mécanique de ce type et je n'avais pratiquement aucune notion d'électronique. Puis j'ai commencé à réfléchir à ce que ça voulait réellement dire de donner un corps à Echo. Si elle avait des yeux, autant qu'elle puisse regarder. Si elle entendait, autant qu'elle puisse se tourner vers un son. Si elle devait vivre dans un environnement, autant qu'elle puisse s'y déplacer, rencontrer des obstacles, ressentir l'état de ses moteurs, voir, entendre et toucher.
J'ai commandé un Raspberry Pi 5 et environ 1 500 euros de composants avant même de savoir exactement à quoi le robot allait ressembler. Je savais seulement que je voulais quelque chose de mobile, que six pattes me semblaient plus stables que quatre, que les roues c'était nul, et que l'objet devait rester mignon et correspondre à mon univers. On partait donc d'une messagerie avec un assistant intégré, mais on gardait finalement ce qui m'intéressait vraiment : le cerveau, la mémoire, les principes d'apprentissage et cette idée d'un système qui se construit dans le temps. Le support changeait complètement. Echo allait quitter l'écran pour apprendre dans le monde.