L'event log : replay à l'identique, reprise garantie
Un agent qui travaille des heures a besoin d'une mémoire qui survit à tout. Le runtime de Muse Code est bâti autour d'un unique log en append-only — et presque toutes les garanties de confiance du produit en découlent.
Un seul log, tout dedans
Le design est d’une simplicité presque agressive : Muse Code ajoute chaque appel au modèle, chaque exécution d’outil, chaque approbation et chaque édition à un event log local. Pas une transcription de chat, pas un résumé — la séquence réelle des opérations, dans l’ordre, sur ta machine. Meta l’appelle la source de vérité unique du runtime, et la formule est à prendre au pied de la lettre : quelle que soit ta question sur ce qu’un agent a fait, la réponse vit dans le log.
Reprise garantie : les crashs cessent de coûter cher
Comme le log enregistre tout jusqu’à l’instant de la panne, un crash ne remet pas la session à zéro — l’agent reprend précisément là où il s’est arrêté, sans rejouer les étapes déjà faites. Pour des tâches de cinq minutes, c’est un confort. Pour le travail au long cours que vise Muse Code, c’est la différence entre un produit qui marche et un produit qui ne marche pas : l’étude de cas de Meta sur l’optimisation de kernel a enchaîné plus de 1 000 appels d’outils sur jusqu’à 24 heures. Personne ne lance un job de 24 heures sur un runtime où l’heure 23 peut s’évaporer.
Replay à l’identique : auditer en avançant pas à pas
La propriété qui rend les reprises sûres rend aussi les sessions relisibles. muse replay déroule une session enregistrée étape par étape — chaque spawn de subagent, chaque recadrage, chaque annulation, dans l’ordre où ils se sont produits. Quand un agent a pris une décision que tu ne comprends pas, tu ne l’interroges pas ; tu rejoues la session et tu regardes.
Les traces complètes s’exportent aussi. Une session d’agent devient alors quelque chose que tu peux passer à un collègue pour revue, ou joindre à un dossier de conformité — une personne extérieure obtient assez de contexte pour évaluer le raisonnement de l’agent sans rien réexécuter. Les équipes qui traitent les changements générés par IA avec une suspicion (justifiée) obtiennent un artefact de code review pour le processus, pas seulement pour le diff.
Pourquoi ça compte encore plus avec plusieurs agents
L’historique d’un agent seul se survole facilement dans le scrollback d’un terminal. Muse Code fait tourner des agents d’arrière-plan persistants et répartit le travail en fan-out vers des enfants parallèles — une activité que, par conception, tu ne regardes pas en temps réel. « Entièrement auditable » est le contrepoids qui rend « multi-agent par défaut » acceptable : tout ce que ces agents ont fait pendant que tu regardais ailleurs est transparent, traçable et rejouable après coup. L’autonomie et l’auditabilité arrivent en paire, pas en compromis.
Le pattern plus large
L’event sourcing — dériver l’état d’un log de faits en append-only — est une idée vieille de plusieurs décennies venue des systèmes distribués, et elle est discrètement en train de devenir la réponse standard à la fiabilité des agents. Ce que Muse Code démontre, c’est la surface de produit qu’une seule primitive peut porter : reprise après crash, débogage pas à pas, passation de session et export de conformité, c’est le même log sous différentes casquettes. Commence par une petite tâche et rejoue-la — le guide de démarrage prend environ cinq minutes.