Журнал событий: точный replay и безопасные рестарты
Агентам, работающим часами, нужна память, которая переживёт что угодно. Рантайм Muse Code построен вокруг одного append-only лога — и почти все свойства доверия к продукту вырастают из него.
Один лог, и в нём — всё
Дизайн почти вызывающе прост: Muse Code дописывает в локальный журнал событий каждый вызов модели, каждый запуск инструмента, каждое одобрение и каждую правку. Не расшифровку чата, не пересказ — фактическую последовательность операций, по порядку, на вашей машине. Meta называет журнал единственным источником истины рантайма, и это буквально: какой бы вопрос о действиях агента у вас ни возник, ответ живёт в логе.
Безопасные рестарты: краши перестают стоить дорого
Поскольку лог фиксирует всё вплоть до момента сбоя, краш не обнуляет сессию — агент продолжает ровно с того места, где остановился, не перепрогоняя предыдущие шаги. Для пятиминутных задач это приятная мелочь. Для длинных дистанций, на которые нацелен Muse Code, это разница между «продукт работает» и «не работает»: в кейсе Meta с оптимизацией ядра было 1000+ вызовов инструментов на протяжении до 24 часов. Никто не запустит суточную работу на рантайме, где 23-й час может испариться.
Точный replay: аудит по шагам
То же свойство, что делает рестарты безопасными, делает сессии проверяемыми. muse replay проходит записанную сессию шаг за шагом — каждый спавн субагента, каждое вмешательство, каждую отмену, в том порядке, в каком они происходили. Когда агент принял решение, которого вы не понимаете, вы его не допрашиваете — вы проигрываете запись и смотрите.
Полные трейсы к тому же экспортируются. Это превращает агентную сессию в артефакт, который можно передать коллеге на ревью или приложить к комплаенс-документации: внешний человек получает достаточно контекста, чтобы оценить логику агента, ничего не перезапуская. Команды, которые относятся к сгенерированным ИИ изменениям с (оправданным) подозрением, получают предмет код-ревью для процесса, а не только для диффа.
Почему с несколькими агентами это важнее
Историю одного агента легко окинуть взглядом в скроллбэке терминала. Но Muse Code держит персистентных фоновых агентов и раздаёт работу параллельным дочерним агентам — за этой активностью вы, по замыслу, не следите в реальном времени. «Полная аудируемость» — тот противовес, который делает «multi-agent by default» приемлемым: всё, что агенты делали, пока вы не смотрели, прозрачно, отслеживаемо и воспроизводимо постфактум. Автономность и аудируемость идут в паре, а не в размене.
Паттерн покрупнее
Event sourcing — восстановление состояния из append-only лога фактов — идея из распределённых систем с десятилетиями стажа, и она тихо становится стандартным ответом на вопрос о надёжности агентов. Muse Code показывает, сколько продуктовой поверхности способен нести один примитив: восстановление после краша, пошаговая отладка, передача сессии и экспорт для комплаенса — всё это один и тот же лог в разных шляпах. Начните с маленькой задачи и проиграйте её запись — быстрый старт занимает минут пять.