徹底解説· 5 分で読めます

イベントログ:完全リプレイ可能で、再起動にも壊れない

何時間も働き続けるエージェントには、何があっても生き残るメモリが必要です。Muse Code のランタイムは単一の追記専用ログを中心に設計されており、このプロダクトの信頼性のほぼすべてがそこから導かれます。

#event-log#auditability#reliability#event-sourcing

1 本のログに、すべてが入っている

設計は潔いほどシンプルです。Muse Code は、すべてのモデル呼び出し、すべてのツール実行、すべての承認、すべての編集を、ローカルのイベントログに追記します。チャットの書き起こしでも要約でもなく、実際の操作シーケンスが、順序どおり、あなたのマシン上に残る。Meta はこれをランタイムの単一の信頼できる情報源(single source of truth)と呼んでいますが、この言葉は文字通りの意味です。エージェントが何をしたのかという疑問への答えは、すべてこのログの中にあります。

再起動しても壊れない:クラッシュが高くつかなくなる

ログには障害の瞬間までのすべてが記録されているため、クラッシュしてもセッションはリセットされません。エージェントは止まった正確な位置から、それまでのステップを再実行することなく再開します。5 分のタスクなら「あると嬉しい」程度の話です。しかし Muse Code が狙う長時間の作業では、これはプロダクトが成立するか否かの分水嶺になります。Meta のカーネル最適化ケーススタディでは、最長 24 時間にわたって 1,000 回以上のツール呼び出しが実行されました。23 時間目が蒸発しうるランタイムで、24 時間ジョブを走らせる人はいません。

完全リプレイ:ステップ実行で監査する

再起動を安全にするのと同じ性質が、セッションをレビュー可能にします。muse replay は記録されたセッションをステップごとに再生します。すべてのサブエージェント生成、すべての軌道修正、すべてのキャンセルが、起きた順序のままに。エージェントが理解しがたい判断をしたとき、本人を問い詰める必要はありません。リプレイして、見ればいいのです。

完全なトレースはエクスポートもできます。これにより、エージェントセッションはチームメイトにレビューを依頼できるもの、コンプライアンス記録に添付できるものになります。第三者が何も再実行することなく、エージェントの推論を評価するのに十分なコンテキストを得られる。AI 生成の変更を(正当に)疑ってかかるチームは、diff だけでなくプロセスに対するコードレビューの成果物を手に入れることになります。

マルチエージェントだからこそ、これが効く

単一エージェントの履歴なら、ターミナルのスクロールバックを眺めれば把握できます。しかし Muse Code は永続的なバックグラウンドエージェントを走らせ、作業を並列の子エージェントにファンアウトします。設計上、あなたがリアルタイムで見ていない活動です。「完全に監査可能」であることは、「デフォルトでマルチエージェント」を受け入れ可能にするための対抗重りです。見ていない間にエージェントたちがしたことのすべてが、事後に透明で、追跡可能で、リプレイ可能である。自律性と監査可能性は、トレードオフではなくペアでやってくるのです。

より大きなパターンとして

イベントソーシング — 事実の追記専用ログから状態を導出する — は分散システム由来の数十年もののアイデアであり、いま静かにエージェントの信頼性に対する標準解になりつつあります。Muse Code が示しているのは、1 つのプリミティブがどれだけのプロダクト表面を支えられるかです。クラッシュリカバリ、ステップ実行デバッグ、セッションの引き継ぎ、コンプライアンス用エクスポート — すべて同じログが帽子をかぶり替えているだけ。まずは小さなタスクを 1 つ実行してリプレイしてみてください。クイックスタートなら 5 分ほどで試せます。

続けて読む