Event log: replay persis, aman dari restart
Agent yang bekerja berjam-jam butuh memori yang tahan segalanya. Runtime Muse Code dibangun di sekeliling satu log append-only — dan hampir semua properti kepercayaan produknya lahir dari situ.
Satu log, semuanya ada di dalamnya
Desainnya sederhana sampai nyaris agresif: Muse Code menambahkan (append) setiap panggilan model, setiap eksekusi tool, setiap persetujuan, dan setiap edit ke sebuah event log lokal. Bukan transkrip chat, bukan ringkasan — melainkan urutan operasi yang sebenarnya, berurutan, di mesinmu sendiri. Meta menyebutnya single source of truth dari runtime, dan frasa itu harfiah: pertanyaan apa pun yang kamu punya tentang apa yang dilakukan sebuah agent, jawabannya tinggal di log itu.
Aman dari restart: crash berhenti jadi mahal
Karena log merekam segalanya sampai detik kegagalan, sebuah crash tidak me-reset sesi — agent melanjutkan persis dari titik dia berhenti, tanpa menjalankan ulang langkah-langkah sebelumnya. Untuk tugas lima menit, ini sekadar bonus. Untuk pekerjaan jangka panjang yang memang jadi sasaran Muse Code, ini beda antara produknya berfungsi atau tidak: studi kasus optimasi kernel dari Meta berjalan 1.000+ tool call selama hingga 24 jam. Tidak ada yang mau menjalankan pekerjaan 24 jam di runtime yang jam ke-23-nya bisa menguap begitu saja.
Replay persis: audit dengan menelusuri langkah demi langkah
Properti yang sama yang membuat restart aman juga membuat sesi bisa di-review. muse replay menyusuri sesi yang terekam langkah demi langkah — setiap spawn subagent, setiap pengarahan, setiap pembatalan, dalam urutan kejadiannya. Ketika sebuah agent mengambil keputusan yang tidak kamu pahami, kamu tidak perlu menginterogasinya; kamu replay dan tonton saja.
Trace lengkapnya juga bisa diekspor. Itu mengubah sesi agent menjadi sesuatu yang bisa kamu serahkan ke rekan setim untuk di-review, atau dilampirkan ke catatan compliance — orang luar mendapat konteks yang cukup untuk menilai penalaran si agent tanpa menjalankan ulang apa pun. Tim yang memperlakukan perubahan buatan AI dengan kecurigaan (yang wajar) mendapat artefak code review untuk prosesnya, bukan cuma diff-nya.
Kenapa ini makin penting dengan banyak agent
Riwayat satu agent tunggal gampang dilirik lewat scrollback terminal. Muse Code menjalankan background agent yang persisten dan me-fan-out pekerjaan ke anak-anak paralel — aktivitas yang memang, by design, tidak kamu tonton real time. “Fully auditable” adalah pemberat yang membuat “multi-agent by default” bisa diterima: semua yang dilakukan agent-agent itu selagi kamu tidak melihat menjadi transparan, terlacak, dan bisa di-replay setelahnya. Otonomi dan auditabilitas datang berpasangan, bukan saling tukar.
Pola yang lebih besar
Event sourcing — menurunkan state dari log fakta yang append-only — adalah ide berumur puluhan tahun dari dunia sistem terdistribusi, dan diam-diam sedang menjadi jawaban standar untuk reliabilitas agent. Yang didemonstrasikan Muse Code adalah seberapa luas permukaan produk yang bisa dipikul satu primitif: crash recovery, debugging langkah demi langkah, serah terima sesi, dan ekspor compliance semuanya adalah log yang sama memakai topi berbeda. Mulailah dari tugas kecil lalu replay — quickstart-nya cuma butuh sekitar lima menit.