Event log: replay chính xác từng bước, khởi động lại không mất gì
Agent làm việc hàng giờ liền cần một bộ nhớ sống sót qua mọi biến cố. Runtime của Muse Code xoay quanh một log append-only duy nhất — và gần như mọi thuộc tính đáng tin của sản phẩm đều bắt nguồn từ đó.
Một log duy nhất, chứa tất cả
Thiết kế đơn giản đến mức gần như cực đoan: Muse Code ghi nối tiếp mọi lần gọi model, mọi lần chạy tool, mọi lần phê duyệt và mọi lần sửa file vào một event log cục bộ. Không phải bản ghi hội thoại, không phải bản tóm tắt — mà là chuỗi thao tác thực sự, theo đúng thứ tự, trên chính máy của bạn. Meta gọi nó là single source of truth của runtime, và cụm từ đó đúng theo nghĩa đen: bất kể bạn thắc mắc gì về việc một agent đã làm, câu trả lời nằm trong log.
Restart-safe: crash không còn đắt đỏ
Vì log ghi lại mọi thứ cho đến đúng khoảnh khắc thất bại, một cú crash không xóa sổ phiên làm việc — agent tiếp tục chính xác từ chỗ nó dừng, không phải chạy lại các bước trước đó. Với task năm phút, đây chỉ là tiện nghi nho nhỏ. Nhưng với kiểu công việc đường dài mà Muse Code nhắm tới, đây là ranh giới giữa sản phẩm dùng được và không dùng được: case study tối ưu kernel của Meta chạy hơn 1.000 tool call trong khoảng thời gian lên đến 24 giờ. Chẳng ai dám chạy một job 24 tiếng trên một runtime mà giờ thứ 23 có thể bốc hơi.
Replay chính xác: audit bằng cách xem lại từng bước
Chính thuộc tính giúp khởi động lại an toàn cũng làm cho phiên làm việc review được. muse replay đi lại từng bước một phiên đã ghi — mỗi lần spawn subagent, mỗi lần bạn lái hướng, mỗi lần hủy, theo đúng thứ tự chúng đã xảy ra. Khi agent đưa ra một quyết định bạn không hiểu, bạn không cần tra khảo nó; bạn replay và xem tận mắt.
Trace đầy đủ còn export được. Điều đó biến một phiên agent thành thứ bạn có thể chuyển cho đồng nghiệp review, hoặc đính kèm vào hồ sơ tuân thủ — người ngoài cuộc có đủ ngữ cảnh để đánh giá lập luận của agent mà không phải chạy lại bất cứ thứ gì. Những team vốn (có lý do chính đáng) nghi ngờ các thay đổi do AI tạo ra giờ có một artifact code-review cho cả quy trình, không chỉ cho bản diff.
Vì sao điều này càng quan trọng khi có nhiều agent
Lịch sử của một agent đơn lẻ thì liếc qua scrollback terminal là thấy. Nhưng Muse Code chạy các background agent bền bỉ và fan out công việc cho các agent con song song — những hoạt động mà theo đúng thiết kế, bạn không theo dõi trong thời gian thực. “Fully auditable” chính là đối trọng khiến “multi-agent by default” trở nên chấp nhận được: mọi thứ các agent đã làm khi bạn không nhìn đều minh bạch, truy vết được và replay được sau đó. Tự hành và khả năng kiểm toán đến cùng một cặp, không phải đánh đổi lấy nhau.
Bức tranh lớn hơn
Event sourcing — suy ra trạng thái từ một log append-only chứa các sự kiện — là ý tưởng đã vài thập kỷ tuổi từ giới hệ phân tán, và đang âm thầm trở thành câu trả lời chuẩn cho độ tin cậy của agent. Điều Muse Code chứng minh là một primitive duy nhất có thể gánh bao nhiêu bề mặt sản phẩm: khôi phục sau crash, debug từng bước, bàn giao phiên, và export phục vụ tuân thủ — tất cả đều là cùng một cái log đội những chiếc mũ khác nhau. Hãy bắt đầu với một task nhỏ rồi replay nó — quickstart chỉ mất khoảng năm phút.