/plan, /grill, /goal: quy trình làm việc với bộ skill có sẵn
Lời chào hàng một dòng của Meta cho bộ skill đi kèm Muse Code: đưa vào một ý tưởng thô, nhận về một tính năng đã được "nướng" kỹ và kiểm định. Đây là những gì từng lệnh thực sự làm, và khi nào nên dùng đến.
/plan — chưa duyệt thì chưa có gì thay đổi
/plan biến task bạn yêu cầu thành một bản kế hoạch phải qua cửa phê duyệt. Agent nghiên cứu repository, phân rã công việc, trình bày hướng tiếp cận dự kiến — rồi dừng lại. Không một dòng code nào thay đổi cho đến khi bạn gật đầu. Với bất kỳ việc gì lớn hơn một bản vá vặt vãnh, đây là nước đi mở màn đúng đắn: nó biến “hy vọng agent hiểu ý mình” thành một tài liệu bạn đọc được, và bắt lỗi hiểu nhầm khi cái giá mới chỉ là vài giây — thay vì cả buổi chiều gỡ lại một cú refactor sai hướng.
/grill — phản biện gắt gao trước khi thực thi
/grill “quay” bản kế hoạch cho đến khi nó đứng vững. Cái tên rất đúng nghĩa: thay vì lịch sự chấp nhận bản kế hoạch nghe-có-vẻ-ổn đầu tiên, agent tự chất vấn hướng đi của chính mình — các edge case, dependency ẩn, những kiểu thất bại có thể xảy ra — và sửa lại cho đến khi kế hoạch sống sót qua màn tra khảo. Kỹ sư con người vẫn làm điều này trong design review. Hầu hết coding agent bỏ qua hoàn toàn khâu này và trả giá bằng những lần làm lại. Nếu một kế hoạch kiểu gì cũng sẽ đổ vỡ, bạn muốn nó đổ vỡ trên giấy.
/goal — vạch đích không bị lãng quên
/goal làm việc hướng tới việc hoàn thành trọn vẹn mục tiêu bạn đặt ra — và giữ agent bám sát nhiệm vụ cho đến khi thứ bạn muốn ban đầu chính là thứ được merge. Các phiên agent dài có một kiểu thất bại kinh điển: trôi dạt. Sau năm mươi tool call, agent đang cần mẫn đánh bóng một thứ na ná, nhưng không hẳn là, điều bạn yêu cầu. Khả năng bám mục tiêu (goal conditioning) được huấn luyện vào Muse Spark 1.2 chính xác vì lý do này, và /goal là tay cầm để bạn nắm lấy nó.
Dàn phụ trợ: /model và /effort
Hai lệnh nữa quản chi phí thay vì quản quy trình. /model đổi model nền ngay giữa phiên — chẳng hạn chuyển sang muse-spark-1.2 với giá chuẩn của Model API khi bạn cần bậc không-dùng-dữ-liệu-để-training (chi tiết trong bài so sánh các bậc giá). /effort vặn độ sâu suy luận lên hoặc xuống. Muse Spark suy nghĩ trước khi trả lời và những token suy nghĩ đó tính tiền như output, nên khớp effort với độ khó của task là cách tối ưu chi phí dễ nhất mà bạn có.
Một quy trình biết ghép nối
Các skill xâu chuỗi với nhau rất tự nhiên: /plan cho tính năng, /grill cho bản kế hoạch, phê duyệt, rồi để /goal dẫn dắt khâu thực thi — với fan-out song song hóa các phần độc lập và event log ghi lại từng bước để review. Mỗi chặng là cánh cổng cho chặng kế tiếp — đúng cách bạn muốn một hệ thống tự hành kiếm được lòng tin từng chút một. Recipe bundled-skills trong cookbook trình diễn trọn vẹn pipeline này trên một tính năng thật; xem tại cookbook.