Mental Mode Enterprise: 119 Baris Aturan Anti-Birokrasi
Commit +119 baris aturan eksekusi di AGENTS.md sempat saya duga jadi birokrasi baru. Ternyata kebalikannya: interview dibatasi, kartu di-scale, iterasi dicap.
Ringkasan
Awalnya kirain aturan 119 baris ini cuma nambah ribet buat tugas sepele, ternyata malah bikin kerjaan lebih satset. Kuncinya ada di kartu kerja yang jelas plus verifikasi yang bisa dicek langsung jadi agen nggak ngarang sendiri. Hasilnya revisi nggak muter-muter dan kita bisa ninggalin keyboard dengan tenang.
Ada commit yang isinya nol baris kode: file AGENTS.md di repo my-apps bertambah 119 baris, semuanya aturan eksekusi buat agen koding. Namanya Mental Mode: Enterprise Full-Stack Engineer. Begitu denger kata "enterprise", dugaan pertama saya jelek: ini pasti birokrasi baru. Masa ngerjain perbaikan sepele harus buka kartu proyek, interview dulu, terus nunggu review.
Setelah dibaca utuh, arahnya justru kebalikannya. Mode ini memangkas gesekan, bukan menambahnya: interview cuma dipakai untuk keputusan yang bener-bener ambigu atau berisiko tinggi, kartu kerja di-scale sesuai ukuran tugas sampai perbaikan sepele cukup satu baris rencana, iterasi perbaikan dicap maksimal tiga, dan agen disuruh berhenti begitu Definition of Done terpenuhi. Tiap aturan menjawab satu mode gagal yang nyata: tuntas palsu tanpa bukti, scope creep senyap, perbaikan tebak-tebakan, atau interview yang makan waktu buat hal sepele.
Konteks Itu Terbatas, Aturan Harus Tajam
Kenapa nggak sekalian tulis aturan selengkap mungkin? Karena konteks agen itu mahal. Di halaman best practices Claude Code, Anthropic menjelaskan bahwa [2] hampir semua best practice mereka berdiri di atas satu batasan: konteks cepat penuh dan performa menurun saat penuh. Tumpukan instruksi tanpa prioritas berarti menguras jatah konteks yang sama persis dengan yang dibutuhkan buat mengerjakan tugasnya.
Makanya urutan prioritas di mode ini kaku: keamanan dan data user di urutan pertama, instruksi eksplisit user di atas aturan global, dan kalau dua aturan bertabrakan konfliknya diselesaikan lewat penulisan ulang yang eksplisit, alih-alih dengan feeling. Pola setel-ulang-cara-kerja ini sebetulnya bukan barang baru. [1] Prinsip Agile menyebut arsitektur terbaik lahir dari tim yang mengatur dirinya sendiri, dan prinsip terakhirnya meminta refleksi berkala untuk menyetel perilaku tim. Retroperspektif yang menghasilkan aturan baru, bukan rapat baru.
Kartu Kerja dan Kontrak Delegasi
Bagian paling praktis ada di cara menyerahkan tugas. Bentuknya kartu kerja yang isinya bisa diverifikasi:
# kartu kerja minimal, tugas sepele cukup satu baris rencana
task: perbaiki validasi email di form kontak
goal: form menolak format invalid dengan pesan yang jelas
priority: security_first # keamanan selalu urutan pertama
scope: vertical_slice # backend + form + verifikasi sekaligus
constraints:
- max_fix_iterations: 3 # berhenti saat DoD terpenuhi
- scope_creep: kartu backlog baru, bukan dikerjakan senyap
verification:
- pytest -k contact_form # exit 0 = lulus
- isi form manual di preview, cek pesan error
definition_of_done: verification lulus dan diff bisa direview
verification di kartu itulah inti evidence-based verification. Anthropic merumuskannya tajam: [2] kasih agen cek yang bisa dijalankan, bedanya sesi yang harus diawasi terus dengan sesi yang bisa ditinggal. Tanpa itu, manusia yang jadi loop verifikasinya, dan otonomi agen berhenti di kata kelihatannya selesai.
Menyerahkan pekerjaan ke agen pelaksana juga pakai kontrak, bukan harapan:
# kontrak delegasi: dibaca agen pelaksana sebelum mulai
goal: tambah paginasi offset di endpoint daftar aplikasi
context:
- apps/api/routes/apps.py (handler list_apps)
- ikuti pola router yang sudah ada, jangan ubah skema database
acceptance_criteria:
- tes paginasi lulus
- halaman 2 tidak menduplikasi baris halaman 1
verification: pytest -k apps_pagination
expected_output: satu commit di branch staging, diff plus hasil verifikasi
Ekosistemnya sudah mendukung pola ini. opencode punya [3] agen khusus yang dikonfigurasi dengan prompt, model, dan akses tool masing-masing, dari Build yang beraksese luas sampai Plan yang read-only. Claude Code memisahkan subagen [4] yang bekerja di konteks sendiri dan kembali hanya dengan ringkasan, supaya riset panjang tidak membanjiri percakapan utama. Kartu itulah yang menentukan potongan pekerjaan mana yang layak dilempar ke sana.
Pagar Buat Otonomi
Mode gagal favorit saya namanya scope creep senyap: agen disuruh memperbaiki satu handler, diam-diam merapikan gaya tombol di file sebelah, dan dua jam kemudian diff-nya tidak bisa direview karena campur aduk. Kartu yang menutup scope, cap tiga iterasi perbaikan, dan aturan scope creep masuk kartu backlog baru menutup lubang itu.
Pagarnya jalan dua arah. Di pipeline blog ini, setiap draft artikel melewati audit gaya mode DETECT sebelum di-push: temuan gaya diedit manual, sedangkan angka, klaim, dan sumber tidak boleh disentuh. Verifikasi berbasis bukti berlaku bukan cuma buat agen, tapi buat siapa pun yang mengklaim pekerjaan sudah selesai.
Pengalaman saya selama ini searah: lima menit menyusun kartu dan kriteria verifikasi yang tajam menghemat dua jam beresin hasil tebakan agen yang salah arah. 119 baris aturan itu bukan birokrasi tambahan. Itu harga tiket supaya saya bisa tinggalkan keyboard tanpa deg-degan, dan tahu persis kartu mana yang lagi jalan di rel mana.