💎 Sementara banyak orang membuat sistem super dengan banyak skill dan sub-agen, lalu menjalankan Claude Code selama berjam-jam, saya melakukan sebaliknya — bahkan lebih teliti.
Ya, Codex-5.3 dan Opus-4.6 bagus, tetapi masih belum cukup bagus (menurut saya. Tapi di bawah akan paham kenapa saya berpikir demikian)
Apa kerangka kerja saya?
Misalkan kita memulai proyek dari nol atau akan membuat fitur super besar.
1. Saya mendiskusikan implementasi dengan GPT dan Claude secara paralel, sesekali berbagi ide di antara mereka. Kemudian saya tetap menggunakan Claude untuk membuat spesifikasi, dan setiap spesifikasi saya tunjukkan ke GPT. Dia menemukan banyak ketidaksempurnaan! Dan bersama-sama bertiga kami menyempurnakan spesifikasi.
2. Selanjutnya berdasarkan spesifikasi kami membuat file rencana, di mana setiap bagian dirinci semaksimal mungkin berdasarkan tugas + di dalamnya ditentukan spesifikasi mana yang harus dirujuk oleh agen AI. Juga perlu memperbarui CLAUDE.md dan AGENTS.md untuk fitur/proyek. Di dalamnya harus ditentukan bahwa harus ada tes dan dokumentasi untuk setiap modul!
3. Selanjutnya untuk kenyamanan, Claude membuatkan saya prompt yang tinggal di-copas di setiap tahap dan tekan start.
4. Selanjutnya di chat terpisah dengan Claude kami mulai bekerja dengan spesifikasi. 1 chat = maksimal 1 bagian. Setelah ada basis, bisa paralel. Untuk setiap bagian, agen coding Claude harus membuat rencana, saya tunjukkan ke Codex, dia memvalidasinya, biasanya menunjukkan banyak kelemahan. Seringkali cukup 1 iterasi penyempurnaan rencana, tetapi kadang 2–3. Setelah Claude selesai implementasi dan memberikan ringkasan apa yang dilakukan, saya tunjukkan lagi ke Codex, dia menemukan kelemahan dan bug. Lalu Claude memperbaikinya. Selanjutnya /compact dan lanjutkan (atau chat baru).
4.5 Ya, saya menggunakan Codex di sini bukan tanpa alasan. Jika melakukan review agen Claude secara terpisah di chat terpisah — itu juga berfungsi, tetapi lebih buruk. Dan saya menggunakan codex-5.3-extra-high di sini.
5. Setelah setiap bagian, atau lebih baik lagi lebih sering, perlu melakukan review lagi melalui agen /review. Di sini saya lakukan melalui sonnet-4.6 dan Codex-5.3-high (tanpa extra), dan mereka menemukan kelemahan yang berbeda. Bisa juga menjalankan security-review di Claude jika fitur berpotensi tidak aman.
6. Dan seterusnya sampai spesifikasi selesai. Nanti bisa sekali lagi melewati agen untuk memeriksa apakah semuanya sudah dilakukan dengan benar.
Poin tambahan:
— perhatian, saya setidaknya membaca sekilas apa yang direncanakan agen! Jika tidak, itu seperti roulette: semakin lama dilakukan, semakin tinggi kemungkinan penyimpangan signifikan dari apa yang ada di pikiran Anda. Bahkan dengan manusia perlu sinkronisasi konstan, apalagi dengan agen.
— sebaiknya juga secara manual mengecek dan melihat apa yang sebenarnya telah dilakukan, tidak hanya mengandalkan laporan dan kelulusan tes.
— kerangka kerja di atas mungkin berlebihan untuk MVP yang harus dibuat cepat dalam 2–3 jam. Tetapi jika ada waktu dan token, lebih baik segera lakukan dengan benar, karena refactoring nanti bisa lebih lama dan lebih menyakitkan.
P.S. Saya menggunakan 1code.dev
di sana ada Codex dan Claude Code. Mereka sudah cukup menyempurnakan solusinya, saya laporkan bug sebisa saya, karena ini benar-benar nyaman. Lebih nyaman daripada Claude Code desktop yang naif. Satu-satunya — bersiaplah bahwa Anda harus memiliki GPU 16GB jika ingin menjalankan 4+ chat secara bersamaan.
Dan juga menyenangkan bahwa founder di sana juga orang kita, berasal dari RF.
Apa kerangka kerja atau lifehack Anda?
Video di atas saya pasang untuk menarik perhatian) Ini sesuai dengan penelitian Anthropic tentang profesi mana yang akan segera hilang)
#vibecoding
@oh_my_zen
Comments
0No comments yet.
Sign in to join the discussion.