Bukan Modelnya. Lingkungannya.
Kamu tidak salah pakai AI karena belum ketemu model yang tepat.
Kamu salah karena belum bangun lingkungannya.
Rohit menulis itu di X Article-nya. Bukan perang merk. Yang ditunjuk lebih tajam:
Model adalah mesin. Harness-nya — lingkungan lengkap tempat model itu berpikir — adalah semuanya.
Ada tim yang mengirim satu juta baris kode dengan tiga engineer. Ada yang susah dapat satu refactor yang konsisten dari pipeline agent-nya. Bedanya bukan GPT-5 versus Claude Opus.
Paper SWE-agent Princeton, SWE-bench Lite, GPT-4 Turbo yang sama: lewat shell biasa 11%. Lewat Agent-Computer Interface yang dirancang, 18%. Kenaikan relatif 64%. Hanya dari interface-nya.
Bukan temperature. Bukan max tokens. Bukan “prompt yang lebih pintar”, meski industri sudah menghabiskan tahun-tahun kolektif untuk berdebat soal itu.
Bedanya: harness.