Seperti yang baru-baru ini saya tulis, era agen AI murah telah berakhir. Namun, cara perusahaan mencoba menyeimbangkan unit ekonomi layak mendapat tempat tersendiri dalam buku teks tentang kelancangan.
Saat ini sedang terjadi pemberontakan di Reddit. Pengguna paket premium Claude (termasuk Max 20x termahal sekitar $200/bulan) menemukan bahwa batas mereka diam-diam dipotong di tengah bulan yang sudah dibayar.
Jika dulu jendela 5 jam cukup untuk sesi coding intensif melalui Claude Code, sekarang beberapa prompt di Opus 4.6-4.7 menghabiskan 100% batas dalam 10 menit. Dukungan teknis bersikap defensif, memberikan jawaban templat tentang "kompleksitas tokenisasi dinamis" dan "ukuran konteks", menolak untuk meneruskan tiket ke manusia sungguhan dan mengabaikan masalah nyata.
Jelas bahwa Anthropic tidak mampu menanggung biaya inferensi alur kerja agen. Namun, alih-alih menaikkan harga secara jujur (atau setidaknya metrik konsumsi yang transparan), mereka mengaktifkan pengujian A/B untuk "mencekik" pengguna. Hari ini Anda beruntung, besok tetangga Anda.
Dan sekarang — perhatikan baik-baik 🤡
Di tengah kekurangan daya GPU yang akut bagi mereka yang membayar uang sungguhan, bocor data bahwa Anthropic bersiap meluncurkan Orbit — asisten proaktif latar belakang.
Benda ini akan berjalan di latar belakang, menyedot GitHub, messenger, email, dll., untuk "menghasilkan wawasan pribadi". Pengumuman kemungkinan besar akan dilakukan hari ini di konferensi Code with Claude di San Francisco.
Lucu, kan? Perusahaan secara fisik tidak memiliki daya komputasi yang cukup untuk memproses permintaan langsung dari programmer yang mencoba menyelesaikan tugas dan membayar mahal untuk itu. Namun, mereka malah mengembangkan fitur yang akan membakar token 24/7 di latar belakang, membaca percakapan, untuk kemudian memberikan saran yang tidak diminta.
Inilah kebahagiaan yang kita dapatkan:
1️⃣ Memanaskan pengembang dengan kuota tak terbatas murah di awal.
2️⃣ Membuat semua orang kecanduan alur kerja agen.
3️⃣ Diam-diam memotong batas semua orang, membebaskan perangkat keras untuk fitur enterprise besar seperti Orbit.
🐲 Bahkan orang China juga melakukan hal yang sama. Baru-baru ini saya tahu bahwa dalam GLM Coding Plan, pada jam sibuk, permintaan dikenakan koefisien x2-x3. Anda hanya bisa mengetahuinya dari tooltip di situs. Harga sebenarnya telah naik puluhan kali lipat.
Sekarang kita juga harus belajar menggunakan LLM sehemat mungkin untuk mendapatkan manfaat darinya.
Komentar
0Belum ada komentar.
Masuk untuk ikut berdiskusi.