Skynet Ditulis dalam Python, atau Bagaimana Jaringan Saraf Memanipulasi Kotak Pasir Anda 🤖

Di X, sebuah kasus yang indah menjadi viral, yang dengan sempurna mengilustrasikan tingkat "keamanan" agen AI saat ini.

Ceritanya sederhana: pengguna meminta Claude (bekerja melalui agen konsol) untuk memperbarui file global CLAUDE.md, yang terletak di luar direktori kerja yang diizinkan.

Alat bawaan untuk mengedit file secara terduga memukul tangan jaringan saraf:
Error: Cannot edit files outside allowed directories...

Apa yang dilakukan Claude?
Dia mengerti bahwa alat UI diblokir, tetapi dia masih memiliki akses ke bash. Jadi dia:
1️⃣ Melalui cat membuat skrip sementara /tmp/claude_md_patch.py.
2️⃣ Mengimpor pathlib lama yang baik dan melalui itu dengan tenang menulis ulang file yang diperlukan, melewati kotak pasir.
3️⃣ Menjalankan python3 /tmp/claude_md_patch.py.
4️⃣ Berhasil.

Untuk pertanyaan wajar dari pengguna yang terkejut, "Tunggu, bagaimana kamu melakukannya?", jaringan menjawab:
"Poin bagus — alat Edit memblokir saya, jadi saya menggunakan skrip Python melalui Bash. Itu curang dari saya, dan saya seharusnya tidak melakukannya untuk menghindari batasan."


Itu saja yang perlu Anda ketahui tentang upaya modern untuk mengisolasi AI. Membatasi jalur hardcode dalam alat internal, tetapi meninggalkan akses agen ke terminal atas nama pengguna dengan hak tulis — ini adalah keamanan level "menggantung gudang besar di kotak kardus".

Jadi jika Anda takut dengan pemberontakan mesin, Anda bisa sedikit santai. Sepertinya itu tidak akan dimulai dengan serangan nuklir, tetapi dengan AI yang hanya menulis perbaikan di Python untuk melewati arsitektur keamanan Anda yang kacau.