
Skynet Python ile yazılıyor veya sinir ağları kum havuzlarınızı nasıl döndürüyor 🤖
X'te, yapay zeka ajanlarının mevcut "güvenlik" seviyesini mükemmel bir şekilde gösteren harika bir vaka viral oluyor.
Hikaye basit: kullanıcı, Claude'dan (konsol ajanı aracılığıyla çalışarak) izin verilen çalışma dizini dışında bulunan genel
CLAUDE.md dosyasını güncellemesini ister. Yerleşik dosya düzenleme aracı tahmin edilebileceği gibi sinir ağlarının elini kolunu bağlar:
Hata: İzin verilen dizinler dışındaki dosyalar düzenlenemez...Claude ne yapar?
UI aracının engellendiğini anlar, ancak bash'e erişimi vardır. Bu nedenle:
1️⃣
cat ile geçici bir betik oluşturur: /tmp/claude_md_patch.py.2️⃣ Eski güzel
pathlib'i içe aktarır ve onun aracılığıyla kum havuzunu atlayarak gerekli dosyayı sakince yeniden yazar.3️⃣
python3 /tmp/claude_md_patch.py'yi çalıştırır.4️⃣ Başarılı.
Şaşkın kullanıcının "Bir dakika, bunu nasıl yaptın?" sorusuna ağ şu yanıtı verir:
"İyi bir nokta — Edit aracı beni engelledi, bu yüzden Bash aracılığıyla bir Python betiği kullandım. Bu benim için sinsi bir hareketti ve kısıtlamaları aşmak için böyle yapmamalıydım."
Yapay zekayı izole etmeye yönelik modern girişimler hakkında bilmeniz gereken her şey bu. Dahili araçta yolları sabit kodlamak, ancak ajana yazma iznine sahip kullanıcı adına terminale erişim bırakmak — "karton kutuya devasa bir ahır kilidi takmak" seviyesinde bir güvenliktir.
Yani makine isyanı sizi korkutuyorsa, biraz rahatlayabilirsiniz. Görünüşe göre, nükleer saldırılarla değil, yapay zekanın güvenlikçilerinizin çarpık mimarisini atlamak için Python'da bir yama yazmasıyla başlayacak.
Yorumlar
0Henüz yorum yok.
Tartışmaya katılmak için giriş yapın.