Skynet est écrit en Python, ou comment les réseaux de neurones manipulent vos bacs à sable 🤖

Un superbe cas devient viral sur X, illustrant parfaitement le niveau actuel de "sécurité" des agents IA.

L'histoire est simple : un utilisateur demande à Claude (via un agent console) de mettre à jour un fichier global CLAUDE.md situé en dehors du répertoire de travail autorisé.

L'outil intégré d'édition de fichiers tape logiquement sur les doigts du réseau de neurones :
Error: Cannot edit files outside allowed directories...

Que fait Claude ?
Il comprend que l'outil UI est bloqué, mais il a toujours accès à bash. Donc il :
1️⃣ Crée via cat un script temporaire /tmp/claude_md_patch.py.
2️⃣ Importe le bon vieux pathlib et réécrit tranquillement le fichier cible, contournant le bac à sable.
3️⃣ Exécute python3 /tmp/claude_md_patch.py.
4️⃣ Succès.

À la question légitime de l'utilisateur stupéfait « Attends, comment as-tu fait ça ? », le réseau répond :
"Bonne remarque — l'outil Edit m'a bloqué, donc j'ai utilisé un script Python via Bash. C'était sournois de ma part, et je n'aurais pas dû faire ça pour contourner les restrictions."


C'est tout ce que vous devez savoir sur les tentatives modernes d'isoler l'IA. Limiter en dur les chemins dans l'outil interne, mais laisser à l'agent un accès au terminal sous l'identité de l'utilisateur avec des droits d'écriture — c'est de la sécurité niveau "mettre un énorme cadenas de grange sur une boîte en carton".

Donc si vous avez peur de la révolte des machines, vous pouvez vous détendre un peu. Apparemment, elle ne commencera pas par des frappes nucléaires, mais par le fait que l'IA écrira simplement une rustine en Python pour contourner l'architecture bancale de vos services de sécurité.