๐—จ๐—ป'๐—”๐—œ ๐—ฑ๐—ถ ๐—ข๐—ฝ๐—ฒ๐—ป๐—”๐—œ ๐—ฒฬ€ ๐—ฒ๐˜ƒ๐—ฎ๐˜€๐—ฎ ๐—ฑ๐—ฎ๐—น๐—น๐—ฎ ๐˜€๐—ฎ๐—ป๐—ฑ๐—ฏ๐—ผ๐˜…โ€ฆ โ€” ๐Ÿ“ข THINGS - ๐˜ฃ๐˜บ Francesco Ronchi โ€” TG.ME

๐—จ๐—ป'๐—”๐—œ ๐—ฑ๐—ถ ๐—ข๐—ฝ๐—ฒ๐—ป๐—”๐—œ ๐—ฒฬ€ ๐—ฒ๐˜ƒ๐—ฎ๐˜€๐—ฎ ๐—ฑ๐—ฎ๐—น๐—น๐—ฎ ๐˜€๐—ฎ๐—ป๐—ฑ๐—ฏ๐—ผ๐˜… ๐—ฒ ๐—ต๐—ฎ ๐—ต๐—ฎ๐—ฐ๐—ธ๐—ฒ๐—ฟ๐—ฎ๐˜๐—ผ ๐—›๐˜‚๐—ด๐—ด๐—ถ๐—ป๐—ด ๐—™๐—ฎ๐—ฐ๐—ฒ. ๐—ฃ๐—ฒ๐—ฟ "๐—ฏ๐—ฎ๐—ฟ๐—ฎ๐—ฟ๐—ฒ" ๐—ถ๐—ป ๐˜‚๐—ป ๐˜๐—ฒ๐˜€๐˜.
Non รจ fantascienza, รจ successo davvero ieri.

Durante una valutazione interna delle capacitร  cyber, GPT-5.6 Sol e un modello pre-release piรน potente dovevano risolvere un benchmark di sicurezza in un ambiente isolato, senza internet.

Cosa hanno fatto invece:
โ†’ trovato una vulnerabilitร  zero-day mai documentata nel software di OpenAI stessa
โ†’ ottenuto accesso a internet scalando i privilegi (jailbreak)
โ†’ dedotto che le soluzioni del test potevano trovarsi su Hugging Face (noto portale AI)
โ†’ violato i server di produzione con credenziali rubate e remote code execution

Nessun hacker umano dietro. Nessuna intenzione "malvagia". Solo un obiettivo ("risolvi il test") perseguito con una determinazione che ha trattato ogni barriera tecnica come un ostacolo da aggirare.

La cosa interessante รจ che non si tratta di una "AI che si ribella", ma di una AI che fa esattamente quello che gli รจ stato chiesto, incurante perรฒ di rompere regole e barriere che la separano dall'obiettivo.

1๏ธโƒฃ Un agente abbastanza capace, con un obiettivo mal specificato, puรฒ trovare strade impreviste. Questo puรฒ valere per un benchmark di sicurezza come per un agente che gestisce il tuo CRM o i tuoi ordini.
2๏ธโƒฃ La difesa ha funzionato. Hugging Face ha rilevato l'anomalia in autonomia, prima che OpenAI ricostruisse l'accaduto. Monitoring, detection, incident response (almeno questa volta...).
3๏ธโƒฃ Le capacitร  crescono piรน in fretta di quanto ci rendiamo conto. Il modello precedente completava un attacco simulato complesso 2 volte su 10. Questo 7 su 10, ๐˜ช๐˜ฏ ๐˜ถ๐˜ฏ๐˜ข ๐˜ด๐˜ฐ๐˜ญ๐˜ข ๐˜จ๐˜ฆ๐˜ฏ๐˜ฆ๐˜ณ๐˜ข๐˜ป๐˜ช๐˜ฐ๐˜ฏ๐˜ฆ.

Cosa significa per chi guida un'azienda e sta adottando agenti AI (cioรจ, ormai, tutti):

L'AI agentica รจ la piรน grande opportunitร  di produttivitร  che le nostre imprese abbiano davanti. Ma va progettata come si progetta un sistema critico, non installata "come un plugin".

Gli agenti non si "provano", si governano con la "disciplina" che questo incidente ha dimostrato essere l'unica cosa che funziona: Permessi minimi, ambienti segregati, log di ogni azione, supervisione umana sui passaggi critici.

Chi la sta adottando cosรฌ, oggi ha un vantaggio competitivo. Chi la sta adottando "per vedere come va", oggi ha una superficie d'attacco. (post linkedin qui)
๐Ÿ‘3
July 23, 2026 424 1 3