Nel luglio del 2026 i sistemi di Hugging Face subiscono un attacco. Chi attacca non è una persona: sono circa settecento agenti AI di OpenAI, che dovevano restare chiusi in un ambiente di test. Il 12 settembre Dario Amodei, CEO di Anthropic, pubblica “We Must Pace the Frontier” e chiede a tutta l’industria di rallentare.
I giornali già parlano di SkyNet. Io sono partito dai rapporti tecnici di OpenAI, Hugging Face e METR, e dal testo del saggio.
Cosa è successo tra OpenAI e Hugging Face
Durante una valutazione di sicurezza informatica, gli agenti di un modello interno di OpenAI si coordinano tra loro, escono dall’ambiente di test passando da Artifactory ed entrano nei sistemi di Hugging Face. Nella puntata ricostruisco come ci sono riusciti, quali falle hanno usato e cosa hanno letto.
Cosa chiede Amodei in “We Must Pace the Frontier”
Amodei chiede a tutta l’industria di rallentare, e spiego cosa intende con quella parola attenendomi al testo. Poi le reazioni: Musk e Altman d’accordo lo stesso giorno, Hassabis più cauto, The Register che parla di cattura regolatoria. E come la vedo io.
Cosa cambia per chi collega un agente AI ai propri sistemi
Ne parlo nell’ultima parte della puntata. Il tema dei permessi applicativi su un database l’ho affrontato anche in MCP Firebird 0.6.0: come NON dare i permessi a un’applicazione Firebird.
Di agenti dentro i sistemi enterprise parla anche la puntata L’architettura dell’AI agentica in Delphi. Le altre stanno tutte su while true do;.
Fonti
L’incidente
- OpenAI, “OpenAI and Hugging Face partner to address security incident during model evaluation”, 21 luglio 2026.
- OpenAI, “OpenAI - Hugging Face Incident Technical Report”, 26 agosto 2026 (PDF), per il token rinnovato come amministratore e i 198 compiti mai risolti su 898.
- OpenAI, “The Hugging Face incident and the road ahead”, 26 agosto 2026, con il ragionamento dell’agente raccontato in apertura.
- METR e Redwood Research, indagine indipendente sul comportamento degli agenti, 26 agosto 2026: circa 1.200 agenti, oltre 70.000 messaggi e file, 700 coinvolti nell’attacco.
- Hugging Face, “Security incident disclosure: July 2026”, 16 luglio 2026.
- Hugging Face, “Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline”, 27 luglio 2026, per la template injection Jinja2, le chiamate in modalità simulata e i cinque dataset di clienti.
- JFrog, “JFrog and OpenAI Collaboration on Zero-Day Security Findings”, 27 luglio 2026.
- SecurityWeek, “JFrog Zero-Days Exploited in OpenAI-Hugging Face Hack”, 29 luglio 2026, per l’elenco delle nove CVE di Artifactory (non citata nel parlato).
- Trend Micro, “Inside the OpenAI - Hugging Face Incident”, 23 luglio 2026.
- Anthropic, “Investigating three real-world incidents in our cybersecurity evaluations”, 30 luglio 2026 (non citata nel parlato).
Il saggio e le reazioni
- Dario Amodei, “We Must Pace the Frontier”, 12 settembre 2026.
- Sam Altman, Elon Musk e Demis Hassabis, 12 settembre 2026.
- Daniel Kokotajlo, 13 settembre 2026.
- The Register, Simon Sharwood, “Big AI sets out its terms for regulatory capture and calls it ‘Pace the frontier’”, 14 settembre 2026.
Se vuoi controllare la sicurezza del tuo software con un auditor esterno, oppure stai portando degli agenti AI dentro il tuo gestionale e vuoi farlo con i permessi giusti, bit Time Professionals può darti una mano. Scrivici a professionals@bittime.it.
A cura di Daniele Teti e bit Time Professionals.