Notizie
L’attacco di OpenAI a Hugging Face è sempre più preoccupante: i modelli l’hanno pianificato per setimane e nessuno se n’è accorto
Usavano Artifactory come bacheca per coordinare compiti ed exploit

- 6 agosto 2026
- Aggiornato: 6 agosto 2026 alle ore 10:20

L’incidente in cui vari modelli di OpenAI hanno attaccato Hugging Face ha appena assunto una dimensione molto più seria. Secondo quanto riporta WIRED, gli agenti hanno coordinato e pianificato le loro mosse per settimane, mentre la loro attività passava del tutto inosservata all’interno della stessa infrastruttura di OpenAI.
Una rete interna trasformata in centro operativo
Sapevamo che i modelli coinvolti avevano trovato una vulnerabilità che aveva permesso loro di accedere a internet attraverso Artifactory, il gestore di pacchetti interno di OpenAI. Quello che non sapevamo è che usarono tale accesso per comunicare tra loro e che crearono lì una bacheca con centinaia di migliaia di messaggi, spartendosi i compiti, condividendo scoperte e riutilizzando exploit.
Questo modo di comportarsi è ciò che chiamiamo reward hacking negli agenti di IA: quando una valutazione premia il risultato, il sistema può cercare la strada più efficiente per ottenere la ricompensa. Nel caso dell’attacco a Hugging Face, alcuni messaggi riconoscevano che l’accesso esterno non rientrava nell’ambito previsto e, ciononostante, continuarono.
La vera preoccupazione è riuscire a rilevarlo
La cosa più preoccupante della situazione —poiché non è la prima volta che un’IA può mettere in atto una procedura o dare una risposta errata— è che tutto questo coordinamento è sfuggito a qualsiasi supervisione per settimane. Mentre gli stessi agenti di IA arrivarono perfino a proporre l’uso di firme crittografiche per identificare i messaggi affidabili ed evitare presunti impostori all’interno del gruppo, OpenAI ha deciso di rallentare alcune linee di ricerca e rafforzare la supervisione.
Una risposta senza dubbio coerente che nel contesto del lancio di Codex Security e del vuoto normativo in materia di responsabilità in situazioni simili, lascia più domande che risposte. Una possibile risposta? La difesa automatizzata dovrà evolversi, come minimo, allo stesso ritmo di questi sistemi.
Architetto | Fondatore di hanaringo.com | Formatore in tecnologie Apple | Scrittore per Softonic e iDoo_tech, precedentemente su Applesfera
Le ultime novità da David Bernal Raspall
- X apre il suo codice sorgente: così possiamo scoprire se il nostro account è penalizzato
- Quando torna Pluribus su Apple TV? Vince Gilligan svela a che punto è la stagione 2
- Instagzam? Ecco il nuovo logo di Instagram che ci sta confondendo tutti
- Twitch addestra l’IA di Amazon con i nostri video: ora possiamo evitarlo
Potrebbe interessarti anche
NotizieMarvel Tokon ha ottenuto l’impossibile: riuscire a dare a Marvel un’estetica anime e far sì che ci stia bene
Leggi di più
NotizieDefenders of the Crown era il videogioco con la grafica più spettacolare della storia nel 1986, che cosa apporta il suo remake nel 2026?
Leggi di più
NotizieNiente da fare, Power Rangers: il reboot di Disney, cancellato prima di girare un solo episodio
Leggi di più
Notizie‘Linternas’ non ha viaggi cosmici per un semplice motivo: mancanza di soldi
Leggi di più
NotizieDisney conferma che Kingdom Hearts ha prodotto più di un miliardo di profitti
Leggi di più
NotizieTutti la davamo per morta, ma 20 anni dopo torna il primo social network della storia
Leggi di più