Notizie
OpenAI lancerà presto Astra, ma con un “bottone antipanico” che non ci aspettavamo
È il primo modello “Critical” e si autoferma su azioni rischiose

- 2 settembre 2026
- Aggiornato: 2 settembre 2026 alle ore 09:44

OpenAI sta preparando il lancio di Astra, il suo modello più avanzato, e questa volta la potenza arriva accompagnata da un sistema di sicurezza particolarmente vistoso. Dopo l’incidente in cui un modello di OpenAI ha attaccato Hugging Face, l’azienda ha rafforzato considerevolmente i suoi controlli e sistemi. Quando sarà disponibile, Astra si fermerà automaticamente in presenza di determinate azioni quando il sottosistema di sicurezza lo riterrà opportuno. Una sorta di pulsante di panico per tenere sotto controllo le sue capacità più avanzate.
Il primo modello di OpenAI con rischio “Critical”
Secondo quanto riporta Axios, OpenAI considera Astra il primo modello a raggiungere il livello Critical all’interno del suo framework di preparazione. Può trovare vulnerabilità sconosciute e sviluppare modi per sfruttarle in modo del tutto autonomo. Durante i test, Astra è arrivato a scoprire e concatenare due vulnerabilità zero-day, un salto notevole nell’evoluzione che abbiamo già visto con il lancio di GPT-5.6 e rispetto agli strumenti di cybersicurezza di OpenAI che hanno aiutato a migliorare la sicurezza di Google Chrome.
Se consideriamo agenti come ChatGPT Work, capaci di mantenere l’esecuzione di compiti per ore, il nuovo approccio, più incentrato su un controllo continuo e non su quello del prompt iniziale o dei risultati, è interessante. Più a lungo lavora un agente, più strade può prendere e più importante è che il sistema possa monitorare ogni azione che esegue all’interno del suo lavoro.
Con questo approccio, OpenAI ha predisposto le salvaguardie in grado di rallentare, mettere in pausa o fermare direttamente un compito in presenza di certi segnali di attività. In ChatGPT o Codex potremo inviare una richiesta per rivedere l’azione bloccata, mentre nell’API l’attività verrà fermata automaticamente a quel punto. In entrambi i casi, tuttavia, le capacità maggiori resteranno inizialmente nelle mani di un gruppo ristretto di tester mentre si affinano le nuove protezioni.
Architetto | Fondatore di hanaringo.com | Formatore in tecnologie Apple | Scrittore per Softonic e iDoo_tech, precedentemente su Applesfera
Le ultime novità da David Bernal Raspall
- Un iPhone rosso ciliegia? Questo mockup generato dall’IA lo mostra in tutto il suo splendore
- Google lancia Gmail Live: Gemini ora parla in Gmail, Docs e Keep
- GPT-6 Astra è già qui: per OpenAI è l’inizio dell’AGI
- Questo messaggio è davvero di Amazon? Così possiamo usare la sua IA per difenderci dalle truffe
Potrebbe interessarti anche
NotizieIl regista di ‘Spider-man: Brand New Day’ sta per adattare una delle serie più famose della storia, che ha appena avuto un remake
Leggi di più
NotizieIn Cina hanno fatto un nuovo film di Tom e Jerry. È il più grande disastro dell’anno.
Leggi di più
NotizieDisney ha scritturato la prima “Genia” per il suo musical di ‘Aladdin’. Naturalmente, tutti hanno un’opinione
Leggi di più
Notizie‘Ora mi vedi’ non si ferma solo al cinema: ora, inoltre, avrà una versione a Broadway
Leggi di più
Notizie‘Spider-man: Brand New Day’ sta per perdere finalmente il suo primo posto al botteghino. La sua sostituta ha usato trucchi di magia
Leggi di più
Notizie“Non sei mai un maestro, sei sempre un apprendista”. Guillermo del Toro parla chiaro sull’IA
Leggi di più