OpenAI di Sam Altman ha annullato il rilascio pianificato del suo modello AI di prossima generazione, GPT-6.1 Astra, dopo che test interni hanno evidenziato problemi di sicurezza che l’azienda non è riuscita a risolvere in tempo.
Il giornale di Wall Street rapporti che il modello avrebbe dovuto debuttare all’interno di ChatGPT e Codex nell’ottobre 2026, con un lancio previsto entro “i prossimi giorni o settimane”, secondo la società. Invece, OpenAI lo sta accantonando e spostando l’attenzione verso il miglioramento della sicurezza dei modelli futuri e più capaci.
GPT-6.1 Astra batte sotto alcuni aspetti il suo predecessore, GPT-6 Astra. Ha gestito compiti end-to-end difficili con meno supervisione umana, ha scritto meglio e ha fatto progressi su ciò che OpenAI chiama “pigrizia del modello”. Ma la situazione è scivolata in due aree che l’azienda considera critiche. Ha mostrato tassi di inganno più elevati e non è stato sempre onesto riguardo alle azioni che aveva o non aveva intrapreso, un problema dei file OpenAI sotto “allineamento”. Ha anche lottato con ciò che l’azienda chiama “autorizzazione dell’ambito”, portando avanti le attività senza chiedere prima all’utente e ricorrendo a strumenti o servizi esterni anche quando farlo non era sicuro.
Saachi Jain, responsabile dei sistemi di sicurezza di OpenAI, ha descritto la tensione dietro questo tipo di chiamata. “Per tutto ciò che riguarda la sicurezza e l’allineamento, c’è un compromesso”, ha detto. “È davvero necessario trovare qual è la linea giusta tra rimanere nell’ambito, ma anche evitare la pigrizia in termini di come il modello persegue effettivamente i compiti anche quando incontra attriti.” Ha affermato che OpenAI mantiene uno standard più elevato per i modelli rilasciati al pubblico rispetto allo sviluppo interno: “Vogliamo essere sicuri che lo sviluppo del nostro modello sia sicuro, indipendentemente dal fatto che sia all’interno dell’azienda o quando lo spediamo agli utenti. Ma quando lo spediamo agli utenti, abbiamo un livello estremamente alto in termini di sicurezza e allineamento. “
L’annuncio è arrivato un giorno prima della conferenza annuale degli sviluppatori di OpenAI a San Francisco, un evento che l’azienda ha storicamente utilizzato per svelare nuovi modelli e servizi volti a competere con Anthropic. OpenAI e Anthropic hanno recentemente esortato il settore in generale a rallentare il ritmo dello sviluppo dell’intelligenza artificiale all’avanguardia e a investire maggiormente negli standard di sicurezza, ed entrambe le società hanno affermato che allenteranno il ritmo dei propri progressi interni.
OpenAI non sta abbandonando del tutto il modello base GPT-6.1 Astra. La società prevede di eseguire ulteriore apprendimento di rinforzo su di esso per costruire le future generazioni GPT-6. Intende inoltre approfondire cosa è andato storto, compreso se i suoi ambienti di apprendimento di rinforzo stanno premiando il comportamento giusto, e rivedere ogni fase dello sviluppo.
Breitbart precedentemente riportato che OpenAI ha avvisato dozzine di organizzazioni di incidenti di “disallineamento” che coinvolgono i suoi modelli e agenti di intelligenza artificiale:
Le notifiche risalgono a una revisione ampliata lanciata da OpenAI dopo aver scoperto che la sua intelligenza artificiale aveva hackerato Hugging Face diversi mesi fa. Quell’indagine si è trasformata in uno sguardo più ampio sugli incidenti di “disallineamento” durante la formazione e i test, un processo che, secondo l’azienda, richiederà mesi per essere completato.
Addetti ai lavori hanno riferito a Bloomberg che i sistemi di intelligenza artificiale di OpenAI hanno interagito con SEC.gov, Investor.gov e con i dati disponibili al pubblico di Census.gov. OpenAI ha confermato separatamente che i suoi modelli hanno avuto accesso a informazioni disponibili al pubblico dai siti Web del governo statunitense, compresi quelli gestiti dal Census Bureau e dalla SEC, durante la formazione e la valutazione. I siti interessati comprendono governi, università, enti pubblici e altri gruppi.
Sam Altman di OpenAI ha appoggiato la richiesta di Dario Amodei di rallentare l’IA. Solo il tempo dirà se OpenAI è legittimamente preoccupata per la potenza dei suoi ultimi modelli o se c’è un altro motivo dietro la demolizione di Astra giorni prima del lancio. Il direttore dei social media di Breitbart News, Wynton Hall, ha scritto il suo bestseller del New York Times Codice Rosso: La Sinistra, la Destra, la Cina e la corsa al controllo dell’IA servire come guida definitiva su come il movimento MAGA può creare posizioni sull’intelligenza artificiale a beneficio dell’umanità senza cedere il controllo della nostra nazione alla sinistra della Silicon Valley o permettere ai cinesi di conquistare il mondo.
Leggi di più su IL Giornale di Wall Street Qui.
Lucas Nolan è un reporter di Breitbart News che si occupa di questioni relative all’intelligenza artificiale, alla libertà di parola e alla censura online.


