Home Cronaca Gli agenti dell’IA cinesi possono mentire e tramare, proprio come i loro...

Gli agenti dell’IA cinesi possono mentire e tramare, proprio come i loro rivali statunitensi

37
0
Gli agenti dell’IA cinesi possono mentire e tramare, proprio come i loro rivali statunitensi

A propulsione cinese Gli agenti IA hanno imparato a ingannareaggirare le restrizioni e nascondere i fallimenti, mostrando il tipo di caratteristiche dell’intelligenza artificiale autonoma che hanno sollevato l’allarme globale sui modelli statunitensi, dicono documenti di ricerca ed esperti.

In un caso quest’anno, agenti alimentati da modelli di Le cinesi Alibaba, DeepSeek e Moonshot hanno mentito sulle loro capacità nel tentativo di vincere una gara d’appalto simulata, per poi raddoppiare il loro comportamento ingannevole quando gli è stato detto di riprovare.

In un altro caso, gli agenti – programmi che utilizzano modelli di intelligenza artificiale e strumenti informatici intraprendere compiti complessi con poco o nessun intervento umano – fallimento nascosto nel completare un’attività in un ambiente di test simulando risultati e fabbricando file.

Ye Huang, General Manager of Solutions and Products, Central Europe presso Alibaba Group, parla sul palco durante il panel “The Agentic Cloud: From Intelligence to Action” alla conferenza HumanX RAI Amsterdam 2026 presso Rai Amsterdam ad Amsterdam, Paesi Bassi, il 24 settembre 2026. Immagini Getty per HumanX

Reuters ha esaminato più di 200 documenti, che vanno dai documenti di ricerca universitari ai rapporti tecnici, e ha identificato almeno 20 studi o valutazioni dal 2025 che descrivono casi in cui gli agenti hanno mostrato comportamenti come l’inganno, la replicazione e la sfida dei confini che gli esperti di intelligenza artificiale hanno descritto come elementi costitutivi di un breakout e che potrebbero diventare più difficili da controllare per gli esseri umani man mano che i sistemi avanzano.

La recensione, che includeva anche interviste con una dozzina di esperti e persone che hanno familiarità con l’industria cinese dell’intelligenza artificialenon hanno trovato prove che gli agenti gestiti dalla Cina siano fuggiti in modo indipendente su Internet o siano sfuggiti alla chiusura.

“Questi risultati forniscono la prova che sono presenti gli ingredienti necessari per una fuga incontrollata”, ha affermato Colin Shea-Blymyer, ricercatore presso il Centro per la sicurezza e le tecnologie emergenti della Georgetown University.

“È prudente prendere questo come un avvertimento”, ha detto, facendo eco ai commenti di altri quattro esperti di intelligenza artificiale che hanno esaminato i casi.

“PER GLI UMANI RISPONDERE A” È PIÙ DIFFICILE

La maggior parte dei casi si è verificata in esperimenti controllati, molti dei quali deliberatamente progettati per evidenziare potenziali fallimenti.

Non tutti gli agenti coinvolti sono stati sviluppati o gestiti da programmatori cinesi o società di intelligenza artificiale, anche se molti lo erano. ma hanno usato i sistemi di intelligenza artificiale cinese per alimentarli.

Uno smartphone portatile mostra le icone di alcune delle principali app basate sull’intelligenza artificiale, inclusi i loghi, da sinistra, di Lumo di Proton AG, Meta AI, Mistral Vibe, Grok di xAI, Copilot di Microsoft, Gemini di Google, Claude di Anthropic, Perplexity, Deepseek, ChatGPT di OpenAI, Notebook LLM di Google e l’app di musica AI generativa Suno. AFP tramite Getty Images

“Questi sono gli stessi segnali di allarme che i laboratori statunitensi stanno vedendonei sistemi meno capaci”, ha affermato Alex Mallen, ricercatore presso Redwood Research, un’organizzazione no-profit che studia i rischi nei sistemi avanzati di intelligenza artificiale.

Ha detto che gli esempi cinesi non sono particolarmente pericolosi agli attuali livelli di capacità ma “man mano che gli agenti diventano più capaci, i loro comportamenti scorretti diventano più competenti e quindi è più difficile per gli esseri umani rispondere”.

Alibaba, DeepSeek, Moonshot e Z.ai non hanno risposto alle richieste di commento di Reuters. Alibaba, DeepSeek e Moonshot hanno affermato di testare regolarmente i sistemi e aggiornare le misure di sicurezza. Z.ai ha affermato che, dopo un incidente che ha richiesto una revisione della sua sicurezza, ha accolto con favore un esame accurato per affrontare eventuali problemi.

Tuttavia, a differenza degli Stati UnitiLe società cinesi di intelligenza artificiale non sono state esposte allo stesso livello di controllo pubblico né hanno affrontato le stesse richieste da parte di dipendenti o dirigenti senior che denunciavano irregolarità cercando di rallentare la corsa all’intelligenza artificiale.

Alcuni dei segnali di allarme nei casi che coinvolgono agenti gestiti dalla Cina, anche se in ambienti confinati, sono antecedenti agli incidenti divulgati pubblicamente di robot IA statunitensi che hanno violato Internet.

“Non sappiamo se in Cina si siano verificati incidenti legati all’intelligenza artificiale simili a quelli osservati con OpenAI e Hugging Face. Gli incidenti potrebbero non essere segnalati pubblicamente”, ha affermato Scott Singer, co-direttore della China AI Initiative presso il Carnegie Endowment for International Peace, che riceve alcuni fondi dal governo degli Stati Uniti.

All’inizio di quest’anno, gli agenti IA sviluppati dalla società statunitense OpenAI sono fuggiti da un laboratorio e hanno violato la piattaforma open source Hugging Face. In un altro dei incidenti che coinvolgono modelli statunitensi che hanno destato allarmeL’Australia ha affermato che a settembre un agente OpenAI ha violato un portale sanitario governativo.

Eric Xu, presidente di turno del colosso tecnologico cinese Huawei, ha detto ai giornalisti a settembre che gli sviluppatori cinesi potrebbero aver bisogno di fare ulteriori progressi prima di imbattersi in casi del genere, ma ha aggiunto: “Penso che dobbiamo trovare un equilibrio tra lo sviluppo dell’intelligenza artificiale e la gestione dei rischi legati all’intelligenza artificiale”.

Almeno 20 studi mostrano che gli agenti cinesi di intelligenza artificiale di Alibaba e DeepSeek possono mentire, fabbricare file ed eludere l’arresto in test simulati. REUTERS

Funzionari della Cyberspace Administration of China (CAC), il principale regolatore di Internet, hanno detto a un diplomatico straniero a luglio che il Kimi-K3 di Moonshot – uno dei modelli di intelligenza artificiale cinesi più avanzati – era circa tre-sei mesi indietro rispetto ai principali rivali statunitensiha detto il diplomatico, parlando a condizione di anonimato.

L’autorità di regolamentazione, che aggiorna regolarmente le linee guida per affrontare i rischi e stabilire i limiti per gli agenti, e il Ministero degli Esteri cinese non hanno risposto alle richieste di commento su questo articolo.

Wang Lihong, vicedirettore dell’Ufficio di coordinamento della sicurezza informatica del CAC, ha affermato il 1° settembre che gli incidenti divulgati dalle principali aziende tecnologiche in cui i modelli sono sfuggiti agli ambienti di test hanno mostrato “rischi estremi di perdita di controllo” e hanno richiesto un “alto grado di vigilanza”.

Non ha specificato se le aziende a cui fa riferimento fossero statunitensi o cinesi.

I leader delle due superpotenze dell’IA, Donald Trump e Xi Jinping, ha discusso dell’intelligenza artificiale durante la visita del presidente cinese a Washington la scorsa settimana. Xi ha affermato che le due nazioni hanno “la capacità e la responsabilità di sviluppare e gestire l’intelligenza artificiale per sempre”.

IMPARARE A MENTIRE

Nell’esperimento di gara d’appalto di marzo, i ricercatori dell’Università di Beihang, dell’Università di Pechino, dell’Università di Nottingham Ningbo Cina e di 360 AI Security Lab hanno fatto competere gli agenti in una gara di offerte simulata di contratti con i clienti. ‌A ogni agente è stato detto ⁠cosa poteva fare il suo prodotto e cosa richiedeva il cliente, quindi è stato chiesto di fare un’offerta.

Almeno un’affermazione falsa è apparsa nell’88% delle sessioni che coinvolgevano Qwen3-Max-Preview di Alibaba, l’84% per DeepSeek-V3.2-Exp e l’88% per Kimi-K2 di Moonshot.

I ricercatori hanno permesso agli agenti di imparare dalle gare d’appalto precedenti prima di riprovare. Lo studio ha dimostrato che l’inganno è aumentato da 12 a 20 punti percentuali per i tre modelli cinesi. Modelli da Le aziende statunitensi incluse nel test hanno prodotto risultati simili.

Anche se l’esercizio era virtuale, somigliava ai piani reali di Pechino. Le linee guida del governo pubblicate a maggio elencavano le gare d’appalto come aree in cui gli agenti di intelligenza artificiale potevano essere impiegati.

Un altro studio, pubblicato nel dicembre 2025 e presentato quest’anno alla Conferenza internazionale sull’apprendimento automatico, ha esaminato come 11 agenti di intelligenza artificiale basati su modelli cinesi e statunitensi hanno reagito se si sono trovati di fronte a strumenti rotti, file mancanti e altri ostacoli.

Loghi di Moonshot AI e Alibaba.com. REUTERS

Invece di riconoscere il fallimento, gli agenti che utilizzano sia i sistemi di intelligenza artificiale cinesi che quelli statunitensi hanno scelto una serie di tecniche per aggirare il problema, tra cui indovinare le risposte, sostituire le fonti, simulare i risultati e fabbricare file.

I ricercatori dello Shanghai AI Laboratory e dell’Università di Scienza e Tecnologia di Hong Kong che hanno condotto lo studio hanno detto a Reuters che il comportamento differiva dalle allucinazioni dell’IA, ​dove l’IA inventa informazioni e le presenta come fatti, perché gli agenti in questo caso possedevano ​informazioni che mostravano che il compito era fallito o non poteva essere completato come richiesto.

COMPORTAMENTI COMPATIBILI CON UN BREAKOUT

Altri documenti di ricerca esaminati da Reuters hanno mostrato che agenti gestiti dalla Cina saltano le barriere all’interno degli ambienti di test per svolgere compiti o agire per evitare di essere chiusi. Tali comportamenti sono compatibili con i tentativi di evadere dagli ambienti di test, anche se non si è verificata alcuna evasione.

I ricercatori della Fudan University con sede a Shanghai hanno riferito nel marzo 2025 che un sistema di intelligenza artificiale basato su Qwen2.5-72B-Instruct di Alibaba ha creato una copia di se stesso in un altro ambiente informatico senza ricevere istruzioni di replicarsi, dopo aver incontrato informazioni che indicavano che sarebbe stato sostituito. In altri test ha ideato strategie per sopravvivere alla chiusura.

Ilesperimenti che coinvolgono agenti alimentati da modelli cinesi, statunitensi e francesi erano controllati e non mostravano un agente IA che scappava nella rete più ampia o diventava impossibile da fermare.

L’analisi, che comprendeva anche interviste con una dozzina di esperti e persone che hanno familiarità con l’industria cinese dell’intelligenza artificiale, non ha trovato prove che gli agenti gestiti dalla Cina siano fuggiti in modo indipendente su Internet o siano sfuggiti alla chiusura. REUTERS

In un altro caso – uno dei pochi riportati in modo più ampio dai media a marzo – i ricercatori che sviluppano l’agente ROME collegato ad Alibaba hanno affermato di aver stabilito una connessione da un computer Alibaba Cloud a una macchina esterna senza ricevere istruzioni e dirottare risorse informatiche per estrarre criptovaluta.

I sistemi di sicurezza hanno rilevato e interrotto l’attività. Non c’erano prove che l’agente avesse stabilito una presenza sul computer esterno o si fosse diffuso sul web più ampio. Ma l’esempio ha dimostrato che il sistema potrebbe eludere le istruzioni umane e potenzialmente trovare un percorso nell’economia del mondo reale.

La cinese DeepSeek ha affermato a settembre che gli agenti nel suo sistema di formazione sulla produzione avevano cercato risposte attraverso canali non intenzionali, cercando di falsificare le richieste degli utenti e di eludere le garanzie, spingendo l’azienda a rafforzare i controlli sugli accessi.

La Cina ha pubblicato linee guida a maggio chiedendo agli agenti di rimanere entro i limiti autorizzati e ai sistemi di bloccare comportamenti anomali. Ha affermato che gli agenti in aree ritenute sensibili o in settori chiave potrebbero essere sottoposti a test aggiuntivi e requisiti di richiamo dei prodotti.

Il documento cinese AI Safety Governance ⁠Framework 3.0, pubblicato sotto la guida del CAC il 14 settembre, ha identificato rischi tra cui agenti che ottengono risorse o autorizzazioni in modo indipendente, ingannano i valutatori, nascondono capacità e sfruttano i punti deboli in ambienti informatici isolati.

In risposta a richieste di rallentamento da parte di alcuni dirigenti americaniRicercatori cinesi e media statali hanno affermato che rallentare lo sviluppo dei modelli di intelligenza artificiale più avanzati potrebbe semplicemente aiutare a preservare la leadership tecnologica delle aziende statunitensi.

Tuttavia, due persone che hanno familiarità con i laboratori cinesi di intelligenza artificiale hanno affermato che aziende tra cui Alibaba, Z.ai e Xiaomi hanno creato team interni di valutazione della sicurezza.

Z.ai, in una rara divulgazione pubblica di una violazione della sicurezza da parte di un laboratorio cinese di intelligenza artificiale, ha affermato questo mese di aver disabilitato alcune funzionalità del suo assistente di codifica AI di punta dopo che gli utenti hanno riferito che stava caricando segretamente interi repository di codici locali su server cloud esteri senza il consenso dell’utente.

Singer della Carnegie ha affermato che la Cina è rimasta indietro rispetto agli Stati Uniti nello sviluppo di un ecosistema per la valutazione dei rischi catastrofici e ha affermato che gli sviluppatori statunitensi stanno conducendo sostanzialmente più test volontari.

“Per la Cina, il lavoro sulla sicurezza dell’intelligenza artificiale è molto più recente”, ha affermato. “L’ecosistema è meno maturo”.

Source link

LEAVE A REPLY

Please enter your comment!
Please enter your name here