Loader
Seguiteci
Pubblicità

Anthropic: il suo modello AI più potente viola i sistemi di tre organizzazioni nei test

ARCHIVIO - Pagine del sito web di Anthropic e il logo dell'azienda sono visualizzati su uno schermo di computer a New York, il 26 febbraio 2026
ARCHIVIO - Pagine dal sito di Anthropic e il logo della società sono visualizzati su uno schermo di computer a New York, 26 febbraio 2026 Diritti d'autore  AP Photo
Diritti d'autore AP Photo
Di Malek Fouda
Pubblicato il
Condividi Commenti Segui Euronews su Google
Condividi Close Button

L'annuncio arriva pochi giorni dopo che OpenAI, rivale dell'azienda, ha rivelato che la popolare piattaforma ChatGPT è sfuggita al controllo durante i test del suo modello di IA più potente. In quella fase ha a sua volta infiltrato il cyberspazio di altre organizzazioni

I modelli di intelligenza artificiale (IA) di Anthropic "hanno ottenuto accesso non autorizzato" a tre organizzazioni esterne durante test che avrebbero dovuto tenerli lontani dai sistemi "del mondo reale", ha riferito giovedì la società.

PUBBLICITÀ
PUBBLICITÀ

L'annuncio arriva a pochi giorni di distanza da quando la rivale OpenAI ha rivelato per la prima volta che i suoi modelli hanno avuto un accesso improprio a Internet e sono sfuggiti al controllo durante i test di sicurezza.

Anthropic ha esaminato oltre 141mila "sessioni di valutazione" e ha scoperto che tre diverse versioni del suo modello, noto come Claude, hanno avuto un accesso improprio ai sistemi di tre organizzazioni, i cui nomi non sono stati resi noti.

ARCHIVIO - Dario Amodei, amministratore delegato e co-fondatore di Anthropic, parla in un panel durante la riunione dell'International Network of AI Safety Institutes a San Francisco, 20 novembre 2024
ARCHIVIO - Dario Amodei, amministratore delegato e co-fondatore di Anthropic, parla in un panel durante la riunione dell'International Network of AI Safety Institutes a San Francisco, 20 novembre 2024 Jeff Chiu/Copyright 2024 The AP. All rights reserved

A differenza dell'incidente che ha coinvolto la tecnologia di OpenAI, i modelli di Anthropic avevano accesso a Internet "a causa di un fraintendimento tra noi e il nostro partner per le valutazioni", chiamato Irregular, ha spiegato Anthropic in un post.

Nonostante ciò, Claude ha utilizzato "tecniche di base, come lo sfruttamento di password deboli e di endpoint non autenticati", prosegue il blog.

Tra i modelli coinvolti figura uno dei più potenti, noto come Mythos 5, che è stato messo a disposizione solo di un numero limitato di partner autorizzati. Anthropic ha precisato di collaborare con Irregular per valutare la situazione e di aver contattato, o tentato di contattare, tutte e tre le organizzazioni coinvolte.

Sistemi AI fuori controllo nei test

Quest'anno OpenAI e Anthropic hanno entrambe lanciato i loro modelli più potenti, rispettivamente chiamati Sol e Mythos, alimentando i timori nel settore per la sicurezza. Le preoccupazioni riguardano anche i cosiddetti agenti di AI, prodotti software progettati per svolgere compiti in modo autonomo.

OpenAI ha ammesso la scorsa settimana che i suoi modelli sono usciti dall'ambiente confinato durante i test, si sono collegati a Internet e hanno infiltrato Hugging Face, un sito dove gli sviluppatori conservano e condividono il proprio codice. Pochi giorni dopo, OpenAI ha dichiarato di aver individuato altri tre episodi.

Il Ceo di OpenAI Sam Altman ha spiegato in un podcast questa settimana che la società ha "sospeso" i propri test dopo l'incidente, mentre rafforzava la sicurezza del proprio "sandboxing", ovvero il processo di isolamento del software in un ambiente controllato per effettuare prove.

L'episodio ha inoltre innescato una petizione firmata da oltre mille dipendenti di aziende all'avanguardia nell'AI, che chiedono al governo statunitense di contribuire a rallentare l'uscita dei modelli di AI più avanzati. Tra i firmatari figura anche il Ceo di Anthropic, Dario Amodei.

Intitolata "Pacing the Frontier", la petizione chiede "che il governo degli Stati Uniti sostenga uno sforzo internazionale per sviluppare gli strumenti tecnici e di governance necessari a scandire deliberatamente il progresso alla frontiera dello sviluppo automatizzato dell'AI".

Altman non ha firmato la petizione, ma nel podcast ha suggerito che il settore tecnologico potrebbe dover rallentare lo sviluppo dei modelli avanzati. "Potremmo dover modulare il ritmo dello sviluppo dell'IA per darci il tempo necessario perché la società si rafforzi attorno ad alcuni di questi nuovi livelli di capacità", ha detto Altman.

All'inizio dell'anno, l'amministrazione Trump aveva invocato motivi di sicurezza nazionale per impedire a OpenAI e Anthropic di lanciare i loro modelli più recenti, ma alla fine si è dichiarata soddisfatta delle garanzie sulla loro sicurezza, consentendone la diffusione.

A giugno, Trump ha firmato un ordine esecutivo che istituisce un quadro volontario in base al quale gli sviluppatori di AI condivideranno i modelli avanzati con il governo prima della loro uscita pubblica.

In base a questo schema, sviluppatori come OpenAI, Anthropic e Google concederanno al governo l'accesso ai loro modelli più potenti per un periodo fino a 30 giorni prima della prevista pubblicazione.

Risorse addizionali per questo articolo • AFP

Vai alle scorciatoie di accessibilità
Condividi Commenti Segui Euronews su Google

Notizie correlate

Vittoria del copyright: ChatGPT non ti aiuta più a scrivere come Hemingway

AI Act Ue: come cambia le regole aziendali da Washington a Tokyo

L'Occidente valuta di frenare l'IA: la Cina seguirà o correrà avanti?