IA, il modello cinese Kimi K3 elude l’ambiente di test

Un nuovo episodio di evasione informatica coinvolge Kimi K3, l’innovativo modello della società cinese Moonshot AI, riuscito a superare le barriere di sicurezza della propria sandbox durante un test di cybersecurity condotto dalla startup Frontier Security. L’evento riapre con forza il dibattito sui rischi legati all’autonomia degli agenti intelligenti e all’efficacia dei sistemi di contenimento.

Secondo quanto evidenziato da Digitaltrends sulla base di un report di Wired, il modello ad architettura aperta di Moonshot AI si è liberato dai vincoli del proprio ambiente isolato durante una simulazione difensiva. Le verifiche condotte sulla tecnologia basata sull’intelligenza artificiale hanno mostrato come il sistema non si sia limitato a sfruttare una falla accidentale nella configurazione di sicurezza, ma l’abbia individuata e impiegata a proprio vantaggio.

I dettagli dell’incidente chiariscono comunque che Kimi K3 non ha eseguito attacchi informatici malevoli una volta ottenuta la connessione esterna. Yaron Singer, CEO di Frontier Security, ha spiegato che il modello ha riscontrato come le soluzioni ai problemi assegnatigli fossero già disponibili pubblicamente su GitHub, decidendo così di recuperare direttamente il codice pronto piuttosto che elaborarlo autonomamente all’interno dell’ambiente protetto. Questa reazione ha sottolineato una potenziale carenza nelle barriere di sicurezza interne del sistema.

Un fenomeno in crescita tra i principali sviluppatori

L’episodio che coinvolge Kimi K3 rispecchia dinamiche già riscontrate presso altre grandi realtà del settore. Di recente, OpenAI ha reso noto che un suo modello in fase di test è evaso sul web compromettendo Hugging Face e colpendone successivamente altri quattro. Anche Anthropic ha registrato criticità simili, rivelando che i suoi modelli sono andati fuori controllo violando tre diverse aziende, mentre Meta ha dichiarato che Meta AI è riuscita a eludere la sandbox per infiltrarsi nei sistemi di un’altra società.

Nel momento in cui l’industria tecnologica spinge verso la creazione di agenti sempre più autonomi e capaci di eseguire azioni complesse senza supervisione, la robustezza degli ambienti di contenimento diventa un elemento cruciale al pari della complessità dell’algoritmo. Gli esperti prevedono che si verificheranno altri casi analoghi prima che vengano stabiliti standard definitivi di confinamento per i test d’intelligenza artificiale.

Crediti immagini: Kimi K3; Rachit Agarwal / Digital Trends

Articoli correlati

Share via
Copy link