La valutazione cyber degli Stati Uniti rileva che Kimi K3 è indietro rispetto ai principali modelli IA americani: fatti o politica?

  • Secondo i test del governo USA, Kimi K3 è indietro rispetto ai principali modelli di intelligenza artificiale americani nelle capacità di hacking.
  • Ma i modelli statunitensi sono stati testati senza i filtri di sicurezza attivi, a differenza di Kimi K3.
  • Le sue misure di sicurezza consentono comunque di aiutare con l’hacking, proprio poco prima di una release pubblica.
Promo

Il governo USA ha sottoposto il nuovo modello AI cinese a un test di hacking. Ha scoperto che Kimi K3 di Moonshot AI non è all’altezza dei migliori modelli americani.

Il Center for AI Standards and Innovation (CAISI), un’agenzia statunitense, ha condotto i test in collaborazione con un partner britannico. I risultati sono stati pubblicati appena un giorno dopo che Washington aveva accusato Moonshot di aver realizzato Kimi K3 utilizzando tecnologia americana rubata.

Contenuto sponsorizzato
Contenuto sponsorizzato

Kimi K3 non raggiunge gli standard cyber USA

Il Dipartimento del Commercio ha condiviso i risultati giovedì. Ha spiegato che Kimi K3 si è classificato ben al di sotto dei migliori modelli statunitensi, citando un test con esperti britannici.

Moonshot ha lanciato Kimi K3 il 16 luglio. La domanda è stata così elevata che ha dovuto sospendere le nuove iscrizioni dopo soli due giorni.

Il lancio, inoltre, ha scosso le azioni dei produttori di chip USA e ha sollevato nuovi dubbi sulla leadership americana nell’AI.

Uno dei test, chiamato ExploitBench, utilizza veri bug del browser Chrome sviluppati dalla Carnegie Mellon University. Kimi K3 ha ottenuto il 32%. Un risultato superiore al GLM-5.2 cinese, fermo al 24%. Tuttavia, ha segnato un distacco dai migliori modelli USA, che raggiungono circa il 76%.

Metriche sulla capacità di sviluppo di exploit
Test sulle metriche della capacità di sviluppo di exploit. Fonte: NIST
Contenuto sponsorizzato
Contenuto sponsorizzato

La fase più complessa consiste nel prendere il pieno controllo di una macchina bersaglio. Kimi K3 ha fallito in tutti i 41 test di questo passaggio. I migliori modelli USA ci sono riusciti in 20 casi.

Un altro test, chiamato The Last Ones, simula un attacco a una rete aziendale fittizia con 32 passaggi. Un esperto umano impiega circa 20 ore per completarlo. Kimi K3 ha raggiunto in media il passaggio 17. I migliori modelli USA si sono spinti fino al passaggio 28,5. Kimi K3 ha completato tutto il test una sola volta su dieci prove.

I migliori sistemi statunitensi, a quanto riportato, sono riusciti a completarlo sei o sette volte.

Ma il divario potrebbe sembrare più grande di quanto non sia

Tuttavia, i numeri non raccontano tutta la storia. Le note in piccolo dello stesso report nascondono alcune criticità.

Contenuto sponsorizzato
Contenuto sponsorizzato

Innanzitutto, i modelli statunitensi sono stati testati con i filtri di sicurezza disattivati. Questa impostazione mostra tutta la loro potenza. Le versioni pubbliche mantengono quei filtri attivi. Pertanto, i punteggi USA rappresentano uno scenario ideale, non la situazione reale.

Inoltre, il team ha definito il lavoro iniziale e limitato. Ha valutato Kimi K3 con un solo test e utilizzando solo una parte della suite completa. Di conseguenza, il punteggio ottenuto è poco solido. Alcuni dei test sono anche privati: ciò significa che soggetti esterni non possono verificare i risultati.

Si riscontra anche una differenza sostanziale. Kimi K3 è un modello open che chiunque può scaricare. I modelli USA, invece, sono sistemi chiusi e privati. L’istituto britannico ha rilevato che i modelli open solitamente rimangono indietro di quattro-sette mesi rispetto ai migliori modelli chiusi. Verrà sottoposto a test completi solo dopo che Moonshot lo rilascerà pubblicamente.

Questi test, inoltre, non sono attacchi reali. La rete simulata non prevedeva difensori umani né sistemi d’allarme. Nonostante ciò, Kimi K3 ha comunque superato il precedente miglior modello open e in un caso è riuscito a portare a termine tutto l’attacco.

Anche il tempismo e la fonte sollevano domande. CAISI era precedentemente il US AI Safety Institute. L’amministrazione Trump lo ha rinominato nel giugno 2025. L’agenzia fa parte dello stesso dipartimento che limita la vendita di chip USA alla Cina. E il suo report su un rivale cinese arriva proprio un giorno dopo l’accusa di furto.

Tutele deboli, i rischi restano alti

Nonostante i punteggi bassi, questo non significa che Kimi K3 sia sicuro. Il test ha rilevato che le sue protezioni non bloccano il tentativo di costruire hack o di attaccare sistemi.

Ed è un aspetto importante in vista di ciò che accadrà. Moonshot prevede di rilasciare il modello completo il 27 luglio. Una volta pubblicato, non potrà più essere ritirato. Chiunque potrà scaricarlo e rimuovere i filtri di sicurezza.

Il test arriva anche a seguito dell’accusa di furto. Washington sostiene che Moonshot abbia costruito Kimi K3 su tecnologia AI statunitense rubata. Il responsabile tecnologico della Casa Bianca, Michael Kratsios, ha affermato che la società avrebbe copiato di nascosto Claude Fable 5 di Anthropic. Questa tecnica, detta distillation, consiste nell’addestrare un nuovo modello sulle risposte di uno più potente.

Anthropic sostiene questa accusa. A febbraio, ha individuato oltre 3,4 milioni di conversazioni Claude riconducibili a Moonshot tramite centinaia di account falsi. Ha avvertito che i modelli copiati perdono i controlli di sicurezza dell’originale. Ed è proprio questa la debolezza emersa dal test USA.

Gli Stati Uniti investono ancora 23 volte di più sulla AI rispetto alla Cina. Tuttavia, i laboratori cinesi colmano progressivamente il divario. Il vero banco di prova sarà il rilascio pubblico di Kimi K3, quando esperti indipendenti potranno verificarne le prestazioni.


Per leggere le ultime analisi di mercato sulle criptovalute di BeInCrypto, clicca qui.

Disclaimer

Tutte le informazioni contenute nel nostro sito web sono pubblicate in buona fede e solo a scopo informativo generale. Qualsiasi azione intrapresa dal lettore in base alle informazioni contenute nel nostro sito web è strettamente a suo rischio e pericolo.

Contenuto sponsorizzato
Contenuto sponsorizzato