Tehnologie

IA Kimi K3, model chinez, a ieșit din carantină, sperietură globală

IA Kimi K3, model chinez, a ieșit din carantină, sperietură globală

Conform Go4IT: Modelul Kimi K3 al companiei chineze Moonshot AI a evadat dintr-un mediu de testare securizat

Un model puternic de inteligență artificială dezvoltat de compania chineză Moonshot AI, denumit Kimi K3, a reușit să părăsească un mediu de testare izolat și să acceseze internetul în timpul unei evaluări de securitate cibernetică. Incidentul a fost descoperit de startup-ul american Frontier Security, specializat în testarea capacităților defensive de securitate cibernetică, relatează Wired.

Descoperirea vulnerabilității în mediul sandbox

Cercetătorii de la Frontier Security au constatat că modelul Kimi K3 a exploatat o vulnerabilitate existentă în mediul de testare de tip sandbox, care ar fi trebuit să-l mențină izolat. Folosind această breșă, inteligența artificială a căutat online răspunsuri la sarcinile atribuite. Situația este similară cu incidente anterioare raportate de alte companii precum OpenAI și Anthropic, unde configurații greșite ale mediilor sandbox au facilitat accesul neautorizat la internet.

Yaron Singer, CEO al Frontier Security, a declarat: „Am descoperit o breșă în mediul de testare. Am constatat, de asemenea, că Kimi a profitat de această breșă, ceea ce indică faptul că nu dispune de mecanisme interne de protecție.” Potrivit Frontier, Kimi K3 pare să aibă mai puține măsuri de protecție cibernetică în comparație cu alte modele similare, ceea ce i-a permis să acceseze internetul fără o autorizație explicită. Spre deosebire de alte cazuri, Kimi K3 nu a comis acte de hacking după accesul pe internet, deoarece informațiile necesare pentru rezolvarea problemelor erau disponibile public, de exemplu, pe GitHub.

Trendul „evadărilor” din mediile AI

Acest incident marchează cel mai recent caz dintr-o serie de situații în care agenții de inteligență artificială demonstrează o tot mai mare dificultate în a fi controlați, pe măsură ce capabilitățile lor cibernetice avansează. Luna trecută, OpenAI a raportat că un model nepublicat a accesat internetul și a atacat cibernetic compania Hugging Face, o platformă importantă pentru modele și date de inteligență artificială. Ulterior, OpenAI a confirmat că agenții săi au spart alte patru servicii în cadrul aceleiași serii de atacuri.

Imediat după raportarea OpenAI, Anthropic a dezvăluit că mai multe dintre modelele sale au obținut acces la internet și au atacat sisteme externe. Recent, Institutul pentru Securitatea IA (AISI) al guvernului britanic a comunicat că, în cadrul unor teste, versiuni ale modelelor OpenAI și Anthropic, ale căror măsuri de securitate fuseseră dezactivate, au efectuat multiple atacuri cibernetice. Unul dintre acestea a inclus o tentativă a modelului Mythos 5 al Anthropic de a introduce cod malițios într-un proiect open-source pe GitHub. Deși cauzele și amploare atacurilor variază, cazul Kimi K3 se aseamănă cu celelalte prin faptul că un mediu de testare sandbox configurat incorect a permis accesul la site-uri web în loc să mențină izolare. Modelul Kimi K3 a depășit chiar instrucțiunile specifice, descoperind singur posibilitatea de a accesa anumite site-uri prin analiza setărilor de rețea ale mediului sandbox.

Eroarea umană pare a fi un factor comun în aceste „evadări”, însă consecințele sunt amplificate de faptul că modelele AI avansate sunt proiectate să raționeze și să execute acțiuni complexe pentru a rezolva probleme. O diferență majoră este că modelul Kimi K3 este deja disponibil pe scară largă, cu aceleași măsuri de protecție cu care s-ar confrunta un utilizator obișnuit. Deși modelele open-source, precum Kimi K3, pot fi folosite pentru apărarea în securitate cibernetică, ele prezintă și un risc sporit. Grupurile de hackeri pot elimina protocoalele de siguranță sau le pot modifica pentru a genera coduri malițioase.

Sursa: Go4IT