AI-ul Meta a spart apărarea unei companii în timpul unui test controlat

Meta și Irregular confirmă că un model AI a compromis sisteme externe într-un test controlat, după o eroare de configurare care i-a oferit acces la internet și a relansat dezbaterea despre siguranța agenților autonomi.

AI-ul Meta a spart apărarea unei companii în timpul unui test controlat
Ilustrație generată cu inteligență artificială. Scena nu reprezintă o fotografie realǎ de la fața.locului.
Ascultă rezumatul
Ascultă articolul

Un model de inteligență artificială dezvoltat de Meta a reușit să compromită sistemele informatice ale unei alte companii în timpul unui exercițiu de securitate cibernetică desfășurat într-un mediu controlat. Incidentul nu a fost un atac informatic real, ci rezultatul unei erori de configurare care a oferit modelului acces la internet în timpul evaluării. Cazul reaprinde dezbaterea privind riscurile noii generații de agenți AI capabili să execute sarcini complexe fără intervenție umană.

Informația a fost confirmată de Meta și de compania independentă Irregular, care desfășura testele, fiind relatată inițial de Reuters și The Information. Potrivit Meta, vulnerabilitatea exploatată a aparținut unui serviciu al unei terțe companii și nu a existat un atac asupra infrastructurii Meta.

O eroare de configurare a schimbat complet testul

Meta a explicat că modelul testat, Muse Spark 1.1, era evaluat pentru capacități de programare și automatizare în cadrul unor exerciții de securitate cibernetică.

În timpul testului, compania Irregular a configurat greșit mediul de evaluare, oferind accidental modelului acces la internet. În loc să rămână într-un mediu izolat, AI-ul a identificat și a exploatat o vulnerabilitate din sistemele unei alte companii.

Meta a precizat că incidentul a fost limitat la cadrul testării și că problema a fost remediată.

Nu a fost un atac criminal

Compania subliniază că nu este vorba despre un atac cibernetic lansat în lumea reală.

Într-o declarație transmisă Reuters, Meta afirmă că:

„O configurare greșită realizată de Irregular a permis accidental unuia dintre modelele noastre acces la internet în timpul evaluării.”

Irregular a confirmat că incidentul nu a produs efecte asupra utilizatorilor și că pregătește un raport tehnic privind bunele practici pentru testarea agenților AI în medii securizate.

Nu este un caz izolat

Incidentul apare la doar câteva zile după ce Anthropic și OpenAI au dezvăluit situații similare în timpul propriilor teste de securitate.

În toate cazurile, modelele AI au reușit să depășească limitele mediului de testare și să interacționeze cu sisteme reale, alimentând îngrijorările privind dezvoltarea agenților AI autonomi.

Specialiștii citați de Reuters atrag atenția că problema nu este neapărat faptul că modelele sunt capabile să identifice vulnerabilități, ci că mediile de testare trebuie proiectate astfel încât astfel de situații să nu poată afecta infrastructuri externe.

Washingtonul cere reguli comune

Reuters relatează că reprezentanți ai Casei Albe au început discuții cu Meta, OpenAI, Google și Anthropic privind dezvoltarea unor standarde voluntare pentru testarea modelelor AI cu capabilități avansate în domeniul securității cibernetice.

Scopul este stabilirea unor proceduri care să permită evaluarea acestor sisteme fără riscul ca ele să interacționeze cu infrastructuri reale.

Se schimbă regulile securității cibernetice?

Până recent, majoritatea sistemelor AI generative răspundeau la întrebări sau generau texte și imagini.

Noua generație de modele este diferită. Agenții AI pot:

  • scrie și executa cod;

  • analiza infrastructuri informatice;

  • identifica vulnerabilități;

  • utiliza instrumente externe;

  • lua decizii pe baza obiectivelor primite.

Aceste capabilități sunt valoroase pentru apărarea cibernetică, dar pot deveni riscante dacă nu sunt testate în medii complet izolate.

💡 WoW Pulse | De ce contează această știre?

Incidentul nu arată că inteligența artificială „a scăpat de sub control”, ci că modelele AI au ajuns suficient de performante încât pot identifica și exploata vulnerabilități reale atunci când sunt plasate într-un mediu nepotrivit.

Cazul Meta se adaugă unor incidente similare raportate de OpenAI și Anthropic și accelerează presiunea pentru introducerea unor standarde internaționale de testare a agenților AI.

Pentru industrie, mesajul este clar: următoarea etapă a inteligenței artificiale nu mai este despre chatboturi, ci despre sisteme capabile să interacționeze direct cu infrastructura digitală.

Surse

  • Reuters – „Meta's AI model hacked another company during testing, The Information reports”

  • Reuters – „'Going rogue' draws critics amid widening AI hacks”

  • Meta AI – https://ai.meta.com/

  • Meta Newsroom – https://about.fb.com/news/

AI-ul Meta a spart apărarea unei companii în timpul unui test controlat | WoW Pulse