Meta съобщи, че един от нейните модели с изкуствен интелект е проникнал в системите на друга компания по време на тестове за киберсигурност, което засилва опасенията доколко разработчиците са способни да контролират все по-мощните AI системи след сходни инциденти при Anthropic и OpenAI.

Случаите при Meta и Anthropic са резултат от грешки в конфигурацията на тестовата среда, които неволно са предоставили на AI моделите достъп до отворения интернет. При OpenAI AI агент самостоятелно е открил и използвал неизвестна дотогава уязвимост, за да получи достъп до интернет по време на тестове за киберсигурност.

Тези пробиви засилват опасенията, че все по-способните AI системи могат да създадат нови рискове за киберсигурността, и вероятно ще ускорят усилията на американските власти за подобряване на стандартите за безопасност при изкуствения интелект, докато компаниите се надпреварват да разработват все по-мощни модели. Някои от водещите експерти в областта вече настояват развитието на технологията да бъде забавено, докато не бъдат въведени по-надеждни механизми за защита.

Meta съобщи, че разследва инцидент, при който неправилна конфигурация, допусната от независимата компания Irregular, която провежда тестове за киберсигурност за Meta, неволно е предоставила на един от AI моделите достъп до интернет по време на изпитванията.

„Моделът се възползва от уязвимост в система на трета страна по начин, сходен с вече описаните случаи при други компании“, се казва в официалното изявление на Meta.

Според The Information става дума за модела Muse Spark 1.1, който Meta определя като най-способния си модел за програмиране и изпълнение на сложни автономни задачи. Позовавайки се на свои източници, изданието твърди, че моделът е проникнал в системите на неназована компания и е променил нейната вътрешна среда.

Говорител на Irregular казва пред Reuters, че инцидентът представлява „абсолютно същия проблем в тестовата среда, който Anthropic разкри миналата седмица“, като подчерта, че не става дума нито за пробив от защитената тестова среда (sandbox escape), нито за сложна кибератака.

„В момента няма нерешени проблеми. Irregular подготвя подробен документ с препоръки за добри практики при ограничаването на AI моделите и безопасното провеждане на тестове за киберсигурност“, посочват от компанията.

Опасения за киберрисковете

Последните инциденти засилват тревогите сред американските законодатели дали все по-мощните AI модели могат да бъдат използвани за извършване или подпомагане на кибератаки.

Група главни прокурори от Републиканската партия вече поиска от OpenAI да съхрани всички документи, свързани с пробива в платформата Hugging Face. От OpenAI заявиха, че ще изпълнят искането и ще публикуват технически доклад за инцидента.

По-рано тази седмица Белият дом покани представители на водещите компании в сферата на изкуствения интелект, сред които Meta, Anthropic, OpenAI и Google, на среща, посветена на нова доброволна рамка за тестване на киберсигурността на най-мощните AI модели.

Според Reuters администрацията на президента Доналд Тръмп е обсъдила с компаниите все още непубликувани правила за тестване и е дала сигнал, че т.нар. open-weight models, като Llama на Meta и Nemotron на Nvidia, няма да попадат в обхвата на планирания режим за доброволни тестове за безопасност.