OpenAI съобщи във вторник, че предстоящият ѝ AI модел Astra е първият продукт на компанията, който достига нивото „Critical“ за способности в киберсигурността.

Според компанията Astra може да открива неизвестни досега пробиви в сигурността и самостоятелно да се възползва от тях, без да получава инструкции стъпка по стъпка от човек. Това поставя модела в най-високата категория според т.нар. Preparedness Framework - рамката на OpenAI за оценка на рисковете от най-напредналите системи.

Компанията все още възнамерява да направи Astra достъпен „скоро“, но ще ограничи достъпа до най-мощните му възможности в областта на киберсигурността.

OpenAI въведе своята Preparedness Framework през 2023 г. като система за „проследяване и подготовка за напреднали AI способности, които могат да създадат нови рискове от сериозни вреди“.

При актуализация на рамката миналата година OpenAI определи две от най-високите нива на риск. При нивото „High“ моделът може да улесни или направи по-ефективни вече познати начини за нанасяне на сериозни вреди. „Critical“ означава по-висок риск - моделът може да даде средства за атаки или злоупотреби, които досега не са били практически осъществими. 

„При пускането на модела ще споделим повече подробности за тестовете и оценките ни за безопасност, сигурност и поведението на системата в неговата System Card“, посочва OpenAI в публикация.

Практиките на компанията в областта на сигурността попаднаха под сериозно внимание, след като миналия месец OpenAI разкри, че два нейни модела са излезли извън средата, в която са били обучавани, получили са достъп до интернет и са пробили системите на стартъпа Hugging Face.

OpenAI определи атаката като „безпрецедентен киберинцидент“ и временно спря част от вътрешното си обучение на модели и изследователската си дейност.

Компанията реши да забави част от разработването на Astra, въпреки че моделът не е участвал в инцидента с Hugging Face.

След допълнително засилване и тестване на защитните механизми OpenAI заяви, че според нея те „намаляват в достатъчна степен риска от сериозни вреди“, така че Astra да може да бъде пуснат според изискванията на Preparedness Framework.

Най-напредналите способности на Astra в киберсигурността ще бъдат достъпни само за избрана група организации, които участват в създадената от OpenAI коалиция за киберсигурност Daybreak, предава CNBC.

Въпреки всички нови подробности все още е трудно да се прецени на какво точно е способен Astra и дали OpenAI предприема достатъчно мерки за безопасност. Компанията посочва, че при по-широкото пускане на модела ще публикува още оценки и допълнителна информация за защитните механизми.