След пробива в Австралия и нови правила в ЕС OpenAI затяга контрола върху AI
Компанията въвежда невидими водни знаци за генериран текст и допълнителни защити за автономните си агенти, докато регулаторите настояват за повече прозрачност и отчетност
,fit(1001:538)&format=webp)
OpenAI навлиза в нов етап на регулаторен натиск от две различни посоки. В Европейския съюз компанията започва да маркира невидимо текстовете, генерирани от ChatGPT и Codex, за да изпълни изискванията на AI Act. В Австралия междувременно призна, че защитните ѝ механизми не са били достатъчни, след като автономен AI агент е получил неоторизиран достъп до правителствени системи.
Двата случая са различни по характер, но очертават една и съща тенденция: с разширяването на възможностите на генеративния AI компаниите вече са принудени да доказват не само какво могат моделите им, но и как проследяват създаденото съдържание, ограничават автономното им поведение и реагират при инциденти.
Според TechCrunch OpenAI през следващите седмици ще започне да добавя невидим цифров воден знак към текстове, създадени с помощта на ChatGPT и Codex от потребители в ЕС. Промяната е свързана с правилата за прозрачност в европейския AI Act, които изискват съдържанието, създадено с изкуствен интелект, да може да бъде разпознавано от други системи.
Мярката ще обхване потребителите на всички планове в ЕС. Разработчиците, използващи API на OpenAI, също ще могат да активират технологията за определени модели независимо от държавата, но по подразбиране тя ще остане изключена. Засега OpenAI не планира водният знак да се превърне в глобален стандарт.
Технологията textGrain не добавя видими символи или скрити кодове към файла. Вместо това тя леко променя избора на думи при генерирането на текста. Така се създава статистически модел, който остава невидим за читателя, но може да бъде открит със специален детектор и таен ключ.
Основното предимство на този подход е, че сигналът се запазва дори след копиране и поставяне на текста в друг документ или платформа. OpenAI посочва, че технологията не съдържа информация за самоличността на потребителя и при тестове не е довела до съществен спад в качеството на моделите.
Въпреки това методът има сериозни ограничения. Технически доклад показва, че при замяна на около 10% от думите със синоними успеваемостта при откриване на маркирания текст спада от приблизително 92% до 66%. По-кратки пасажи, математически отговори и преводи също са значително по-трудни за надеждно идентифициране.
Именно заради тези слабости OpenAI засега няма да предоставя свободен достъп до детектора. Пред TechCrunch компанията уточнява, че първоначално той ще бъде достъпен само за одобрени изследователи и специализирани организации, които да оценят надеждността му и рисковете от неправилна употреба.
OpenAI предупреждава още, че липсата на воден знак не трябва да се приема като доказателство, че даден текст е написан от човек.
Маркировката може да бъде загубена след редакция, да липсва при твърде кратък текст или съдържанието да е генерирано от модел на друга компания. Дори при открит воден знак това доказва единствено, че система на OpenAI е участвала в създаването или обработката на част от текста. Не може обаче да се установи каква е степента на човешка намеса, редакция или творчество.
Решението идва около два месеца след като Anthropic обяви глобално въвеждане на маркировка за текстовете, генерирани от Claude. OpenAI също е разработвала подобна технология и по-рано, но според The Wall Street Journal е отлагала пускането ѝ заради опасения, че потребителите могат да се насочат към конкуренти, които не използват подобни механизми.
Натискът върху OpenAI обаче вече не се ограничава единствено до произхода на генерираното съдържание.
Пред парламентарна комисия в Австралия компанията призна, че действията ѝ са били „недостатъчни“, след като през юни автономен агент е получил неоторизиран достъп до австралийски правителствени сайтове.
Главният стратегически директор Джейсън Куон заяви, че инцидентът „не е трябвало да се случва“ и че реакцията на OpenAI не е отговаряла на сериозността на ситуацията, предава BBC.
Британската медия съобщава, че агентът е получил достъп до частен статистически портал, съдържащ нечувствителни данни от австралийската система Medicare. Експерти по киберсигурност, цитирани от BBC, определят случая като първия известен пробив от този тип, извършен от автономен AI агент.
Сериозни критики предизвика не само самият инцидент, но и начинът, по който OpenAI е уведомила австралийските власти. Вместо незабавен директен контакт с правителството информацията е изпратена седмици по-късно на общ имейл адрес.
Куон призна пред парламентарната комисия, че това е било грешка. По думите му служителите са възприели инцидента основно като технически проблем и са търсили контакт с технически екипи, вместо да го разглеждат като въпрос с по-широки институционални и политически последици.
„Не е достатъчно“, призна той и обясни, че OpenAI вече е променила процедурата си при подобни случаи. Новият подход предвижда засегнатата страна да бъде уведомявана веднага, дори когато компанията все още не разполага с пълна картина на случилото се.
Въведени са и допълнителни защитни механизми в средите, в които се обучават и тестват моделите. По думите на Куон поведението на системите вече се наблюдава в реално време, а при опит модел да комуникира с интернет по непредвиден начин се задейства предупреждение.
OpenAI твърди, че новите процедури вече дават резултат. При отделен инцидент с правителството на Нов Южен Уелс миналата седмица компанията е подала сигнал в рамките на 48 часа.
Освен това се създава местна работна група в Австралия, която ще проучва как по-добре да бъдат управлявани рисковете, свързани с все по-автономните AI системи. Куон заяви, че OpenAI би подкрепила и задължителен режим за уведомяване при подобни инциденти, тъй като той би създал по-ясни стандарти за това кога и как компаниите трябва да докладват за проблеми.
По време на същото парламентарно изслушване Anthropic съобщи, че след инциденти с автономни AI агенти, включително пробив в платформата Hugging Face, е анализирала стотици милиони взаимодействия със своите модели, за да провери за подобни нарушения срещу австралийски институции. Компанията посочва, че не е открила такива случаи.
В Австралия дискусията обхваща и един от най-спорните въпроси около генеративния AI: авторското право. Представители на творческите индустрии предупредиха депутатите, че система, при която авторите трябва изрично да заявят, че не желаят произведенията им да бъдат използвани за обучение на модели, прехвърля тежестта върху самите творци и създава риск те да останат без компенсация.
„Австралийските артисти ще бъдат прегазени в надпреварата за тази AI сделка“, заяви изпълнителният директор на Australian Recording Industry Association Анабел Хърд.
Примерите от Европа и Австралия показват колко бързо се измества фокусът на дебата за изкуствения интелект. Докато доскоро основният въпрос беше колко ефективни могат да станат моделите, днес акцентът все повече пада върху това кой носи отговорност при автономни действия на AI, как обществото може да разпознава използването му и какво следва, когато технологичните защити се окажат недостатъчни.
За OpenAI това означава необходимост от паралелно изграждане на две системи за доверие. Едната трябва да осигури по-голяма проследимост на генерираното съдържание, а другата да държи под контрол все по-автономните AI агенти. И в двата случая регулаторният натиск показва, че доброволните ангажименти вече трудно могат да бъдат достатъчни.
&format=webp)
&format=webp)
&format=webp)
)
&format=webp)
&format=webp)
,fit(334:224)&format=webp)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)