„Екзистенциална заплаха“ за медиите: Какво разкриват документи от Microsoft и OpenAI
Нова информация разкрива вътрешни опасения около използването на милиони журналистически материали за разработването на AI системи
,fit(1001:538)&format=webp)
Нови съдебни документи разкриват сериозни опасения в Microsoft и близкия ѝ партньор OpenAI относно използването на милиони журналистически материали за разработването на системи с изкуствен интелект.
Докато OpenAI ускорява работата си, служители на Microsoft обсъждат дали действията на компанията не представляват „най-мащабната кражба на труд в човешката история“ и дали в крайна сметка няма да създадат порочен кръг, който да подкопае качеството на големите езикови модели, които самите те разработват, предава The New York Times.
„Милиони хора по света скоро ще възприемат начина, по който големите модели ‘изсмукват’ целия им труд, като потресаваща кражба с безпрецедентни мащаби“, се казва във вътрешен документ на Microsoft от 2023 г., цитиран от NYT.
Подобни опасения има и в OpenAI. В документ от юни 2023 г. Ник Търли, който ръководи екипа зад ChatGPT, пише, че AI представлява „екзистенциална заплаха“ за издателите.
През февруари 2024 г. той посочва, че AI продуктите „ще заместват все повече съществуващите услуги, колкото по-добри стават“.
Части от тези вътрешни разговори бяха публикувани в четвъртък като част от внимателно следено дело, заведено от The New York Times срещу OpenAI и Microsoft в края на 2023 г. Към иска впоследствие се присъединиха още 11 медии.
Изданията твърдят, че технологичните компании са нарушили авторските им права, като са извлекли милиони техни статии от интернет и други бази данни и са използвали текстовете без разрешение и без заплащане за обучението на усъвършенствани AI системи.
Microsoft и OpenAI отхвърлят тези обвинения. Според тях използването на материалите попада под защитата на американската доктрина за добросъвестно използване, или fair use. Двете компании твърдят, че AI системите преобразуват съдържанието в достатъчна степен, за да създават нов продукт, който не замества оригиналните публикации и не намалява стойността им.
Говорителят на Microsoft Алекс Хаурек коментира, че вътрешните бележки, написани от Брент Хехт, директор по приложни науки в компанията, не отразяват официалната ѝ позиция.
„Позицията на Microsoft е изложена в документите, внесени в съда. В тях обясняваме защо подобно трансформиращо използване е в съответствие с авторското право и защо Copilot не замества журналистиката на издателите“, казва той, визирайки AI асистента на Microsoft.
В отделен съдебен документ Microsoft посочва, че Хехт е изследовател и преподавател, който работи и в Northwestern University. Според компанията той не е бил сред хората, вземащи решения, и е бил нает именно за да представя „различни и нетипични гледни точки“.
„Сега целият свят може да види какво всъщност са мислели OpenAI и Microsoft през цялото време за това доколко справедливо е собственото им поведение“, посочва Стивън Либерман, адвокат на New York Daily News и още седем вестника по делото.
Издателите твърдят също, че OpenAI е използвала специални инструменти за заобикаляне на платения достъп до новинарски сайтове.
Според съдебните документи служител на OpenAI пише на президента на компанията Грег Брокман, че разработва „трик за заобикаляне на paywall-а на NYT“. Отговорът на Брокман е: „А, супер.“
Главният изпълнителен директор на Microsoft Сатя Надела също заявява под клетва, че „всяко съдържание зад платен достъп трябва да бъде лицензирано от всеки, който иска да го използва“.
Той добавя, че ако е бил информиран, че OpenAI е извличала и използвала за обучение информация зад платен достъп, би упражнил правото на Microsoft да изиска моделите да бъдат обучени наново без тези данни.
Говорителят на компанията Хаурек уточни, че Надела е говорил за „общи принципи и за промените в начина, по който хората намират и потребяват информация“.
Документите показват, че вътре в компаниите е имало опасения дали новинарската индустрия изобщо може да оцелее, ако съдържанието ѝ бъде използвано по този начин.
Големите AI модели са „продукт, който унищожава собствената си верига за доставки“, пише Хехт.
Опасения относно копирането на журналистически материали е имало и в OpenAI.
През 2020 г. Джак Кларк, тогава директор по публичните политики в компанията, изпраща бележка до Грег Брокман и главния изпълнителен директор Сам Алтман. Кларк, който по-късно напуска и става съосновател на Anthropic, предупреждава, че работата на стартъпа „все повече ще ни води към създаването на системи, които заместват труда на хората, определящи ‘културата’ на обществото“.
Той предупреждава още, че „OpenAI ще се превърне в символ на начина, по който Силициевата долина безразсъдно навлиза в други сфери на живота и оставя бъркотия след себе си“.
Документите показват и че ChatGPT не насочва потребителите към оригиналните публикации толкова често, колкото издателите биха искали.
През февруари 2023 г. софтуерен инженер на OpenAI пише на свои колеги: „Независимо колко видими направим линковете, потребителите няма да кликат върху тях.“
Ник Търли от OpenAI е още по-категоричен:
„AI продуктите до голяма степен заместват съществуващите продукти. Точка.“
&format=webp)
&format=webp)
&format=webp)
)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)