OpenAI въвежда невидими водни знаци за съдържание в Европейския съюз

OpenAI обяви, че започва внедряването на невидим воден знак за текстовете, генерирани от ChatGPT и Codex в рамките на Европейския съюз. Мярката е продиктувана от изискванията на Законодателния акт за изкуствения интелект на ЕС, влязъл в сила на 2 август, който налага прозрачност при маркирането на машинно генерирано съдържание.

Технологията ще бъде въведена поетапно през следващите седмици за всички отговарящи на условията потребители на ChatGPT и Codex в ЕС. Разработчиците, които използват API на OpenAI, вече имат опцията да активират функцията, макар тя да остава изключена по подразбиране в световен мащаб.

Водният знак не представлява видим символ, а работи чрез фино структуриране на избора на думи от модела, което е доловимо само от специализиран детектор. Тази информация се пренася заедно с текста при копиране и поставяне, като според компанията това не се отразява на производителността на моделите.

Заедно с това OpenAI представи технически доклад за метода „textGrain“, разработен в партньорство с изследователи от университетите в Пенсилвания и Йейл. Методът използва таен ключ за сортиране на вероятностите при избор на следваща дума, позволявайки по-лесно идентифициране на съдържанието.

Въпреки иновацията, компанията признава, че защитата не е стопроцентова, тъй като значителни редакции или синоними могат да намалят ефективността на засичане от 92% на 66%. Кратките пасажи, математическите отговори и преведените текстове също остават трудни за идентифициране с този метод.

OpenAI ограничава първоначалния достъп до детектора само за одобрени изследователи и експертни организации, за да оцени по-прецизно надеждността на системата. Компанията подчертава, че липсата на воден знак не е гаранция за човешко авторство, тъй като текстът може да е редактиран или генериран от друг ИИ инструмент.

Този ход следва политиката на Anthropic, която вече въведе глобални водни знаци за своя модел Claude, предизвиквайки дебати относно интелектуалната собственост върху генерираното съдържание. Опасенията от отлив на потребители към конкуренти без водни знаци са сред причините OpenAI да забави внедряването на тази технология в миналото, според данни на The Wall Street Journal от 2024 г.

Вижте още: