Възможността да се определи дали дадено съдържание е създадено от изкуствен интелект остава сериозно предизвикателство в световен мащаб. Технологичните компании разработиха по-надеждни методи за вграждане на невидими водни знаци в изображения и видеоклипове, което улеснява разпознаването дали те са генерирани или променени с помощта на ИИ.
Въпреки това, установяването дали даден текст е генериран от ИИ остава значително техническо предизвикателство дори за водещите лаборатории в тази област. На пазара съществуват десетки инструменти, които твърдят, че могат да засекат текст, създаден от ИИ, но резултатите от тях често са ненадеждни. С продължаващото развитие на моделите с изкуствен интелект, тези външни инструменти за засичане може да станат още по-малко ефективни.
Още през 2024 г. OpenAI потвърди, че е разработила метод за поставяне на водни знаци в текст, но не го е пуснала за масова употреба. По това време съществуваха опасения относно въздействието на подобна технология върху потребителите на ChatGPT, включително ученици и студенти, чиито работи биха могли погрешно да бъдат маркирани като генерирани от ИИ.
Днес OpenAI най-накрая въвежда функцията за поставяне на водни знаци в текстовете на ChatGPT. Това се случва главно заради Законодателния акт за изкуствения интелект на Европейския съюз, който изисква от доставчиците на генеративни ИИ модели да осигурят възможност за разпознаване на генерираното от ИИ съдържание в машинночетим формат.
От днес клиентите на OpenAI API по целия свят могат да изберат да използват текстови водни знаци за определени модели. През следващите седмици OpenAI също така автоматично ще добавя невидими водни знаци към подходящо съдържание, генерирано от ChatGPT и Codex в рамките на Европейския съюз.
Важно е да се отбележи, че водният знак на ChatGPT няма да добавя скрити символи, необичайна пунктуация, невидими интервали или допълнителни токени към генерирания текст. Вместо това, технологията textGrain на OpenAI фино променя статистическия модел на думите и токените, избрани от модела. При генериране на текст AI моделът обикновено определя вероятности за няколко възможни следващи токена. textGrain коригира тези вероятности според таен модел, като насърчава модела да избира определени алтернативи.

От OpenAI твърдят, че тяхната технология textGrain се представя на същото или по-добро ниво в сравнение с други тествани от тях подходи, включително SynthID на Google за текст. Тази технология ще бъде предоставена и на изследователи и други организации, за да могат те да разработват инструменти за откриване на текст, генериран от изкуствен интелект.
Въпреки това, от OpenAI отбелязват, че поставянето на водни знаци върху текст е много по-малко надеждно в сравнение с водните знаци при изображения или аудио. Колкото по-кратък е текстът, толкова по-трудно е за OpenAI да установи дали той е генериран от изкуствен интелект. Според вътрешните тестове детекторът на OpenAI е успял да разпознае около 80% от откъсите с дължина 200 токена, съдържащи воден знак, и приблизително 95% от откъсите с дължина 400 токена.
Дори незначителни редакции могат значително да отслабят водния знак. При тестовете на OpenAI замяната на едва 10% от думите с други намалява успеваемостта на засичане от около 92% на 66%. При замяна на 25% от думите този показател спада до едва 17%.
За да се избегнат проблемите с фалшиво положителни резултати, водещи до обвинения, от OpenAI отбелязват, че засичането на воден знак не трябва да се разглежда като доказателство, че дадено лице просто е копирало целия текст от ChatGPT. Водният знак може да покаже, че модел на OpenAI е генерирал или обработил част от съдържанието, но не може да определи до каква степен потребителят го е редактирал или колко човешки труд е вложен в крайния резултат.
Освен OpenAI, компанията Anthropic също въведе невидими текстови водни знаци за поддържаните модели Claude като част от усилията си за спазване на изискванията на Закона за изкуствения интелект на ЕС.
Снимка: Unsplash/OpenAI
Виж още: Изкуството да живееш гъвкаво: как Samsung The Frame се адаптира към дома тази есен