OpenAI подготвя въвеждането на невидими водни знаци за текст, генериран от ChatGPT и Codex в Европейския съюз. Технологията няма да променя видимо текста при четене или копиране, а ще променя статистически начина, по който моделът избира определени думи.
Новата система, наречена textGrain, създава статистически разпознаваем модел в генерирания текст, който впоследствие може да бъде проверяван със специален детектор.
Технологията променя избора на думи
За разлика от традиционния воден знак, който може да бъде видим като изображение, символ или друг графичен елемент, textGrain работи на ниво генериране на текста.
OpenAI посочва, че през следващите седмици ще започне да добавя невидимия воден знак към поддържан текст от ChatGPT и Codex в ЕС.
Промяната не означава, че потребителят ще вижда специален маркер или че копирането на текста ще бъде ограничено. Идеята е статистическият модел да остане в текста и да може да бъде разпознат при последващ анализ.
API разработчиците получават възможност за включване
OpenAI няма да превърне watermarking в глобална настройка по подразбиране.
От компанията посочват, че разработчици, използващи API, могат да активират водния знак за поддържаните модели, като функцията първоначално остава изключена по подразбиране.
Паралелно с това OpenAI започва да приема заявления за достъп до своя детектор. В началния етап инструментът ще бъде достъпен само за одобрени изследователи и експертни организации.
Това показва, че компанията разглежда технологията не просто като потребителска функция, а и като инструмент за изследване на произхода и автентичността на съдържание, генерирано от нейните модели.
Обикновеното редактиране може да отслаби водния знак
OpenAI обаче признава важна слабост – водният знак не е устойчив на всяка последваща обработка на текста.
При тест с текстове от 400 токена замяната на 10% от думите със синоними е намалила успеваемостта на детекцията от около 92% до 66%. При промяна на 25% от думите показателят е спаднал до едва 17%.
Това е съществено ограничение, защото в реална среда генерираният текст рядко остава напълно непроменен. Потребителите могат да го редактират, съкращават, превеждат или комбинират с човешки текст.
Следователно наличието на воден знак не трябва да се приема като абсолютен тест за авторство.
Кратките текстове също са проблем
Ефективността зависи и от дължината на съдържанието.
При целево ниво на фалшивите положителни резултати от 1% OpenAI е открила водния знак в около 80% от текстове с дължина 200 токена, докато при 400 токена резултатът е достигнал приблизително 95%.
При някои теми откриването е още по-трудно. Компанията посочва математиката като пример, тъй като там моделът има по-малка свобода при избора на думи.
Това е логично ограничение за статистически подход. Колкото по-малко текст има за анализ и колкото по-ограничен е изборът на формулировки, толкова по-трудно е да бъде различен специфичният модел на генериране.
Липсата на воден знак не доказва човешко авторство
OpenAI изрично предупреждава срещу интерпретирането на детектора като окончателен арбитър.
Ако системата не открие воден знак, това не означава, че текстът със сигурност е написан от човек. Съдържанието може да е прекалено кратко, редактирано или преведено и по тази причина статистическият модел да е отслабнал.
Обратното също има значение. Дори при открит воден знак той не показва кой е генерирал текста, кой потребител е използвал системата, какъв е бил подаденият промпт или какъв е бил разговорът.
Детекторът също не може да установи каква част от крайния текст е написана от ИИ и каква е била редактирана от човек.
Водният знак поставя въпроса за доказването на произход
Технологията може да има практическо приложение при мащабното разпространение на генерирано съдържание. Медии, образователни организации, изследователи и други институции все по-често търсят начини да установят дали даден текст е създаден или подпомогнат от ИИ.
Но резултатите на самата OpenAI показват, че водният знак трябва да се разглежда като индикатор, а не като абсолютна система за доказване на авторство.
Това е особено важно при решения с реални последствия – например оценяване на академични работи, журналистически проверки или установяване на нарушение на авторски правила. Детектор, който допуска както пропуски, така и фалшиви резултати, не може самостоятелно да бъде единственото доказателство.
Производителността на моделите остава близка
OpenAI твърди, че активирането на textGrain не оказва съществено влияние върху качеството на GPT-6 Astra, като резултатите от проведените тестове остават като цяло сходни.
Това е важно от технологична гледна точка, тъй като основният проблем при подобни механизми е балансът между възможността за проследяване на произхода и качеството на генерираното съдържание.
Ако водният знак може да бъде добавен без осезаемо влошаване на резултатите, подходът има потенциал да се превърне в допълнителен слой за идентифициране на съдържание, генерирано от ИИ.
В същото време ограниченията на textGrain показват, че невидимият воден знак няма да реши сам проблема с разграничаването между човешки и машинно генериран текст. По-скоро той представлява още един технически сигнал, който трябва да се комбинира с контекст, произход на съдържанието и други методи за проверка.









