OpenAI въвежда невидим воден знак за текст от ChatGPT и Codex в ЕС

OpenAI подготвя въвеждането на невидими водни знаци за текст, генериран от ChatGPT и Codex в Европейския съюз. Технологията няма да променя видимо текста при четене или копиране, а ще променя статистически начина, по който моделът избира определени думи.

Новата система, наречена textGrain, създава статистически разпознаваем модел в генерирания текст, който впоследствие може да бъде проверяван със специален детектор.

Технологията променя избора на думи

За разлика от традиционния воден знак, който може да бъде видим като изображение, символ или друг графичен елемент, textGrain работи на ниво генериране на текста.

OpenAI посочва, че през следващите седмици ще започне да добавя невидимия воден знак към поддържан текст от ChatGPT и Codex в ЕС.

Промяната не означава, че потребителят ще вижда специален маркер или че копирането на текста ще бъде ограничено. Идеята е статистическият модел да остане в текста и да може да бъде разпознат при последващ анализ.

API разработчиците получават възможност за включване

OpenAI няма да превърне watermarking в глобална настройка по подразбиране.

От компанията посочват, че разработчици, използващи API, могат да активират водния знак за поддържаните модели, като функцията първоначално остава изключена по подразбиране.

Паралелно с това OpenAI започва да приема заявления за достъп до своя детектор. В началния етап инструментът ще бъде достъпен само за одобрени изследователи и експертни организации.

Това показва, че компанията разглежда технологията не просто като потребителска функция, а и като инструмент за изследване на произхода и автентичността на съдържание, генерирано от нейните модели.

Обикновеното редактиране може да отслаби водния знак

OpenAI обаче признава важна слабост – водният знак не е устойчив на всяка последваща обработка на текста.

При тест с текстове от 400 токена замяната на 10% от думите със синоними е намалила успеваемостта на детекцията от около 92% до 66%. При промяна на 25% от думите показателят е спаднал до едва 17%.

Това е съществено ограничение, защото в реална среда генерираният текст рядко остава напълно непроменен. Потребителите могат да го редактират, съкращават, превеждат или комбинират с човешки текст.

Следователно наличието на воден знак не трябва да се приема като абсолютен тест за авторство.

Кратките текстове също са проблем

Ефективността зависи и от дължината на съдържанието.

При целево ниво на фалшивите положителни резултати от 1% OpenAI е открила водния знак в около 80% от текстове с дължина 200 токена, докато при 400 токена резултатът е достигнал приблизително 95%.

При някои теми откриването е още по-трудно. Компанията посочва математиката като пример, тъй като там моделът има по-малка свобода при избора на думи.

Това е логично ограничение за статистически подход. Колкото по-малко текст има за анализ и колкото по-ограничен е изборът на формулировки, толкова по-трудно е да бъде различен специфичният модел на генериране.

Липсата на воден знак не доказва човешко авторство

OpenAI изрично предупреждава срещу интерпретирането на детектора като окончателен арбитър.

Ако системата не открие воден знак, това не означава, че текстът със сигурност е написан от човек. Съдържанието може да е прекалено кратко, редактирано или преведено и по тази причина статистическият модел да е отслабнал.

Обратното също има значение. Дори при открит воден знак той не показва кой е генерирал текста, кой потребител е използвал системата, какъв е бил подаденият промпт или какъв е бил разговорът.

Детекторът също не може да установи каква част от крайния текст е написана от ИИ и каква е била редактирана от човек.

Водният знак поставя въпроса за доказването на произход

Технологията може да има практическо приложение при мащабното разпространение на генерирано съдържание. Медии, образователни организации, изследователи и други институции все по-често търсят начини да установят дали даден текст е създаден или подпомогнат от ИИ.

Но резултатите на самата OpenAI показват, че водният знак трябва да се разглежда като индикатор, а не като абсолютна система за доказване на авторство.

Това е особено важно при решения с реални последствия – например оценяване на академични работи, журналистически проверки или установяване на нарушение на авторски правила. Детектор, който допуска както пропуски, така и фалшиви резултати, не може самостоятелно да бъде единственото доказателство.

Производителността на моделите остава близка

OpenAI твърди, че активирането на textGrain не оказва съществено влияние върху качеството на GPT-6 Astra, като резултатите от проведените тестове остават като цяло сходни.

Това е важно от технологична гледна точка, тъй като основният проблем при подобни механизми е балансът между възможността за проследяване на произхода и качеството на генерираното съдържание.

Ако водният знак може да бъде добавен без осезаемо влошаване на резултатите, подходът има потенциал да се превърне в допълнителен слой за идентифициране на съдържание, генерирано от ИИ.

В същото време ограниченията на textGrain показват, че невидимият воден знак няма да реши сам проблема с разграничаването между човешки и машинно генериран текст. По-скоро той представлява още един технически сигнал, който трябва да се комбинира с контекст, произход на съдържанието и други методи за проверка.

e-security.bg

Подобни

Microsoft потвърди нов проблем с Windows 11, засягащ игри и приложения със звук
6.10.2026
nimash-windows-6869498_640
„Безплатно плюс скорост“ - новият модел за растеж на потребителския ИИ
5.10.2026
vetonogueira-spiral-1035714_640
Папа Лъв XIV призовава за съюз с творците срещу рисковете от ИИ
4.10.2026
meromex-wax-figure-670318_640
Brute force атаките остават ефективно оръжие срещу слаби пароли
4.10.2026
zt_oscar-ai-generated-8950517_640
НАТО се нуждае от по-устойчива инфраструктура за бързо придвижване
1.10.2026
nato-logo-and-map-of-the-atlantic
Microsoft спря актуализация, която деактивира и премахва Office 2016 и 2019
27.09.2026
microsoft-4412148_640

Споделете

Facebook
LinkedIn

Бюлетин

С нашия бюлетин ще бъдеш сред първите, които научават за нови заплахи, практични решения и добри практики. Напълно безплатно и с грижа за твоята сигурност.

Популярни

Българските торент сайтове продължават да изчезват
27.02.2026
pirate-flag-7541041_640
Изземване на Zamunda, Arena и други торент сайтове
30.01.2026
seizure
12-те най-използвани техники за разбиване на пароли
23.11.2022
password_sticky_note_shutterstock
Bitdefender пусна безплатен инструмент за проверка на телефонни номера
12.12.2025
telephoneAlamy