Пълна версия →
Авто
Аналитика
Българи по света
Война в Украйна
Интересно
История
Лайфстайл
Новини
Спорт
Туристически новини
Технологии

Водният знак на ChatGPT в ЕС е в избора на думи и не доказва кой е писал текста

07.10.2026

OpenAI ще слага в ChatGPT в ЕС статистически знак в избора на думи. Той се губи при силна редакция, липсата му не значи човешки текст, а наличието му не доказва авторство.

Снимка: Abdelrahman Ahmed / Pexels

OpenAI публикува на 5 октомври 2026 г. технически доклад за водния знак „textGrain“. Той ще се слага автоматично в текстовете на ChatGPT и Codex в Европейския съюз, а пускането е планирано „в следващите седмици“. Знакът е статистическа следа в избора на думи, а не скрит символ или невидим интервал, и затова не доказва нищо сигурно за автора на текста.

Поводът е член 50 от Акта за изкуствения интелект на ЕС. От 2 август 2026 г. той изисква изходът на системите, които генерират текст, изображения, звук и видео, да е означен в машинночетим вид и да може да се разпознае като създаден от изкуствен интелект. Европейската комисия публикува на 10 юни 2026 г. окончателния Кодекс за добри практики по тези въпроси. Той е доброволен, но служи като начин да се докаже, че правилото е спазено. По него никоя техника сама не изпълнява изискванията, затова доставчиците трябва да ползват поне два слоя означение, например метаданни и воден знак.

Статистическа следа в избора на думи

Езиковият модел пише дума по дума и всеки път избира между няколко подходящи варианта. „textGrain“ заменя част от тази случайност със стойности, изчислени от таен ключ и от предходните думи. Който има ключа, може да провери дали текстът следва този модел по-често, отколкото би станало случайно. Копирането и поставянето на непроменен отговор не премахва знака.

Самият текст не променя вида си, затова знакът не се вижда нито в текстов редактор, нито в електронно писмо. При кратките отговори, според OpenAI, под около 150 английски думи сигналът е твърде слаб, а в код, математика и строго фактически отговори моделът има малко начини да перифразира, затова там знакът се слага трудно.

Детекторът е най-надежден при дълги текстове. При пасажи от 400 токена (части от думи, с които моделът работи) откриването е около 95%, а при 200 токена е около 80%. Зависи и от езика: от 42,2% за румънски до 69,0% за испански. За български в източниците няма данни.

Редакцията заличава знака

Ако 25% от думите се заменят, откриването пада до 17%. OpenAI признава, че перифразиране или превод го заличават. Проучване на SynthID, сходната технология на Google, показва същото: при леко перифразиране и превод точността спада рязко. При друга атака, в която текст на ИИ се размесва с много човешки, над половината от непомаркираните текстове са сбъркани с маркирани.

Ученик или студент, който пренапише отговора със свои думи, най-вероятно няма да остави следа, а липсата на знак не доказва, че текстът е човешки. Текст, в който ChatGPT само е поправил правописа, може да носи знак. Откриването му сочи, че е участвал ИИ, но не показва колко е редактирал човекът.

Детекторът е достъпен за одобрени организации

Детекторът греши в двете посоки: може да отчете знак там, където го няма, или да го пропусне там, където е. Засега не е публичен. OpenAI го дава само на одобрени изследователи и експертни организации, сред които Корнелския университет, ETH Цюрих и KInIT. Кодексът изисква по-късно достъп да получат регулатори, органи, които прилагат закона, медии и проверяващи факти.

Правилото на ЕС изисква и публикуващият текст на ИИ по въпроси от обществен интерес да го обозначи, освен ако текстът е минал през човешка редакция и някой е поел редакторската отговорност.

Преди OpenAI Anthropic обяви на 11 август 2026 г., че слага невидим знак в текстовете на моделите си, пуснати от 2 август 2026 г. насам, и предупреди, че знакът не доказва авторство и че силната редакция, перифразирането и кратките пасажи го заличават. Според критици правилото на ЕС изисква знакът да е труден за отделяне от съдържанието, а текстовите знаци се махат лесно. Достъпът до програмния интерфейс за клиенти по света остава по избор и е изключен по подразбиране. За вече работещите системи срокът за съответствие е 2 декември 2026 г.

★ Добавете BurgasMedia в предпочитаните си източници в Google →

Свързани статии

Отвори пълната версия в burgasmedia.com →