OpenAI публикува на 5 октомври 2026 г. технически доклад за водния знак „textGrain“. Той ще се слага автоматично в текстовете на ChatGPT и Codex в Европейския съюз, а пускането е планирано „в следващите седмици“. Знакът е статистическа следа в избора на думи, а не скрит символ или невидим интервал, и затова не доказва нищо сигурно за автора на текста.
Поводът е член 50 от Акта за изкуствения интелект на ЕС. От 2 август 2026 г. той изисква изходът на системите, които генерират текст, изображения, звук и видео, да е означен в машинночетим вид и да може да се разпознае като създаден от изкуствен интелект. Европейската комисия публикува на 10 юни 2026 г. окончателния Кодекс за добри практики по тези въпроси. Той е доброволен, но служи като начин да се докаже, че правилото е спазено. По него никоя техника сама не изпълнява изискванията, затова доставчиците трябва да ползват поне два слоя означение, например метаданни и воден знак.
Статистическа следа в избора на думи
Езиковият модел пише дума по дума и всеки път избира между няколко подходящи варианта. „textGrain“ заменя част от тази случайност със стойности, изчислени от таен ключ и от предходните думи. Който има ключа, може да провери дали текстът следва този модел по-често, отколкото би станало случайно. Копирането и поставянето на непроменен отговор не премахва знака.
Самият текст не променя вида си, затова знакът не се вижда нито в текстов редактор, нито в електронно писмо. При кратките отговори, според OpenAI, под около 150 английски думи сигналът е твърде слаб, а в код, математика и строго фактически отговори моделът има малко начини да перифразира, затова там знакът се слага трудно.
Детекторът е най-надежден при дълги текстове. При пасажи от 400 токена (части от думи, с които моделът работи) откриването е около 95%, а при 200 токена е около 80%. Зависи и от езика: от 42,2% за румънски до 69,0% за испански. За български в източниците няма данни.
Редакцията заличава знака
Ако 25% от думите се заменят, откриването пада до 17%. OpenAI признава, че перифразиране или превод го заличават. Проучване на SynthID, сходната технология на Google, показва същото: при леко перифразиране и превод точността спада рязко. При друга атака, в която текст на ИИ се размесва с много човешки, над половината от непомаркираните текстове са сбъркани с маркирани.
Ученик или студент, който пренапише отговора със свои думи, най-вероятно няма да остави следа, а липсата на знак не доказва, че текстът е човешки. Текст, в който ChatGPT само е поправил правописа, може да носи знак. Откриването му сочи, че е участвал ИИ, но не показва колко е редактирал човекът.
Детекторът е достъпен за одобрени организации
Детекторът греши в двете посоки: може да отчете знак там, където го няма, или да го пропусне там, където е. Засега не е публичен. OpenAI го дава само на одобрени изследователи и експертни организации, сред които Корнелския университет, ETH Цюрих и KInIT. Кодексът изисква по-късно достъп да получат регулатори, органи, които прилагат закона, медии и проверяващи факти.
Правилото на ЕС изисква и публикуващият текст на ИИ по въпроси от обществен интерес да го обозначи, освен ако текстът е минал през човешка редакция и някой е поел редакторската отговорност.
Преди OpenAI Anthropic обяви на 11 август 2026 г., че слага невидим знак в текстовете на моделите си, пуснати от 2 август 2026 г. насам, и предупреди, че знакът не доказва авторство и че силната редакция, перифразирането и кратките пасажи го заличават. Според критици правилото на ЕС изисква знакът да е труден за отделяне от съдържанието, а текстовите знаци се махат лесно. Достъпът до програмния интерфейс за клиенти по света остава по избор и е изключен по подразбиране. За вече работещите системи срокът за съответствие е 2 декември 2026 г.
Коментари (1)
Ей, ама хайде сега! "Статистически знак"?! Сериозно ли? Някой да обясни НА баба ми к'во е тоя статистически знак - все едно ще го татуират на текста. И какво печелим от това всъщност? Че ако някой си е написал нещо и после го прегледа, бе, изчезва знака! Каква работа свършваме тогава