OpenAI слага водни знаци на изображения и текст - какво означава това
OpenAI вече маркира снимките от ChatGPT и DALL-E с невидими метаданни. За текста положението е по-сложно - компанията разработи watermarking система, но се колебае дали да я пусне. Тук разглеждаме какво работи, какво не и какво означава това за потребителите.
Съдържание
C2PA - водни знаци за изображения
Всяка снимка, генерирана от DALL-E 3 или GPT-4o, съдържа C2PA метаданни. C2PA (Coalition for Content Provenance and Authenticity) е отворен стандарт, подкрепен от Adobe, Microsoft, Google, BBC и Sony.
Метаданните записват кой инструмент е създал изображението и кога. Те са невидими за окото, но четими от софтуер.
Как се проверява
Ако искате да проверите дали дадена снимка има C2PA данни, качете я в Content Credentials Verify на адрес contentcredentials.org/verify. Инструментът показва произхода - кой модел е генерирал картинката и дата на създаване.
Ограничения
C2PA метаданните се губят при повечето операции - resize, screenshot, конвертиране на формат. Ако някой свали изображението и го качи в социална мрежа, повечето платформи изтриват метаданните при обработката. Работи добре само когато файлът остане непроменен.
Текстови watermarking - защо OpenAI се колебае
OpenAI разработи метод за маркиране на текст от ChatGPT. Системата променя вероятностното разпределение на думите по начин, който е незабележим за читателя, но разпознаваем от специален детектор.
Технологията работи с висока точност при контролирани условия. Проблемите идват, когато текстът бъде променен след генерирането.
Кога watermark-ът спира да работи
- Превод с Google Translate или друг преводач
- Преформулиране с друг AI модел
- Добавяне и триене на специални символи между думите
- Ръчно пренаписване на части от текста
Който иска да заобиколи watermark-а, може да го направи с минимални усилия.
Проблемът с честността
OpenAI посочват, че watermarking-ът може да навреди на определени групи потребители. Хора, за които английският не е роден език, ползват ChatGPT като помощник при писане. Ако текстът се маркира автоматично, тези потребители рискуват да бъдат несправедливо обвинени в измама.
Затова компанията не е пуснала инструмента публично. Към средата на 2025 г. няма обявена дата за пускане.
Какво правят другите компании
Google вече ползва SynthID за маркиране на текст от Gemini. Meta също имат собствена watermarking система. Всяка работи само за съответния модел - SynthID не засича текст от ChatGPT, а OpenAI не могат да засекат текст от Gemini.
Няма единен стандарт за текстово маркиране. За изображенията C2PA набира скорост, но за текста индустрията е разпокъсана.
Какво означава за хората, които пишат
Ако генерирате снимки с ChatGPT или DALL-E - те вече носят метаданни. Това не е тайна и не е скрито. Метаданните обаче лесно се премахват.
За текста засега няма работещ публичен watermark. Детекторите като AI Detector разчитат на лексикален и стилистичен анализ, не на скрити маркери. Затова работят с текст от всеки модел, а не само от конкретен доставчик.
Watermarking-ът може да стане стандарт в бъдеще, но за момента не е достатъчно надежден за широка употреба.