ChatGPT, Gemini или Claude - кой AI пише най-трудно за засичане

Не всички AI модели пишат по един и същ начин. ChatGPT, Gemini и Claude имат различен стил и различни слабости. Детекторите ги засичат с различна точност - от 23% до 85% според модела и инструмента.

Съдържание

Основни числа

При тест с няколко детектора средният процент на засичане е:

  • ChatGPT: 68% засечен
  • Gemini: 61% засечен
  • Claude: 23% засечен

ChatGPT бива маркиран най-лесно. Claude минава през детекторите 3 пъти по-лесно от ChatGPT. Gemini е по средата.

Защо ChatGPT се засича толкова лесно

ChatGPT има характерен лексикален отпечатък. Проучване на University of Tubingen от 2024 г. анализира 14 милиона абстракти в PubMed и установи, че ChatGPT прекалява с определени думи: "robust", "pivotal", "facilitate", "leverage", "delve". На български еквивалентите са подобни - "от голямо значение", "от съществена важност".

Другият проблем е структурата. Изреченията на ChatGPT са с дължина между 15 и 25 думи - почти без изключение. Човешкият текст е по-хаотичен: кратки фрази от 5 думи, после дълго изречение от 40. ChatGPT няма този хаос.

Типични маркери: преходни фрази като "Furthermore", "Additionally", "It's worth noting that"; списъци от три точки, където третата е най-абстрактна; заключение, което преповтаря въведението.

Originality.ai засича ChatGPT в 85% от случаите. Turnitin - в 78%. Причината е проста: повечето детектори са обучени предимно с текст от ChatGPT, защото е най-разпространеният модел.

Gemini - друг тип проблем

Gemini не се издава с речника си толкова, колкото ChatGPT. Думите му са по-разнообразни. Проблемът е в организацията.

Gemini обича списъци. Булет точки, номерирани стъпки, подзаглавия на всеки 2-3 параграфа. Структурата е твърда: твърдение, доказателство, извод - като учебник. Детекторите все по-често разпознават тази твърда йерархия като AI сигнал.

GPTZero го засича в 58% от случаите, а Originality.ai - в 70%. По-малко от ChatGPT, но достатъчно, за да бъде разпознат.

Защо Claude минава по-лесно

Claude има по-голяма вариация в дължината на изреченията. Не се придържа към шаблон от 15-25 думи. Ползва разговорни съкращения и думи, които ChatGPT избягва. Поддържа стил, който изглежда обмислен, без да е шаблонен.

Copyleaks го засича едва в 18% от случаите. GPTZero - в 28%. Turnitin - в 31%. Средно 1 от 4 текста на Claude минава през детекторите напълно чист.

Причината не е само в стила. Детекторите имат по-малко тренировъчни данни от Claude спрямо ChatGPT, защото Claude се ползва от по-малко хора. По-малко данни означава по-слаба разпознаваемост.

Но и Claude не е перфектен. 77% от текстовете му все пак биват маркирани. А опитни редактори забелязват друг проблем: текстът е "прекалено равномерно добър" - поддържа качество, което повечето хора не могат да задържат в дълъг текст.

Как детекторите различават моделите

Различните модели се засичат по различни характеристики:

  • ChatGPT: лексикален отпечатък - повтарящи се думи и фрази
  • Gemini: структурен отпечатък - твърда организация и списъци
  • Claude: консистентност - равномерно качество, което рядко се среща при хора

Автоматизираните детектори се справят добре и с трите модела. Проучване от 2025 г. показа, че стилометричен анализ с Random Forest класификатор постига 99.8% точност при разделяне на AI и човешки текст. Но хората се справят зле - при слепи тестове участниците познават на нивото на случайността.

Какво означава това за автора

Ако ползвате AI за писане, моделът има значение. ChatGPT текстът минава през детектори най-трудно. Claude - най-лесно. Но нито един модел не е невидим.

Проверете текста си преди публикуване с AI Detector. Инструментът маркира думи и фрази - засича стилистични модели, фрази и структури, типични за машинно генериран текст, без значение от кой модел идва.