Фалшиви положителни резултати от AI детектори - кога човешки текст бива маркиран като AI
AI детекторите грешат. Не рядко, не понякога - а регулярно. Тестове от 2025 и 2026 г. показват, че реалната точност на повечето инструменти е между 76% и 80%, макар рекламираната да стига до 99%.
Съдържание
Грешката, която засяга хора директно, се нарича false positive - детекторът маркира човешки текст като генериран от AI. Тази грешка може да коства оценка, работа или репутация.
Какво показват числата
Проучване от 2023 г. (публикувано в Patterns, Cell Press) тества 91 есета от TOEFL изпити, писани от китайски студенти, и 88 есета от американски ученици. Седем популярни AI детектора участват в теста.
Резултатите: 61.3% от есетата на чуждестранните студенти са маркирани като AI текст. При американските ученици грешката е 5.1%. Всички седем детектора едногласно маркират 19.8% от TOEFL есетата като написани от машина. Поне един детектор маркира 97.8% от тях.
Реални тестове от 2026 г.
Независим тест с 150 текстови проби показва обща точност: Originality.ai - 79%, Copyleaks - 77%, GPTZero - 76%. При смесени и редактирани текстове точността пада до 44-62%. Лека редакция намалява засичането с 15 до 25 процентни пункта.
Защо детекторите бъркат човешки текст с AI
AI детекторите измерват perplexity - колко предвидим е текстът. Ниска perplexity означава предвидимо подреждане на думите. AI моделите генерират текст с ниска perplexity по дефиниция - те избират статистически вероятната следваща дума.
Проблемът: хора, които пишат с ограничен речник, също произвеждат текст с ниска perplexity. Граматически правилни, кратки изречения с прости думи изглеждат "твърде гладки" за детектора.
Кой попада най-често в капана
- Хора, които пишат на чужд език - ползват по-прости конструкции и по-малко синоними
- Студенти, работили с преподавател или тютор - текстът им е "изгладен" и следва шаблон
- Автори на технически документи - стилът е сух, точен и предвидим по природа
- Хора с невродивергентен профил - често пишат с по-еднообразна структура
Парадоксът с подобряването на текста
Изследователите от Stanford провеждат допълнителен тест. Вземат TOEFL есетата и карат ChatGPT да подобри речника - без да променя смисъла. Резултат: false positive процентът пада от 61.3% на 11.6%.
AI подобрява текста и детекторът спира да го маркира. Човешкият оригинал е маркиран, AI-редактираната версия - не. Това е обратното на очакваното.
Turnitin и GPTZero - какво казват самите те
GPTZero твърди 99.39% точност в собствените си бенчмаркове от 2026 г. и 0% false positive процент върху 1000 човешки текста. Turnitin рекламира 95% точност с 2% false positive.
Независими тестове казват друго. При 160 проби и двата инструмента показват false positive от 1.28% - но това е при "чисти" текстове на роден език. При формален академичен стил числата растат. При текстове на чужд език - скачат.
Какво правят платформите
Upwork и Fiverr вече ползват AI детекция за проверка на фрийлансъри. Тест на Originality.ai върху 100 автора от Upwork засича AI в 24% от пробите. При автори, които таксуват между 10 и 19 долара на статия, процентът е 40%. При тези с цена над 60 долара - под 10%.
Университетите са друг голям потребител. Turnitin обработва над 200 милиона работи годишно. Фалшиво обвинение в AI генериране води до дисциплинарно производство.
Как да проверите дали текстът ви е маркиран погрешно
- Тествайте с повече от един инструмент - ако само един маркира текста, вероятно е грешка
- Проверете процента - резултат между 30% и 60% AI е несигурна зона, не присъда
- Добавете лични примери, нестандартни сравнения и разговорни елементи - те повишават perplexity
- Избягвайте шаблонни структури: увод, три точки, край - това е типичен AI формат
Проверете текста си с AI Detector, който маркира стилистични белези и Unicode водни знаци - двата основни сигнала, по които се разпознава AI текст.
Защо това е проблем за всички
AI детекторите не са тестове за лъжа. Те са статистически модели, които правят предположения. Когато решения за оценки, наемане или публикуване се базират на един инструмент с точност 76-80%, грешките са неизбежни.
Най-засегнати са хората, които вече са в неравностойно положение - чуждестранни студенти, автори на втори език, фрийлансъри с ниски бюджети. Един false positive резултат не доказва нищо. Той само показва, че текстът прилича на статистически модел - а това не е престъпление.