Тази страница описва прозрачно как работи ИИ Редактор, какво анализираме, какви са известните ограничения на инструмента и как можете да оспорите резултат. Публикуваме я в съответствие с принципите за прозрачност на Регламент (ЕС) 2024/1689 (AI Act) и нашата отговорност към потребителите.
ИИ Редактор е статистически и детерминиран анализатор на текстово съдържание. Той не използва генеративен изкуствен интелект и не "разбира" смисъла на текста. Алгоритъмът извършва технически проверки върху HTML кода и текстовото съдържание и сравнява резултатите с вътрешна база от признаци.
Анализът преминава през следните стъпки:
&, и подобни се преобразуват в реалните им символи, за да не пропуснем скрити маркировки.data-start и data-end атрибути).Анализът обхваща четири основни класа технически признаци:
Това са невидими знаци, които могат да се появят в HTML кода без визуално да се забелязват. Включват: zero-width space (U+200B), zero-width non-joiner (U+200C), zero-width joiner (U+200D), Byte Order Mark (U+FEFF), soft hyphen (U+00AD), word joiner (U+2060) и подобни. Това откриване е технически детерминирано: ако такъв символ присъства в кода, системата го констатира с пълна сигурност. Това не означава непременно AI произход - такива символи могат да бъдат вмъкнати и от различни редактори, копиране между програми или конкретни CMS системи.
Различни видове "интелигентни" кавички („ " " " ‚ ‛ ‟), em-dash (—), en-dash (–), figure dash (‒), не-разкъсващ интервал (U+00A0) и нестандартни видове интервали (thin space, hair space, em space, en space и т.н.). Тези символи се появяват автоматично при копиране от Word, Google Docs, някои ИИ модели или съвременни текстови процесори. Тяхното присъствие НЕ е достатъчно доказателство за AI произход - те се срещат и в напълно авторско съдържание, особено в официален стил.
Базата ни съдържа думи, изрази и фрази, които често се срещат в съдържание, генерирано от популярни ИИ модели като ChatGPT, Claude, Gemini, Perplexity и други. Базата се поддържа и обновява от нашия екип на основата на собствени наблюдения, тестове и практически анализи на текстове, генерирани от тези модели. Базата НЕ е официално публикуван научен списък и не претендира за изчерпателност или научна валидност. Същите думи и фрази могат да се появят и в напълно авторско съдържание, особено в официален, технически, юридически или формален стил.
Някои ИИ инструменти оставят технически "отпечатъци" в HTML кода при копиране от тях. Примери: data-start / data-end атрибути (характерни за текст копиран от ChatGPT интерфейс), data-hveid атрибути (характерни за Google AI Overview), data-subtree="aimfl" или CSS клас Y3BBE (характерни за Gemini). Системата изброява тези атрибути в резултата за прозрачност.
Бихме искали да бъдем напълно прозрачни относно ограниченията на инструмента:
Нашият екип периодично сравнява резултатите от инструмента с известно ИИ генерирано съдържание (контролни проби) и с известно авторско съдържание (контролни проби) за български език. Калибрирането се основава на тези практически тестове, не на формална академична валидация. Конкретни числови стойности за false-positive / false-negative rate не публикуваме, защото те зависят силно от типа на текста (формален vs разговорен, кратък vs дълъг, тематика и т.н.) и не отразяват реалистично надеждността при произволен текст.
За технически читатели, които искат да разберат обхвата на инструмента:
В съответствие с чл. 22 от GDPR и Регламент (ЕС) 2024/1689 (AI Act), потребителите трябва да знаят, че:
Ако сте автор, собственик или представител на организация, за която считате, че получен резултат е неточен или вреди на доброто Ви име, моля свържете се с нас:
В рамките на процедурата по оспорване ще извършим една или повече от следните стъпки:
Точността на инструмента се подобрява постепенно с реалния опит. Ако забележите систематични грешки (например цял клас тексти, който получава нереалистично високи или ниски резултати), моля споделете с нас. Тази обратна връзка е безценна за подобряване на алгоритъма.
За технически въпроси, предложения или сътрудничество: support@ai-detector.bg.