ИИ-детекторы вроде Turnitin и GPTZero ошибочно обвиняют людей

Обозреватель The Verge в еженедельной рассылке The Stepback разбирает, как детекторы ИИ-текста выросли из систем поиска плагиата (вроде Turnitin, которые сверяют текст с базой существующих работ) в отдельный класс инструментов, которые вместо сверки с базой используют собственные ИИ-модели, чтобы угадать, писал ли текст человек, по формулировкам, ритму, структуре, длине предложений и тону. По опросу Center for Democracy and Technology, в 2024, 2025 годах такие детекторы регулярно использовали 43% американских учителей 6, 12 классов; часть университетов обнаружила, что Turnitin включил детекцию ИИ автоматически ещё при запуске функции в 2023 году.
Производители заявляют о низкой доле ложных срабатываний: у Turnitin, менее 1% человеческих текстов ошибочно помечаются как ИИ, у Pangram, 1 случай на 10000, у GPTZero, сопоставимо низкий показатель. Но исследование Стэнфорда 2023 года показало, что детекторы чаще ошибочно помечают как ИИ-текст эссе людей, для которых английский не родной; авторы статьи также отмечают возможную предвзятость против нейроотличных авторов.
Статья приводит несколько конкретных историй. Издательство Minotaur в прошлом месяце разорвало контракт на книгу на $2 млн с автором Джерри Фаладе из-за подозрений, что тот использовал ИИ, сам Фаладе это категорически отрицает. Француз Тьерри Ринёль в прошлом году подал в суд на Йельский университет: профессор с помощью GPTZero обвинил его в написании части финального экзамена с помощью ИИ, из-за чего Ринёль получил неуд и годовое отстранение; иск утверждает, что средства слежения и детекции ИИ систематически несправедливо бьют по тем, для кого английский, не родной язык. В феврале студент Adelphi University выиграл иск против университета после похожего обвинения от преподавателя (у Adelphi есть лицензия на Turnitin, но в иске не названо, каким именно инструментом пользовался преподаватель). На прошлой неделе сын Оззи Осборна Джек в видео, обращённом к более чем 3,5 млн подписчиков в соцсетях, обвинил журналистку и автора The Verge Кэт Тенбардж в использовании ИИ для статьи в Rolling Stone, представив результат детектора Getsolved как «доказательство»; Тенбардж опровергла обвинение в собственном видео и на сайте, но Осборн видео не удалил и обвинение не отозвал.
Сами разработчики детекторов признают их ограничения: Turnitin пишет, что инструмент «может ошибаться» и не должен быть основанием для санкций против студента; Grammarly предупреждает, что нельзя полагаться только на результат детектора; GPTZero заявляет, что ни один детектор ИИ не бывает стопроцентно точным; OpenAI в 2023 году закрыла собственный детектор из-за низкой точности. На этом фоне Йельский, Джонса Хопкинса, Вандербильтский, Джорджтаунский университеты и другие отключили или ограничили использование таких инструментов, а MIT прямо заявляет: «Детекторы ИИ не работают». Вместо детекторов Чикагский университет советует замедлять чтение, дробить письменные задания и требовать рефлексии по ним, Стэнфорд предлагает проводить проверочные работы в аудитории, а MIT, давать студентам возможность честно раскрыть использование ИИ без штрафа.
Одновременно детекция ИИ расширяется и за пределами учёбы: Substack встроил в приложение Pangram для проверки блогов, LinkedIn добавил к постам кнопку «похоже на ИИ-шлак». В ответ возникает встречное движение: Authors Guild выдаёт писателям сертификаты «Human Authored», существуют бейджи Not by AI и Written by Human, а Википедия выпустила для редакторов гайд по распознаванию ИИ-текста (искать «раздутую» значимость темы и «поверхностный анализ информации») и полностью запретила ИИ-сгенерированные статьи. Итог, к которому приходит автор колонки: формируется новая эпоха взаимного недоверия, где читатели постоянно сомневаются в подлинности текста, а живые авторы стараются не звучать «как ИИ».
Ключевые факты
- 43% американских учителей 6, 12 классов регулярно пользовались ИИ-детекторами в 2024, 2025 годах (опрос Center for Democracy and Technology); заявленная точность у Turnitin, Pangram и GPTZero высокая (менее 1%, 1 на 10000 и сопоставимо низкая доля ложных срабатываний соответственно), но стэнфордское исследование 2023 года показало повышенную долю ложных срабатываний у не носителей английского языка.
- Издательство Minotaur разорвало контракт на $2 млн с автором Джерри Фаладе из-за подозрений в использовании ИИ (он отрицает); студент Тьерри Ринёль подал в суд на Йель после обвинения через GPTZero (неуд и годовое отстранение); студент Adelphi University выиграл похожий иск против университета.
- Сын Оззи Осборна Джек публично обвинил журналистку The Verge Кэт Тенбардж в использовании ИИ, сославшись на детектор Getsolved как на «доказательство»; Тенбардж обвинение опровергла.
- Йель, Джонс Хопкинс, Вандербильт, Джорджтаун и другие университеты отключили или ограничили ИИ-детекторы; MIT заявляет, что «детекторы ИИ не работают», а OpenAI ещё в 2023 году закрыла собственный детектор из-за низкой точности.
- Детекция ИИ тем временем расширяется вне учёбы: Substack встроил Pangram в приложение, LinkedIn добавил кнопку «похоже на ИИ-шлак»; в ответ появляются сертификаты подлинности вроде Human Authored от Authors Guild.
Почему это важно
Материал фиксирует переход от давно привычной проверки на плагиат (сверка текста с базой источников) к принципиально другому классу инструментов: детекторы ИИ-текста вроде Turnitin, GPTZero и Pangram не сверяют текст ни с чем, а угадывают его происхождение по стилю с помощью собственных ИИ-моделей, и делают это при формально низкой, но не нулевой ошибке, которая на практике уже стоила людям денег, оценок и репутации.
Кому это важно
Студентам и преподавателям (детекторы уже применяют 43% учителей 6, 12 классов в США), писателям и издателям (контракт на $2 млн сорван из-за подозрения), журналистам и публичным авторам (обвинение через соцсети со ссылкой на детектор), а также администрациям университетов, часть которых, Йель, Джонс Хопкинс, Вандербильт, Джорджтаун, уже отказалась от таких инструментов или ограничила их, а MIT прямо заявляет, что такие детекторы не работают.
Как это применить
Вместо того чтобы полагаться на процент от детектора, статья приводит практики вузов: Чикагский университет предлагает замедлять чтение и дробить письменные задания с обязательной рефлексией, Стэнфорд, проводить проверочные работы очно в аудитории, MIT, заранее давать студентам возможность честно указать, что они использовали ИИ, без штрафа за это. Авторам и издателям есть смысл использовать сертификаты подлинности (Human Authored от Authors Guild, бейджи Not by AI и Written by Human) как встречное доказательство, раз сами детекторы доказательством считаться не могут.
Можно ли доверять
Даже создатели детекторов признают их ограничения дословно: Turnitin пишет, что инструмент «может ошибаться» и не должен служить основанием для санкций против студента; Grammarly предупреждает не полагаться на детектор в одиночку; GPTZero прямо говорит, что ни один детектор не бывает стопроцентно точным; MIT формулирует жёстче, «детекторы ИИ не работают». При этом стэнфордское исследование 2023 года зафиксировало повышенную долю ложных срабатываний у авторов, для которых английский, не родной язык, а авторы материала указывают и на возможную предвзятость против нейроотличных людей.
Риски и подводные камни
Ключевой риск, необратимость последствий при обратимой по природе ошибке: разорванный книжный контракт, проваленный экзамен с годовым отстранением, публичное обвинение перед 3,5 млн подписчиков, при том что сам показатель детектора не является доказательством и сами разработчики это подтверждают. Экспансия детекции за пределы учёбы (Pangram в Substack, кнопка «похоже на ИИ-шлак» в LinkedIn) увеличивает число ситуаций, где чей-то текст может быть публично поставлен под сомнение без возможности эту метку опровергнуть.
«Детекторы ИИ не работают»
— Массачусетский технологический институт (MIT)