Дьорнуло мене перевірити на новому (передовому) детекторі Substack власний текст українською. Все норм,результат 100% human.
Потім попросила ШІ виправити в ньому лише русизми, орфографію та розділові знаки, і Pangram одразу побачив у ньому більше AI.
А тоді я переклала виправлений текст англійською і раптом він знову став 100% human.
Що ж виходить? Детектор не знає, хто написав текст, просто реагує на поверхневі ознаки нормативність мови, синтаксис, ритм і напевно передбачуваність? Який висновок маємо, що мова то вже повністю сіра зона? Враховуючи що для тренування детектора зібрали близько мільйона документів публічні й ліцензовані людські тексти та тексти, створені GPT й іншими моделями. А для "людської" частини Pangram переважно використовував матеріали не пізніше 2021 року, щоб туди випадково не потрапили тексти ШІ 🙂
Ще зацікавив момент, що детектор взагалі не бачить частину ai assistant, хоча що виправлення знаків,що переклад мав би то показати.