Можно ли измерить, насколько текст звучит по-человечески? Я думал, что нет, пока не устроил аудит скилла humanizer-ru. Оказалось, можно: каталог из 54 паттернов AI-генерации и скрипт, который ставит тексту оценку.
Тридцатого июля я разбирал этот скилл по винтикам. Внутри оказался каталог из 54 паттернов в двенадцати категориях: пустые открытия, канцелярит, кальки с английского и десятки других. Плюс жёсткие запреты, конструкции, которые палят нейросеть почти гарантированно.
Но главное, метрики. Скрипт scan.py считает запрещённые конструкции, маркеры, длину предложений и соотношение существительных к глаголам. Человеческий текст живёт глаголами, AI-текст тонет в существительных. Итог одна оценка от 0 до 100: выше 85 чисто, 60-84 точечная правка, ниже 60 рерайт.
Отдельно сравнил методологию с английским humanizer. Принципы те же: непредсказуемость, рваный ритм, живые детали. Русский каталог свой: кальки с английского, падежные согласования, длинное тире, которое AI ставит в каждом втором предложении.
Аудит закончился, а скилл остался работать. Теперь каждый пост этого канала проходит через его проверку: лимит, эмодзи, маркеры канцелярита. Инструмент из аудита стал частью редакции.
Правило: если не можешь измерить качество, ты не можешь его контролировать. Оценка от 0 до 100 лучше, чем «вроде нормально».