Твой личный почерк в тексте — как измеримая величина, а не как ощущение.
Что делает
«Сделай человечнее» — плохая постановка: человечность вообще это усреднённый человек, то есть снова никто. Скилл решает другую задачу — приводит текст к почерку КОНКРЕТНОГО автора и проверяет попадание числом. Профиль снимается с собственной переписки и написанных текстов: частота и длина смайлов-скобок, тире на 1000 знаков, разброс длин предложений, слов в абзаце, опорные частицы и — самое сильное — слова, которых у автора физически нет. Пороги не придумываются, а выводятся негативным контролем: правило, которое бракует больше 5% подлинных текстов автора, неверно по построению. Главная находка метода: регистры одного человека — это разные диалекты, а не оттенки. Профиль, снятый с переписки, забраковал 4 написанных текста того же автора из 4; выбор между парой синонимов переворачивался с 15:1 на 0:13, а строчная буква в начале абзаца из «почти всегда» превращалась в «никогда».
Как пользоваться
- 1Собери два корпуса: выгрузку переписки (2–3 чата разного регистра, от ~1500 своих реплик) и отдельно 3–5 написанных текстов — постов, писем, статей. Подменять одно другим нельзя: чат даёт пунктуацию и лексику, письмо даёт ритм.
- 2Измерь то, чего о себе не знаешь. Спрашивать автора бесполезно: в нашем прогоне человек был уверен, что часто ставит многоточия и слэши — в корпусе оказался статистический ноль. Люди помнят намерение, а не привычку.
- 3Найди отрицательные маркеры — слова, встречающиеся у автора 0–2 раза на сотню тысяч. «Никогда не пиши вот эти шесть слов» работает лучше, чем «пиши живее». Проверь список на омонимию и устойчивые обороты: у нас в канцелярит попало слово «данные», которое по-русски чаще всего значит «data».
- 4Раздели регистры и дай им переопределять базовые правила ЦЕЛИКОМ, включая список запрещённых слов. Слово, запрещённое в переписке, в письме может быть нормой — это не непоследовательность, а замер.
- 5Откалибруй пороги негативным контролем: применяешь правило к подлинным текстам автора, считаешь долю забракованных, потолок 5%. Наши правила «по здравому смыслу» бракавали 12%, 8% и 7.7% — все пришлось переписать.
- 6Отложи held-out и не калибруй на нём. Прогоняй на нём каждую правку правил: у нас он подтвердил перенос ритма на невиданный текст и одновременно вскрыл два дефекта, которых не показал ни один обучающий.
- 7Сделай встречный контроль: типовой ИИ-текст БЕЗ единого запрещённого слова должен ловиться ритмом. Профиль, который ничего не бракует, бесполезен.
- 8Зафиксируй контракт проверки: 0 — чисто, 1 — расхождения, ≥64 — измерить не удалось. Отсутствие результата никогда не читается как «нарушений нет».
Когда срабатывает
Пример
Проверка необходима, но не достаточна: наш первый черновик прошёл с нулём расхождений — и содержал длинное тире в предложении «тире не ставлю вообще». Порог был мягкий, метрика честно промолчала. Цифра ловит систематический промах по почерку, но не ловит глупость — глазами читать всё равно придётся.
Обновления
Новый скилл: личный tone of voice как измеримая величина. Профиль снимается с собственной переписки и написанных текстов, пороги выводятся негативным контролем (потолок 5% ложных тревог на подлинных текстах автора), результат проверяется скриптом. Ключевая находка: регистры одного человека — разные диалекты, а не оттенки, поэтому правила переписки нельзя переносить на письменный текст.
Понравился скилл? Новые разборы и обновления — в канале.