Как я избавлялся от ИИ-маркеров в текстах Claude: промпт, второй проход и регулярка
Тексты, написанные нейросетями, особенно Claude, легко узнать по характерным оборотам: длинные тире, конструкции вроде «дело не в X, а в Y», «важно понимать», «давайте разберёмся». Автор наткнулся на эту проблему при разработке Telegram-бота, который преобразует голосовые сообщения в готовые сценарии для соцсетей.
Первая попытка решить проблему — добавить в промпт просьбу избегать таких маркеров — не сработала. Второй проход нейросети, где она сама проверяла и исправляла текст, тоже не дал нужного результата. Тогда автор выстроил трёхслойный пайплайн: промпт, второй проход и финальная чистка регулярными выражениями.
В статье подробно разбирается устройство бота, почему каждый из слоёв по отдельности не справлялся и как комбинация методов позволила за один день решить задачу. Код из рабочего репозитория прилагается.