Цифровой двойник из 3,4 млн символов: автор превратил 10 лет блога в ИИ-ассистента
Автор книжного блога поделился экспериментом: он собрал все свои публикации за 10 лет — про автоматизацию, управление, карьеру и книги — в один текстовый файл объёмом 3,4 млн символов (примерно 8 книг по 400 тыс. знаков). Получился «рабочий двойник», с которым уже можно поговорить почти как с самим автором.
Идея родилась из желания упростить навигацию по блогу: вместо длинного оглавления читатель может скормить файл любимой нейросети и попросить подборку книг или ответ на конкретный вопрос. Автор отмечает, что ИИ справляется с поиском полезного в большом массиве информации лучше любых других инструментов.
Впрочем, не обошлось без сложностей: попытки заставить нейросеть отвечать строго в контексте знаний конкретного автора провалились, особенно когда публикации разбросаны по разным источникам. Тем не менее, автор считает подход перспективным и уже использует его для работы с читателями.
Эксперимент показывает, как личные архивы можно превращать в полезных ИИ-ассистентов — без дообучения моделей, просто за счёт упаковки контекста в файл.