Инструменты
AudioToText: как превратить записи встреч в структурированные протоколы требований
Проект AudioToText решает типичную боль: после встречи остаются длинные аудиозаписи, которые никто не слушает. Вместо простой транскрибации сервис генерирует структурированные протоколы — с разбивкой по темам, решениям и задачам, что сразу пригодно для работы с требованиями.
В основе — MLX Whisper для распознавания речи и Django для веб-интерфейса. Автор описывает сценарий работы, ключевые элементы UI и контур ревью, через который проходят сгенерированные протоколы перед тем, как попасть в работу.
В планах — добавить NER для извлечения сущностей и поиск противоречий по summary, чтобы автоматически находить конфликты в требованиях. Пока это рабочий прототип, но подход выглядит практичным для команд, где встречи — основной источник требований.
Источник: habr.com