Инструменты
Развернули MiniMax-M2.7 на GPU с S3: пошаговая инструкция
Использовать нейросети для работы с внутренними данными компании — идея классная, но скармливать их внешним API банально опасно. Никому не хочется, чтобы коммерческая тайна или уязвимости инфраструктуры утекли в сеть. Выход — поднять модель в своём закрытом контуре.
В этой статье пошагово разворачивают языковую модель nvidia/MiniMax-M2.7-NVFP4 на GPU-сервере и подключают её к S3-совместимому объектному хранилищу. Под катом разбирают, как подобрать конфигурацию сервера для запуска, создать преднастроенную виртуальную машину, запустить MiniMax-M2.7 через vLLM, подключить S3 и загрузить туда тестовые логи, а также передать модели технический контекст из S3 и сохранить сформированный отчёт обратно в бакет.
Источник: habr.com