Волна ИИПодписаться
← Назад
Модели и агенты

StepFun выпустила Step 5 Preview: 600B параметров, 1M контекста и упор на дешевизну для агентов

21.09.2026 · marktechpost.com ↗

StepFun анонсировала Step 5 Preview — новую флагманскую модель, заточенную под длинные агентные сценарии: разработку ПО, профессиональную работу со знаниями и финансы. Главный козырь — цена: по словам команды, модель даёт сопоставимый с конкурентами уровень интеллекта при существенно меньшей стоимости задачи. Это сознательная ставка на «парето-фронтир» — баланс качества и расходов.

Архитектурно это разрежённый Mixture-of-Experts: около 600B параметров суммарно, но только 27B активируются на каждый токен — примерно 4,5% весов. Модель поддерживает контекст до 1M токенов, принимает текст, изображения и видео, выдаёт текст, умеет стриминг, вызов инструментов, JSON Mode и Schema, а также кэширование промптов. Уровень рассуждений настраивается: low, medium, high.

Инженеры StepFun пошли в глубину, а не в ширину: 92 слоя Transformer в узко-глубокой компоновке. По их логике, более глубокие стеки дают более длинные пути для неявного многошагового рассуждения — это критично при длинном prefill, когда агент ищет в вебе, запускает код и читает результаты инструментов. Обучение строилось на on-policy RL с длинным горизонтом, заявлено выравнивание битовой точности train/inference, спекулятивное декодирование MTP-3, FP8 MoE и выгрузка KV-кэша. Итог — более чем трёхкратное ускорение end-to-end для длинногоризонтного RL.

Сейчас модель доступна через хостинг API и на платформе StepFun. Самостоятельный запуск придётся подождать: открытые веса появятся 15 октября 2026 года. Учитывая 600B параметров, в BF16 это примерно 1,2 ТБ только под веса, без учёта KV-кэша, так что для инференса понадобится многогигабайтный сервер. На исследовательских задачах StepFun заявляет, что модель координировала 950 веб-запросов за одно агентное действие, а также есть интеграция с Claude Code через Step Plan.

Источник: marktechpost.com
← Все новости AI Wave