Волна ИИПодписаться
← Назад
Модели и агенты

Китайские лаборатории Z.ai и Alibaba независимо создали почти идентичные архитектуры ИИ-моделей

28.08.2026 · marktechpost.com ↗

На этой неделе две китайские лаборатории — Z.ai и Alibaba Qwen — выпустили открытые весовые модели с разницей в сутки. GLM-5.3-Flash — 320-миллиардная мультимодальная модель MoE с 18B активных параметров, а Qwen3.8-Flash-Next — 125B модель с 6B активных параметров, которая предвосхищает архитектуру Qwen4. Обе системы разрабатывались независимо, но их конфигурации читаются как почти полные копии друг друга.

GLM-5.3-Flash — первая нативно мультимодальная модель в серии GLM-5, выпущена под лицензией MIT. Она обучалась на 30 триллионах токенов мультимодального корпуса, поддерживает контекст до 1 млн токенов. По данным Z.ai, модель превосходит GLM-5.2 по всем бенчмаркам при цене в десять раз ниже, приближаясь к Claude Opus 4.8 на задачах кодинга и агентных сценариях. Цена — $0.15 за миллион входных токенов и $0.50 за миллион выходных. Qwen3.8-Flash-Next — публичное превью следующего архитектурного семейства: 125B основная модель плюс 51B n-gram таблица эмбеддингов, контекст 262 144 токена с расширением до 1M через YaRN. Обучение потребовало примерно в девять раз меньше вычислительных ресурсов, чем Qwen3.7-Plus.

Обе модели используют одинаковые нововведения: гибридное внимание в пропорции 3:1 (линейное + полное), сжатый индексер контекста на 2048 токенов, расширение residual stream до 4 ответвлений с гейтами, а также оптимизатор Muon с объединёнными матрицами параметров, разделяемыми перед ортогонализацией. Единственное различие — в деталях реализации, которое авторы статьи называют «точкой расхождения». Это яркий пример конвергенции архитектурных решений в ведущих китайских AI-лабораториях.

Источник: marktechpost.com
← Все новости AI Wave