GPT-6 Astra совершил «скачок» в пространственном мышлении: 7 из 100 задач на робо-бенчмарке, конкуренты — ноль
Ранние тесты GPT-6 Astra показывают качественный прорыв в способности модели понимать и манипулировать объектами в пространстве. На специализированном бенчмарке StationeryBench, который оценивает работу с двурукими роботами, модель OpenAI успешно завершила 7 задач из 100. Для сравнения, конкурирующая модель MolmoAct2 не смогла выполнить ни одного задания.
Один из исследователей охарактеризовал результат как «шаг вперёд в пространственном мышлении» (step change in spatial reasoning). Хотя абсолютное число выполненных задач невелико, сам факт, что модель способна координировать две руки робота, — значимый индикатор прогресса в физическом ИИ. Пока это лишь ранние бенчмарки, но они намекают, что следующее поколение моделей OpenAI может быть гораздо более пригодным для задач робототехники и автономного управления.