GPT-6 Astra взяла ErdosBench, хотя математику не тренировали — так задумано
OpenAI сообщила, что их флагманская модель GPT-6 Astra заняла первое место на бенчмарке ErdosBench, который оценивает способность ИИ решать сложные открытые математические задачи. Это значимое достижение, учитывая, что бенчмарк содержит нетривиальные проблемы, которые обычно ставят в тупик даже современные LLM.
Однако главный научный сотрудник OpenAI Якуб Пачоцки подчеркнул, что математика не была приоритетом при обучении модели. «Это произошло не потому, что мы гнались за математическими результатами, а благодаря глубокому пониманию структуры задач», — сказал он. Компания сознательно направляет ресурсы на рекурсивное самоулучшение модели и исследования alignment.
Этот случай подтверждает теорию «шипастого» развития ИИ: модели демонстрируют сверхвысокие результаты в отдельных областях, а не равномерный прогресс по всем направлениям. Пока ИИ не может самостоятельно улучшать себя, ему требуются целенаправленная оптимизация на данных, созданных человеком.
Хотя модель уже была анонсирована ранее как бизнес-флагман, новость о триумфе на ErdosBench показывает, что отказ от универсальности в пользу узкой глубины может приносить неожиданные плоды.