Волна ИИПодписаться
← Назад
Модели и агенты

OpenAI выпустила GPT-6 Astra: 1,05 млн токенов контекста, упор на управление компьютером и спорные бенчмарки

03.09.2026 · marktechpost.com ↗

OpenAI выпустила GPT-6 Astra — модель, которую компания называет самой умной и согласованной. В отличие от обычных чат-моделей, Astra позиционируется как система для управления компьютером: она сама работает в браузере, таблицах, десктопных приложениях и терминале, выполняя многошаговые задачи вместо того, чтобы объяснять, как их сделать. Модель закрытая, веса не опубликованы, запустить на своём железе не получится. Сейчас она доступна только организациям из программ Trusted Access и Daybreak.

Главное техническое новшество — работа с контекстом. В Codex раньше использовалась компакция: когда контекст заполнялся, ранние сообщения сжимались, теряя детали. Astra вместо этого сохраняет заметки между окнами контекста и может возвращаться к старым сообщениям и выводам инструментов. Функция пока экспериментальная, включается через config.toml, но в ближайшие недели станет стандартом для Codex. Ещё одна фича: Astra может задать пользователю вопрос и продолжать работу, не зависящую от ответа, — это решает проблему, когда одно нерешённое решение стопорит весь агент.

По бенчмаркам: Astra набирает 72,6% на OSWorld V2-Offline против 65,7% у GPT-5.6 Sol, а среднее время задачи упало с 75 до 40 минут. Anthropic сообщает 77,9% для Claude Fable 5.1, но предупреждает, что использовалась другая версия OSWorld. На ARC-AGI-3 Astra получила 98,6%, но OpenAI признаёт, что результат сильно зависит от обвязки Responses API, а не только от модели. Слабый код: на DeepSWE v1.1 Astra показывает 74,1% — чуть выше Sol (70,8%), но ниже Muse Spark 1.3 от Meta (75,4%) и на уровне Gemini 3.8 Flash и Claude Opus 5 (около 74%). Разница в один-два задания на 113 тестов.

Другие цифры: 97,6% на FrontierMath Tier 4, 95,9% на BenchCAD Vision2Code (против 84,3% у Fable 5.1), 64,6% на Terminal-Bench Science (против 52,6% у Anthropic). Однако Epoch AI отмечает, что OpenAI финансировала FrontierMath и имеет эксклюзивный доступ к части тестов. Astra поддерживает инструменты: computer use, hosted shell, apply patch, skills, MCP, tool search. Доступны новые уровни reasoning.effort — xhigh и max. Fine-tuning не поддерживается.

Источник: marktechpost.com
← Все новости AI Wave