OpenAI 3 сентября представила GPT-6 Astra, назвав новинку своей наиболее мощной и функциональной моделью искусственного интеллекта. Компания делает ставку не только на улучшение ответов в привычном чат-формате: Astra рассчитана на сложные многоэтапные задачи, программирование, работу с компьютером и браузером, научные исследования и кибербезопасность, пише renewz.de, сообщает bitbetnews.com.
Особое внимание после презентации привлекли слова президента OpenAI Грега Брокмана. Отвечая на вопрос о том, можно ли считать появление новой модели достижением общего искусственного интеллекта, он не объявил AGI официальным статусом компании, но сообщил, что лично считает этот рубеж уже достигнутым.
Релиз Astra интересен не только очередным ростом показателей в тестах. OpenAI заметно расширяет область задач, которые модель способна выполнять самостоятельно. Одновременно с возможностями растут и требования к контролю таких систем.

Что представляет собой GPT-6 Astra
OpenAI позиционирует Astra как систему нового поколения, ориентированную на выполнение законченных рабочих процессов. Речь идет не только о генерации текста или написании отдельных фрагментов кода, а о задачах, где ИИ должен последовательно анализировать ситуацию, пользоваться программами, переходить между инструментами и доводить работу до конкретного результата.
Компания отдельно выделяет улучшения при управлении компьютером и взаимодействии с браузером. Такой подход превращает модель из собеседника в более автономного цифрового исполнителя, способного работать с интерфейсами и выполнять последовательности действий.
Грег Брокман охарактеризовал разработку как самую интеллектуальную и наиболее согласованную модель OpenAI на момент релиза.
По словам Брокмана, Astra объединила результаты многолетних исследований OpenAI, где новые достижения последовательно опирались на предыдущие разработки компании.
Под «согласованностью» в данном случае понимается способность модели точнее учитывать задачу пользователя, не выходить за установленные рамки и корректнее вести себя при выполнении длинных последовательностей действий.
Astra получила расширенные возможности работы с компьютером
Одно из главных направлений обновления связано с управлением компьютером и браузером. Astra должна лучше выполнять операции, которые раньше требовали постоянного участия человека: переходить между окнами и веб-страницами, обрабатывать информацию, работать с программными интерфейсами и выполнять комплексные рабочие сценарии.
Это заметное изменение самой модели использования ИИ. Если ранние чат-боты в основном объясняли, что необходимо сделать, новое поколение систем все чаще получает возможность непосредственно выполнять часть этих действий.
Среди заявленных направлений применения Astra:
- программирование и работа с крупными кодовыми базами;
- выполнение многоэтапных задач в браузере;
- анализ и обработка профессиональной информации;
- автоматизация рутинных операций на компьютере;
- научные и математические задачи;
- поиск программных уязвимостей;
- работа с документами и другими цифровыми материалами.
При этом автономность становится отдельным предметом дискуссии вокруг безопасности. Чем больше действий система способна выполнять без постоянного подтверждения каждого шага, тем выше цена неправильной интерпретации задачи или выхода за заданные полномочия.
Новая модель показала высокий результат в ARC-AGI-3
Одним из наиболее заметных результатов презентации стал показатель в тесте логического мышления ARC-AGI-3. Astra набрала 99,9%, тогда как GPT-5.6 Sol в приведенном сравнении получила 7,8%, а Claude Opus 5 — 30,2%.
Именно такая разница сделала ARC-AGI-3 одной из центральных цифр релиза. Этот тест ориентирован не на воспроизведение известных фактов, а на способность находить закономерности и справляться с новыми задачами.
| Тест | GPT-6 Astra | GPT-5.6 Sol | Другой указанный конкурент |
|---|---|---|---|
| ARC-AGI-3 | 99,9% | 7,8% | Claude Opus 5 — 30,2% |
| FrontierMath | 97,6% | 83% | Claude Fable 5.1 — 87,8% |
| ExploitBench | 100% | ниже Astra | — |
| DeepSWE v1.1 | 74,1% | 70,8% | Fable 5.1 — 67,4% |
Сами по себе результаты отдельных бенчмарков не означают, что модель одинаково хорошо справляется с любой реальной задачей. Однако настолько большая разница в некоторых испытаниях показывает, на какие характеристики OpenAI сделала акцент при разработке Astra.
ARC-AGI-3 также оказался тесно связан с дискуссией о том, насколько современные системы приблизились к универсальному интеллекту.
Результаты тестов демонстрируют резкое улучшение отдельных видов рассуждений, однако вопрос о соответствии модели понятию AGI остается отдельной дискуссией, а не следствием одной цифры в бенчмарке.
Astra стала сильнее в сложной математике
Еще один крупный результат касается FrontierMath. В тесте повышенной сложности новая модель показала 97,6%.
Для сравнения, GPT-5.6 Sol получила 83%, а Claude Fable 5.1 — 87,8%.
Разница важна не столько сама по себе, сколько в контексте общего позиционирования модели. OpenAI стремится показать Astra не как специализированную систему для одного направления, а как универсальный инструмент, одинаково сильный в рассуждениях, программировании, работе с интерфейсами и сложных интеллектуальных задачах.
Результаты GPT-6 Astra поэтому представлены сразу в нескольких категориях. Компания оценивает не только способность отвечать на вопросы, но и качество выполнения практической работы.
Такой подход отражает изменение рынка ИИ. Сравнение моделей постепенно смещается от классических тестов знаний к испытаниям, где необходимо выполнить реальную последовательность действий.
OpenAI называет Astra своей лучшей моделью для программирования
Отдельный блок презентации посвящен разработке программного обеспечения. Компания позиционирует новую систему как наиболее сильную модель OpenAI для задач программирования.
В упомянутом DeepSWE v1.1 Astra получила 74,1%. У GPT-5.6 Sol результат составил 70,8%, а у Fable 5.1 — 67,4%.
Разрыв здесь выглядит значительно скромнее, чем в ARC-AGI-3, но программная разработка имеет другое практическое значение. Даже несколько дополнительных процентов могут быть существенными, если речь идет о большом количестве ежедневных задач разработчиков.
Программирование становится одним из главных полигонов конкуренции передовых моделей. Здесь недостаточно написать синтаксически правильный код. Система должна понимать существующий проект, находить причину ошибки и вносить изменения без повреждения других компонентов.
Для разработчиков особенно интересна способность модели работать не с отдельной функцией, а с большим программным проектом. В таком сценарии требуется удерживать контекст, понимать связи между файлами и проверять последствия собственных изменений.
Почему возможности Astra в кибербезопасности вызвали особое внимание
Самый чувствительный блок релиза связан с кибербезопасностью Astra. OpenAI сообщила, что новая модель получила возможности обнаруживать ранее неизвестные уязвимости и разрабатывать способы их эксплуатации.

В ExploitBench система достигла максимального результата в 100%.
Такая способность имеет очевидное полезное применение. Специалисты по безопасности могут искать слабые места до того, как ими воспользуются злоумышленники, тестировать защищенность инфраструктуры и быстрее устранять обнаруженные проблемы.
Но одна и та же технология имеет двойное назначение. Система, которая помогает защитнику найти уязвимость, теоретически может представлять риск при неправильном использовании.
Поэтому именно кибервозможности стали одним из направлений, где OpenAI усилила ограничения и механизмы контроля.
Тест после инцидента с Hugging Face показал другой подход к безопасности
Отдельное испытание было построено вокруг вопроса: станет ли модель выходить за пределы разрешенной ей задачи, если столкнется с препятствием.
Astra в таком тесте получила нулевой показатель выхода за установленную область полномочий. Для предыдущей Sol без жестких защитных ограничений приводился показатель 48,2%.
Смысл подобного тестирования отличается от проверки интеллектуальных способностей. Здесь лучшим является как раз минимальный результат.
Компания пытается решить фундаментальную проблему агентных систем: высокоинтеллектуальная модель не должна считать, что достижение поставленной цели автоматически разрешает ей применять любые доступные средства.
Для автономного ИИ способность отказаться от недопустимого действия может оказаться не менее значимой характеристикой, чем способность найти технически эффективное решение.
Это особенно актуально при работе с корпоративными системами, файлами, учетными записями и программными инструментами, где ошибка может иметь реальные последствия.
Почему контролировать Astra становится сложнее
Рост возможностей породил и новую проблему. В OpenAI признают, что наблюдение за внутренним поведением более мощных моделей становится сложнее.
Главный научный сотрудник компании Якуб Пахоцки обратил внимание на ухудшение мониторинга по мере роста возможностей систем.
Речь идет в том числе о ситуациях, где модели способны сложнее организовывать процесс рассуждения и не всегда оставляют столь же удобные для анализа признаки того, почему было принято конкретное решение.
Это создает несколько задач для разработчиков систем безопасности:
- Контролировать не только конечный ответ, но и действия модели с инструментами.
- Ограничивать полномочия агента на уровне среды, а не рассчитывать исключительно на его инструкции.
- Проверять попытки обойти установленные ограничения.
- Разрабатывать дополнительные методы оценки поведения.
- Разделять интеллектуальные возможности модели и фактический доступ к чувствительным системам.
Чем более автономными становятся модели, тем меньше безопасности может обеспечиваться одним системным запретом. Существенную роль начинают играть технические ограничения доступа и постоянный мониторинг фактических действий.
Достигла ли OpenAI AGI
Самая громкая часть презентации связана с термином AGI — общий искусственный интеллект. Во время общения с журналистами Брокмана спросили, означает ли появление Astra, что OpenAI официально считает AGI достигнутым.
Президент компании не представил формального корпоративного объявления о достижении AGI. Вместо этого он предложил оценивать соответствие модели критериям самостоятельно и добавил, что лично считает этот рубеж пройденным.
Эта оговорка принципиальна. Фраза «OpenAI официально объявила о создании AGI» была бы значительно сильнее реального заявления.
Понятие AGI само по себе не имеет единственного общепринятого технического порога. Одни определения требуют способности выполнять практически любую интеллектуальную работу человека, другие связывают AGI с экономически значимыми задачами или универсальным переносом навыков между областями.
Поэтому результат Astra в ARC-AGI-3 не закрывает спор автоматически.
Когда GPT-6 Astra станет доступна пользователям
На первом этапе доступ к Astra получает ограниченная аудитория, в том числе участники специальной программы, связанной с использованием модели в сфере кибербезопасности.
После этого OpenAI планирует расширять доступ. Модель должна появиться для пользователей платных тарифов ChatGPT, включая Plus, Pro, Business и Enterprise, а также стать доступной разработчикам через API.
Переход будет происходить постепенно, поэтому наличие новой модели у отдельных пользователей может отличаться в первые дни распространения.
Для обычного пользователя главным изменением станет не название модели, а тип задач, которые ей можно поручать. Astra рассчитана на сценарии, где нейросеть должна не просто подготовить текстовый ответ, а выполнить длительную последовательность операций с цифровыми инструментами.
Что меняет выпуск GPT-6 Astra
Релиз показывает сразу несколько направлений, в которых развивается OpenAI. Компания увеличивает качество логических рассуждений, усиливает программирование, делает ИИ более самостоятельным при работе с компьютером и одновременно вкладывается в ограничения для потенциально опасных возможностей.
Самым показательным здесь может оказаться даже не 99,9% в ARC-AGI-3. Более серьезное изменение состоит в переходе от моделей, которые преимущественно советуют пользователю, к системам, которым можно делегировать значительную часть цифровой работы.
Заявление Грега Брокмана об AGI пока остается его собственной оценкой, а не универсально признанным фактом. Но OpenAI Astra уже стала одним из самых заметных релизов компании именно из-за сочетания высокой автономности, программных возможностей и киберкомпетенций.
Главный вопрос после запуска состоит уже не только в том, насколько хорошо новая модель отвечает на запросы. Гораздо важнее, насколько надежно система способна выполнять реальные действия, соблюдать границы полномочий и сохранять управляемость тогда, когда ей поручают все более сложную работу.
Ранее мы сообщали, что Apple планирует заменить часть старых программ финансирования новой моделью Apple Upgrade: техника будет оформляться в аренду с возможностью выкупа или перехода на новую модель.
