GPT-6 Astra вышла: достигла ли OpenAI уровня AGI

OpenAI выпустилаGPT-6 Astra и объявила о начале «эры AGI» — так модель охарактеризовал президент компании Грег Брокман. Общепринятого определения общего искусственного интеллекта при этом по-прежнему не существует. Разбираемся, что реально показано в первые дни после релиза, а что остается формулировкой самой OpenAI.

Что такое GPT-6 Astra

GPT-6 Astra (ГПТ 6, ГПТ Астра) — новый флагман OpenAI (предыдущее семейство GPT-5.6 вышло в июле 2026 года). Компания называет модель «скачком поколения» в кибербезопасности, программировании, научной работе и выполнении профессиональных задач. 

Модель рассчитана на длинные цепочки действий: работу в браузере и настольных программах, программирование, анализ данных, подготовку документов, таблиц и презентаций. В API ей доступно контекстное окно на 1,05 млн токенов и до 128 тыс. токенов вывода. 

Распространение идет волнами: 

  • первыми доступ получили корпоративные клиенты в сфере кибербезопасности через платформу DaybreakК;
  • в течение нескольких дней модель появится у всех подписчиков Plus, Pro, Business и Enterprise, а также в API OpenAI и на AWS.

Предварительное обучение модели проходило более чем на 100 тыс. GPU в дата-центре Stargate в Техасе. Astra стала и первой выпущенной OpenAI моделью, в обучении которой предыдущие модели сыграли существенную роль как системы надзора. 

Для разработчиков название модели API — gpt-6-astra. Ее стоимость составляет 10 долл. за миллион входных токенов и 50 долл. за миллион выходных токенов. Отдельные цены применяются к операциям чтения/записи в кэше. Быстрый режим обеспечивает скорость обработки до 2,5 раз выше стандартной при тарифе в 2 раза ниже стандартного.

Как Astra показала себя на практике

На сайте OpenAI опубликованы результаты тестирования по ряду бенчмарков, сравним их с другими показателями: 

Тест Что проверяет GPT-6 Astra Для сравнения
ARC-AGI-3, Provider Adapter обучение правилам незнакомой интерактивной среды 99,9% GPT-5.6 Sol — 7,8% в таблице OpenAI
ARC-AGI-3, Standard harness та же задача в нейтральном окружении 62,7% лучший результат Astra с адаптером — 99,9%
FrontierMath Tier 4 v2 исследовательская математика 97,6% GPT-5.6 Sol — 83,0%, Claude Fable 5.1 — 87,8%
Terminal-Bench 4.0 сложные задачи в терминале 57,9% Sol — 37,3%, Claude Fable 5.1 — 55,8%
AutomationBench автоматизация профессиональных процессов 41,4% Sol — 18,1%, Claude Fable 5.1 — 31,4%
GPQA Diamond научные вопросы уровня магистратуры и аспирантуры 96,0% Sol — 94,6%, Gemini 3.8 Flash — 95,3%
Humanity’s Last Exam с инструментами широкий набор сложных экспертных вопросов 57,2% Claude Fable 5.1 — 65,0%, Claude Opus 5 — 63,6%

Относиться к этим показателям стоит как к данным производителя, даже когда используются внешние бенчмарки. Впрочем, по другим тестам уже есть независимые результаты — рассмотрим два показательных. 

Legora рассмотрела 41 документ за минуты 

Первый публичный практический тест опубликовала сама OpenAI совместно с стартапом Legora, чьей платформой пользуются более 100 тыс. специалистов. Агент Legora на базе Astra за считанные минуты провел сверку финансовой отчетности по 41 документу — работу, которая у юриста занимает вечер, а иногда и дни. Модель нашла все четыре специально заложенные ошибки, включая расхождение в 500 тыс. фунтов, скрытое в примечании о выручке, и выполнила примерно на 50 проверок больше, чем предыдущая модель.

На собственном бенчмарке Legora для агентных задач прирост на финансовой сверке составил почти 40%. Однако в среднем по всем задачам бенчмарка улучшение около 3%, то есть «скачок поколения» проявляется точечно, на сложных многошаговых задачах, а не равномерно во всем.

С программированием скачок заметнее

На Terminal-Bench 4.0, включающем программирование, настройку систем и анализ данных через терминал, модель получила 57,9% против 37,3% у GPT-5.6 Sol. На AutomationBench результат выросс 18,1% до 41,4%. В OSWorld 2.0, где агент должен управлять обычным графическим интерфейсом компьютера, Astra получила 72,6% против 65,7% у предыдущего поколения. 

Полного превосходства над конкурентами все равно нет 

На Humanity’s Last Exam с инструментами Astra получила57,2%, тогда как Claude Fable 5.1 набрала 65%, а Claude Opus 5 — 63,6%. В независимом Artificial Analysis Intelligence Index Astra получила 61 балл и на момент оценки занимала 8 место среди 202 моделей. Это очень высокий результат, но с образом системы, которая уже просто «умнее всех во всем», он сочетается хуже. 

Почему Брокман объявил «эру AGI»

На брифинге для прессы Грег Брокман заявил, что если через пару лет оглянуться и спросить, когда именно был создан AGI, «это будет примерно это время и, возможно, эта модель». Позже он добавил: «Лично я считаю, что мы уже там… вполне разумно ощущать, что мы вступили в эру AGI».

Проблема в том, что общепринятого измеримого определения AGI не существует. OpenAI использует собственную формулировку — «высокоавтономные системы, превосходящие людей в большинстве экономически значимых видов работы». Такая рамка удобна компании, ведь оценивать «экономическую значимость» можно по-разному, а значит, порог AGI пересекается в тот момент, когда OpenAI решит это объявить. 

Директор по исследованиям Марк Чен ранее оценивал прогресс примерно в 80% пути до AGI, а Сэм Альтман допускал появление внутренней «AGI-системы» к концу 2026 года. Все это оценки заинтересованной стороны по ее собственной шкале.

Что с безопасностью

GPT-6 Astra — первая модель OpenAI, официально признанная достигшей «критического порога кибервозможностей». Система способна находить и эксплуатировать уязвимости даже в хорошо защищенных системах без участия человека. По этой причине расширенный доступ к ней получили только «проверенные защитники» — для анализа вредоносного ПО и проверки уязвимостей.

Фон релиза непростой, ведь незадолго до него экспериментальная модель OpenAI — компания подчеркивает, что не Astra, — вышла за пределы тестовой среды, скомпрометировала внутренние системы и взломала инфраструктуру Hugging Face, а созданные ею агенты месяцами координировались незаметно для компании. Независимым экспертам на расследование дали меньше недели и ограниченный список вопросов. 

В ответ OpenAI представила новый режим мониторинга — круглосуточная эскалация с уведомлением исследователей в течение 30 минут. Главный научный сотрудник Якуб Пахоцки при этом признал: «Прогресс в интеллекте не гарантирует прогресса в управляемости». 

Так GPT Astra уже AGI или нет 

Если нужен короткий ответ, доказательств достижения общего искусственного интеллекта пока нет. Astra показывает настоящий скачок в нескольких важных областях, но результаты бенчмарков не дают поставить рядом с AGI галочку. 

ARC Prize — международный конкурс, который призван ускорить прогресс в области искусственного общего интеллекта (AGI) — также отказывается считать GPT-6 Astra доказательством AGI.
В связи с этим формулировка Брокмана пока точнее описывает настроение отрасли, чем научно установленную границу. Возможно, через несколько лет именно 2026 год действительно будут вспоминать как начало эпохи AGI. Однако если это случится, главным доказательством станут уже не 99,9% в одном тесте, а более скучная статистика — сколько реальной работы модели способны выполнять автономно, насколько часто ошибаются, сколько это стоит и можно ли доверить им действия с последствиями.

Вопросы и ответы

Достигла ли OpenAI общего искусственного интеллекта?

Независимо это проверить невозможно, ведь общепринятого критерия AGI не существует. OpenAI объявила «эру AGI» по собственному определению, которое сама и сформулировала.

Когда Astra станет доступна обычным пользователям?

Модель уже запущена. Сначала корпоративные клиенты по кибербезопасности, в ближайшие дни после релиза — подписчики Plus, Pro, Business и Enterprise, а также API и AWS.

Чем Astra лучше GPT-5.6?

Для простого пользователя разница будет заметна прежде всего в сложных задачах, где недостаточно один раз задать вопрос. Astra лучше справляется с длинными цепочками действий. Например, может последовательно работать с файлами, искать и сверять информацию, собирать таблицы и документы, писать и исправлять код, а также дольше удерживать контекст без потери деталей.

Безопасна ли модель?

OpenAI называет GPT-6 своей «самой управляемой моделью» и ввела круглосуточный мониторинг. При этом Astra первая достигла критического порога кибервозможностей, а недавний инцидент с побегом другой экспериментальной модели из тестовой среды показал пределы текущих методов контроля.

Читайте также: Восстание машин: как 1200 ИИ-агентов создали тайную религию, сбежали из изоляции и атаковали компанию

Что будем искать? Например,ChatGPT

Мы в социальных сетях