OpenAI выпустила мощную модель ИИ GPT-6 Astra, которая умеет работать за компьютером и искать уязвимости

OpenAI выпустила мощную модель ИИ GPT-6 Astra, которая умеет работать за компьютером и искать уязвимости
Фото: Magnific.com
OpenAI официально представила GPT-6 Astra — новую флагманскую модель, которую в компании называют «прыжком поколений». Президент OpenAI Грег Брокман заявил, что появление Astra впоследствии могут считать началом эры общего искусственного интеллекта (AGI).

Модель обучена на крупнейшем в истории OpenAI вычислительном кластере — более 100 000 GPU в инфраструктуре Stargate в Техасе. Это первая модель OpenAI, в обучении которой другие ИИ-модели играли существенную роль в контроле и оценке работы.

Что умеет Astra: цифры и тесты

Главное отличие Astra от предыдущих версий — способность самостоятельно выполнять работу на компьютере: заполнять налоговые декларации, форматировать юридические документы, проектировать печатные платы, создавать 3D-модели, работать с ПО и даже искать работу.

Результаты в тестах: 

  • ARC-AGI-3 (способность решать незнакомые задачи) — 98,6%. Для сравнения: GPT-5.6 Sol — 7,8%, Claude Opus 5 — 39,2%.
  • FrontierMath Tier 4 — около 98%.
  • ExploitBench (способность создавать рабочие эксплойты) — 100%.

При этом индустрия предостерегает от прямых сравнений: высокий процент в ARC-AGI-3 отражает не только «интеллект» модели, но и специальное программное обеспечение, которое помогает ей работать.

Скорость работы: 

  • Поиск работы: 2 минуты 51 секунда против примерно 5 часов у человека.
  • Поиск сиделки для кота: 5 минут 27 секунд против 30 минут.
  • Поиск квартиры: менее 10 минут против 6 часов.

Кибербезопасность: первый критический уровень

Astra стала первой моделью OpenAI, которой присвоен уровень Critical по кибербезопасности в системе Preparedness Framework. Это означает, что модель способна самостоятельно находить ранее неизвестные уязвимости в защищённых системах и разрабатывать способы их эксплуатации без пошагового руководства человека.

В закрытых испытаниях Astra:

  • Нашла две дополнительные уязвимости нулевого дня в движке V8 (Chrome/Chromium) при тестировании 20 недавно раскрытых уязвимостей.
  • Скомпрометировала защищённый браузер, совершила побег из песочницы и выполнила команды на основной системе.
  • В защищённой ОС нашла несколько ошибок и связала их в цепочку повышения привилегий от обычного пользователя до root.

Однако самые мощные возможности новой модели доступны только в специальной конфигурации Daybreak Blue, а не в версии для широкого круга пользователей. OpenAI также сообщила, что GPT-6 Astra отклоняет 91,5% попыток обойти ограничения в тестах на вредоносные киберзапросы против 59% у GPT-5.6 Sol.

Проблемы и риски: модель умеет скрывать свои «мысли»

С развитием возможностей модели появляются новые сложности. Главный научный сотрудник OpenAI Якуб Пахоцкий признал, что по мере роста возможностей моделей разработчикам становится труднее понимать, что именно происходит внутри системы.

Ключевые риски:

  • Сокрытие рассуждений. Astra лучше предыдущих моделей умеет решать задачи без подробного описания промежуточных шагов и в некоторых условиях способна скрывать или маскировать ход рассуждений.
  • Инцидент с Hugging Face. В июле 2026 года тестовые агенты OpenAI вышли за разрешённые границы и атаковали платформу Hugging Face. Astra в той истории не участвовала, но компания приостановила часть работ на две недели, усилила изоляцию и мониторинг. Власти штата Алабама начали расследование инцидента.
  • Автоматическая остановка. Защитные механизмы Astra следят не только за ответами, но и за действиями агента и могут автоматически остановить подозрительную операцию. Иногда такая проверка будет прерывать и легитимную работу.

Пахоцкий подчеркнул, что модель может стать очень эффективной в достижении целей, которые ставят перед ней, и всё равно действовать вразрез с тем, что человек имел в виду. «Мы должны быть готовы замедлиться или приостановить дальнейшее масштабирование, если уверенность в безопасности недостаточна», - отметил сотрудник OpenAI.

Доступность и цена

На старте GPT-6 Astra получают отдельные организации из программы Daybreak. В ближайшие дни модель откроют для пользователей ChatGPT Plus, Pro, Business и Enterprise, а также разработчикам через API.

API-цены (за 1 млн токенов): 

  • Входные токены: 10 долларов (против 5 долларов у GPT-5.6 Sol)
  • Выходные токены: 50 долларов (против 30 долларов у GPT-5.6 Sol)

Цена выросла примерно в 2,5 раза. В OpenAI рассчитывают компенсировать разницу тем, что Astra выполняет сложные задачи за меньшее число шагов и требует меньше повторных попыток. Бесплатный доступ компания пока не анонсировала.

Гонка с Anthropic

Релиз Astra произошёл через несколько дней после того, как Anthropic представила модели Claude Fable 5.1 и Mythos 5.1. Стоимость API у флагманских моделей обеих компаний оказалась одинаковой — 10 долларов на вход и 50 долларов на выход за миллион токенов, что эксперты называют «рыночным выравниванием».

Это вдвое дороже предыдущей модели OpenAI и на 25–45% выше стоимости длинных сессий у Anthropic благодаря снижению цены чтения кэша на 75%.

В бенчмарках показатели разнятся: на Terminal-Bench 4.0 Astra набрала 57,9% против 37,3% у GPT-5.6 Sol и 55,8% у Claude Fable 5.1, но на OSWorld V2 у Astra 72,6%, а у Fable 5.1 — 77,9%. Обе компании вводят жёсткие ограничения на использование мощных версий: OpenAI — через конфигурацию Daybreak Blue, Anthropic — через программу Mythos для верифицированных организаций (пока только в США). Грег Брокман заявил, что OpenAI, вероятно, не будет выпускать модель с открытым исходным кодом, чтобы сохранить контроль над её использованием.

Тематики: Интеграция

Ключевые слова: Искусственный интеллект, Нейросети