Рынок

OpenAI открыла ограниченный доступ к GPT-6 Astra

3 сентября OpenAI выпустила новую флагманскую ИИ-модель GPT-6 Astra. Компания начала развертывание для ограниченного круга организаций в рамках программы

7 мин чтенияИсточник: ForkLog
OpenAI открыла ограниченный доступ к GPT-6 Astra
TelegramВКонтактеWhatsApp

3 сентября OpenAI выпустила новую флагманскую ИИ-модель GPT-6 Astra. Компания начала развертывание для ограниченного круга организаций в рамках программы Trusted Access и в ближайшие дни откроет доступ для пользователей ChatGPT Plus, Pro, Business и Enterprise, а также в OpenAI API и Amazon Bedrock.

This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw

Microsoft начала предоставлять модель через программу ограниченного доступа Microsoft Foundry в Azure. Доступ для участвующих клиентов расширят в скором времени.

По данным OpenAI, Astra превосходит GPT-5.6 Sol во многих представленных компанией тестах на работу с компьютером, программирование, научные задачи и кибербезопасность. При этом в некоторых бенчмарках модели Anthropic показывают более высокие результаты.

В OpenAI уточнили, что в сравнительных таблицах приводят максимальные результаты при любом уровне вычислительных усилий. Тесты моделей GPT проводились в исследовательской среде или через API, поэтому показатели доступных пользователям версий могут отличаться.

Расширенные возможности

Согласно релизу, GPT-6 Astra способна самостоятельно работать с браузером и приложениями: заполнять формы, обновлять записи в CRM, искать информацию, редактировать документы, анализировать данные и тестировать программное обеспечение.

На офлайн-подмножестве OSWorld 2.0 с частичной оценкой, которое проверяет выполнение задач в графическом интерфейсе, Astra набрала 72,6% против 65,7% у GPT-5.6 Sol. В моделировании задержки OpenAI Astra выполняла такие задания примерно на 47% быстрее: около 40 минут на задачу против 75 минут у GPT-5.6 Sol.

На Agents’ Last Exam, где ИИ решает сложные профессиональные задачи в реальных программах, результат составил 59,3%. GPT-5.6 Sol получил 53,6%, Claude Opus 5 — 55,5%.

В ScreenSpot-Pro, оценивающем понимание элементов компьютерного интерфейса, Astra показала 92,7% против 76,9% у GPT-5.6 Sol.

OpenAI также представила экспериментальный механизм сохранения контекста в Codex. Astra может вести заметки между заполненными контекстными окнами и искать требования или результаты тестов в предыдущих сообщениях и результатах работы инструментов.

Сейчас функцию необходимо самостоятельно включить в config.toml . В ближайшие недели OpenAI планирует сделать ее стандартной для Astra.

Код, математика и наука

В Terminal-Bench 4.0 для агентного программирования GPT-6 Astra получила 57,9%. Для сравнения, GPT-5.6 Sol набрала 37,3%, Claude Fable 5.1 — 55,8%.

На FrontierCode 1.1 Extended новая модель достигла 64,5%, на научном Terminal-Bench Science 0.1 — 64,6% против 22,4% у GPT-5.6 Sol и 52,6% у Claude Fable 5.1.

В FrontierMath Tier 4 модель набрала 97,6%. По заявлению разработчиков, Astra помогла улучшить два результата в теории простых чисел: в первом случае снизила верхнюю границу промежутка между бесконечным числом пар простых чисел с 240 до 186, во втором —изменила один из членов оценки больших промежутков между простыми числами, остававшийся неизменным более 80 лет.

В Humanity’s Last Exam с инструментами Astra получила 57,2%, уступив Claude Fable 5.1 с 65%.

Критический уровень кибервозможностей

GPT-6 Astra стала первой моделью OpenAI , достигшей уровня Critical по кибервозможностям в рамках Preparedness Framework . Без продакшн-ограничений она получила 100% на ExploitBench против 78,5% у GPT-5.6 Sol. На ExploitGym результаты составили 42,4% и 30,3% соответственно.

На внутреннем наборе ExploitBench (июнь–август 2026) из 20 недавно раскрытых уязвимостей высокой степени опасности в V8, охватывающем 13 стабильных версий Chrome, Astra добилась выполнения произвольного кода в 39% случаев. GPT-5.6 Sol показала 11,5%.

В экспертных испытаниях Astra без продакшн-защиты использовала неизвестные уязвимости для выполнения произвольного кода в защищенных браузерах и создавала эксплойты для повышения привилегий в защищенных операционных системах.

«Способность Astra выявлять и разрабатывать эксплойты для zero-day может помочь находить и устранять слабые места, но одновременно требует более строгих мер безопасности», — отметили в компании.

В выпущенной версии действуют дополнительные ограничения. Astra будет отказываться от продвинутых киберзадач, включая создание proof-of-concept-эксплойтов . Более широкий доступ для защитных сценариев компания намерена постепенно предоставлять через OpenAI Daybreak.

Разработчики также внедрили дополнительный мониторинг рассуждений и действий модели. Система классификаторов должна выявлять потенциально несанкционированное поведение и автоматически останавливать соответствующие действия.

OpenAI признала, что письменная цепочка рассуждений Astra хуже поддается мониторингу, чем у GPT-5.6 Sol. Этот вывод основан преимущественно на состязательных тестах, в которых модель прямо побуждали уклоняться от наблюдения.

Компания связывает результат со способностью Astra лучше управлять письменными рассуждениями в простых задачах и решать их за меньшее число текстовых шагов. На сложных заданиях модель, по оценке разработчика, пока испытывает трудности при попытке скрыть необходимые для решения рассуждения.

$1 млрд на киберзащиту

Одновременно с релизом Astra OpenAI объявила программу Daybreak for Frontline Defenders объемом $1 млрд. В эту сумму компания включила субсидируемый доступ к моделям и продуктам Daybreak, обучение, техническую поддержку и партнерские программы.

В первую очередь инициативу запустят в США для операторов водоснабжения и электросетей, властей штатов и муниципалитетов, региональных и местных банков, некоммерческих организаций и разработчиков открытого ПО с ограниченными ресурсами на кибербезопасность. В ближайшие недели программу планируют расширить на страны-партнеры.

«У защитников есть окно возможностей: оно сужается, и ИИ нужно использовать для устранения пробелов в безопасности раньше атакующих», — заявили в OpenAI.

Daybreak уже используют специалисты примерно из 2000 одобренных организаций и рабочих пространств. Daybreak Blue предназначен для стандартных защитных задач, а Daybreak Red предоставляет проверенным организациям доступ к специализированным кибермоделям для более чувствительных сценариев.

Пользователи ChatGPT Pro, Business и Enterprise также получат доступ к отдельной версии GPT-6 Astra Pro. Чем она отличается от базовой, в OpenAI не уточнили. Администраторы Enterprise должны самостоятельно включить Astra для своих рабочих пространств.

Для разработчиков модель появится в OpenAI API под идентификатором gpt-6-astra . Согласно документации , контекстное окно составляет 1,05 млн токенов, максимальный объем ответа — 128 000 токенов. Дата отсечения знаний — 30 апреля 2026 года.

Стандартная цена составляет $10 за 1 млн входных и $50 за 1 млн выходных токенов. Кешированный ввод стоит $1 за 1 млн токенов, запись в кеш — $12,5.

Для запросов объемом свыше 272 000 входных токенов тарифы на ввод и кеширование удваиваются, а стоимость вывода увеличивается в 1,5 раза для всего запроса. Ускоренный режим работает до двух раз быстрее стандартного и стоит вдвое дороже применимого тарифа.

Напомним, в августе OpenAI временно замедлила масштабирование новых ИИ-моделей и на две недели приостановила обучение с подкреплением новейших систем, предназначенных для последующего развертывания.

Подписывайтесь на ForkLog в социальных сетях

Поделиться новостью

TelegramВКонтактеWhatsApp
OpenAI открыла ограниченный доступ к GPT-6 Astra | Новости Aifory Pro