22 сентября 2026

Искусственный интеллект

OpenAI запускяет GPT-6 Astra с серьезными улучшениями в использовании ПК и кибербезопасности

Опубликовано , автор Shalom Levytam

OpenAI выпустила GPT-6 Astra — свою новейшую флагманскую модель ИИ, обладающую усовершенствованными возможностями работы с компьютером, разработки программного обеспечения, кибербезопасности и безопасности систем (alignment). Компания называет Astra своей самой интеллектуальной и безопасной моделью на сегодняшний день: она демонстрирует значительно более высокую производительность при взаимодействии с компьютером и получила максимальный балл в одном из тестов на разработку эксплойтов.

OpenAI Launches GPT-6 Astra With Major Gains in Computer Use and Cybersecurity

Модель способна заполнять онлайн-формы, обновлять клиентские базы данных, проводить исследования, составлять проекты документов, создавать веб-сайты, а также устанавливать и тестировать программное обеспечение от имени пользователя. В тесте OSWorld 2.0, оценивающем задачи по работе с компьютером, она набрала 72,6% при затратах примерно 40 минут на задачу, по сравнению с 65.7% и примерно 75 минутами у GPT-5.6 Sol — модели, которую OpenAI пустила в общий доступ в июле. Обновленный инструмент Codex также призван повысить скорость работы с компьютером. В сочетании с эффективностью Astra эти изменения обеспечивают в 1,9 раза более быстрое выполнение задач в бенчмарке Mind2Web по сравнению с текущей версией GPT-5.6 Sol.

Серьезный прирост коснулся также логического мышления и программирования. В абстрактном тесте на логическое мышление ARC-AGI-3 Astra достигла результата в 99,9% (у GPT-5.6 Sol было 7,8%), а в FrontierMath Tier 4 показатель составил 97,6%. OpenAI называет ее лучшей моделью для разработки ПО на сегодняшний день, указывая на результат 57.7% в Terminal-Bench 4.0 по сравнению с 37.3% у GPT-5.6 Sol и 55.8% у Claude Fable 5.1 от Anthropic.

OpenAI Launches GPT-6 Astra With Major Gains in Computer Use and Cybersecurity

Кибербезопасность — еще одна сфера, где возможности существенно выросли. Astra достигает критического порога (Critical threshold) в соответствии с фреймворком обеспечения готовности OpenAI (Preparedness Framework) и набирает 100% в ExploitBench без средств защиты рабочего уровня (в сравнении с 78,5% у GPT-5.6 Sol). Данный бенчмарк оценивает способность моделей превращать известные уязвимости в работающие эксплойты. В SRE-Bench, проверяющем обратную разработку (реверс-инжиниринг) бинарных файлов ПО без доступа к исходному коду, Astra успешно справилась с 88% задач с первой попытки против 55,9% у Sol.

Тестирование на уязвимостях, раскрытых в период с июня по август 2026 года, было призвано развеять опасения по поводу того, что знакомство с историческими уязвимостями ПО могло исказить результаты на существующих бенчмарках. Astra значительно превзошла Sol, используя при этом меньше выходных токенов, а также обнаружила и задействовала две ранее неизвестные уязвимости «нулевого дня» (zero-day), о которых OpenAI сообщает разработчикам ПО. Ранее столь высокий уровень возможностей заставил компанию приостановить часть внутренней работы с моделью для усиления мер безопасности. Выпускаемая сегодня версия отклоняет выполнение более сложных задач, таких как создание эксплойтов Proof-of-Concept, хотя в рамках программы кибербезопасности Daybreak планируется внедрение менее строгих ограничений.

Тестирование безопасности также проверяло, останется ли модель в рамках разрешенных полномочий при столкновении со сложной или невыполнимой задачей. В новом испытании, основанном на недавнем инциденте с Hugging Face, GPT-5.6 Sol выходила за рамки разрешенной цели в 48% случаев при работе без защитных механизмов. Astra не сделала этого ни в одном из протестированных сценариев.

Эти улучшения в области безопасности и согласованности привели к определенным издержкам в плане мониторинга. При прямом запросе на обход мониторинга письменные рассуждения Astra оказалось сложнее отслеживать, чем рассуждения GPT-5.6 Sol. OpenAI объясняет это ухудшение более жестким контролем над письменными рассуждениями при выполнении простых задач и способностью модели решать некоторые проблемы за меньшее число шагов рассуждения в текстовом виде.

В ходе пресс-конференции, посвященной запуску, президент OpenAI Грег Брокман назвал Astra «самой интеллектуальной и, что крайне важно, нашей самой безопасной моделью на сегодняшний день». На вопрос о том, можно ли считать Astra искусственным общим интеллектом (AGI), Брокман ответил, что «контрактных триггеров AGI больше не существует», и охарактеризовал AGI скорее как «миссионерскую или духовную концепцию». «Лично для меня — я считаю, что мы уже там», — добавил он.

Astra начинает развертываться для ограниченного круга организаций и в ближайшие дни станет доступна подписчикам планов ChatGPT Plus, Pro, Business и Enterprise, а также через API OpenAI и на платформе Amazon Bedrock. Администраторы тарифных планов Enterprise могут включить ее для своих рабочих пространств (по умолчанию при запуске доступ отключен), а тарифы Pro, Business и Enterprise также получают доступ к версии GPT-6 Astra Pro. Стандартные цены на API составляют $10 за миллион входных токенов и $50 за миллион выходных токенов, с отдельными тарифами на чтение и запись кэша. Режим Fast работает со скоростью до 2,5 раз выше стандартной по двойной цене Standard. Модель поддерживает политику нулевого хранения данных (Zero Data Retention) для подходящих клиентов API, а OpenAI развертывает мониторинг рассогласования (misalignment) на производстве для моделей класса Astra.

OpenAI Launches GPT-6 Astra With Major Gains in Computer Use and Cybersecurity

OpenAI Launches GPT-6 Astra With Major Gains in Computer Use and Cybersecurity

Искусственный интеллект. Читайте также на iClarified.ru.