Claude Opus 4.7 от Anthropic превосходит GPT-5.4 в тесте на программирование
Опубликовано , автор Shalom Levytam
Компания Anthropic выпустила Claude Opus 4.7 — свою новейшую флагманскую модель, которая отличается заметными улучшениями в области продвинутой разработки программного обеспечения и поддержкой модернизированного зрения высокого разрешения. Выход новинки состоялся спустя два месяца после релиза Claude Sonnet 4.6. Новая модель опирается на этот фундамент, демонстрируя более высокую производительность при решении сложных и долгосрочных задач, которые ранее требовали более тщательного контроля.

Главной новостью здесь является разработка программного обеспечения. Данные бенчмарков показывают, что Opus 4.7 набрала 64,3% в тесте SWE-bench Pro, который измеряет способность ИИ исправлять реальные проблемы на GitHub. Это заметный скачок по сравнению с 53,4% у предыдущей версии 4.6, что ставит новинку выше модели GPT-5.4 от OpenAI, набравшей 57,7%. Для разработчиков на Mac модель отлично подходит для работы с Xcode 26.3 от Apple, в котором появилась поддержка автономных ИИ-агентов, способных выполнять более длинные многоэтапные рабочие процессы.
Визуальные возможности модели также претерпели значительные изменения. Теперь Opus 4.7 способна обрабатывать изображения с разрешением до 2576 пикселей по длинной стороне, что составляет примерно 3,75 мегапикселя. Это более чем в три раза превышает лимит разрешения предыдущих моделей Claude. Такой уровень детализации поддерживает такие сценарии использования, как управление компьютером на macOS, где ИИ-агенту необходимо точно считывать плотный текст с неизменных скриншотов или ориентироваться в сложных диаграммах и пользовательских интерфейсах.
Безопасность и защита остаются главным приоритетом после запуска инициативы Project Glasswing, которая подчеркивает как риски, так и преимущества использования ИИ-моделей в кибербезопасности. Opus 4.7 стала первой моделью в этом ряду, в которую встроены средства защиты, предназначенные для обнаружения и блокирования высокорисковых или запрещенных запросов, связанных с кибербезопасностью. Для легитимных исследователей безопасности Anthropic запускает программу проверки кибербезопасности (Cyber Verification Program), предоставляющую доступ для тестирования уязвимостей и имитации атак (red-teaming).
Кроме того, Anthropic предоставляет пользователям больше контроля над тем, как модель рассуждает. Новый уровень интенсивности «xhigh» был добавлен между настройками «high» и «max», позволяя точно настраивать баланс между глубиной рассуждений и задержкой. В среде рабочего стола Claude Code теперь можно использовать новую команду /ultrareview для выявления ошибок и недочетов проектирования, которые стандартный анализ кода может пропустить.
В модели также улучшены память и производительность при решении реальных задач. Opus 4.7 лучше использует память на базе файловой системы, что позволяет ей сохранять важный контекст в течение длительных многосессионных рабочих процессов. По заявлению Anthropic, она также демонстрирует более высокие результаты в тестах финансовой тематики и в более широких бенчмарках интеллектуального труда, выдавая более тщательный анализ и качественные результаты в сложных задачах.
Существует небольшой нюанс для тех, кто переходит с Opus 4.6. Эта новая версия использует более буквальный стиль следования инструкциям, а это значит, что промпты, написанные с расчетом на вольную интерпретацию, возможно, придется скорректировать. В ней также используется обновленный токенизатор, который улучшает обработку текста, но может увеличить расход токенов для некоторых входных данных примерно в 1,0–1,35 раза в зависимости от контента.
Claude Opus 4.7 доступна уже сегодня через API Claude, а также через облачные платформы Amazon Bedrock, Google Cloud Vertex AI и Microsoft Foundry. Цены остались на уровне предыдущей версии: 5 долларов за миллион входных токенов и 25 долларов за миллион выходных токенов.
