Logo
Decide better.Live better.
Logo
Decide better.Live better.

Anthropic выпустила Claude Opus 5. Вот когда вам стоит переключиться на новую модель. Модель обеспечивает интеллект флагмана при стоимости в два раза ниже

Вы можете использовать Claude Opus 5 как основной рабочий инструмент для сложных задач. Она предлагает высокую точность при значительно меньших затратах, позволяя компаниям автоматизировать процессы без раздутого бюджета.

banner

24 июля 2026 года компания Anthropic выпустила Claude Opus 5. По заявлению разработчика, модель приближается к уровню интеллектуальных возможностей Claude Fable 5, но при этом рассчитана на более экономичное использование. Релиз показывает, что рынок ИИ все больше оценивает не только максимальную мощность моделей, но и стоимость их ежедневной работы.

Для вас это означает более доступный инструмент для сложных задач: анализа документов, программирования и автоматизации рабочих процессов. Opus 5 можно рассматривать как основной рабочий вариант там, где нужна высокая точность, но не требуется самая длительная автономная работа.

1. Что изменилось в производительности и цене

Anthropic указывает базовую цену $5 за 1 млн входных токенов и $25 за 1 млн выходных токенов. Токены являются условными единицами, из которых модель собирает и обрабатывает текст. Цена совпадает со ставкой для Opus 4.8, но компания заявляет о более высокой эффективности Opus 5 в ряде задач.

Модель доступна с даты публикации на платформах Anthropic, включая Claude API, Claude Pro и Claude Max. Также заявлена поддержка Amazon Bedrock. Конкретные условия подписок, лимиты и доступность отдельных функций зависят от соответствующей платформы.

Основные заявленные результаты выглядят так:

  • На Frontier-Bench v0.1, тесте агентного программирования, Opus 5 набрала 43,3% против 18,7% у Opus 4.8 и 33,7% у Fable 5.
  • В ARC-AGI 3, тесте на решение новых задач, результат Opus 5 оказался, по данным Anthropic, в три раза выше, чем у следующей модели.
  • Anthropic также сообщает о высокой эффективности Opus 5 при использовании компьютера, однако итоговое сравнение стоимости зависит от настроек теста и конкретной задачи.

2. Где экономия заметна в работе

Главная идея запуска проста: для многих рабочих задач важен не рекордный результат в лабораторном тесте, а стоимость успешно выполненной операции. Если модель решает задачу с меньшим числом обращений и требует меньше ручной проверки, бизнес может автоматизировать больше процессов без пропорционального роста расходов.

Компания Harvey сообщила, что Opus 5 показала сопоставимый результат с максимальным режимом рассуждений Opus 4.8, создав в среднем на 26% меньше токенов. В задачах финансового моделирования, по данным Fundamental Research Lab, точность выросла на 9 процентных пунктов, а время работы сократилось на 60%.

Для пользователя это особенно важно в трех ситуациях:

  1. Проверка собственной работы. Anthropic описывает случаи, когда модель сама создавала дополнительные инструменты для проверки результата. Например, в одном тесте она написала компьютерное зрение, чтобы восстановить 3D-деталь по исходным пикселям.
  2. Сложное программирование. Opus 5 предназначена для отладки, поиска первопричин ошибок и других задач, где простой сгенерированный ответ часто требует нескольких циклов исправлений.
  3. Настройка затрат. Режим effort позволяет выбирать баланс между глубиной обработки, скоростью и расходом токенов. Для быстрых операций можно использовать меньшую глубину, а для сложных задач оставлять более тщательную обработку.

Кроме того, Anthropic заявляет режим Fast, который работает примерно в 2,5 раза быстрее стандартного и стоит в два раза дороже базового режима. Это может быть полезно, когда задержка ответа важнее минимальной цены отдельного запроса.

3. Какие есть ограничения и меры безопасности

Anthropic сообщает, что Opus 5 получила оценку 2,3 по внутренней метрике несогласованного поведения. По утверждению компании, этот показатель ниже, чем у Opus 4.8, Sonnet 5 и Fable 5. Это не универсальная оценка безопасности, а результат конкретного внутреннего аудита, поэтому его стоит воспринимать вместе с другими проверками.

Разработчики также заявляют, что не обучали Opus 5 специально на киберзадачах. Несмотря на это, модель находила уязвимости в 79,4% случаев в тесте OSS-Fuzz. Anthropic подчеркивает, что способность обнаружить уязвимость и способность использовать ее на практике не одно и то же.

Для рискованных запросов применяются классификаторы безопасности. В Claude.ai, Claude Code и Claude Cowork система может переключить запрос на Opus 4.8 и показать пользователю уведомление. Это снижает доступный уровень возможностей, но не означает, что любой потенциально опасный запрос автоматически становится безопасным.

4. Как понять, подходит ли Opus 5 именно вам

Начните с ограниченного теста на собственных задачах. Сравните не только качество ответа, но и число исправлений, количество обращений к инструментам, время работы и итоговую стоимость. Такой подход полезнее, чем выбор модели по одному публичному бенчмарку.

Opus 5 логично проверить на задачах, которые требуют глубокого анализа, программирования или последовательной работы с документами, но укладываются в один рабочий сеанс. Для автономных проектов, которые должны сохранять связность в течение нескольких часов или дней, Anthropic по-прежнему позиционирует Fable 5 как более подходящий вариант.

Если вы используете Claude в автоматизации или разработке, начните с повторяемого процесса и заранее задайте критерии успеха. Так вы поймете, дает ли экономия токенов реальное сокращение затрат на проверку и доработку. В этом и состоит практическая ценность Opus 5: не просто получить сильный ответ, а сделать сложную работу доступнее для ежедневного использования. Подробнее: Prentis запускает ИИ для работы за компьютером: как это сократит ваши рутинные задачи.

Лента