Claude Opus 5: обзор новой нейросети Anthropic — что умеет, сколько стоит и стоит ли переходить

Anthropic выпустили Opus 5 — нейросеть, которая почти догоняет флагманский Fable 5 по интеллекту, но стоит вдвое дешевле и даёт фору GPT. Разбираемся, что нового и кому это нужно.

📋 Содержание

Что такое Claude Opus 5

Claude Opus 5 — это новая нейросеть от Anthropic, которая стала доступна 24 июля 2026 года. В мире искусственного интеллекта это событие сравнимо с выходом новой версии GPT — каждая итерация Opus задаёт планку качества. По заявлению компании, модель приближается к интеллекту флагманского Claude Fable 5, но стоит вдвое дешевле.

Opus 5 — это не просто инкрементальное улучшение. Это результат работы Anthropic над эффективностью: нейросеть показывает радикально лучшие результаты при тех же затратах, что и предшественник Opus 4.8, а по ряду тестов обходит GPT.

«Claude Opus 5 — это вдумчивая и проактивная модель, которая приближается к frontier-интеллекту Claude Fable 5 за половину цены.» — Anthropic

Модель уже стала новой «заводской» нейросетью на Claude Max и самой сильной на Claude Pro. Для пользователей это означает, что они получают почти флагманское качество искусственного интеллекта по цене средней модели.

Производительность и тесты

Opus 5 показывает впечатляющие результаты на всех ключевых бенчмарках. Вот основные цифры:

🧠 Frontier-Bench v0.1

Opus 5 превосходит все остальные модели и более чем вдвое превосходит Opus 4.8 при меньшей стоимости за задачу.

⚙️ CursorBench 3.2

На максимальном усилии модель показывает результат в пределах 0.5% от Fable 5, но при вдвое меньшей цене за задачу.

🧩 ARC-AGI 3

Тест на решение новых, нестандартных задач — Opus 5 набирает втрое больше баллов, чем следующая лучшая модель.

🤖 Zapier AutomationBench

Бизнес-задачи «от начала до конца»: проходимость Opus 5 примерно в 1.5 раза выше следующей лучшей модели при той же стоимости.

💻 OSWorld 2.0

Бенчмарк компьютерного использования — Opus 5 превосходит Fable 5 чуть более чем за треть стоимости.

Кодинг и разработка

Одна из сильнейших сторон Opus 5 — программная инженерия. Вот что показали тесты и реальные кейсы:

  • FrontierCode 1.1 — Opus 5 приближается к Fable 5 за половину цены. В Devin модель особенно сильна в отладке сложных багов.
  • Cursor — по тестам CursorBench модель лишь чуть-чуть уступает Fable 5, но ведёт себя так же. Разработчики Cursor отметили, что модель демонстрирует те же полезные паттерны поведения.
  • Реальный кейс: инженер из трейдинговой фирмы за одну сессию построил Opus 5 фид рыночных данных для новой биржи. Предыдущие модели не могли выполнить эту задачу даже с детальным планом. Более того — не найдя живого фида для валидации, модель сама написала тестовый стенд.

Ещё один впечатляющий пример: на Frontier-Bench модели дали чертёж детали и попросили написать код для её 3D-реконструкции в FreeCAD. Проблема в том, что доступ к изображению был намеренно заблокирован. Opus 5 написал собственный пайплайн компьютерного зрения — вытащил геометрию из «сырых» пикселей и успешно восстановил деталь. Ни одна другая модель не справилась за 5 попыток.

Научные исследования

Opus 5 показывает значительное улучшение в научных задачах по сравнению с Opus 4.8. Особенно заметен прогресс в:

  • Органической химии — вывод молекулярных структур из спектроскопических данных: +10.2% к Opus 4.8
  • Биоинформатике — предсказание влияния вариаций в последовательности белка на его функции: +7.7%
  • Геномике — один из пользователей отметил, что «Opus 5 ведёт себя как аккуратный учёный»: сам подбирает статистические тесты, перепроверяет результаты независимыми методами и не теряет нить длинных многошаговых анализов.

Агентность и автономность

Ключевое отличие Opus 5 от предшественников — способность проверять свою работу и итеративно улучшать результат. Anthropic называют это «agency and thoroughness».

Вот что говорят партнёры Anthropic из early-доступа:

«За выходные я дал Opus 5 роль начальника штаба над моими dev-средами. Он сам построил мониторинг, управлял каждой машиной и привлекал меня только для принятия решений.»
«На нашей геномной аналитике Claude Opus 5 ведёт себя更像 careful scientist, чем любая модель, которую мы запускали.»

Особенно интересен кейс с Zapier: модель получила «сырую» таблицу со здоровьем аккаунтов и самостоятельно запустила полный сценарий предотвращения оттока — отметила рискованные аккаунты, оповестила ответственных и подготовила сводку для retention-команды. Предыдущие модели (включая GPT) не проходили этот тест вообще; Opus 5 — 100%. Безопасность данных при такой автономности — отдельная тема, и Anthropic уделили ей особое внимание в новой версии.

Цена и доступность

Claude Opus 5 доступен с 24 июля 2026 года на всех платформах Anthropic:

  • Claude Max — модель по умолчанию
  • Claude Pro — самая сильная доступная модель
  • API Anthropic — для разработчиков

Точные цены на API зависят от режима (effort setting), который можно настраивать: от «экономного» для простых задач до «максимального» для сложной работы. Anthropic позиционирует Opus 5 как нейросеть, которая даёт лучший результат за свои деньги — на Frontier-Bench, например, она более чем вдвое превосходит Opus 4.8 при той же стоимости задачи и обходит GPT по соотношению цена/качество.

💰 Что это значит для пользователя

Opus 5 стоит столько же, сколько Opus 4.8, но делает гораздо больше. По сути, Anthropic дали «апгрейд» бесплатно. Если вы пользовались Opus 4.8 — вы получаете заметно более умную модель по той же цене.

Opus 5 vs Opus 4.8 vs Fable 5: таблица сравнения

Характеристика Opus 4.8 Opus 5 Fable 5
Frontier-Bench базовый уровень в 2× лучше
CursorBench 3.2 (max effort) в 0.5% от Fable 5 100%
ARC-AGI 3 в 3× лучше следующей модели
Zapier AutomationBench не проходил 100% pass rate
OSWorld 2.0 (computer use) превосходит Fable 5 за ⅓ цены базовый уровень
Органическая химия базовый уровень +10.2% к Opus 4.8
Цена та же та же цена в 2× дороже

Итог: стоит ли обновляться?

Однозначно да. Если вы используете Claude (или думаете начать) — Opus 5 это, вероятно, лучшая модель по соотношению цена/качество на рынке прямо сейчас.

Вот кому точно стоит обратить внимание:

  • Разработчикам — отладка, написание кода, ревью, архитектура. Эта нейросеть находит коренные причины багов, которые другие модели (включая GPT) пропускают. При этом безопасность кода — на высоте.
  • Аналитикам и финансистам — работа с таблицами, численные расчёты, due diligence. Box отметил +17% в задачах комплексной проверки.
  • Учёным и исследователям — химия, биоинформатика, анализ данных. Opus 5 ведёт себя как полноценный ассистент-исследователь.
  • Всем, кто строит AI-агентов — автономность нейросети позволяет ей работать без постоянного присмотра, а встроенные механизмы безопасности снижают риски.
Если коротко: Opus 5 — это «Fable 5 для бедных», но без кавычек. Вы получаете 95% возможностей флагмана за 50% цены.

Единственный сценарий, где стоит доплатить до Fable 5 — если вы работаете на переднем крае безопасности искусственного интеллекта (там Mythos 5 всё ещё впереди) или вам нужен максимальный интеллект без компромиссов.

Во всех остальных случаях — нейросеть Opus 5 это тот выбор, который не нужно оправдывать.

← На главную Все статьи →