Claude Opus 5: обзор новой нейросети Anthropic — что умеет, сколько стоит и стоит ли переходить
Anthropic выпустили Opus 5 — нейросеть, которая почти догоняет флагманский Fable 5 по интеллекту, но стоит вдвое дешевле и даёт фору GPT. Разбираемся, что нового и кому это нужно.
📋 Содержание
Что такое Claude Opus 5
Claude Opus 5 — это новая нейросеть от Anthropic, которая стала доступна 24 июля 2026 года. В мире искусственного интеллекта это событие сравнимо с выходом новой версии GPT — каждая итерация Opus задаёт планку качества. По заявлению компании, модель приближается к интеллекту флагманского Claude Fable 5, но стоит вдвое дешевле.
Opus 5 — это не просто инкрементальное улучшение. Это результат работы Anthropic над эффективностью: нейросеть показывает радикально лучшие результаты при тех же затратах, что и предшественник Opus 4.8, а по ряду тестов обходит GPT.
«Claude Opus 5 — это вдумчивая и проактивная модель, которая приближается к frontier-интеллекту Claude Fable 5 за половину цены.» — Anthropic
Модель уже стала новой «заводской» нейросетью на Claude Max и самой сильной на Claude Pro. Для пользователей это означает, что они получают почти флагманское качество искусственного интеллекта по цене средней модели.
Производительность и тесты
Opus 5 показывает впечатляющие результаты на всех ключевых бенчмарках. Вот основные цифры:
🧠 Frontier-Bench v0.1
Opus 5 превосходит все остальные модели и более чем вдвое превосходит Opus 4.8 при меньшей стоимости за задачу.
⚙️ CursorBench 3.2
На максимальном усилии модель показывает результат в пределах 0.5% от Fable 5, но при вдвое меньшей цене за задачу.
🧩 ARC-AGI 3
Тест на решение новых, нестандартных задач — Opus 5 набирает втрое больше баллов, чем следующая лучшая модель.
🤖 Zapier AutomationBench
Бизнес-задачи «от начала до конца»: проходимость Opus 5 примерно в 1.5 раза выше следующей лучшей модели при той же стоимости.
💻 OSWorld 2.0
Бенчмарк компьютерного использования — Opus 5 превосходит Fable 5 чуть более чем за треть стоимости.
Кодинг и разработка
Одна из сильнейших сторон Opus 5 — программная инженерия. Вот что показали тесты и реальные кейсы:
- FrontierCode 1.1 — Opus 5 приближается к Fable 5 за половину цены. В Devin модель особенно сильна в отладке сложных багов.
- Cursor — по тестам CursorBench модель лишь чуть-чуть уступает Fable 5, но ведёт себя так же. Разработчики Cursor отметили, что модель демонстрирует те же полезные паттерны поведения.
- Реальный кейс: инженер из трейдинговой фирмы за одну сессию построил Opus 5 фид рыночных данных для новой биржи. Предыдущие модели не могли выполнить эту задачу даже с детальным планом. Более того — не найдя живого фида для валидации, модель сама написала тестовый стенд.
Ещё один впечатляющий пример: на Frontier-Bench модели дали чертёж детали и попросили написать код для её 3D-реконструкции в FreeCAD. Проблема в том, что доступ к изображению был намеренно заблокирован. Opus 5 написал собственный пайплайн компьютерного зрения — вытащил геометрию из «сырых» пикселей и успешно восстановил деталь. Ни одна другая модель не справилась за 5 попыток.
Научные исследования
Opus 5 показывает значительное улучшение в научных задачах по сравнению с Opus 4.8. Особенно заметен прогресс в:
- Органической химии — вывод молекулярных структур из спектроскопических данных: +10.2% к Opus 4.8
- Биоинформатике — предсказание влияния вариаций в последовательности белка на его функции: +7.7%
- Геномике — один из пользователей отметил, что «Opus 5 ведёт себя как аккуратный учёный»: сам подбирает статистические тесты, перепроверяет результаты независимыми методами и не теряет нить длинных многошаговых анализов.
Агентность и автономность
Ключевое отличие Opus 5 от предшественников — способность проверять свою работу и итеративно улучшать результат. Anthropic называют это «agency and thoroughness».
Вот что говорят партнёры Anthropic из early-доступа:
«За выходные я дал Opus 5 роль начальника штаба над моими dev-средами. Он сам построил мониторинг, управлял каждой машиной и привлекал меня только для принятия решений.»
«На нашей геномной аналитике Claude Opus 5 ведёт себя更像 careful scientist, чем любая модель, которую мы запускали.»
Особенно интересен кейс с Zapier: модель получила «сырую» таблицу со здоровьем аккаунтов и самостоятельно запустила полный сценарий предотвращения оттока — отметила рискованные аккаунты, оповестила ответственных и подготовила сводку для retention-команды. Предыдущие модели (включая GPT) не проходили этот тест вообще; Opus 5 — 100%. Безопасность данных при такой автономности — отдельная тема, и Anthropic уделили ей особое внимание в новой версии.
Цена и доступность
Claude Opus 5 доступен с 24 июля 2026 года на всех платформах Anthropic:
- Claude Max — модель по умолчанию
- Claude Pro — самая сильная доступная модель
- API Anthropic — для разработчиков
Точные цены на API зависят от режима (effort setting), который можно настраивать: от «экономного» для простых задач до «максимального» для сложной работы. Anthropic позиционирует Opus 5 как нейросеть, которая даёт лучший результат за свои деньги — на Frontier-Bench, например, она более чем вдвое превосходит Opus 4.8 при той же стоимости задачи и обходит GPT по соотношению цена/качество.
💰 Что это значит для пользователя
Opus 5 стоит столько же, сколько Opus 4.8, но делает гораздо больше. По сути, Anthropic дали «апгрейд» бесплатно. Если вы пользовались Opus 4.8 — вы получаете заметно более умную модель по той же цене.
Opus 5 vs Opus 4.8 vs Fable 5: таблица сравнения
| Характеристика | Opus 4.8 | Opus 5 | Fable 5 |
|---|---|---|---|
| Frontier-Bench | базовый уровень | в 2× лучше | — |
| CursorBench 3.2 (max effort) | — | в 0.5% от Fable 5 | 100% |
| ARC-AGI 3 | — | в 3× лучше следующей модели | — |
| Zapier AutomationBench | не проходил | 100% pass rate | — |
| OSWorld 2.0 (computer use) | — | превосходит Fable 5 за ⅓ цены | базовый уровень |
| Органическая химия | базовый уровень | +10.2% к Opus 4.8 | — |
| Цена | та же | та же цена | в 2× дороже |
Итог: стоит ли обновляться?
Однозначно да. Если вы используете Claude (или думаете начать) — Opus 5 это, вероятно, лучшая модель по соотношению цена/качество на рынке прямо сейчас.
Вот кому точно стоит обратить внимание:
- Разработчикам — отладка, написание кода, ревью, архитектура. Эта нейросеть находит коренные причины багов, которые другие модели (включая GPT) пропускают. При этом безопасность кода — на высоте.
- Аналитикам и финансистам — работа с таблицами, численные расчёты, due diligence. Box отметил +17% в задачах комплексной проверки.
- Учёным и исследователям — химия, биоинформатика, анализ данных. Opus 5 ведёт себя как полноценный ассистент-исследователь.
- Всем, кто строит AI-агентов — автономность нейросети позволяет ей работать без постоянного присмотра, а встроенные механизмы безопасности снижают риски.
Если коротко: Opus 5 — это «Fable 5 для бедных», но без кавычек. Вы получаете 95% возможностей флагмана за 50% цены.
Единственный сценарий, где стоит доплатить до Fable 5 — если вы работаете на переднем крае безопасности искусственного интеллекта (там Mythos 5 всё ещё впереди) или вам нужен максимальный интеллект без компромиссов.
Во всех остальных случаях — нейросеть Opus 5 это тот выбор, который не нужно оправдывать.