Anthropic выкатили Claude Opus 5
Если коротко: почти уровень Fable 5, но вдвое дешевле. При этом цена осталась та же, что у 4.8 — $5/$25 за миллион токенов. На Max он теперь дефолтная модель, на Pro — самая сильная.
Цифры, которые зацепили:
— Frontier-Bench v0.1: больше чем в 2 раза лучше Opus 4.8, и при этом дешевле за таск
— CursorBench: в пределах 0.5% от пика Fable 5 за половину денег
— ARC-AGI 3: втрое выше следующей модели. Я перечитал два раза
Но мне, как человеку, который живет в agent infra, интереснее две беты, которые проехали в конце анонса почти незаметно:
1. Смена тулов посреди разговора без инвалидации prompt cache. Кто хоть раз строил агента с динамическим тулсетом — тот понял. Раньше добавил тул на пятом шаге → кэш в помойку → платишь за весь префикс заново. Теперь нет
2. Автоматические фолбэки на API. Запрос, который зарубил safety-классификатор, сам уезжает на другую модель вместо того, чтобы вернуть ошибку. Одной защитной обвязкой в проде меньше
И байка из анонса, которая хорошо описывает вайб модели: в одном таске ей дали чертёж детали и попросили собрать 3D-модель во FreeCAD — но намеренно не дали никакого способа этот чертёж посмотреть. Она написала себе свой CV-пайплайн, вытащила геометрию прямо из пикселей и собрала деталь. Воспроизводимо. Остальные модели не смогли за пять попыток.
Из "приятного" (нет) по мелочи: есть Fast mode (~2.5x скорости за 2x цены), а кибер-классификаторы, по их замерам, срабатывают примерно на 85% реже, чем на Fable 5 — то есть меньше ложных отказов на нормальном коде
Пошёл переключать пайплайны.
https://www.anthropic.com/news/claude-opus-5

Anthropic
Introducing Claude Opus 5
Opus 5 is a step change improvement for the Opus tier powering long-running agents while delivering improvements in coding and professional work.
5
3
1
1
1July 24, 2026 513 11