Anthropic выпустила Claude Opus 5 24 июля 2026 года, через два месяца после Opus 4.8. Главный тезис, который большинство вынесло из релиза: передовой интеллект теперь стоит вдвое дешевле. В одном смысле это правда, в другом — вводит в заблуждение, и если перепутать эти смыслы, разница составит около ста процентов вашего бюджета.

Вот что вышло на самом деле, что говорят цифры и что с этим делать небольшому бизнесу.

Что именно выпустила Anthropic

Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных. У модели контекстное окно в 1 млн токенов, и это одновременно значение по умолчанию и максимум, плюс до 128 тыс. токенов на выходе. Согласно документации Anthropic, рассуждение теперь включено по умолчанию: модель сама решает, когда и насколько глубоко думать, а параметр effort со значениями low, medium, high, xhigh и max управляет этой глубиной.

Модель доступна через Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry. В потребительских продуктах она стала моделью по умолчанию в Claude Max и самой сильной из доступных в Claude Pro. Opus 4.8 остаётся там, где был.

Два менее заметных изменения весят больше, чем кажется. Минимальный размер промпта, который можно кешировать, снизился с 1024 до 512 токенов — короткие запросы, которые раньше не кешировались вообще, теперь кешируются без единой правки в коде. А пакетная обработка (batch) вдвое снижает обе ставки, до $2,50 и $12,50 за миллион токенов, для задач, которые могут подождать.

Историю с ценой читают неправильно

Вот на этом стоит остановиться.

Opus 5 стоит $5 за миллион входных токенов. Opus 4.8 стоил столько же — $5. В документации Anthropic прямо сказано, что цена не изменилась по сравнению с предыдущей моделью Opus. Этот релиз не сделал линейку Opus дешевле, чем она была в мае.

Формулировка «вдвое дешевле» — это сравнение с другой моделью. Claude Fable 5, вышедшая в июне, стоит $10 за миллион входных и $50 за миллион выходных токенов. То есть Opus 5 даёт близкие к Fable возможности за половину цены Fable. Это настоящее и весомое заявление. Но это не снижение цены, и если вы заложили в бюджет, что текущие расходы на Opus вот-вот сократятся вдвое, этого не произойдёт.

Практическая версия: ваш счёт уменьшится только в том случае, если вы раньше платили по ставкам Fable за работу, которую теперь потянет Opus 5, либо если начнёте использовать пакетную обработку и более низкие уровни effort. Заявленная цифра — не там, где лежит экономия.

Что говорят бенчмарки, а что нет

Результаты сильные. На OSWorld 2.0, бенчмарке работы с компьютером, Opus 5 набрала 70,6%. На Frontier-Bench — 43,3%, более чем вдвое лучше Opus 4.8. На ARC-AGI 3, тесте, нацеленном на новое рассуждение, а не на заученные шаблоны, модель поднялась с 1,5% до 30,2%.

Именно скачок на ARC-AGI заслуживает внимания, потому что он измеряет то, что бенчмарки обычно измерить не в состоянии: работу с задачами, которых модель фактически не видела. Двадцатикратный рост по этой оси говорит больше, чем ещё один-два пункта в таблице по программированию.

Две оговорки, и они касаются любого релиза любого вендора. Цифры на старте предоставляет компания, выпускающая модель, либо ранние независимые прогоны — в условиях, которые выбрали те, кто их запускал. И оценка в бенчмарке не является обещанием относительно вашей задачи. Модель, возглавляющая тест по агентному программированию, не обязательно лучше напишет описания товаров для вашего магазина. Единственное число, имеющее значение для бизнеса, — то, которое вы измерили на собственных задачах.

Что меняется для небольшого бизнеса

Для большинства малых и средних компаний делать что-либо на этой неделе не требуется. Модели в ваших инструментах стали лучше, а цена этих инструментов не изменилась. Для типичного пользователя на этом история заканчивается.

Меняется там, где раньше вас останавливала цена. Три конкретных случая:

Работа с длинными документами. Контекст в 1 млн токенов означает, что весь пакет договоров, полный экспорт сайта или год обращений в поддержку можно подать одним запросом, а не резать на куски и сшивать обратно. Именно на этой нарезке качество тихо терялось.

Контроль расходов стал регулятором, а не догадкой. Параметр effort позволяет тратить меньше токенов на рутину и больше на сложные случаи в пределах одной модели. Вместе с пакетной обработкой за половину цены для всего, что может подождать, это более сильный рычаг для месячного счёта, чем любая заявленная ставка.

Задачи с проверкой результата. Anthropic отмечает, что модель теперь проверяет свою работу без отдельного указания — настолько, что старые промпты вроде «добавь шаг проверки» приводят к избыточным проверкам. Если у вас есть промпты, перенесённые с предыдущих моделей, они могут теперь работать против вас.

Ничего из этого не требует отдельного проекта миграции. Нужно лишь, чтобы кто-то посмотрел, за что вы уже платите и соответствуют ли настройки новой модели.

Почему это касается того, как вас находят

Есть ещё один эффект, не имеющий отношения к вашему счёту за API.

Каждый раз, когда передовые возможности дешевеют относительно того, что они замещают, бо́льшая их часть попадает в потребительские продукты: ассистенты, которые сами ищут, обобщают и отвечают вместо того, чтобы отдать список ссылок. Эта тенденция не зависит от какого-либо отдельного релиза. Она длится уже два года, и каждый такой запуск продвигает её дальше.

Следствие для бизнеса будничное и неизменное. Всё большая доля людей, составляющих о вас мнение, будет делать это через сгенерированный машиной ответ, который никогда не проследит до вашего сайта. Появится ли там ваш бизнес и будет ли сказанное о нём точным — это не управляется рекламой. Это зависит от того, являются ли факты о вас понятными, согласованными и доступными там, где эти системы действительно читают.

Это более медленная проблема, чем запуск модели, и куда более долговечная. Цены этого релиза устареют за квартал. Вопрос, правильно ли ассистент описывает ваш бизнес, — нет.

Источники

Показатели бенчмарков приведены так, как их опубликовали на старте Anthropic и ранние независимые обзоры. Мы не воспроизводили их самостоятельно.