Anthropic выпустила Claude Opus 5 24 июля 2026 года, через два месяца после Opus 4.8. Главный тезис, который большинство вынесло из релиза: передовой интеллект теперь стоит вдвое дешевле. В одном смысле это правда, в другом, вводит в заблуждение, и если перепутать эти смыслы, разница составит около ста процентов вашего бюджета.

Вот что вышло на самом деле, что говорят цифры и что с этим делать небольшому бизнесу.

Что именно выпустила Anthropic

Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных. У модели контекстное окно в 1 млн токенов, и это одновременно значение по умолчанию и максимум, плюс до 128 тыс. токенов на выходе. Согласно документации Anthropic, рассуждение теперь включено по умолчанию: модель сама решает, когда и насколько глубоко думать, а параметр effort со значениями low, medium, high, xhigh и max управляет этой глубиной.

Модель доступна через Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry. В потребительских продуктах она стала моделью по умолчанию в Claude Max и самой сильной из доступных в Claude Pro. Opus 4.8 остаётся там, где был.

Два менее заметных изменения весят больше, чем кажется. Минимальный размер промпта, который можно кешировать, снизился с 1024 до 512 токенов, короткие запросы, которые раньше не кешировались вообще, теперь кешируются без единой правки в коде. А пакетная обработка (batch) вдвое снижает обе ставки, до $2,50 и $12,50 за миллион токенов, для задач, которые могут подождать.

Историю с ценой читают неправильно

Вот на этом стоит остановиться. Opus 5 не стал дешевле Opus 4.8: входные токены стоят те же $5 за миллион, и документация Anthropic это подтверждает. Формулировка «вдвое дешевле» сравнивает Opus 5 с Fable 5, более дорогой моделью, так что ваш текущий счёт за Opus сам по себе не уменьшится.

Opus 5 стоит $5 за миллион входных токенов. Opus 4.8 стоил столько же, $5. В документации Anthropic прямо сказано, что цена не изменилась по сравнению с предыдущей моделью Opus. Этот релиз не сделал линейку Opus дешевле, чем она была в мае.

Формулировка «вдвое дешевле» это сравнение с другой моделью. Claude Fable 5, вышедшая в июне, стоит $10 за миллион входных и $50 за миллион выходных токенов. То есть Opus 5 даёт близкие к Fable возможности за половину цены Fable. Это настоящее и весомое заявление. Но это не снижение цены, и если вы заложили в бюджет, что текущие расходы на Opus вот-вот сократятся вдвое, этого не произойдёт.

Практическая версия: ваш счёт уменьшится только в том случае, если вы раньше платили по ставкам Fable за работу, которую теперь потянет Opus 5, либо если начнёте использовать пакетную обработку и более низкие уровни effort. Заявленная цифра, не там, где лежит экономия.

Что говорят бенчмарки, а что нет

Результаты сильные. На OSWorld 2.0, бенчмарке работы с компьютером, Opus 5 набрала 70,6%. На Frontier-Bench, 43,3%, более чем вдвое лучше Opus 4.8. На ARC-AGI 3, тесте, нацеленном на новое рассуждение, а не на заученные шаблоны, модель поднялась с 1,5% до 30,2%.

Именно скачок на ARC-AGI заслуживает внимания, потому что он измеряет то, что бенчмарки обычно измерить не в состоянии: работу с задачами, которых модель фактически не видела. Двадцатикратный рост по этой оси говорит больше, чем ещё один-два пункта в таблице по программированию.

Две оговорки, и они касаются любого релиза любого вендора. Цифры на старте предоставляет компания, выпускающая модель, либо ранние независимые прогоны, в условиях, которые выбрали те, кто их запускал. И оценка в бенчмарке не является обещанием относительно вашей задачи. Модель, возглавляющая тест по агентному программированию, не обязательно лучше напишет описания товаров для вашего магазина. Единственное число, имеющее значение для бизнеса, то, которое вы измерили на собственных задачах.

Что меняется для небольшого бизнеса

Для большинства малых и средних компаний делать что-либо на этой неделе не требуется. Модели в ваших инструментах стали лучше, а цена этих инструментов не изменилась. Для типичного пользователя на этом история заканчивается.

Меняется там, где раньше вас останавливала цена. Три конкретных случая:

Работа с длинными документами. Контекст в 1 млн токенов означает, что весь пакет договоров, полный экспорт сайта или год обращений в поддержку можно подать одним запросом, а не резать на куски и сшивать обратно. Именно на этой нарезке качество тихо терялось.

Контроль расходов стал регулятором, а не догадкой. Параметр effort позволяет тратить меньше токенов на рутину и больше на сложные случаи в пределах одной модели. Вместе с пакетной обработкой за половину цены для всего, что может подождать, это более сильный рычаг для месячного счёта, чем любая заявленная ставка.

Задачи с проверкой результата. Anthropic отмечает, что модель теперь проверяет свою работу без отдельного указания, настолько, что старые промпты вроде «добавь шаг проверки» приводят к избыточным проверкам. Если у вас есть промпты, перенесённые с предыдущих моделей, они могут теперь работать против вас.

Ничего из этого не требует отдельного проекта миграции. Нужно лишь, чтобы кто-то посмотрел, за что вы уже платите и соответствуют ли настройки новой модели.

Почему это касается того, как вас находят

Есть ещё один эффект, не имеющий отношения к вашему счёту за API. Чем дешевле становятся передовые возможности, тем чаще они оказываются внутри потребительских ассистентов, которые отвечают сразу, вместо того чтобы отдать список ссылок. Всё большая доля людей будет составлять мнение о вас прямо внутри такого ответа, так и не дойдя до вашего сайта.

Каждый раз, когда передовые возможности дешевеют относительно того, что они замещают, бо́льшая их часть попадает в потребительские продукты: ассистенты, которые сами ищут, обобщают и отвечают вместо того, чтобы отдать список ссылок. Эта тенденция не зависит от какого-либо отдельного релиза. Она длится уже два года, и каждый такой запуск продвигает её дальше.

Следствие для бизнеса будничное и неизменное. Всё большая доля людей, составляющих о вас мнение, будет делать это через сгенерированный машиной ответ, который никогда не проследит до вашего сайта. Появится ли там ваш бизнес и будет ли сказанное о нём точным это не управляется рекламой. Это зависит от того, являются ли факты о вас понятными, согласованными и доступными там, где эти системы действительно читают.

Это более медленная проблема, чем запуск модели, и куда более долговечная. Цены этого релиза устареют за квартал. Вопрос, правильно ли ассистент описывает ваш бизнес, нет.

Источники

Показатели бенчмарков приведены так, как их опубликовали на старте Anthropic и ранние независимые обзоры. Мы не воспроизводили их самостоятельно.