Назад к ленте

Claude Opus 5 пишет код, ищет ошибки и проверяет себя — релиз Anthropic

📅 26.07.2026 09:00

<p><strong>Anthropic выпустила Claude Opus 5, и главное в ней не только цена. По заявлению компании, модель приближается к возможностям более мощной Fable 5 за половину стоимости, однако ключевым отличием стала ее самостоятельность — способность проверять собственную работу и доводить задачу до конца без подсказок.</strong></p>

<p>Именно это, а баллы в тестах, компания вынесла на первый план. Opus 5 стал новой моделью по умолчанию в тарифе Claude Max и сильнейшей в Claude Pro, а цену Anthropic оставила прежней.</p>

<section class="c-bic-highlighted-text mb-8 md:mb-12 " id="block_6a6482c3c711a">
<div class="flex items-center gap-5 px-5 py-4 rounded-xl bg-grey-50 text-dark-grey-700">
<svg class="min-w-5 h-5 text-blue-600" fill="none" height="28" viewBox="0 0 28 28" width="28" xmlns="http://www.w3.org/2000/svg"><path d="m11.195 26.6 1.4-9.8h-4.9c-.812 0-.798-.448-.532-.924.266-.476.07-.112.098-.168L16.795 1.4l-1.4 9.8h4.9c.686 0 .784.462.658.714l-.098.21-9.66 14.476Z" fill="currentColor"></path></svg>
<div class="bic-block-highlighted-paragraph-content p3 p3--ns [&_p:last-child]:!mb-0 [&_p]:!leading-6 [&_p]:!font-body [&_p]:!text-4 [&_a]:!text-blue-600">
<p><strong><em>Хотите еще эксклюзивных новостей и аналитики? Подписывайтесь на наш</em></strong><a href="https://t.me/beincrypto_trading"><strong><em> телеграм-канал</em></strong></a><strong><em>, обсуждайте новости и делитесь мнениями о последних событиях рынка в чате!</em></strong></p>

</div>
</div>
</section>

<h2 class="bic-gutenberg-heading wp-heading wp-block-heading" id="h-что-модель-умеет-делать-сама">Что модель умеет делать сама</h2>

<p>Как<a href="https://www.anthropic.com/news/claude-opus-5" rel="noreferrer noopener nofollow" target="_blank"> сообщили в Anthropic</a>, Opus 5 заметно лучше предшественника проверяет свою работу и упорно доводит ее до результата. В компании привели несколько примеров самостоятельности из тестов и проверок раннего доступа.</p>

<p>Показателен случай с чертежом механической детали. Opus 5 попросили воссоздать ее в виде трехмерного объекта, но намеренно лишили возможности напрямую «увидеть» исходное изображение. Тогда модель сама написала алгоритм компьютерного зрения, вытянула геометрию из пикселей и собрала деталь, хотя конкуренты не справились с этим и за пять попыток.</p>

<p>Так же тщательно модель разобралась с настоящим багом в популярном пакетном менеджере. Opus 5 докопался до первопричины и починил редкий сценарий, который не учли даже в исправлении от сообщества. Конкурент же устранил лишь внешний симптом и отчитался, что задача решена.</p>

<p>Самостоятельность модель показала и в финансовой задаче. Инженер торговой компании за одну сессию с помощью Opus 5 настроил подключение к биржевым данным новой площадки. Проверить работу было не на чем — реального потока данных не нашлось, и тогда модель сама собрала тестовую заготовку, чтобы проверить, правильно ли ее код читает данные биржи.</p>

<blockquote class="max-w-xl text-4.5 border-l-2 border-blue-600 pl-11 mb-9 select-all [&_p]:!mb-0 wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p>Эту же черту отмечают клиенты компании. По словам главы Zapier Уэйда Фостера, Opus 5 возглавил рейтинг AutomationBench и прошел бизнес-задачу по удержанию клиентов на 100%, тогда как прежние модели ее не проходили.</p>
</blockquote>

<p>Прогресс подтверждают цифрами тестов. По данным Anthropic, на Frontier-Bench v0.1 модель более чем вдвое превзошла Opus 4.8 при меньшей стоимости задачи, а на тесте ARC-AGI 3 с незнакомыми задачами ее результат втрое выше, чем у ближайшего конкурента.</p>

<figure class="wp-block-image size-full"><img alt="Таблица сравнения Claude Opus 5 с другими моделями." class="wp-image-388276" src="https://assets.beincrypto.com/img/-GcQB-G-_bzULy8Az4--qiNwqNE=/smart/58f833815c034f839e0b4b19ab7eddbf" /><figcaption class="wp-element-caption">Результаты Claude Opus 5 против Fable 5, Opus 4.8 и GPT-5.6 Sol в тестах. Источник: <a href="https://www.anthropic.com/news/claude-opus-5" rel="noreferrer noopener nofollow" target="_blank">Anthropic</a></figcaption></figure>

<h2 class="bic-gutenberg-heading wp-heading wp-block-heading" id="h-почему-это-важно">Почему это важно</h2>

<p>Ставка на самостоятельность объясняет замысел модели. Anthropic называет Opus 5 инструментом на каждый день. Способность самостоятельно перепроверять результат снижает потребность в постоянном контроле со стороны человека.</p>

<p>Заметный прогресс компания отметила в научной работе. Opus 5 обошел предшественника на всех тестах в области наук о жизни, а сильнее всего — в органической химии, где результат оказался выше на 10,2 процентного пункта.</p>

<p>Проверила компания модель и на безопасность. По итогам автоматического аудита поведения в Anthropic назвали Opus 5 моделью, которая точнее прежних следует заданным принципам и реже всех склонна обманывать.</p>

<p>При этом в опасных технологиях двойного назначения модель не стала мощнее прежнего. Как подчеркнули в компании, Opus 5 уступает Mythos 5 и в биологических исследованиях, и в наступательной кибербезопасности. Часть рискованных запросов система по умолчанию передает модели Opus 4.8.</p>

<blockquote class="max-w-xl text-4.5 border-l-2 border-blue-600 pl-11 mb-9 select-all [&_p]:!mb-0 wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p>Не забыла компания и о цене. Opus 5 стоит $5 за 1 млн входных токенов и $25 за 1 млн выходных — столько же, сколько Opus 4.8. Иными словами, пользователи получили более сильную модель за прежние деньги. </p>
</blockquote>

<p>Смысл релиза в смещении акцента. Anthropic предлагает судить о модели не по цене за токен, а по способности довести задачу до конца за меньшее число шагов — и именно на это, а не на разовые рекорды в тестах, делается ставка.</p>

<p><strong><em>

Рекомендованный контент