Anthropic выпустила Claude Sonnet 5 и усилила ограничения в Fable 5

·

·

Просмотров: 55

Anthropic* представила Claude Sonnet 5* и обновлённую Claude Fable 5*, сделав ставку не только на новые возможности, но и на более жёсткие ограничения в чувствительных сценариях. При этом именно тесты показывают, что релиз получился неоднозначным: в ряде задач новая модель стала сильнее, но в других — заметно просела относительно предыдущих версий.

В тесте CyberGym, Claude Sonnet 5 показала 52,7% успешных решений. Это хуже, чем у Claude Opus 4.8, которая набрала 78,1%, и 
хуже, чем у Claude Sonnet 4.6 с результатом 65,2%.

В тестах SWE-bench Pro ситуация тоже не в пользу новой версии: Sonnet 5 получила 63,2%, тогда как Opus 4.8* — 69,2%. Для модели, которую позиционируют как шаг вперёд, это выглядит, как заметное снижение эффективности в тяжёлых технических задачах.

На этом фоне особенно важным выглядит официальный системный документ Anthropic. В нём разработчики прямо признают, что усилили защитные фильтры и увеличили число ложных отказов. Модель чаще отказывается отвечать даже там, где запрос сам по себе не выглядит опасным. Это и создаёт эффект, который многие пользователи описывают как «затупила» модель: Sonnet 5 стала осторожнее, но вместе с этим потеряла часть полезности в сложных сценариях.

С Claude Fable 5* ситуация похожая. Anthropic усилила механизм безопасности и расширила «зону защиты», из-за чего под ограничения могут попадать даже относительно безобидные запросы. В случае блокировки модель не всегда отвечает напрямую: запрос может быть бесшовно переключён на более раннюю Claude Opus 4.8. Для пользователя это означает, что он общается вроде бы с новой моделью, но фактически часть ответа может быть сгенерирована старой версией.

Отдельно вопрос вызывает и стоимость. По данным Artificial Analysis, Sonnet 5 обходится в API дороже конкурентов: около 2,29 доллара за задачу против 1,80 у Opus 4.8 и 1,03 у GPT-5.5 от OpenAI. При этом модель тратит больше выходных токенов и уходит в более длинные внутренние рассуждения, что дополнительно увеличивает расход.

В итоге релиз Anthropic выглядит как компромисс: Sonnet 5 и Fable 5 действительно стали более контролируемыми и безопасными, но за это пришлось заплатить падением качества в ряде сложных задач и ростом стоимости использования. Для разработчиков это важный сигнал: новая линейка Claude 5 сильнее не во всём, а выбор между моделями теперь зависит не только от мощности, но и от того, насколько компания готова мириться с фильтрами, отказами и расходами.


*Официально недоступна на территории РФ.


Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Бесплатно

После регистрации вы получите ГАЙД «7 способов заработка на нейросетях с примерами».

Бесплатно

Работайте с GPT, Claude, Gemini и другими моделями без VPN в одном удобном интерфейсе.