Пользователи заподозрили Anthropic в тихом снижении усердия Claude Code
Пользователи Claude Code — терминального агента Anthropic для работы с кодом — заметили признаки того, что часть запросов уходит на пониженный уровень усердия: модель тратит меньше вычислений на обдумывание задачи. Похоже на A/B-тест, когда одной группе достаётся один режим, другой — другой.
Свидетельства косвенные: разница в поведении на однотипных задачах и следы в служебных полях. Anthropic ничего не подтверждала.
Обсуждение на Hacker News собрало больше полутора сотен комментариев, и там же всплыл общий фон недели: инженеры жалуются, что модели «стали хуже, чем месяц назад», без замеров.
Austen Allred@Austen
I swear these models are all worse today than they were a month ago
63622 августа 2026
Что говорят
🥔🥔🥔@argofowl
Апдейт: дело в сервере, а не в приложении. Anthropic записывает сессии Fable 5 на Claude Code 2.1.236+ в эксперимент, который ужимает шкалу «усердия»; старые версии и Opus 5 не трогают. Похоже на A/B-тест, так что увидят не все — но если у вас «high» ощущается как «low», вот почему.
336
WowfunhappyHacker News
Насколько я понимаю по треду, все доказательства сводятся к тому, что человек спросил у Claude, какой у него выставлен уровень усердия. Но откуда модель вообще может это знать? Меня это не убеждает.
pizzafeelsrightHacker News
То, что творит Opus 5, — так быть не должно. Промпт: «прочитай конфиг и обнови его новыми данными». На 4.6 это занимает меньше двух минут. Opus 5: 43 минуты — тянет контейнеры, запускает песочницы, строит тестовые наборы и оценивает весь репозиторий далеко за пределами конфига. Результат в обоих случаях — правка одного файла.