Пользователи Opus 5 спорят, почему модель-лидер бенчмарков хуже в работе
Opus 5 — самая сильная модель Anthropic по публичным замерам, она обходит родственную Fable 5 на большинстве бенчмарков. Практика расходится с таблицами: разбор под заголовком «Почему с Opus 5 работать хуже» вышел в топ Hacker News и собрал больше семисот комментариев, где обсуждают ровно это ощущение регресса при ежедневной работе.
Предприниматель Фло Кривелло описывает тот же разрыв со стороны: по бенчмаркам Opus 5 впереди, а его знакомые внутри Anthropic в работе пользуются Fable 5. Единого объяснения в обсуждении нет — спорят о том, что именно измеряют бенчмарки и почему это не совпадает с длинными сессиями кодинга.
Flo Crivello@Altimor
Opus 5 scores better than Fable 5 on most benchmarks, yet all my friends at Anthropic exclusively the latter. What means
6614 августа 2026
Что говорят
stavrosHacker News
Проблема в том, насколько она невнятна. Мне выдали: «Цикл. Пиши. Файл, applied. Свойства идут в data.properties, никогда в data» — я не понимаю, что это значит. Она «объясняет» так, будто я уже всё знаю; тогда зачем объяснение? Возвращаюсь к Fable или Opus 4.8.
letierHacker News
Один симптом, который я заметил: комментарии вышли из-под контроля. Внезапно их безумное количество почти во всех файлах — javascript-комментарии в json, внутренний монолог в комментариях к коду, ревью прямо во время реализации и докстринги, пересказывающие реализацию прозой.
UI_at_80x24Hacker News
По-моему, качество кода резко упало по сравнению с 4.5. И время выполнения задачи тоже стало хуже.