Несколько недель разработчики жаловались, что Claude Code стал работать хуже: модель забывала контекст, повторялась и отвечала короче обычного. Anthropic сначала не находила подтверждений, а затем опубликовала разбор и признала три отдельные причины. История полезна не столько деталями, сколько выводом: продукт может измениться без единой строчки в релиз-ноутах.
Три причины, которые сложились вместе
Первая — понижение уровня рассуждений. В марте стандартное значение для Claude Code опустили с высокого до среднего: часть пользователей жаловалась на слишком долгие ответы. Модель стала меньше думать над задачей, если разработчик не менял настройку вручную. Компания позже признала, что это немного снижало интеллектуальные возможности, зато уменьшало задержки и реже упирало пользователя в лимиты. Изменение окончательно откатили 7 апреля.
Вторая — ошибка кэширования. Оптимизация, выпущенная 26 марта, должна была очищать историю размышлений один раз после часа простоя. Вместо этого она стирала её на каждом следующем ходу. В длинных диалогах модель теряла собственные предыдущие рассуждения, начинала забывать детали и ходить по кругу. Починили в версии v2.1.116.
Третья — инструкция краткости. 16 апреля в системный промпт добавили требование держать текст между вызовами инструментов в пределах 25 слов, а финальный ответ — в пределах 100. Замеры показали падение результатов в программировании примерно на три процента. Инструкцию тоже убрали.
Ни одно из трёх изменений не подавалось как ухудшение. Каждое решало свою задачу: латентность, расход ресурсов, лаконичность ответов. Совпав по времени, они дали эффект, который пользователи описывали как «модель поглупела».
Почему «тайное ухудшение» — неверная формулировка
Компания отрицает намеренное ослабление моделей и утверждает, что веса не менялись. Судя по опубликованному разбору, так и есть: ломались обвязка и системные инструкции, а не сама модель. Говорить о доказанном тайном понижении качества оснований нет.
Для пользователя, впрочем, разница невелика. Он платит за результат, а результат ухудшился из-за изменений, о которых он не знал и на которые не мог повлиять. Признание пришло через несколько недель жалоб.
Один и тот же выбор модели — разные ответы
Есть механика, которая усиливает то же ощущение. Выбор Opus 5 в интерфейсе не гарантирует, что запрос обработает именно эта модель. Часть обращений, связанных с кибербезопасностью, внутри Claude, Claude Code или Claude Cowork автоматически уходит на Opus 4.8. Для запросов из областей безопасности, биологии и дистилляции решение о модели принимает внутренний классификатор.
Anthropic рассказала об этой системе открыто, так что скрытой её назвать нельзя. Практическое следствие всё равно неприятное: два человека с одинаковым запросом на одном тарифе могут получить разные модели, и интерфейс об этом не сообщит.
Отдельно обсуждают текстовые водяные знаки — механизм, который слегка смещает выбор слов при генерации, чтобы сгенерированный текст можно было опознать. Идея вызвала критику: пользователь снова получает не совсем то, что заказывал.
Что из этого следует для работы
Фиксируйте версию инструмента, если результат для вас критичен. Номер версии клиента и дата прогона — минимальные данные, без которых потом невозможно понять, изменился продукт или ваш проект.
Держите короткий набор собственных проверок. Пять-десять типовых задач, которые вы прогоняете раз в неделю с записью результата, ловят деградацию раньше, чем она превратится в ощущение. Ощущение к делу не пришьёшь, а два замера с разницей в три недели — аргумент.
Не полагайтесь на значения по умолчанию в критичных задачах. Уровень рассуждений, длина ответа, выбор модели — те параметры, которые поставщик может поменять из соображений нагрузки. Явно заданная настройка переживает такие изменения, настройка по умолчанию — нет.
Сравните модели перед запуском
Тарифы, лимиты и список моделей — на стороне сервиса. Если что-то разойдётся с описанным здесь, напишите: поправим материал и проставим новую дату проверки.
Открыть каталог моделей«SEO Разум» не продаёт доступ к API и не является поставщиком токенов.