Anthropic отменила скрытые ограничения в Claude Fable 5 после критики исследователей
Модель незаметно ухудшала ответы на запросы, связанные с разработкой передовых языковых моделей
Исследователи жаловались на необъявленную деградацию качества и напрасно потраченные токены
Теперь о блокировке или переключении на менее мощную модель пользователя предупреждают каждый раз
Anthropic отзывает политику, которая незаметно ограничивала исследователей, использующих новую языковую модель Claude Fable 5 для работы над передовыми ИИ-системами. «Мы меняем защитные механизмы Fable 5 для разработки передовых языковых моделей, делая их видимыми», — говорится в заявлении компании изданию Wired. Там же Anthropic признала, что выбрала неверный компромисс, и извинилась за то, что не нашла правильного баланса.
Источник изображения — engadget.com
Что заметили исследователи
Claude Fable 5 вышла 9 июня 2026 года — это первая общедоступная модель на базе мощной системы Mythos. Уже в первые сутки исследователи обнаружили странность: на части запросов модель либо отказывалась работать, либо заметно ухудшала качество ответов. Речь шла о задачах вроде обучения конкурирующих языковых моделей, отладки кода ИИ-систем и оптимизации архитектур нейросетей.
Отдельно возмутило то, что об этом не предупреждали. Условие было упомянуто мелким шрифтом в системной карточке модели: Fable и Mythos распознают «запросы, нацеленные на разработку передовых языковых моделей», и снижают эффективность ответа без уведомления пользователя. В основной документации об этом не говорилось ничего.
Претензия была не только к самой деградации, но и к деньгам: Fable 5 стоит примерно вдвое дороже предыдущей флагманской модели Opus 4.8, и пользователи оплачивали токены за ответы, которые заведомо выдавались в урезанном виде.
Почему реакция оказалась такой резкой
Anthropic позиционирует себя как более этичную и ориентированную на исследователей альтернативу OpenAI, поэтому история ударила по компании особенно больно. Претензии предъявили сразу две обычно не пересекающиеся группы — сторонники открытых разработок, которые и так критикуют закрытость Anthropic, и специалисты по безопасности ИИ, обычно выступающие на её стороне.
Исследователь и автор Substack Дин Болл написал в X, что ухудшение качества в исследованиях по машинному обучению без уведомления пользователя выглядит враждебно по отношению к нему. Высказался и Андрей Карпаты, бывший сооснователь OpenAI, месяцем ранее перешедший в Anthropic: в сообществе хватало тех, кто хвалил саму модель, но считал такой способ вывода её на рынок ошибкой.
«Ухудшение качества в исследованиях по машинному обучению без уведомления пользователя — это шокирующе враждебно и выглядит ужасно»
Дополнительный контекст: это уже не первая претензия к прозрачности компании. Ранее в 2026 году Anthropic столкнулась с волной жалоб после тихих изменений в Claude Code, которые разработчики восприняли как ухудшение работы инструмента.
Что именно изменили
Anthropic не отказалась от ограничений — она сделала их заметными. С 11 июня запросы, помеченные фильтрами, видимо откатываются на Opus 4.8, и пользователь получает уведомление каждый раз. В программном интерфейсе помеченные запросы возвращают причину отказа.
Объяснение компании выглядит так: видимые ограничения можно прощупывать и обходить, поэтому они должны быть устойчивыми, а на это нужно время. Невидимые можно настроить точечно и выпустить модель быстрее, с минимумом ложных срабатываний. Именно поэтому и был выбран скрытый вариант — и именно это Anthropic назвала неверным решением.
Сейчас у Fable 5 три публично описанные категории, при которых срабатывает переключение:
- Наступательная кибербезопасность — создание эксплойтов, вредоносного кода и инструментов для атак. Откат на Opus 4.8.
- Биология, химия и науки о жизни — из-за риска двойного назначения. Откат на Opus 5.
- Дистилляция и разработка передовых языковых моделей — попытки «перекачать» способности Claude в конкурирующие системы. Откат на Opus 4.8.
Важная деталь, о которой знают немногие: фильтры проверяют всё, что читает модель, а не только последнее сообщение. В проверку попадают память, содержимое подключённых сервисов, результаты поиска в сети и загруженные файлы — то есть срабатывание может вызвать текст, который пользователь не писал сам. По оценке Anthropic, переключение происходит в среднем менее чем в 5% сессий. За переадресованные запросы по тарифу Fable плату не берут.
Что было дальше
История на этом не закончилась. 12 июня Anthropic приостановила доступ к Fable 5 и Mythos 5, чтобы выполнить требования экспортного контроля Министерства торговли США. Ограничения сняли 30 июня, доступ вернули 1 июля.
Отдельная проблема — ложные срабатывания. Разработчики регулярно жалуются, что фильтры принимают за атаку обычную защитную работу: разбор собственного кода в закрытом хранилище, борьбу с мошенничеством на своей же платформе, укрепление инфраструктуры компании. Сессия при этом продолжается на Opus 4.8, но выбранная и оплаченная модель подменяется посреди задачи.
7 августа 2026 года компания перенастроила биологические фильтры. По её собственным подсчётам, общее число откатов снизилось примерно на 67% в веб-версии Claude, на 55% в Cowork, на 17% в Claude Code и на 7% на платформе для разработчиков. При этом вирусология, токсикология и молекулярный дизайн остаются заблокированными — здесь Anthropic обещает отдельную программу доверенного доступа, но сроков пока не называет.
Пожаловаться на ошибочную блокировку можно тремя способами: командой /feedback в Claude Code, оценкой «палец вниз» под ответом в веб-версии и Cowork или через форму обжалования для запросов из программного интерфейса.
Главный вопрос эта история не закрыла. Само ограничение никуда не делось: полноценный Fable 5 для задач передовых ИИ-исследований остаётся доступен внутри самой Anthropic, а всем остальным его выдают в урезанном виде — просто теперь об этом честно сообщают. Следующей лаборатории, выпускающей передовую модель, предстоит тот же выбор. И та же аудитория, которая уже доказала, что читает примечания мелким шрифтом.












