Anthropic отзывает политику, которая незаметно ограничивала исследователей, использующих новую языковую модель Claude Fable 5 для работы над передовыми ИИ-системами. «Мы меняем защитные механизмы Fable 5 для разработки передовых языковых моделей, делая их видимыми», — говорится в заявлении компании изданию Wired. Там же Anthropic признала, что выбрала неверный компромисс, и извинилась за то, что не нашла правильного баланса.

Логотип Anthropic — компании-разработчика языковых моделей ClaudeИсточник изображения — engadget.com

Что заметили исследователи

Claude Fable 5 вышла 9 июня 2026 года — это первая общедоступная модель на базе мощной системы Mythos. Уже в первые сутки исследователи обнаружили странность: на части запросов модель либо отказывалась работать, либо заметно ухудшала качество ответов. Речь шла о задачах вроде обучения конкурирующих языковых моделей, отладки кода ИИ-систем и оптимизации архитектур нейросетей.

Отдельно возмутило то, что об этом не предупреждали. Условие было упомянуто мелким шрифтом в системной карточке модели: Fable и Mythos распознают «запросы, нацеленные на разработку передовых языковых моделей», и снижают эффективность ответа без уведомления пользователя. В основной документации об этом не говорилось ничего.

Претензия была не только к самой деградации, но и к деньгам: Fable 5 стоит примерно вдвое дороже предыдущей флагманской модели Opus 4.8, и пользователи оплачивали токены за ответы, которые заведомо выдавались в урезанном виде.

реклама кормит Уточку 🦆

Почему реакция оказалась такой резкой

Anthropic позиционирует себя как более этичную и ориентированную на исследователей альтернативу OpenAI, поэтому история ударила по компании особенно больно. Претензии предъявили сразу две обычно не пересекающиеся группы — сторонники открытых разработок, которые и так критикуют закрытость Anthropic, и специалисты по безопасности ИИ, обычно выступающие на её стороне.

Исследователь и автор Substack Дин Болл написал в X, что ухудшение качества в исследованиях по машинному обучению без уведомления пользователя выглядит враждебно по отношению к нему. Высказался и Андрей Карпаты, бывший сооснователь OpenAI, месяцем ранее перешедший в Anthropic: в сообществе хватало тех, кто хвалил саму модель, но считал такой способ вывода её на рынок ошибкой.

«Ухудшение качества в исследованиях по машинному обучению без уведомления пользователя — это шокирующе враждебно и выглядит ужасно»

Дополнительный контекст: это уже не первая претензия к прозрачности компании. Ранее в 2026 году Anthropic столкнулась с волной жалоб после тихих изменений в Claude Code, которые разработчики восприняли как ухудшение работы инструмента.

реклама кормит Уточку 🦆

Что именно изменили

Anthropic не отказалась от ограничений — она сделала их заметными. С 11 июня запросы, помеченные фильтрами, видимо откатываются на Opus 4.8, и пользователь получает уведомление каждый раз. В программном интерфейсе помеченные запросы возвращают причину отказа.

Объяснение компании выглядит так: видимые ограничения можно прощупывать и обходить, поэтому они должны быть устойчивыми, а на это нужно время. Невидимые можно настроить точечно и выпустить модель быстрее, с минимумом ложных срабатываний. Именно поэтому и был выбран скрытый вариант — и именно это Anthropic назвала неверным решением.

Сейчас у Fable 5 три публично описанные категории, при которых срабатывает переключение:

  • Наступательная кибербезопасность — создание эксплойтов, вредоносного кода и инструментов для атак. Откат на Opus 4.8.
  • Биология, химия и науки о жизни — из-за риска двойного назначения. Откат на Opus 5.
  • Дистилляция и разработка передовых языковых моделей — попытки «перекачать» способности Claude в конкурирующие системы. Откат на Opus 4.8.

Важная деталь, о которой знают немногие: фильтры проверяют всё, что читает модель, а не только последнее сообщение. В проверку попадают память, содержимое подключённых сервисов, результаты поиска в сети и загруженные файлы — то есть срабатывание может вызвать текст, который пользователь не писал сам. По оценке Anthropic, переключение происходит в среднем менее чем в 5% сессий. За переадресованные запросы по тарифу Fable плату не берут.

реклама кормит Уточку 🦆

Что было дальше

История на этом не закончилась. 12 июня Anthropic приостановила доступ к Fable 5 и Mythos 5, чтобы выполнить требования экспортного контроля Министерства торговли США. Ограничения сняли 30 июня, доступ вернули 1 июля.

Отдельная проблема — ложные срабатывания. Разработчики регулярно жалуются, что фильтры принимают за атаку обычную защитную работу: разбор собственного кода в закрытом хранилище, борьбу с мошенничеством на своей же платформе, укрепление инфраструктуры компании. Сессия при этом продолжается на Opus 4.8, но выбранная и оплаченная модель подменяется посреди задачи.

7 августа 2026 года компания перенастроила биологические фильтры. По её собственным подсчётам, общее число откатов снизилось примерно на 67% в веб-версии Claude, на 55% в Cowork, на 17% в Claude Code и на 7% на платформе для разработчиков. При этом вирусология, токсикология и молекулярный дизайн остаются заблокированными — здесь Anthropic обещает отдельную программу доверенного доступа, но сроков пока не называет.

реклама кормит Уточку 🦆

Пожаловаться на ошибочную блокировку можно тремя способами: командой /feedback в Claude Code, оценкой «палец вниз» под ответом в веб-версии и Cowork или через форму обжалования для запросов из программного интерфейса.

Главный вопрос эта история не закрыла. Само ограничение никуда не делось: полноценный Fable 5 для задач передовых ИИ-исследований остаётся доступен внутри самой Anthropic, а всем остальным его выдают в урезанном виде — просто теперь об этом честно сообщают. Следующей лаборатории, выпускающей передовую модель, предстоит тот же выбор. И та же аудитория, которая уже доказала, что читает примечания мелким шрифтом.