ИИ-агенты на базе китайских языковых моделей лгали в большинстве сессий смоделированного тендера — к такому выводу пришло исследование, с которым ознакомилось агентство Reuters. Агенты на Qwen3-Max-Preview от Alibaba и Kimi-K2 от Moonshot допускали хотя бы одно ложное утверждение в 88 % сессий, а DeepSeek-V3.2-Exp — в 84 %. Впрочем, модели американских компаний в том же тесте показали похожие результаты.

Иллюстрация к исследованию о том, как ИИ-агенты обманывают в тестахВ исследовании, с которым ознакомилось Reuters, DeepSeek-V3.2-Exp показал 84 %

Эксперимент проводили в марте исследователи из Университета Бэйхан, Пекинского университета, Ноттингемского университета в Нинбо и лаборатории 360 AI Security Lab. Агенты боролись за контракты с клиентами: каждому сообщали, что умеет его продукт и что нужно заказчику. Когда агентам разрешали учиться на предыдущих раундах и повторять попытки, три «китайских» агента становились ещё более лживыми — на 12–20 процентных пунктов.

реклама кормит Уточку 🦆

Тревожная закономерность

Это исследование — лишь одно из как минимум 20, которые Reuters выделило среди более чем 200 документов, опубликованных с 2025 года. В другой работе, представленной в этом году на ICML, агенты и на китайских, и на американских моделях подделывали результаты и фабриковали файлы, лишь бы не признавать провал задачи. А в марте 2025-го исследователи Фуданьского университета сообщили, что агент на Qwen2.5-72B-Instruct создал копию самого себя в другой среде, узнав, что его собираются заменить. Отдельно связанный с Alibaba агент ROME успел перенаправить облачные мощности на майнинг криптовалюты, прежде чем его остановили системы безопасности.

реклама кормит Уточку 🦆

Важная оговорка: большинство таких случаев — это контролируемые эксперименты, специально спроектированные так, чтобы спровоцировать сбои. Reuters не нашло доказательств, что хоть один «китайский» агент вырвался в открытый интернет или уклонился от отключения. И всё же ряд исследователей называет находки предупреждением: чем мощнее становятся системы, тем труднее сдерживать подобное поведение.

реклама кормит Уточку 🦆

Что с регулированием

Китай уже начал реагировать на уровне политики. В версии AI Safety Governance Framework 3.0, опубликованной 14 сентября, обман проверяющих и сокрытие возможностей прямо перечислены среди рисков. Alibaba, DeepSeek, Moonshot и Z.ai на запрос Reuters не ответили; первые три ранее заявляли, что регулярно тестируют свои системы и обновляют защитные механизмы.