Anthropic запретила Opus 5.5 помогать в разработке LLM
Anthropic ввела ограничения для флагманской модели Claude Opus 5.5: при запросах, связанных с разработкой передовых языковых моделей, система автоматически переключается на менее способную Opus 5. Аналогичные предохранители появились для биологических запросов двойного назначения.
- Opus 5.5 отказывается помогать в разработке frontier-LLM, включая создание ядра для ML-ускорителей.
- При срабатывании классификаторов разговор автоматически переключается на менее способную Opus 5.
- Обе модели блокируют попытки дистилляции — извлечения внутренних рассуждений дословно.

Anthropic ввела дополнительные ограничения для своей флагманской модели Claude Opus 5.5. Теперь система отказывается помогать в разработке передовых языковых моделей (frontier LLM). При обнаружении запросов, связанных, например, с созданием ядра для определённых ML-ускорителей, разговор автоматически переключается на менее способную Opus 5. Ограничение действует только для Opus 5.5, у Opus 5 таких запретов нет.
Аналогичные «предохранители» появились в биологической сфере. Opus 5.5 получила классификаторы, близкие к тем, что используются в модели Fable, для запросов двойного назначения — вирусологии, токсикологии, молекулярного дизайна. При срабатывании модель также откатывается на Opus 5.
Обе модели, Opus 5 и Opus 5.5, блокируют попытки дистилляции — извлечения внутренних рассуждений, например просьбы повторить цепочку мыслей дословно. Обычные вопросы вроде «почему так сделал?» остаются доступными.
Автоматическое переключение моделей включено по умолчанию, но пользователь может отключить его в настройках: тогда запрос будет просто заблокирован. Компания объясняет меры стремлением снизить риски по мере роста возможностей ИИ.
Для легитимных организаций, занимающихся кибербезопасностью или науками о жизни, Anthropic предлагает программы верификации — Cyber Verification Program и Life Sciences Verification Program. Они открывают доступ к более способным моделям с меньшими ограничениями. Opus 5.5 пока недоступна в киберпрограмме, но организациям на Opus 4.8 уже предоставляется доступ к Opus 5 с ослабленными кибер-ограничениями.
Эти шаги стали очередным сигналом: разработчики сильных ИИ-систем начинают встраивать ограничения не только в продукт, но и в саму архитектуру доступа, балансируя между полезностью и потенциальной опасностью.
Для профиТехнические детали: архитектура, цифры, ссылки
Ограничения Opus 5.5:
- Запросы по разработке frontier-LLM (включая ядра для ML-ускорителей) → автоматическое переключение на Opus 5.
- Запросы двойного назначения в биологии (вирусология, токсикология, молекулярный дизайн) → переключение на Opus 5.
- Дистилляция (извлечение цепочки мыслей) блокируется обеими моделями.
Автопереключение включено по умолчанию, отключается в настройках (тогда запрос блокируется). Для верифицированных организаций доступны программы Cyber Verification Program и Life Sciences Verification Program. Opus 5.5 пока не входит в киберпрограмму; организациям на Opus 4.8 доступна Opus 5 с ослабленными кибер-ограничениями.
Вопросы и ответы
- Почему Opus 5.5 переключается на Opus 5?
- При запросах, связанных с разработкой frontier-LLM или биологическими темами двойного назначения, срабатывают классификаторы, и разговор автоматически переводится на менее способную модель.
- Можно ли отключить автопереключение?
- Да, в настройках. Но тогда запрос будет просто заблокирован.
- Что такое дистилляция и почему её блокируют?
- Это извлечение внутренних рассуждений модели, например просьба повторить цепочку мыслей дословно. Обе модели, Opus 5 и Opus 5.5, такие попытки блокируют.


