Anthropic запретила Opus 5.5 помогать в разработке LLM

Anthropic ввела ограничения для флагманской модели Claude Opus 5.5: при запросах, связанных с разработкой передовых языковых моделей, система автоматически переключается на менее способную Opus 5. Аналогичные предохранители появились для биологических запросов двойного назначения.

Главное
  • Opus 5.5 отказывается помогать в разработке frontier-LLM, включая создание ядра для ML-ускорителей.
  • При срабатывании классификаторов разговор автоматически переключается на менее способную Opus 5.
  • Обе модели блокируют попытки дистилляции — извлечения внутренних рассуждений дословно.
Иллюстрация к новости об ограничениях Anthropic для модели Claude Opus 5.5
Фото: iXBT

Anthropic ввела дополнительные ограничения для своей флагманской модели Claude Opus 5.5. Теперь система отказывается помогать в разработке передовых языковых моделей (frontier LLM). При обнаружении запросов, связанных, например, с созданием ядра для определённых ML-ускорителей, разговор автоматически переключается на менее способную Opus 5. Ограничение действует только для Opus 5.5, у Opus 5 таких запретов нет.

Аналогичные «предохранители» появились в биологической сфере. Opus 5.5 получила классификаторы, близкие к тем, что используются в модели Fable, для запросов двойного назначения — вирусологии, токсикологии, молекулярного дизайна. При срабатывании модель также откатывается на Opus 5.

Обе модели, Opus 5 и Opus 5.5, блокируют попытки дистилляции — извлечения внутренних рассуждений, например просьбы повторить цепочку мыслей дословно. Обычные вопросы вроде «почему так сделал?» остаются доступными.

Автоматическое переключение моделей включено по умолчанию, но пользователь может отключить его в настройках: тогда запрос будет просто заблокирован. Компания объясняет меры стремлением снизить риски по мере роста возможностей ИИ.

Для легитимных организаций, занимающихся кибербезопасностью или науками о жизни, Anthropic предлагает программы верификации — Cyber Verification Program и Life Sciences Verification Program. Они открывают доступ к более способным моделям с меньшими ограничениями. Opus 5.5 пока недоступна в киберпрограмме, но организациям на Opus 4.8 уже предоставляется доступ к Opus 5 с ослабленными кибер-ограничениями.

Эти шаги стали очередным сигналом: разработчики сильных ИИ-систем начинают встраивать ограничения не только в продукт, но и в саму архитектуру доступа, балансируя между полезностью и потенциальной опасностью.

Для профиТехнические детали: архитектура, цифры, ссылки

Ограничения Opus 5.5:

  • Запросы по разработке frontier-LLM (включая ядра для ML-ускорителей) → автоматическое переключение на Opus 5.
  • Запросы двойного назначения в биологии (вирусология, токсикология, молекулярный дизайн) → переключение на Opus 5.
  • Дистилляция (извлечение цепочки мыслей) блокируется обеими моделями.

Автопереключение включено по умолчанию, отключается в настройках (тогда запрос блокируется). Для верифицированных организаций доступны программы Cyber Verification Program и Life Sciences Verification Program. Opus 5.5 пока не входит в киберпрограмму; организациям на Opus 4.8 доступна Opus 5 с ослабленными кибер-ограничениями.

Вопросы и ответы

Почему Opus 5.5 переключается на Opus 5?
При запросах, связанных с разработкой frontier-LLM или биологическими темами двойного назначения, срабатывают классификаторы, и разговор автоматически переводится на менее способную модель.
Можно ли отключить автопереключение?
Да, в настройках. Но тогда запрос будет просто заблокирован.
Что такое дистилляция и почему её блокируют?
Это извлечение внутренних рассуждений модели, например просьба повторить цепочку мыслей дословно. Обе модели, Opus 5 и Opus 5.5, такие попытки блокируют.

Источники

Материал подготовлен редакцией на основе указанных источников. Как мы работаем