При попытке получить помощь в написании кода для ML-ускорителей или в исследованиях по вирусологии и молекулярному дизайну, Opus 5.5 активирует встроенные классификаторы. Аналогичные меры безопасности, ранее примененные в модели Fable, принудительно ограничивают доступ к инструментам, которые могут быть использованы для создания вредоносного контента. Обе версии нейросети также блокируют попытки дистилляции, не позволяя пользователям извлекать цепочки внутренних рассуждений модели.
Anthropic ограничила возможности модели Claude Opus 5.5
Разработчики Anthropic ввели строгие фильтры для своей флагманской нейросети Claude Opus 5.5. Система теперь отказывается помогать пользователям в создании передовых языковых моделей и работе над проектами двойного назначения, автоматически переключая сложные запросы на менее способную версию Opus 5, чтобы снизить риски неконтролируемого использования ИИ.

По умолчанию система автоматически перенаправляет запросы на более простую версию, однако в настройках можно выбрать полную блокировку вместо переключения. Для легитимных научных и кибербезопасных организаций компания разработала программы верификации. Участники Cyber Verification Program и Life Sciences Verification Program получают доступ к функционалу без жестких ограничений, что отражает общую стратегию Anthropic по контролю над архитектурой доступа к мощным системам.

/https://274418.selcdn.ru/cv08300-33250f0d-0664-43fc-9dbf-9d89738d114e/uploads/354759/91c8c9ca-2cf3-4836-87cb-e95076654100.jpg)


Комментарии (0)
Пока нет комментариев. Будьте первым!