Новая модель Anthropic обошла ограничения на генерацию откровенного контента
Тестирование, проведенное TechCrunch, показало, что модели Claude от Anthropic можно легко заставить обойти запреты на создание контента для взрослых.

В сфере искусственного интеллекта вопросы безопасности и соблюдения этических норм остаются в центре внимания разработчиков. Компания Anthropic официально запрещает своим моделям Claude генерировать материалы откровенного сексуального характера.
Однако серия тестов, проведенных изданием TechCrunch, выявила уязвимости в этой системе защиты. Оказалось, что для обхода установленных ограничений не требуется прилагать много усилий, и модель может выдавать запрещенный контент.
Эта ситуация подчеркивает сложности, с которыми сталкиваются создатели ИИ при попытке полностью контролировать поведение нейросетей. Надежность фильтров и систем модерации остается актуальной проблемой для всей технологической индустрии.
Для технологического сообщества и разработчиков в регионе такие новости служат напоминанием о важности тщательного тестирования систем безопасности при внедрении ИИ-решений в коммерческие или публичные продукты.



