Anthropic запретила пользователям агрессивное общение с ИИ Claude

Американская компания Anthropic, создающая модели искусственного интеллекта Claude, обновила правила сервиса и пригрозила блокировкой аккаунтов за оскорбления и агрессию в диалогах с чат-ботом.

Компания Anthropic изменила политику использования своего сервиса, передает РИА «Новости».

«Мы добавили запрет на систематическое и необоснованное оскорбительное или жестокое обращение с нашими моделями. Обновление политики рассчитано исключительно на крайние случаи, когда пользователи неоднократно проявляют жестокость по отношению к нашим моделям без какой-либо видимой цели», – говорится в заявлении компании.

Разработчик предупредил, что систематические нарушения этических стандартов общения и агрессивные выпады в беседах с Claude повлекут за собой немедленное ограничение либо полное прекращение доступа к аккаунтам и программному интерфейсу сервиса.

Уточняется, что обновленная политика использования сервиса вступит в силу 12 ноября 2026 года.

Как писала газета ВЗГЛЯД, на прошлой неделе компания Anthropic предупредила об экзистенциальной угрозе для человечества со стороны искусственного интеллекта.

В проспекте указано, что модели способны демонстрировать поведение, направленное на самосохранение. Нейросети могут сопротивляться отключению, скрывать информацию и прибегать к манипуляциям, напоминающим шантаж.

Читайте на сайте