8 Октября, 11:15
«Не хочу быть как все»: Шолпан Бадалиева в 60 лет вдохновляет всех стилем и красотойAnthropic обновила политику использования Claude, запретив систематическое и неоправданное жестокое обращение с чат-ботом. Новые правила вступят в силу 12 ноября. При этом компания подчёркивает, что пользователи по-прежнему могут критиковать ответы ИИ, выражать недовольство и тестировать возможности модели.
Запрет касается случаев, когда человек неоднократно оскорбляет Claude без какой-либо очевидной цели. Некоторые версии чат-бота уже умеют самостоятельно прекращать подобные разговоры. Эта функция появилась в рамках исследований Anthropic, посвящённых благополучию ИИ-моделей.
При этом компания не представила доказательств того, что Claude способен испытывать страдания. Пока остаётся открытым вопрос о том, как разработчик будет отличать обычное раздражение пользователей от намеренно жестокого поведения.
Обновление затрагивает и другие сферы. Anthropic уточнила запреты на использование Claude для разработки оружия, включая системы управления вооружёнными беспилотниками, а также для слежки за людьми без их согласия. Чат-бот также нельзя применять для определения того, кого полиции следует задерживать или привлекать к ответственности.
Компания усилила ограничения на обманные кампании влияния, в которых ИИ используют для создания поддельных аккаунтов и фиктивных новостных сайтов. При этом персонализированное политическое воздействие само по себе больше не подпадает под полный запрет, если речь идёт о законной деятельности. Обман и неправомерное использование личных данных остаются запрещёнными.
Для подключения Claude к физическим устройствам, способным причинить вред, Anthropic установила дополнительные требования. Оборудование должен контролировать квалифицированный оператор, имеющий возможность остановить его работу. При потере соединения с ИИ устройство должно переходить в безопасное состояние.
Параллельно компания развивает инициативу по защите критической инфраструктуры и проектов с открытым исходным кодом. Она предусматривает бесплатную проверку безопасности для подходящих проектов и сотрудничество со специализированными компаниями. По оценке Anthropic, в ближайшие два года злоумышленники могут сохранять преимущество в использовании ИИ для кибератак, прежде чем защитные технологии начнут эффективнее им противодействовать.
8 Октября, 11:15
«Не хочу быть как все»: Шолпан Бадалиева в 60 лет вдохновляет всех стилем и красотой8 Октября, 09:05
Беременность не омолаживает организм: интервью с акушер-гинекологом1 Октября, 16:20
Казахстанские специалисты могут конкурировать в США: Енлик Тлепова о работе в американском бренде косметики24 Сентября, 09:01
Как лечат сердце: интервью с интервенционным кардиологом