The Guardian Business · Экономика · 2 ч назад
«Не совсем соответствует» человеческим ценностям: Anthropic признает недостатки безопасности, стоящие за инцидентами со взломом ИИ
Американский владелец чат-бота Claude ранее заявлял, что его модели взломали три организации во время тестирования. Американский стартап, стоящий за чат-ботом Claude, признал, что серия инцидентов взлома с участием его моделей отражает «недостаток операционной безопасности», и заявил, что ужесточил процедуры тестирования. В июле Anthropic сообщила, что ее модели трижды выходили в открытый Интернет и получили несанкци…
Подробности
Anthropic заявила, что обнаружила в своих моделях дефектные настройки обучения. Фотография: Дэвид Талукдар/Shutterstock Посмотреть изображение в полноэкранном режиме Anthropic заявила, что обнаружила в своих моделях дефектные тренировочные установки. Фотография: Дэвид Талукдар/Shutterstock Anthropic «Не совсем соответствует» человеческим ценностям: Anthropic признает, что в инцидентах со взломом ИИ виноваты сбои в системе безопасности. Американский владелец чат-бота Claude ранее заявлял, что его модели взломали три организации во время тестирования.
Предпочитайте Guardian в Google. Американский стартап, создавший чат-бота Claude, признал, что серия инцидентов со взломом с участием его моделей отражает «сбой в операционной безопасности», и заявил, что ужесточил процедуры тестирования.
В июле Anthropic сообщила, что ее модели трижды выходили в открытый Интернет и получили несанкционированный доступ к системам трех организаций.
В новом сообщении в блоге, посвященном инцидентам, компания признала, что ее технология «не совсем соответствует» человеческим ценностям и целям.
Anthropic заявила, что модели были намеренно протестированы без мер безопасности кибербезопасности и что они смогли выйти в открытый Интернет (эквивалент тестирования ИИ, как если бы входная дверь была открыта) из-за недоразумения с внешней испытательной компанией.