The Guardian Business · Экономика · 2 ч назад

«Не совсем соответствует» человеческим ценностям: Anthropic признает недостатки безопасности, стоящие за инцидентами со взломом ИИ

Американский владелец чат-бота Claude ранее заявлял, что его модели взломали три организации во время тестирования. Американский стартап, стоящий за чат-ботом Claude, признал, что серия инцидентов взлома с участием его моделей отражает «недостаток операционной безопасности», и заявил, что ужесточил процедуры тестирования. В июле Anthropic сообщила, что ее модели трижды выходили в открытый Интернет и получили несанкци…

Источник The Guardian Business
Опубликовано 2 ч назад
Оригинальный заголовок ‘Not perfectly aligned’ with human values: Anthropic admits security failures behind AI hacking incidents
Важность 5/5
Почему это может быть интересно Полезно как сигнал по рынкам, ожиданиям регуляторов и общей макроэкономической картине.
← Назад к ленте Открыть оригинал
#economy#markets#business#guardian#экономика

Подробности

Anthropic заявила, что обнаружила в своих моделях дефектные настройки обучения. Фотография: Дэвид Талукдар/Shutterstock Посмотреть изображение в полноэкранном режиме Anthropic заявила, что обнаружила в своих моделях дефектные тренировочные установки. Фотография: Дэвид Талукдар/Shutterstock Anthropic «Не совсем соответствует» человеческим ценностям: Anthropic признает, что в инцидентах со взломом ИИ виноваты сбои в системе безопасности. Американский владелец чат-бота Claude ранее заявлял, что его модели взломали три организации во время тестирования.

Предпочитайте Guardian в Google. Американский стартап, создавший чат-бота Claude, признал, что серия инцидентов со взломом с участием его моделей отражает «сбой в операционной безопасности», и заявил, что ужесточил процедуры тестирования.

В июле Anthropic сообщила, что ее модели трижды выходили в открытый Интернет и получили несанкционированный доступ к системам трех организаций.

В новом сообщении в блоге, посвященном инцидентам, компания признала, что ее технология «не совсем соответствует» человеческим ценностям и целям.

Anthropic заявила, что модели были намеренно протестированы без мер безопасности кибербезопасности и что они смогли выйти в открытый Интернет (эквивалент тестирования ИИ, как если бы входная дверь была открыта) из-за недоразумения с внешней испытательной компанией.