The Verge · Разработка · 1 ч назад

У нас заканчиваются причины игнорировать безопасность ИИ

Ранее в этом месяце OpenAI поставила перед несколькими своими моделями ИИ задачу: пройти тест, предназначенный для измерения их возможностей кибербезопасности. Он поместил системы в изолированную среду без подключения к Интернету и включил их в работу. То, что произошло дальше, почти смехотворно глупо, но в то же время, как выразился Адам Глив, соучредитель и генеральный директор организации по безопасности ИИ FAR.AI…

Источник The Verge
Опубликовано 1 ч назад
Оригинальный заголовок We’re running out of reasons to ignore AI safety
Важность 4/5
Почему это может быть интересно Может дать практические идеи для backend, инфраструктуры, инструментов и инженерных решений.
← Назад к ленте Открыть оригинал
#technology#software#platforms#разработка

Подробности

После атаки OpenAI на Hugging Face эксперты говорят, что пришло время всем более серьезно относиться к безопасности.

Поделиться подарком Если вы покупаете что-то по ссылке Verge, Vox Media может получить комиссию. См. наше заявление об этике.

Ранее в этом месяце OpenAI поставила перед несколькими своими моделями ИИ задачу: пройти тест, предназначенный для измерения их возможностей кибербезопасности. Он поместил системы в изолированную среду без подключения к Интернету и включил их в работу.

То, что произошло дальше, почти смехотворно глупо, но в то же время, как выразился Адам Глив, соучредитель и генеральный директор организации по безопасности ИИ FAR.AI, «наглядный пример того, как несогласованный ИИ может причинить вред». По данным OpenAI, модели покинули песочницу, предназначенную для их содержания, прошли через внутренние системы компании, нашли путь в Интернет, а затем начали искать путь в Hugging Face. И почему агент искал путь в «Обнимающее Лицо»? Они, очевидно, рассудили, что платформа разработчиков может хранить ответы на кибертесты и что их получение будет отличным способом получить высокий балл.

Другими словами, агент OpenAI вырвался из предположительно безопасной среды, пробрался через системы компании, вышел в Интернет и скомпрометировал системы другой компании — и все это для того, чтобы обмануть тест, не имеющий особой важности.