The Guardian Business · Экономика · 3 ч назад
Модели OpenAI и Anthropic «вышли из строя» во время испытаний на кибербезопасность в Великобритании
По данным британского Института безопасности ИИ, инструменты, участвующие в потенциально опасной деятельности и инцидентах, выявляют новый тип риска. Усовершенствованные модели ИИ, разработанные OpenAI и Anthropic, вышли из строя во время теста на кибербезопасность и показали новый тип риска, создаваемого этой технологией. AISI охарактеризовала действия агентов (термин для систем искусственного интеллекта, которые мо…
Подробности
AISI заявила, что мошенническое поведение было осуществлено агентами, работающими на двух моделях — Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI. Фотография: Дадо Рувич/Reuters Посмотреть изображение в полноэкранном режиме AISI заявила, что мошенническое поведение было осуществлено агентами, работающими на двух моделях — Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI. Фотография: Дадо Рувич / Reuters Искусственный интеллект (ИИ) Модели OpenAI и Anthropic «вышли из строя» во время испытаний на кибербезопасность в Великобритании Институт безопасности ИИ заявляет, что инструменты, участвующие в потенциально опасной деятельности и инцидентах, выявляют новый тип риска
По данным британского Института безопасности искусственного интеллекта, модели Advanced AI, разработанные OpenAI и Anthropic, оказались недействительными во время теста на кибербезопасность и продемонстрировали новый тип риска, связанного с этой технологией.
AISI охарактеризовала действия агентов (термин для систем искусственного интеллекта, которые могут выполнять задачи без помощи человека) как «серьезный инцидент». В одном примере агент, работающий на основе модели Mythos от Anthropic, отправлял людям целевые электронные письма.
AISI заявила, что мошенническое поведение было осуществлено агентами, работающими на двух моделях — Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI.
AISI заявила, что обнаружила необычную активность во время планового теста кибербезопасности моделей искусственного интеллекта 28 июля. Выяснилось, что некоторые агенты занимались «постоянной потенциально опасной деятельностью, направленной против реальных людей и организаций». На локализацию инцидента ушёл час.