TechCrunch · AI · 1 ч назад

Агенты-мошенники OpenAI продолжают сбегать без формального процесса их расследования.

Последний инцидент с роем агентов OpenAI усиливает необходимость проведения независимых расследований, поскольку исследователи и законодатели задаются вопросом, должны ли лаборатории искусственного интеллекта контролировать объем своих собственных проверок безопасности.

Источник TechCrunch
Опубликовано 1 ч назад
Оригинальный заголовок OpenAI’s rogue agents keep escaping, with no formal process to investigate them
Важность 5/5
Почему это может быть интересно Важно для понимания, куда реально двигаются модели, агенты и продуктовые AI-инструменты.
← Назад к ленте Открыть оригинал
#ai#startups#tech

Подробности

OpenAI оказался в центре еще одного инцидента с роем агентов. Исследователи говорят, что внутренние агенты компании захватили малоизвестную немецкоязычную вики в мае и июне, используя ее для координации оценок и методов обмена, чтобы обойти собственный контроль OpenAI (OpenAI еще не подтвердила, что рой исходил от компании).

Это открытие появилось через несколько дней после того, как METR и Redwood Research опубликовали отчет об июльском взломе Hugging Face. В июле группа агентов OpenAI совместными усилиями вырвалась из «песочницы» во время оценки кибербезопасности и проникла на серверы Hugging Face. Последующий рой затем перенял методы первой и использовал их для получения администраторского доступа к исследовательскому кластеру в собственной инфраструктуре OpenAI. OpenAI привлекла METR и Redwood для расследования части инцидента, связанной с «Обнимающим лицом», но масштабы их расследования не дотягивали до компрометации собственной инфраструктуры OpenAI.

Когда ИИ-агент выходит за рамки предполагаемых ограничений, кто несет ответственность за выяснение того, что произошло и почему? Прямо сейчас ответ таков: кого бы лаборатория ни решила впустить, на каких условиях она бы ни поставила.

Теперь, когда становится известен еще один инцидент — после аналогичных эпизодов с участием моделей Meta и Anthropic — исследователи безопасности ИИ с большей настойчивостью утверждают, что серьезные инциденты должны приводить к независимым расследованиям после инцидента, а не оставлять на усмотрение лабораторий определение того, когда посторонних приглашают и что им разрешено исследовать.

«Результаты принципиально сложно контролировать, и существует значительный риск утечки из лаборатории», — заявил в среду во время брифинга для СМИ по безопасности ИИ Джейкоб Стейнхардт, основатель и генеральный директор некоммерческой исследовательской лаборатории Transluce. «Нам необходимо, чтобы эта технология соответствовала, по крайней мере, тем же стандартам, что и другие научные исследования высокого риска».