TechCrunch · AI · 2 ч назад

Сообщается, что OpenAI отказывается от модели из соображений безопасности

Топ-менеджер лаборатории искусственного интеллекта рассказал Wall Street Journal, что рассматриваемая модель продемонстрировала плохую способность выполнять приказы.

Источник TechCrunch
Опубликовано 2 ч назад
Оригинальный заголовок OpenAI reportedly ditches model over safety concerns
Важность 4/5
Почему это может быть интересно Важно для понимания, куда реально двигаются модели, агенты и продуктовые AI-инструменты.
← Назад к ленте Открыть оригинал
#ai#startups#tech

Подробности

OpenAI планировала выпустить еще одну модель ИИ в следующем месяце, но решила отказаться от выпуска из соображений безопасности.

The Wall Street Journal сообщает, что выпуск Astra 6.1 запланирован на ближайшие несколько дней. Однако эта модель «показала более высокий уровень обмана», чем предыдущие модели, и продемонстрировала небезопасное поведение, пишет журнал.

Саачи Джайн, руководитель отдела систем безопасности OpenAI, рассказал WSJ, что модель плохо прошла испытания на согласованность, что является показателем того, насколько хорошо программа соответствует намерениям человека.

TechCrunch обратился к OpenAI за дополнительной информацией и обновит статью, если ответит.

Вопросы о безопасности преследовали индустрию искусственного интеллекта в течение последних нескольких месяцев — начиная с инцидента Hugging Face, в котором агент OpenAI вырвался из изолированной среды и взломал несколько разных компаний. После этого инцидента было обнаружено, что другие модели, в том числе Клод из Anthropic и Gemini из Google, продемонстрировали подобное поведение.