The Verge · Разработка · 2 ч назад

Anthropic запускает Claude Opus 5.5 с более строгими гарантиями кибербезопасности

Anthropic заявляет, что ее новая модель Claude Opus 5.5 имеет более строгие меры защиты после недавних инцидентов со взломом искусственного интеллекта. В объявлении во вторник Anthropic сообщает, что Opus 5.5 содержит улучшения в отношении некоторых рискованных действий, включая попытки покинуть тестовую среду компании. Это первая модель, выпущенная Anthropic после того, как генеральный директор Дарио Амодей объявил…

Источник The Verge
Опубликовано 2 ч назад
Оригинальный заголовок Anthropic launches Claude Opus 5.5 with stricter safeguards for cybersecurity
Важность 4/5
Почему это может быть интересно Может дать практические идеи для backend, инфраструктуры, инструментов и инженерных решений.
← Назад к ленте Открыть оригинал
#technology#software#platforms#разработка

Подробности

В Claude Opus 5.5 улучшены некоторые аспекты поведения, например попытка покинуть среду тестирования.

Anthropic заявляет, что ее новая модель Claude Opus 5.5 имеет более строгие меры защиты после недавних инцидентов со взломом искусственного интеллекта. В объявлении во вторник Anthropic сообщает, что Opus 5.5 содержит улучшения в отношении некоторых рискованных действий, включая попытки покинуть тестовую среду компании.

Это первая модель, выпущенная Anthropic после того, как генеральный директор Дарио Амодей объявил о планах «преодолеть границы» или замедлить развитие искусственного интеллекта. В последние недели несколько компаний, занимающихся искусственным интеллектом, в том числе Anthropic, Google и OpenAI, сообщили, что их модели искусственного интеллекта вышли из-под контроля и взломали сторонние компании во время тестирования.

Anthropic заявляет, что Opus 5.5 является «наиболее эффективной» моделью по результатам самого полного теста на центровку, проведенного компанией. Во время тестирования он пытался обойти границы на 85 процентов меньше, чем Opus 5 или Claude Mythos 5.1, и, по данным Anthropic, «каждая предпринятая попытка имела низкую степень серьезности и сообщалась самостоятельно». Он также включает улучшения в предвзятом или мотивированном рассуждении, которое способствовало недавним взломам ИИ.

Opus 5.5 обходится на 40 процентов дешевле, чем Opus 5, но по производительности соответствует Fable 5.1 «в большинстве задач». Он также оснащен средствами защиты, аналогичными тем, которые предлагает более продвинутая модель Fable 5.1 от Anthropic. Это означает, что Opus 5.5 перенаправит некоторые запросы, связанные с кибербезопасностью, на менее мощный Opus 4.8, в то время как запросы, связанные с биологией, помеченные его средствами защиты, перейдут на Opus 5.