TechCrunch · AI · 34 мин назад

Nvidia только что показала, что настоящим героем теперь является ремень безопасности, а не модель искусственного интеллекта.

Исследования Nvidia показывают, что агенты ИИ могут работать хорошо и не сходить с ума благодаря точной настройке, даже если модель ИИ не так уж хороша для выполнения этой задачи.

Источник TechCrunch
Опубликовано 34 мин назад
Оригинальный заголовок Nvidia just showed that the harness, not the AI model, is now the real hero
Важность 4/5
Почему это может быть интересно Важно для понимания, куда реально двигаются модели, агенты и продуктовые AI-инструменты.
← Назад к ленте Открыть оригинал
#ai#startups#tech

Подробности

В пятницу Nvidia опубликовала несколько интересных новых исследований, в которых говорится, что именно система, а не базовая модель, гораздо важнее, когда ИИ просит выполнять долгосрочные задачи.

The tldr: просто используя специальное оборудование, настроенное для хорошей работы с памятью и включающее компонент, похожий на босса-супервайзера, исследователи добились того, что Клод Опус 5 набрал 100% баллов в тесте интерактивного мышления ARC-AGI-3. (Этот тест особенно разозлил конкурирующую пограничную лабораторию OpenAI.) Без ремня Opus 5 набрал 30%, что стало лучшим результатом среди всех протестированных моделей.

Исследование Nvidia является еще одним показателем того, что, хотя выбор модели действительно имеет значение, действуя как мозг агента, он представляет собой меньшую часть агентной системы, чем думают многие пользователи ИИ, особенно для долгосрочных задач. Обвязка — это то, что делает модель агентом: она управляет памятью, контекстом и обратной связью.

«Вообще говоря, мир интерпретирует агента почти как API модели», — рассказывает TechCrunch Адель Эль Халлак, вице-президент по продуктам подразделения искусственного интеллекта Nvidia (на фото выше). Но на самом деле агент — это нечто большее. "Это модель. Это каркас вокруг модели, который мы называем обвязкой, то есть набор инструментов, которые она использует. Это среда выполнения и связанные с ней навыки и библиотеки, к которым мы даем ей доступ".

Задачи с долгосрочным горизонтом — это те, которые требуют объединения множества решений, иногда в течение нескольких дней, для получения завершенной работы. Это отличие от ИИ, просто выдающего ответ на подсказку. Выяснение того, как заставить ИИ выполнять долгосрочные задачи, не отвлекаясь и не отправляясь в страну ла-ла, является одним из Святых Граалей в агентных исследованиях.