TechCrunch · AI · 2 ч назад

Vals при поддержке Андриссена Горовица стремится стать золотым стандартом для сравнительного анализа ИИ.

Vals AI надеется сделать сравнительный анализ ИИ более нейтральным и заслуживающим доверия ресурсом в мире, который все больше наводнен моделями ИИ.

Источник TechCrunch
Опубликовано 2 ч назад
Оригинальный заголовок Vals, backed by Andreessen Horowitz, is looking to become the gold standard for AI benchmarking
Важность 4/5
Почему это может быть интересно Важно для понимания, куда реально двигаются модели, агенты и продуктовые AI-инструменты.
← Назад к ленте Открыть оригинал
#ai#startups#tech

Подробности

К сожалению, компании также придумали, как перехитрить устаревшие системы сравнительного анализа, многие из которых устарели и не созданы для измерения возможностей современных моделей.

Стартап Vals, созданный в 2024 году, заявляет, что его миссия — исправить эту очень несовершенную систему. Менее чем за два года компания зарекомендовала себя как заметное присутствие в технологической отрасли, а в прошлом году ей удалось обеспечить посевной раунд под руководством 8VC и Bloomberg Beta. Затем, в прошлом месяце, после периода быстрого роста, компания привлекла 40 миллионов долларов в рамках серии А под руководством Андриссена Горовица.

Райан Кришнан, 25-летний сооснователь компании, ранее проходил стажировку в Palantir, а будучи студентом Стэнфорда, работал в Microsoft и в знаменитой школьной лаборатории искусственного интеллекта. Кришнан говорит, что Вальс родился из своих собственных наблюдений о том, как бенчмаркинг отстает от достижений отрасли, для измерения которой он был предназначен.

На прошлой неделе молодой основатель показал мне двухэтажный офис своей компании на Фолсом-стрит в Сан-Франциско — старое кирпичное здание, в котором сто лет назад располагалась крупная пивоварня. Вместо промышленного производства пива, историческая структура теперь является домом для множества различных стартапов, стремящихся обеспечить будущее технологической отрасли.

«Исторически я думаю, что оценка проводилась для оценки интеллекта очень абстрактным способом», — говорит мне Кришнан. «Например, знают ли модели достаточно информации, чтобы пройти типовой тест на экзамен на адвоката?»