The Verge · Разработка · 1 ч назад
Google заявляет, что ее новая модель Gemini 3.8 Flash «работает тяжелее», но может стоить дороже
Google выпустила Gemini 3.8 Flash всего через несколько недель после своего предшественника. Компания утверждает, что новая модель «работает тяжелее», чем Gemini 3.7 Flash, выполняя больше шагов для рассуждения над сложными задачами и «итеративно вызывая инструменты». Он имеет ту же начальную цену, что и 3,7 Flash: 0,75 доллара США за миллион входных токенов и 3,75 доллара США за миллион выходных токенов, но в конечн…
Подробности
Google выпустила Gemini 3.8 Flash всего через несколько недель после своего предшественника. Компания утверждает, что новая модель «работает тяжелее», чем Gemini 3.7 Flash, выполняя больше шагов для рассуждения над сложными задачами и «итеративно вызывая инструменты». Он имеет ту же начальную цену, что и 3,7 Flash: 0,75 доллара США за миллион входных токенов и 3,75 доллара США за миллион выходных токенов, но в конечном итоге он может стоить пользователям больше. Google предупреждает, что «модель может использовать больше токенов для максимизации производительности, особенно при более высоких уровнях усилий». Разработчики могут продолжать использовать Gemini 3.7 Flash, если хотят свести к минимуму использование токенов.
За запуском Gemini 3.8 Flash последовали первые впечатления в Интернете. Искусственный анализ подчеркнул цену модели, заявив, что Gemini 3.8 Flash — «самая дешевая модель, которую мы измеряли на этом уровне интеллекта. Это примерно на 40 % выше, чем у Gemini 3.7 Flash, несмотря на неизменную цену за токен, что обусловлено увеличением количества выходных токенов на задачу на 30 % и увеличением количества агентских оценок».
Генеральный директор Aigora.ai Джон Эннис сравнил Gemini 3.8 Flash с моделями Anthropic, заявив, что он предлагает «качество кодирования Opus 5, но за небольшую часть стоимости и очень быстро», добавив: «Это будет очень здорово для таких вещей, как создание рекламных видеороликов».
Google заявляет, что Gemini 3.8 Flash предлагает «значительные улучшения» для разработки программного обеспечения и автономных агентов искусственного интеллекта. Он превосходит своего предшественника и другие передовые модели в тесте разработки программного обеспечения DeepSWE v1.1, включая Fable 5 от Anthropic, который ранее на этой неделе получил обновление, которое также обещает более высокую производительность по более низкой цене за счет снижения цены на использование кэшированных данных.
Новая модель Google также превзошла своих конкурентов в тестах Vals Finance Agent V2 и Harvey’s Legal Agent. Однако новая модель также «обеспечивает защиту от злоупотреблений в области химической, биологической, радиологической и ядерной (ХБРЯ) и киберпреступлений».