Google выпустила Gemini 3.8 Flash

2 сентября Google представила Gemini 3.8 Flash – новую универсальную модель семейства Gemini 3, ориентированную на программирование, автономных агентов и сложные многоэтапные задачи. В Kodacode уже есть, если что.

Google называет Gemini 3.8 Flash своей самой интеллектуальной моделью линейки Flash. Она построена на основе Gemini 3.7 Flash, которая вышла всего три недели назад. Это уже третье обновление семейства Flash за последние шесть недель.

По заявлению разработчиков, новая версия лучше справляется с длительной автономной работой. Она разбивает задачу на более мелкие шаги, несколько раз вызывает инструменты и проверяет промежуточные результаты. Основной прирост ожидается в программировании, работе с большими проектами и агентных сценариях.

Результаты DeepSWE v1.1 в зависимости от средней стоимости выполнения задачиРезультаты DeepSWE v1.1 в зависимости от средней стоимости выполнения задачи

Результаты тестов

В официальном руководстве Google приводит следующее сравнение Gemini 3.8 Flash и Gemini 3.7 Flash:

Бенчмарк

Gemini 3.8 Flash

Gemini 3.7 Flash

Terminal-Bench 2.1

90,8%

81,6%

SWE-Bench Pro

61,6%

60,4%

SWE-Atlas

51,9%

48,0%

τ³-bench Banking

38,1%

30,9%

CharXiv Reasoning

86,2%

84,5%

GDP.pdf

35,0%

34,0%

Humanity’s Last Exam

45,4%

45,7%

Наиболее заметный прирост получился в Terminal-Bench 2.1, который проверяет способность модели выполнять практические задачи в терминале, — плюс 9,2 процентного пункта. Улучшения также заметны в SWE-Atlas и банковской части τ³-bench. При этом в обычной версии Humanity’s Last Exam результат практически не изменился и даже оказался на 0,3 пункта ниже.

В другой серии опубликованных Google тестов Gemini 3.8 Flash получила:

  • 61,4% против 59,0% у Gemini 3.7 Flash в Vals Finance Agent v2;

  • 10,0% против 8,8% в Harvey’s Legal Agent Benchmark;

  • 54,9% против 53,6% в HLE-Verified.

Контекст, форматы и инструменты

Gemini 3.8 Flash получила контекстное окно до 1 048 576 токенов и может сгенерировать до 65 536 токенов за один ответ.

На вход модель принимает:

  • текст;

  • изображения;

  • аудио;

  • видео;

  • PDF-документы.

Результатом пока может быть только текст. Генерация изображений и аудио не поддерживается.

Через Gemini API модели доступны кэширование контекста, исполнение кода, поиск по файлам, function calling, структурированный вывод, работа с URL, подключение Google Search и Google Maps. Также заявлена экспериментальная поддержка управления компьютером. Live API для Gemini 3.8 Flash не поддерживается.

Модель имеет статус General Availability, то есть Google позиционирует её как готовую для использования в продакшн системах.

Три уровня рассуждений

Разработчики могут управлять количеством вычислений с помощью параметра thinking_level:

  • low – быстрые ответы, чаты, черновики и задачи, чувствительные к задержке;

  • medium – режим по умолчанию и баланс между скоростью и качеством;

  • high – сложное программирование, математика, длительные цепочки действий и активная работа с инструментами.

Режим minimal модель не поддерживает.

Google отдельно предупреждает, что Gemini 3.8 Flash может расходовать больше токенов, чем 3.7 Flash, особенно в режиме high. Все потому, что на сложных задачах модель делает больше промежуточных шагов, повторно вызывает инструменты и проверяет собственную работу.

Если важнее стоимость и минимальный расход токенов, Google рекомендует уменьшать уровень рассуждений или продолжать использовать Gemini 3.7 Flash.

Цена

До 31 декабря 2026 года для Gemini 3.8 Flash действует стартовая цена:

  • $0,75 за 1 млн входных токенов;

  • $3,75 за 1 млн выходных токенов.

Она совпадает с текущей ценой Gemini 3.7 Flash. С 1 января 2027 года Google планирует повысить стоимость до $1,50 за 1 млн входных и $7,50 за 1 млн выходных токенов.

Gemini 3.8 Flash в Kodacode

Мы добавили Gemini 3.8 Flash в Koda на следующий день после официального релиза. Модель уже можно использовать для работы с кодом, исследования репозиториев, рефакторинга и длительных автономных задач.

Flash по-прежнему остаётся быстрой моделью, но теперь готова дольше работать над сложным запросом и внимательнее проверять результат. Обратная сторона только в том, что имеется повышенный расход токенов на самых тяжёлых задачах.

  • официальный анонс Google;

  • документация Gemini API;

  • описание изменений и цен;

  • руководство разработчика и сравнение с 3.7 Flash;

  • официальная карточка модели.

Попробуйте Kodacode на своём проекте: скачать для IDE, CLI и Desktop. Анонсы обновлений, практические разборы и новости продукта в нашем Telegram-канале.

Источник: habr.com

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев