Компания Google приступила к тестированию новой модели Gemini 4 Argon, которая пока доступна ограниченному числу специалистов по кибербезопасности и другим доверенным тестировщикам. Компания планирует постепенно расширять доступ, а полноценный запуск для разработчиков, бизнеса и обычных пользователей ожидается позже. Подписывайтесь на Telegram-канал про технологии
Одной из главных особенностей Argon стал увеличенный лимит вывода в 1 млн токенов против 64 тысяч у предыдущих моделей. Это позволяет использовать её для длинных многоэтапных задач, включая разработку программного обеспечения, анализ документов и корпоративные исследования. Стартовая цена API составит 2 доллара за миллион входных токенов и 10 долларов за миллион выходных, а для кэшированных входных токенов действует скидка 95 %.
В Google модель уже применяют сами сотрудники компании. Argon используют для отладки и масштабной миграции кода, исследований и подготовки текстов. В одном из проектов модель помогла оптимизировать квантовый алгоритм и превзойти опубликованный базовый показатель на 40 %. Другой эксперимент с анализом телеметрии позволил освободить более 300 ТиБ памяти в дата-центрах Google.
Отдельное внимание уделено программированию. Агенты Argon участвуют в переносе крупных кодовых баз с C и C++ на Rust, включая проекты re2, libgav1 и ядро Fuchsia Zircon. При работе с libgav1 модель переработала 32 тысячи строк SIMD-кода. Получившийся вариант на Rust оказался в 2,7 раза быстрее предыдущего порта при сохранении идентичного видеовыхода.
Если говорить о задачах кибербезопасности, в Google заявляют о возможности Argon самостоятельно находить, проверять и устранять критические уязвимости. В тесте CWE-bench v1 модель получила 68 % и разделила первое место. Компания также сообщает о более высоких результатах в поиске уязвимостей работающих веб-систем по сравнению с Gemini 3.8 Flash Cyber.
На DeepSWE v1.1, который оценивает выполнение длительных задач по разработке, Argon набрала 77,9 %. Для сравнения: у GPT-6 Astra результат составляет 74,1 %, у Claude Opus 5.5 составляет 74,2 %, у Fable 5.1 составляет 67,4 %. Модель также опережает конкурентов в тестах автоматизации бизнес‑процессов, финансовых и юридических задач, работы с длинным контекстом и понимания видео.
Перед широким запуском Google продолжает усиливать защиту модели от вредоносных запросов, непрямых prompt injection-атак и действий, которые могут расходиться с намерениями пользователя. Для высокорисковых испытаний используются изолированные среды и дополнительный мониторинг.
Точная дата массового запуска Gemini 4 Argon пока не названа. Сначала модель получат платные пользователи API и подписчики Google AI Ultra.
Источник: trashbox.ru