В Google Antigravity SDK появилась поддержка полностью локальных моделей

Google добавила в Antigravity SDK поддержку локальных AI‑моделей. Агенты на базе SDK могут работать полностью на компьютере пользователя без отправки данных в облако и платы за токены.

В первую очередь Google оптимизировала Antigravity SDK для модели Gemma 4 26B A4B и собственного рантайма LiteRT. Gemma 4 26B построена на MoE‑архитектуре. Всего в модели 26 млрд параметров, но при генерации используется всего около 3,8 млрд. Благодаря этому достаточно крупную модель можно запускать на пользовательском железе с ограниченными вычислительными ресурсами.

Для запуска Google рекомендует использовать компьютеры с 24 ГБ видеопамяти или объединённой памяти. Подготовленная для LiteRT версия Gemma занимает около 17 ГБ на диске. На чипах Apple Silicon используется Metal, а на Windows и Linux доступна работа с GPU. В SDK также есть NPU‑бэкенд.

При этом Antigravity SDK не ограничивает пользователей одной моделью и одним рантаймом. Систему можно подключать к OpenAI‑совместимым API, включая Ollama, LM Studio и vLLM. Модель можно заменить без переписывания основной логики агентов, его сценариев и инструментов.

Есть и гибридный режим работы, в котором локальная и облачная модели работают вместе. Google показала пример, в котором Gemini 3.8 Flash выступает в роли «архитектора», а локальные экземпляры Gemma 4 анализируют код, ищут уязвимости, создают исправления и запускают тесты. В одном из тестов облачная модель потратила всего 95 токенов, а локальные — 3322 (97,2%).

Источник: habr.com

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев