• Виктор
  • Блог
  • 2 мин. чтения

Google научила Antigravity SDK работать с локальными моделями без интернета


Google научила Antigravity SDK запускать ИИ-агентов на локальных моделях, в том числе без интернета. Первой поддержана открытая Gemma 4 26B на движке LiteRT, а к Ollama, LM Studio и vLLM агент подключается как к обычному серверу.

Google научила Antigravity SDK работать с локальными моделями без интернета

Antigravity SDK — Python-библиотека, через которую Google открывает разработчикам движок своей агентной среды Antigravity . Агент на её основе читает файлы, запускает команды, правит код и вызывает подключённые инструменты. До сих пор мозгом такого агента служил облачный Gemini , а новый режим Google адресует тем, кому нельзя или невыгодно отправлять код во внешнее облако.

Gemini планирует, локальная Gemma латает уязвимости

Самый показательный сценарий из анонса Google называет схемой «архитектор и строитель». Облачная Gemini 3.8 Flash получает задачу найти и закрыть уязвимости в трёх модулях проекта, auth.py, billing.py и database.py. Исходников она не видит — план строится только по именам файлов и описанию задачи.

Дальше за дело берутся несколько локальных копий Gemma 4 26B на видеокарте. Они воспроизводят уязвимости, пишут исправления, критикуют патчи друг друга и прогоняют их через регрессионные тесты, которые ловят поломки в старом коде. В записанном прогоне облако потратило 95 токенов, а 97,2% всей работы (3322 токена) прошло локально. Все патчи прошли проверку, и код с машины не уходил.

В абсолютных числах демо скромное. 3322 токена — это несколько страниц кода, и как схема поведёт себя на проекте в тысячи файлов, Google не показывает.

Второй пример попроще. По одному запросу агент Antigravity на Gemma 4 26B написал на Python терминальную панель мониторинга (загрузка процессора, память и пять самых прожорливых процессов), сам составил список зависимостей и проверил результат. Облако в этом сценарии не участвовало вовсе.

Два способа подключить локальную модель к Antigravity SDK

Локальные модели Antigravity SDK поддерживает двумя путями:

  • LiteRTAgentConfig — оптимизированный вариант через LiteRT, движок Google AI Edge для запуска моделей прямо на устройстве. Первой здесь поддержана Gemma 4 26B A4B, модель со смесью экспертов, у которой из 26 млрд параметров на каждом шаге работают около 4 млрд;
  • LocalOpenAIAgentConfig — подключение к локальному серверу с OpenAI -совместимым интерфейсом, например Ollama, LM Studio или vLLM. Такие программы держат модель в памяти компьютера и отвечают на запросы так же, как облачный API.

По словам Google, смена бэкенда не трогает остальную логику агента, и инструменты, сценарии и правила доступа остаются прежними. Установка укладывается в две команды, pip install google-antigravity litert-lm и загрузку модели с Hugging Face через litert-lm import. Дальше агенту достаточно указать путь к файлу модели.

Второй путь интереснее, чем выглядит в анонсе. Через Ollama к агенту Google можно подключить и открытые модели других разработчиков — насколько хорошо они справятся с агентными задачами, компания не оценивает.

Порог входа – больше 24 ГБ видеопамяти

Для локального режима Antigravity SDK Google рекомендует машину, у которой больше 24 ГБ видеопамяти или общей памяти. Под это определение попадают серверные ускорители, старшие игровые видеокарты последних поколений и Mac на Apple Silicon с памятью от 32 ГБ. Обычный рабочий ноутбук в этот список не входит.

Второе ограничение касается скорости. Примеры кода из анонса прямо предупреждают, что локальный ответ может занять несколько минут. Для фоновых задач вроде аудита кода это терпимо, для живого диалога с агентом уже нет.

Документация пока отстаёт от анонса. В README репозитория Antigravity SDK раздела о локальных моделях нет, хотя пост в блоге ссылается именно на него, поэтому параметры LiteRTAgentConfig и назначение метода .lightweight() приходится понимать по примерам. В одном из них агенту выдают полные права через policy.allow_all(), хотя по умолчанию SDK работает только на чтение. Переносить такую настройку в рабочий проект лучше осознанно.

Для разработчиков из России локальный режим снимает главный барьер

Облачный API Gemini официально в России недоступен, и это затрудняло работу с Antigravity SDK. Локальный режим на Gemma 4 26B обходится без обращений к облаку Google. Библиотека ставится из PyPI, модель скачивается с Hugging Face, а в примерах из анонса нет даже API-ключа. Гибридная схема с Gemini в роли архитектора по-прежнему требует облачного доступа, так что начинать разумно с полностью локальных задач.

Google оставила Gemini место архитектора

Локальный режим Antigravity SDK похож на уступку рынку, но самое ценное звено цепочки Google оставила за собой. В гибридной схеме планирует облачный Gemini, а исполняет открытая Gemma, которая тоже принадлежит Google. Компания продвигает идею, что облако нужно для редких дорогих решений, а рутину можно гонять у себя. Проверкой станут первые отчёты разработчиков о том, как Gemma 4 26B справляется с реальными проектами крупнее демонстрационных трёх модулей.

Источник:
Google Developers Blog



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Anthropic объединила чат с Cowork и встроила редакторы документов и слайдов прямо в Claude

Anthropic объединила стандартный диалоговый чат и рабочий режим Cowork в единый интерфейс Claude. Модель теперь сама определяет характер...

Perplexity встроила слайдер вычислительных усилий в агентный сервис Computer

Perplexity добавила слайдер управления вычислительными усилиями в агентный сервис Computer. Пользователи веб-версии платформы могут выбирать глубину рассуждений и...

PixVerse обновила партнёрскую программу для авторов AI-видео

PixVerse представила Global Creative Partner Program 2.0 - обновлённую партнёрскую программу для авторов AI-видео. Участникам обещают кредиты, денежные...

Проверка текста нейросетью: частые ошибки новичков

Люди приходят к нейросети с текстом так же, как раньше несли его редактору: «вот, посмотри, всё ли нормально»....

Промты для новогодней ИИ-фотосессии, +подходящие нейросети

Как говорят, готовь сани зимой, а промты для новогодних ИИ-фотосессий — в ноябре. Картинки можно публиковать уже сейчас...

Kling добавила нативную генерацию в 4K в версии Video 3.0

Kling запустила режим 4K Mode в линейке Video 3.0. Теперь видео можно генерировать сразу в 4K — без...

ElevenLabs представила Composer — редактор песен по секциям

ElevenLabs добавила Composer в сервис Eleven Music. Редактор позволяет начать песню с чистого листа, текстового запроса, собственных слов...

Kling AI выпустила Skill для генерации видео через ИИ-агентов

Kling AI запустила Kling Skills Suite — инструмент, который подключается к сторонним AI-агентам и даёт им доступ к...

YouTube позволит генерировать Shorts с помощью Veo 3

На мероприятии «Made on YouTube» 16 сентября компания представила большое обновление для Shorts и YouTube Studio. В сервис...

Нейросеть Veo 3.1: как пользоваться и создавать видео бесплатно

Google обновила свою модель для генерации видео — Veo 3.1, и теперь создание роликов со звуком и озвучкой...

OpenAI выпустила GPT Image 2 и ChatGPT Images 2.0

OpenAI представила GPT Image 2 для API и одновременно обновила генерацию изображений в ChatGPT до версии Images 2.0....

OpenAI интегрировала ChatGPT в Microsoft Word через общую офисную надстройку

OpenAI выпустила интеграцию ChatGPT для текстового редактора Microsoft Word. Инструмент встраивается в боковую панель программы и доступен на...

Alibaba выложила Qwen-Image-2.1 – картинки с прозрачным фоном из коробки

Команда Qwen выложила в открытый доступ Qwen-Image-2.1 - модель, которая рисует изображения сразу с прозрачным фоном и правит...

Google выпустила Nano Banana 2 Lite — быструю модель для генерации изображений через Gemini API

Google выпустила Nano Banana 2 Lite (gemini-3.1-flash-lite-image) — новую модель для генерации и редактирования изображений. Это самая быстрая...

ElevenLabs выпустили Eleven v4 и v4 Turbo — ИИ для озвучки с управлением эмоциями и манерой речи

ElevenLabs представила новые модели синтеза речи Eleven v4 и Eleven v4 Turbo. Они построены на новой архитектуре и...

Лимиты использования в ChatGPT/Codex: где посмотреть и как сбросить

Даже на платных тарифах ChatGPT действуют лимиты на использование. Если они заканчиваются, сервис может прямо во время работы...

Claude Mythos 5. ИИ, который обычным пользователям не продадут

Существует целый класс программ, которые не рекламируют широко. Не потому, что они плохи, а ровно наоборот. Claude Mythos...

MiniMax Hub добавил аудиомодели и готовые процессы для производства видео

MiniMax обновила творческую платформу MiniMax Hub. В ней появились аудиомодели ElevenLabs Music v2 и Seed Audio 1.0, готовые...

ElevenLabs теперь можно подключить к Claude через MCP

ElevenLabs представила MCP-сервер для Claude. Он позволяет управлять агентами ElevenLabs из чата в Claude. Коннектор уже появился в...

Google показала проекты на Gemini 3.8 Flash

Google показала четыре проекта, собранных разработчиками на Gemini 3.8 Flash. Модель вышла в начале сентября и, по заявлению...