Google于2026年9月23日宣布,Antigravity SDK新增本地AI模型工作流支持,首批适配Gemma 4 26B A4B与Google AI Edge的LiteRT。开发者可以在本机运行智能体,让模型使用本地GPU和内存完成离线任务,也可以把本地模型与云端模型组合成混合工作流。
该SDK面向需要隐私、离线能力或可控成本的开发者和企业团队。官方示例提供LiteRTAgentConfig配置,并建议使用超过24GB显存或统一内存的机器;同时支持通过LocalOpenAIAgentConfig接入Ollama、LM Studio和vLLM等OpenAI兼容推理服务器。混合架构中,云端模型可以负责规划,本地Gemma实例负责代码审计、补丁编写和回归测试,尽量避免上传源代码。
Google展示的一次安全修复演示中,Gemini 3.8 Flash只根据文件名和任务描述规划,使用95个云端token;本地模型完成主要审计和修复,记录显示97.2%的token在本地离线运行。这个数字来自官方演示,不是通用性能或隐私保证,实际效果会受硬件、模型量化、工作区权限和任务复杂度影响。运行智能体仍需谨慎设置文件、命令和网络策略;若采用云端规划器,任务元数据仍可能离开本机。
官方发布日期:2026年9月23日。官方来源:https://developers.googleblog.com/introducing-support-for-local-ai-models-in-the-antigravity-sdk/ |