Antigravity SDK 新增本地模型支持,Gemma 4 26B 等模型可通过 LiteRT 本地执行,支持 Ollama/vLLM 兼容推理服务器。
今天,我们正式宣布 Antigravity SDK 支持在多种本地模型和执行选项上运行本地工作流,并首发支持 Google AI Edge 的 LiteRT 驱动的 Gemma 4 26B A4B。
Antigravity SDK 让开发者能够基于驱动 Google Antigravity 的同款 Agent 能力进行开发。借助这一新支持,你可以通过本地模型完全离线地启用 Agent 辅助功能。我们针对 LiteRT 和 Gemma 4 26B 优化了这一工作流,高效利用本地 GPU 和 RAM,进一步释放本地机器的能力上限。
本地模型执行为 Agent 体验带来多项优势:
成本效率:无需 API 费用或速率限制,即可执行本地 Agent 工作流。
隐私保护:代码和请求完全保留在本地机器上,非常适合有严格数据隐私要求或受合规限制的企业环境。
离线容错:即使在无法保证稳定网络连接的环境下,也能无缝执行 Agent 工作流。
混合工作流:将节省 Token 的本地处理与云端处理相结合,在需要时仍能访问更大、更强大的模型,同时最大化效率。
(推荐使用 >24GB VRAM 或统一内存的机器)
创建一个虚拟环境:
python3 -m venv .venv
source .venv/bin/activate
安装 Antigravity SDK 和 LiteRT-LM,并下载 Gemma 4 26B A4B:
pip install google-antigravity litert-lm
litert-lm import \
--from-huggingface-repo=litert-community/gemma-4-26B-A4B-it-litert-lm \
gemma-4-26B-A4B-it-gpu.litertlm \
gemma4-26b
在目录下创建一个名为 agy_sample.py 的文件,将以下内容粘贴进去:
import asyncio
import os
from google.antigravity import Agent, LiteRTAgentConfig
from google.antigravity.hooks import policy
# UPDATE: Point to the locally downloaded model from the previous step (litert-lm import ...)
MODEL_PATH = os.path.expanduser("~/.litert-lm/models/gemma4-26b/model.litertlm")
async def main():
print(f"Using local LiteRT model: {MODEL_PATH}. Please wait for local inference to complete. This could take several minutes.")
config = LiteRTAgentConfig(model_path=MODEL_PATH).lightweight()
async with Agent(config) as agent:
response = await agent.chat("What files are in the current directory?")
async for token in response:
print(token, end="", flush=True)
if __name__ == "__main__":
asyncio.run(main())
在许多场景中,我们发现"架构师-构建者"模式是结合云端模型规模与本地模型优势的绝佳方式。在下方这段由更新版 Antigravity SDK 构建的混合演示视频中,云端架构师(Gemini 3.8 Flash)担任规划者和指挥者,而本地部署的 Gemma 4 26B 实例集群则在设备端完成所有重活。
当被要求对三个有漏洞的模块(auth.py、billing.py 和 database.py)进行审计和修复时,整个工作流严格保证了数据隐私,同时最大化 Token 利用率:
无需上传代码:Gemini 3.8 Flash 仅根据文件名和任务描述制定策略并分解工作——仅消耗 95 个云端 Token,全程没有任何源代码离开本机。
本地自主接力:本地 Gemma 4 26B 模型接管本地 GPU,执行对抗性审计循环:复现安全漏洞、编写候选修复方案、对补丁进行评审,并根据回归测试套件进行验证。
巨大的成本和隐私收益:在这段录制运行中,97.2% 的 Token(3322 个)完全在本地离线运行,未调用任何云端 API,在将专有代码完全安全地保留在设备端的同时,交付了完全验证通过的绿色补丁。
点击这里查看示例项目,可以运行内置的 3 文件审计流程,也可以将其指向你自己的 Python 模块和测试套件。
Sorry, your browser doesn't support playback for this video
Antigravity SDK 配合 Gemma 4 26B A4B 在构建实用系统工具方面表现出色。在这个例子中,Agent 构建了一个在终端中实时更新的资源监控工具。仅需一条提示词,Agent 就能自主编写一个使用 psutil 和 rich 库的 Python 脚本,用于追踪 CPU 和内存使用情况,生成所需的 requirements.txt 文件,甚至测试生成的代码是否正常工作——全程完全在本地机器上运行,使用 Gemma 4 26B。
Sorry, your browser doesn't support playback for this video
import asyncio
import os
from google.antigravity import Agent, LiteRTAgentConfig
from google.antigravity.hooks import policy
# UPDATE: Your prompt
PROMPT = "Build a command-line interface tool using the psutil and rich libraries that displays a live-updating terminal dashboard. It should show CPU usage, memory consumption, and a sorted table of the top 5 most memory-intensive processes. Save the script as 'monitor.py' and create a 'requirements.txt' file. Test that it works."
# UPDATE: Point to the locally imported LiteRT-LM model path
MODEL_PATH = os.path.expanduser("~/.litert-lm/models/gemma4-26b/model.litertlm")
# UPDATE: Give AGY-SDK a workspace to write files
WORKING_DIR = os.path.expanduser("~/agy-test")
os.makedirs(WORKING_DIR, exist_ok=True)
os.chdir(WORKING_DIR)
async def main():
print(f"Using local LiteRT model: {MODEL_PATH}. Please wait for local inference to complete. This could take several minutes.")
config = LiteRTAgentConfig(
model_path=MODEL_PATH,
workspaces=[WORKING_DIR],
policies=[policy.allow_all()],
).lightweight()
async with Agent(config) as agent:
response = await agent.chat(PROMPT)
async for token in response:
print(token, end="", flush=True)
if __name__ == "__main__":
asyncio.run(main())
Antigravity SDK 还通过 LocalOpenAIAgentConfig 提供了无缝、即插即用的支持,可连接任何 OpenAI 兼容的服务器,如 Ollama、LM Studio 或 vLLM。这让你能够灵活尝试不同的本地推理后端,同时保持 Agent 编排、工具和工作流完全不变。
通过查看 Antigravity Python SDK README 中的说明,开始你的本地 AI 之旅,并进一步了解如何使用 LiteRT 在边缘高效运行模型。欢迎在 Antigravity Python SDK GitHub Issue Tracker 上分享你的反馈和功能请求。期待看到你们的作品!
致谢:Abhi Patel、Ander Dobo、Ben Miles、Cormac Brick、Ian Ballantyne、Jingxiao Zheng、Jonathan Reay、Kimish Patel、Lu Wang、Marissa Ikonomidis、Matthias Grundmann、Olivier Lacombe、Omar Sanseviero、Rishika Sinha、Rody Davis、Taylor Mullen、Tyler Mullen、Wai Hon Law、Xiaoming Hu、Xu Chen、Yu-hui Chen