Meta宣布开源Muse Glimmer,300亿参数可在单张消费级GPU上运行,瞄准always-on个人Agent,与OpenAI/Anthropic的订阅模式差异化竞争。
Originally published on NextFuture
Zuckerberg 刚刚宣布 Meta 将开源 Muse Glimmer,这是一款 300 亿参数的小型模型,小到足以在单张消费级 GPU 上运行,无需云服务器。这是 Meta 在 OpenAI 和 Anthropic 追求的订阅模式之外的一次方向转变。
在这篇 8 月 10 日发布的 6510 词长文中,Zuckerberg 将 Muse Glimmer 描述为"small enough to run on a Mac or PC with a single consumer GPU"——小到可以在 Mac 或 PC 上仅用一张消费级 GPU 运行。与云端 chatbot 不同,这款模型专为持续运行(always-on agent)的个人 agent 设计,实时学习用户上下文,而非每次等你打开 app 才响应。
Zuckerberg 在文中写道:"We will offer free versions that will be accessible to billions of people." 开源策略延续了此前 Llama 的打法,但这次直接瞄准个人 agent 而非通用 LLM chatbot。
与依赖 API 和订阅模式的云端 chatbot 不同,始终在线的本地 agent 可以成为设备上的默认平台——谁控制了用户机器上 AI runtime,谁就控制了下一个个人 AI 应用生态,堪比当年操作系统锁定用户的方式。这正是越南开发者从现在起就该关注的原因,无需等 Meta 推出正式产品才重视。
你无需等待 Muse Glimmer 就能体验类似路径。配合 Ollama 在 Docker 上运行 Open WebUI(GitHub 星标超过 70000),你可以在低配 VPS 上自托管 Llama 3.1、Mistral NeMo、DeepSeek-Coder 或 Qwen 2.5 等量化模型,所有 prompt 和代码都留在自己的服务器上。
| 方案 | 成本/月 | 限制 |
|---|---|---|
| ChatGPT Plus / Claude Pro | $20(≈$240/年) | 高峰期速率限制,数据被保留用于训练 |
| Open WebUI + Ollama(独立 VPS) | $6–12 | 无限消息,100% 隐私 |
| Hybrid(Open WebUI + OpenRouter/DeepSeek API) | $1–3(按 token 计费) | 通过单一界面访问 100+ 模型 |
以上为自托管指南中的成本估算,非 VPS 提供商官方数据——实际费用取决于 RAM/NVMe 配置和每月 token 用量。
Meta 在未来几周是否会公开发布 Muse Glimmer 并附带具体许可证,还是仅停留在文章层面。
如果你目前每月在付 AI 订阅费,在决定完全转向 self-host 之前,先在 8GB RAM VPS 上用 llama3.1:8b 跑一下 token 速度基准测试。
关注 OpenAI 和 Anthropic 是否会推出各自的 on-device 方案来反击 Meta 的这一策略。
This article was originally published on NextFuture. Follow us for more fullstack & AI engineering content.