推出 Muse Glimmer:可在你的设备上运行的开放智能体模型
Meta AI Research · · 发布于 2026-08-10 · 26 分钟阅读
Meta Superintelligence Labs 推出 30B 参数开放智能体模型 Muse Glimmer,以 Apache 2.0 许可证开源模型权重,可在配备单张消费级 GPU 的 Mac 或 PC 上运行,支持本地智能体、函数调用、本地编程与 LLM-as-a-judge 等场景。
发布与开源许可
Muse Glimmer 是 Meta Superintelligence Labs 的下一款模型,模型权重以 Apache 2.0 许可证开放,已发布于 Hugging Face,并附带开发者文档。
模型规格与目标
Muse Glimmer 是一个 30B 参数模型,专为始终在线的本地代理工作流优化,可在配备单消费级 GPU 的 Mac 或 PC 上运行。
训练方法
训练分为预训练、中期训练和后期训练:预训练使用 Muse Spark 的输出进行 logit 蒸馏;中期训练使用更长上下文、更多代理相关数据;后期训练结合监督微调、on-policy 蒸馏和强化学习。
代理能力
模型具备端到端代理任务完成、可靠工具调用、多步推理、失败恢复、多模态输入与推理、脚手架兼容、可控推理强度和 100 多种语言支持。
本地运行优化
通过量化将模型权重压缩至约 4-bit,语言模型体积降至 20GB 以下,可在 24GB 或 32GB 内存范围内运行;同时提供基于 DFlash 的投机解码模型,以加快生成速度。
部署生态与合作
即将支持 llama.cpp、MLX、ExecuTorch、vLLM、SGLang 等框架,并与 Ollama、LM Studio、Unsloth、Together AI、Fireworks AI、OpenRouter 等合作,同时与 AMD、Arm、Dell、Intel、NVIDIA 等硬件伙伴优化性能。