主要内容
Meta今日发布开源大模型Muse Glimmer,采用Apache 2.0协议,参数规模300亿,可在消费级GPU本地运行。该模型由Meta超智能实验室开发,专为解决云托管模型依赖网络与中心基础设施的局限设计,支持本地代码生成、工具调用、代理任务及大语言模型裁判评估,适用于处理日程、消息等私有上下文的个人代理。
Muse Glimmer已在Hugging Face平台开源,在多任务代理基准测试中表现突出:在MCP Atlas(75.5分)、DeepSearch QA(74.6分)、WildClawBench(47.6分)等测试中领先于Gemma4-31B和Qwen3.6-27B,8项测试中有5项得分最高。
编码与多模态能力方面,Muse Glimmer在SWE-Bench Pro(51.2分)和SciCode(43.6分)中领先,但在SWE-Bench Verified(76.0分)、TerminalBench 2.1(51.7分)中落后于Qwen3.6-27B。多模态测试中,其在Charxiv Reasoning(78.8分)领先,Qwen则在ScreenSpot Pro、OmniDocBench v1.5中占优。
Meta表示,Muse Glimmer支持OpenClaw等代理编排模式,开发者可自定义脚手架配置访问权限,并提供失败工具调用的重试训练机制,为本地AI代理提供安全灵活的解决方案。