
Meta发力,开源全新30B大模型Muse Glimmer
就在刚刚,Meta超级智能实验室正式发布全新30B大模型 —— Muse Glimmer,而且重磅开源。这个智能体模型,专为本地设备量身定制。它性能强大,却被塞进不到20GB的内存里,只要一块消费级GPU(比如RTX 5090)或者一台M4/M5 Max的MacBook就能流畅运行。而且,Meta这次采用的是最良心的Apache 2.0协议,允许免费商用。
Muse Glimmer:塞进背包的「超级智能」
如今的开源AI很多,但能干活且普通人电脑能跑的模型很少。Muse Glimmer的诞生就是为打破僵局,Meta野心是让它能「完全离线、本地运行」,可在没网的飞机、高铁上调用,还能保障隐私安全。Meta有几大黑魔法让30B模型塞进个人电脑。一是极限压缩,用4 - bit量化压缩技术将模型权重压缩到20GB以下,且对性能表现几乎无衰减,在24GB显存或32GB内存设备上可运行并留空间给视觉感知编码器和上下文缓存。二是DFlash投机解码,Muse Glimmer自带基于DFlash技术的轻量级「草稿模型」,采用「投机解码」技术,在不牺牲输出质量前提下,让其在RTX 5090上生成速度飙升3.1倍,在MacBook M4 - Max和M5 - Max上也能撑得起流畅实时对话和复杂代码生成。
Muse Glimmer定位不只是LLM,是为智能体工作流优化,由Meta顶级闭源大模型Muse Spark经过「逻辑蒸馏」训练而来,具备五大核心超能力:端到端任务完成,在DeepSearch QA、SWE - Bench等测试中表现优异;可靠的工具调用,能精准识别调用工具的时机;失败恢复能力,代码报错或工具调用失败时能自动诊断错误、修改参数并重新尝试;长程多步推理,能制定长期连贯计划;多模态理解,能看懂屏幕截图、图表和文档,实现图文穿插推理。在各项基准测试中,它在同体量模型中与Gemma4 - 31B和Qwen3.6 - 27B不相上下,在「智能体操作」上表现惊人,且采用Apache 2.0协议,目前权重已上线Hugging Face,很快会全面接入Ollama、LM Studio等主流本地运行工具。前Meta超能实验室评估负责人Zengyi Qin分析称,Muse Spark将对全球开源模型形成降维打击,原因在于Meta今年基础设施预算高达1450亿美元,有更多算力和合规优势,且Meta开源无需靠卖API赚钱,30B免费模型和Apache 2.0协议将对开源实验室商业逻辑形成巨大冲击。
小扎万字檄文,撕下硅谷「AI安全」假面
小扎发布万字长文,是Meta向闭源阵营下的战书。文章核心思想是超级智能必须属于每个人,把超级智能集中在少数人手里才是人类最大危险。他猛烈抨击「AI末日论」与权力集中,指出认为AI危险需权力极端集中的观念有固有问题,举例说明权力集中会让社会倒退,而权力制衡才是真正的安全。他还提出颠覆性的「AI对齐」观,称人类文化多样,不存在让单一超级智能对所有人仁慈的技术方案,批评竞品把公司教条强加给用户,Meta提出AI必须与用户个人目标和价值观对齐,并承诺为个人Agent提供「完全私密模式」。
在文章后半段,小扎对美国目前AI监管政策表达强烈不满,认为过度严苛限制是「给竞争对手送大礼」,他公开站台蒸馏,指出从其他模型学习是开源生态系统运作重要原则,Muse Glimmer就是从Muse Spark中蒸馏出来的。他呼吁美国政策放宽对训练数据和蒸馏技术的限制,否则美国开源AI将失去竞争力,限制美国开源模型不能解决问题,反而会削弱美国在AI生态上的话语权,警告美国若主动设限,其他国家开源新星会填补空白,让美国失去定义全球AI标准的机会,他还提出折中方案,即让实验室提前向政府分享「中间训练检查点」。今天,Meta用Muse Glimmer本地模型证明,超级智能可以放在每个人包里。


被折叠的 条评论
为什么被折叠?



