打开网易新闻 查看精彩图片

新智元报道

打开网易新闻 查看精彩图片

就在刚刚,Meta发力了!

首先,Meta超级智能实验室正式发布全新30B大模型 —— Muse Glimmer,而且重磅开源。

打开网易新闻 查看精彩图片

这个智能体模型,专为本地设备量身定制。它性能强大,却被塞进不到20GB的内存里,只要一块消费级 GPU(比如 RTX 5090)或者一台 M4/M5 Max 的 MacBook 就能流畅运行!

而且,Meta这次采用的是最良心的 Apache 2.0 协议,允许免费商用,随便造。

另一方面,Meta CEO 小扎亲自下场,发表了一篇万字重磅宣言——《未来属于每个人》。

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

这个长篇檄文中,他没有点名,却处处都在暗讽OpenAI 和 Anthropic。

他开炮说:有些人天天炒作AI末日论,试图把超级智能集中在少数几家公司和少数精英手里,这才是人类面临的最大危险!

Muse Glimmer:塞进你背包里的「超级智能」

虽然如今的开源AI很多,但真正能干活的模型,普通人的电脑跑不动;能跑得动的模型,又仿佛智障。

Muse Glimmer 的诞生,就是为了打破这个僵局。

Meta的野心是:让这个30B 模型能「完全离线、本地运行」!

这意味着,你可以在没有网的飞机、高铁上随时调用这个超级大脑,而且还能保障隐私安全,本地文件、私人代码不必上传远端。

打开网易新闻 查看精彩图片

30B模型,怎样塞进个人电脑里?Meta有以下几大黑魔法。

极限压缩:20GB 以内的完美瘦身

按照常规精度,30B模型无论怎样都得吃掉 55GB 以上的显存,这远远超出了消费级显卡的极限。

为此,Meta 团队使用了4-bit 量化压缩技术,硬生生将模型权重压缩到 20GB 以下。

打开网易新闻 查看精彩图片

更惊人的是,这种极致的压缩「对智能体任务的性能表现几乎没有造成任何衰减」。

从此,在 24GB 显存(如 RTX 3090/4090)或 32GB 内存(如 Mac 统一内存)的设备上,我们不仅能跑这个模型,还能留出足够空间,给它的「视觉感知编码器」和上下文缓存。

DFlash 投机解码:让生成速度起飞

本地运行大模型最怕什么?就是慢。

模型一个字一个字地挤牙膏,极其破坏工作流。

为了解决这个问题,Muse Glimmer 自带了一个基于 DFlash 技术的轻量级「草稿模型」。

这个小模型会一次性「猜」出一大段 Token,然后交给主模型进行并行验证。对了就保留,错了就修改。

打开网易新闻 查看精彩图片

这种「投机解码」技术,在不牺牲任何输出质量的前提下,让 Muse Glimmer 在 RTX 5090 上的生成速度直接飙升了 3.1 倍!

在 MacBook M4-Max 和 M5-Max 上,它同样快得飞起,撑得起流畅的实时对话和复杂的代码生成。

打开网易新闻 查看精彩图片

真正的「智能体」

而且,Muse Glimmer 的定位不仅仅是一个LLM,它是专为智能体工作流优化的。

它是由 Meta 最顶级的闭源大模型 Muse Spark 经过「逻辑蒸馏」训练,继承了这个顶级模型的灵魂。

它具备五大核心超能力。

端到端任务完成:在 DeepSearch QA、SWE-Bench 等极难的测试中表现优异,能从头到尾帮你写代码、DeBug、查资料。

可靠的工具调用:能精准识别什么时候该调用计算器,什么时候该搜索本地文件,什么时候该运行代码。

失败恢复能力:这是智能体最关键的能力。当代码报错或工具调用失败时,它不会直接宕机罢工,而是会像人类程序员一样,自动诊断错误、修改参数并重新尝试!

长程多步推理:能够制定长期的连贯计划,不会做着做着就「失忆」。

多模态理解:能够直接看懂你的屏幕截图、图表和文档,实现图文穿插推理。

在各项基准测试中,Muse Glimmer 在同体量模型中与 Gemma4-31B 和 Qwen3.6-27B 不相上下,并且在「智能体操作」上表现惊人。

打开网易新闻 查看精彩图片

最重要的是,它采用了 Apache 2.0 协议!

这意味着无论是个人开发者还是企业,都可以免费商用。

目前权重已经上线 Hugging Face,并且很快就会全面接入 Ollama、LM Studio 等主流本地运行工具。

打开网易新闻 查看精彩图片

https://huggingface.co/meta-models/Muse-Glimmer-30B

前Meta超能实验室评估负责人Zengyi Qin分析称,Muse Spark将对全球开源模型形成降维打击。

打开网易新闻 查看精彩图片

原因在于,Meta今年的基础设施预算高达1450亿美元,因此Meta拥有更多算力;他们还有合规的优势。

最关键的,Meta为什么要开源?因为他们根本不需要靠卖API赚钱!

30B免费模型,Apache 2.0协议,将对让开源实验室的商业逻辑形成巨大冲击。

小扎万字檄文,

彻底撕下硅谷「AI安全」的假面

同时,小扎发布了一篇万字长文,可以说是Meta向整个闭源阵营下的战书!

打开网易新闻 查看精彩图片

这篇文章,让所有人都惊了:很少看到攻击性这么强的小扎。

文章的核心思想就是:超级智能必须属于每个人,把超级智能集中在少数人手里,才是人类最大的危险!

猛烈抨击「AI 末日论」与权力集中

我们都知道,硅谷有那么两家公司,特别喜欢玩这套叙事:AI太危险了,随时会毁灭人类,所以必须锁在几个精英公司手里。

小扎对此发出猛烈抨击:

认为 AI 如此危险,以至于唯一的安全途径就是权力的极端集中,这种观念本身就存在着固有的问题。纵观历史,指望一个绝对的权力如果足够开明就能仁慈地养活人类,从来没有带来过安全或积极的结果。

他举例说,如果世上只有一个人拥有「超级智能律师」,那他在法庭上将拥有绝对优势,让社会倒退。但如果每个人都有一个这样的律师,世界反而会更公平。

同理,少数人掌握超级黑客AI是灾难,但如果每个人都有超级AI在做防御,整个世界的数字基础设施将坚不可摧。

「真正的安全,来源于权力的制衡,而不是权力的垄断。」

打开网易新闻 查看精彩图片

颠覆性的「AI 对齐」观:AI 应该听谁的?

关于 AI 对齐,扎克伯格爆出金句:

人类不是单一的文化……不存在一种技术解决方案,可以同时满足所有人相互冲突的利益。因此,没有任何一个单一的超级智能可以对所有人都是仁慈的。

他严厉批评了竞品的做法:某家领先的模型,仅仅因为其公司内部认为「标准化考试是不道德的」,就拒绝帮用户起草一封写给学校的信!

这根本不是对齐,这叫「把公司的教条强加给用户」!

Meta 提出:AI 必须与用户个人的目标和价值观对齐,而不是与 Meta 公司的价值观对齐。

为此,小扎承诺,Meta 将为个人 Agent 提供「完全私密模式」,如同 WhatsApp 的端到端加密一样。

开源生态的生死存亡,直指美国监管政策

在文章后半段,小扎对美国目前的AI监管政策表达强烈不满。

他说,这种过度严苛的限制,是在「给竞争对手送大礼」。

而且,小扎居然选择公开站台蒸馏!

打开网易新闻 查看精彩图片

他指出,从其他模型中学习,是开源生态系统运作的重要原则。「任何 AI 模型都源于人类知识……你应该可以从任何你能观察到的事物中学习,这就是世界运转的方式。」

而且,Muse Glimmer 就是从 Meta 自己的 Muse Spark 中蒸馏出来的。小扎呼吁,美国政策必须放宽对训练数据和蒸馏技术的限制,否则美国开源AI将失去竞争力。

而且他认为,限制美国开源模型并不能解决任何问题,反而会削弱美国在 AI 生态上的话语权。

他警告,如果主动设限,其他国家的开源新星会迅速填补空白,让美国失去定义全球AI标准的机会。

同时,他提出一个折中方案:不去卡开源模型的发布,而是让实验室提前向政府分享「中间训练检查点」。

打开网易新闻 查看精彩图片

今天,让我们记住小扎,记住Meta。

他们用Muse Glimmer本地模型,向所有人证明:超级智能不必高高在上,它完全可以放在每一个人的包里。

参考资料:

https://www.meta.com/thefutureisforeveryone/

https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model

编辑:Aeneas