“我到旧金山太急太兴奋了。”发帖人开场先认了个错。他原本准备大谈特谈刚落地时看到的东西,结果被评论区提醒:真正值得看的其实是MiMo-2.6

他的原话很直接——比Grok 4.7更好,而且便宜得多。后面还跟了一句感慨:中国又回来了,这才是真正的惊喜。

打开网易新闻 查看精彩图片

这条帖子的时间戳显示发布于1小时前。发帖人自己补了一句,说要好好去研究一下,还顺带向“chubby”喊话:下次发帖前先把X看仔细点。

打开网易新闻 查看精彩图片

先夸Grok 4.7的那条

就在这条认错帖之前,他刚发过另一条内容。开头是“Damn,我来晚了”,因为飞机刚落地旧金山。

在那条帖子里,他对Grok 4.7的评价是“看起来超级惊艳”。他给出的理由是两点:一是能跟当前最强水平竞争,在某些基准测试上甚至超过了fable 5.1;二是比GPT和fable 5.1都便宜得多。

结尾他写的是“干得好,SpaceX”,并表示之后会再写点东西展开讲讲。这条帖子的浏览量显示为15.5K

两条帖子之间的反转

把两条放在一起看,逻辑链条很清楚:先是被Grok 4.7的参数和价格打动,发了一条热情洋溢的帖子;随后被评论区指出真正的主角是MiMo-2.6,于是又发一条,承认自己看漏了。

他没有收回对Grok 4.7的评价,只是把“真正的惊喜”这个位置让给了MiMo-2.6。给出的判断标准也没变,还是两条:性能更好,价格更便宜。

值得注意的是,他两次都用了“便宜”作为核心卖点。对Grok 4.7,是比较GPT和fable 5.1;对MiMo-2.6,是比较Grok 4.7。参照物在换,但“更便宜”这个结论一直保留。

“中国又回来了”这句怎么理解

打开网易新闻 查看精彩图片

他写的是“holy moly is china back”。这是一句情绪化的感叹,不是一份分析报告。从上下文看,他把MiMo-2.6的出现,当成了中国模型重新回到牌桌上的信号。

这个判断只代表他个人。他没有给出MiMo-2.6的具体参数、训练成本、评测分数,也没有说明它到底在哪些基准上超过了Grok 4.7。他说的“更好”,目前只是一个主观结论。

同样,他也没有解释MiMo-2.6便宜多少、便宜在哪里。整条帖子里,关于价格只有“much cheaper”这一个模糊表述。

一条帖子引发的连锁反应

这件事的有趣之处不在结论,而在过程。一个刚落地旧金山的人,凭第一印象发了条夸Grok 4.7的帖子,然后被评论区纠正,公开承认自己看漏了。

他用的词是“too quick and excited”——太快、太兴奋。这个自我描述,比任何评测数据都更能说明当下模型迭代的节奏:新东西出现的速度,已经快到让人来不及核对。

他最后说要去研究一下MiMo-2.6。至于研究结果如何,这条帖子里没有下文。

目前能确认的只有三件事:他认为MiMo-2.6比Grok 4.7更好;他认为MiMo-2.6便宜得多;他认为中国模型又回来了。这三条都是他的个人判断,不是经过验证的事实。