牛来火冒了烟,这AI圈蹦出来个牛来模型,你可信?

打开网易新闻 查看精彩图片

一个叫 Ox Alpha 的匿名大模型,出现在了 OpenCode 和 OpenRouter 上。

以目前公开信息来看,配置相当夸张。百万 Token、多模态、还能跑 Agent 。

有人拿它跑测试,据说结果已经接近 Claude Fable、GPT-5.6 这类顶级模型。

重点是,它免费一周!

可以来一场酣畅淋漓的vibe Coding了。

案例实测工作台

Vibe Coding出来的工具很多情况,都会出现第一版根本不能用的情况,Bug与天齐飞,但是这次的牛来模型真的不一样。

它问了我具体的要求之后,开始自己干起来了。

第一版
打开网易新闻 查看精彩图片
第一版

基础的功能全部都有,而且没发现什么BUG,一切正常,只是这个UI差点意思。

所以第二次让他调整UI,看看它能自己改成什么样。

第二版改了UI
打开网易新闻 查看精彩图片
第二版改了UI

改了之后就好了很多,但是不知道这个UI风格,你是否有点熟悉?我觉得有点像智谱家出品,扑面而来那种老极客风。这老牛拉车的速度,也很像。

修各种 Bug整理知识库

Obsidian 虽然很好用,但是必须定期做清理,不然就能乱成一锅粥。

最近我的 Obsidian 有点乱套,昨天开始DeepSeek V4 Flash,在 Claudian 上怎么都召唤不出来了,换了其他方案整理,搞出来一堆乱文件。

正巧让牛来模型来收拾烂摊子。

打开网易新闻 查看精彩图片

整理规整了3次,知识库终于又恢复了原样,并且让他帮我把整个库又再优化了一下。

打开网易新闻 查看精彩图片

非常管用,整个库都让它做了一遍翻新,真的有点像之前接入Codex调整的效果,这把薅爽了。

处理工具BUG

不得不说,这应该是让我最惊喜的点,Ox 修小bug的能力真的很不错。

之前这个AI英语教练的工具是用地主家的大儿子做的,陆陆续续地搞了能有半个月,BUG不断,都是小毛病但是怎么修也修不明白。

打开网易新闻 查看精彩图片

Ox是不能像Workbuddy一样,把文件拖拽进去就行了,得给项目文件的本地地址。

之前一直没改明白的提速问题,直接就改好了,现在反应速度相当快。

而且记忆文件也都规整好了,甚至我让它帮我优化,也给出了很实用的意见。

打开网易新闻 查看精彩图片

它这个记忆力是真的强,我最开始跟他说我对整个UI不满意,想要都改一下,都转了几个小时了,它竟然还记得我说UI不行的事。

打开网易新闻 查看精彩图片

很多agent回复经常出现乱七八糟的情况,它的回复就比较利索了。

这个工具里一部分是游戏的环节,之前做了很多次出来都是按键游戏,Ox 这次一次就理解我的意思,并且给做出来了。

打开网易新闻 查看精彩图片

而且在我吐槽它设计做得太差之后,它自己去网站挖免费素材回来了。

打开网易新闻 查看精彩图片

不过审美确实差点意思,有很多好看的素材可以用,但它偏偏给我找了这个

打开网易新闻 查看精彩图片

果然素材这方面还得自己找。

3D游戏

首先来看一个模型的自主行动意识,之前做事之前它都来问我细节,但是这次没有。没给要求它就自己想了个游戏做。

打开网易新闻 查看精彩图片

这次我想挑战做个竞速的游戏,这类游戏做出来容易出各种物理问题,看看Ox得表现如何。

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

来看成品效果

游玩的流畅程度比最开始的 kimi K3 要好一些,而且在没有多少提示词的前提下,它能自己思考游戏的玩法,理解力也明显有提升,它应该是有自己处理一遍bug才把成品交给我的。

我还顺手让它帮我把上次用GLM 5.3做的那个3D游戏的bug改一下。

效果真的比之前那个好太多了,之前调了好几次也没有做明白。

使用总结

作为一款羊毛模型来说,可以说是顶配,薅就完了!

单纯从实测体验上来说,这个模型编程能力应该在 GLM 5.3 之上、接近 GPT5.6,出bug的几率确实比较小,但审美方面就非常一般了。

盘了这个模型大概一天半,比较大的问题是,用的人有点太多了,它每天也有可薅的上限,慢慢的就会进入到链接困难的状态。

甚至直接不可用,一整天下来,能成功几十次这样吧。

打开网易新闻 查看精彩图片

不过 OpenCode 会不断帮你一次又一次重连,直到彻底失败,所以让它自己蹬就行了。

7天的时间更适合做各种各样的小项目,尤其是低等级的agent搞不定的问题,非常推荐来用这个模型改改看。

如何用上 Ox Alpha

现在只要下载 OpenCode 客户端,然后就可以在上面直接使用。

点击模型选择就能看到

打开网易新闻 查看精彩图片

当然你也可用A//P//I,用 OpenRouter 去接就好了。

两个平台一起薅那更是爽哉。

现在 AI 模型竞争的玩法正在变化。

以前模型公司发布新模型,主要靠内部测试、Benchmark、官方 Demo。

但是现在越来越多模型开始选择直接进入真实用户环境。

实验室里测千次,可能都不如用户拿它跑几万个真实任务。

终究是真实业务值马内。

今天就酱八,明天继续聊AI。