机器之心编辑部

9 月的大模型会战,DeepSeek 应战了。

今天下午 3 点,DeepSeek 官方社区突然传来消息,DeepSeek V4.1 Flash 直接开始测试

打开网易新闻 查看精彩图片

说是内测,不过对于使用 API 服务的用户来说,没有什么特殊的限制门槛,在现有 DeepSeek 服务商下手动添加模型:deepseek-v4.1-flash-expires-on-0910,保留原来的 API Key 和 base_url,再在新对话中选择它,就能直接用了

最近,「不加班」的 DeepSeek 也被全球的大模型浪潮裹挟着猛猛上新。此前 7 月底上线的 DeepSeek V4-Flash-0731 保持了原有模型结构,仅重新进行了后训练就取得了能力的大幅提升;8 月 13 日,DeepSeek V4 Pro 正式版与 DeepSeek Harness 共同问世,开始尝试通过布局生态来实现能力的最大化;8 月 21 日公开的 deepseek-v4-flash-vision-exp 则支持图文混合输入,结束了 DeepSeek 大模型没法看的历史。

值得注意的是,这次 V4.1 Flash 并不是一次简单的后训练更新。

打开网易新闻 查看精彩图片

V4-Flash-Vision-Exp 的一个官方示例:在 Agent 框架下生成商业定制西藏自驾游 PPT。

DeepSeek 明确提到V4.1 Flash 使用了「新的模型结构」,不免让人有了更多期待。

目前因为只是内测,官方给出的信息不多。看起来,官方宣称的新结构虽然不至于是对于模型架构的推翻,但可改的还有注意力机制、专家网络、视觉模块等等。不过既然有了「原生多模态」,我们可以期待像之前 v4-flash-vision-exp 那样,新模型能在大部分任务能力上都有进一步的提升。

另一部分有趣的在于「速度更快」,社区里有人已经获得了 400 token/s 的水平,比 Gemini 3.8 Flash 还要快。

还有用户给出了更直观的对比:在相同任务下,V4.1 Flash 相比 V4-Flash-Vision-Exp,49k 长上下文检索快 5.2 倍、SVG 代码生成快 6 倍。

打开网易新闻 查看精彩图片

网友自测显示,V4.1 Flash 在长上下文检索、代码生成、算法题等任务中的端到端速度较 V4-Flash-Vision-Exp 提升约 3.9~6 倍。图源:X 用户 @NFT_Chen。

最后是「成本更低」,虽然当前计费与 V4 Flash 相同,已经有很多人开始期待 DeepSeek 的降价,那个斩杀线又要来了?

我们也在第一时间进行了实测,做一个 html 版本的马里奥 MVP 小游戏,耗时 7 多分钟,成本不到 2 块钱。

它把「立即能玩」作为首要目标,没有一上来就堆很多敌人和关卡,而是先保证「马里奥小游戏」最基本的细节:

金币、蘑菇怪、水管几乎 100% 还原。

打开网易新闻 查看精彩图片

视频链接:https://mp.weixin.qq.com/s/zwwX7mQFWteJh3jokLoLxA

再做一个 html 版本的关于 FDE 的科普 PPT,它没有上来就做,而是问清楚是哪个 FDE,以及这个 PPT 是讲给谁听。

接着上网查最新资料,确定大纲先讲什么后讲什么,然后把内容翻译成小白也能听得懂,最终整理成 html。

打开网易新闻 查看精彩图片

视频链接:https://mp.weixin.qq.com/s/zwwX7mQFWteJh3jokLoLxA

最后,既然模型名字是「9 月 10 日到期」(expires-on-0910),这可能意味着该版本还有不到 2 天就会正式失效,你用上了吗?评论说说你的体验。