“我大多数任务使用国外模型,国内用 DeepSeek 稍好一点。”

这句话来自作者 Geek 在回复中的一段分享。没有长篇评测,没有跑分对比,就一句工作流里的真实选择。

一句话里的两层信息

第一层是整体倾向:国外模型在他的日常任务中占主力位置。第二层是国内模型的排序:DeepSeek 被他单独拎出来,评价是“稍好一点”。

“稍好一点”这个说法本身很克制。不是碾压,不是替代,是在国内可选范围里相对更顺手的那一个。

为什么这种偏好值得看

开发者选模型,通常不看榜单看手感。任务能不能一次跑通、输出要不要反复改、上下文接不接得住,这些细节决定了一个模型会不会被留在工作流里。

作者把国外模型放在大多数任务上,说明在他的使用场景里,这套组合目前更省事。而 DeepSeek 能被他点名,至少意味着它在某些任务上已经进入了备选名单,而不是被直接跳过。

这条分享只有一句话,信息量也止于一句话。它不构成评测结论,只是一份个人偏好的切片——但对同样在挑模型的人来说,这种切片往往比参数表更接近真实。