文|童蔚
1天,8万亿。这是DeepSeek最新发布的V4-Flash模型,在单一平台上24小时的调用量。
8月3日,海外开源项目团队OpenCode在社交平台上透露了几个数字:仅8月1日这一天,DeepSeek-V4-Flash在他们的AI编程工具上完成的Token处理量,就达到了8万亿。其中,5万亿来自免费试用额度,3万亿为开发者付费使用。OpenCode的CEO Jay还提到,平台的新订阅用户也随之增长了30%。
8万亿Token是个什么概念?
按照1个Token约等于1到1.5个汉字来算,这相当于8万亿到12万亿个汉字。拿《红楼梦》作参照,全书约73万字,8万亿Token大概能装下1400多万部《红楼梦》的信息量。换句话说,这个模型在24小时内处理过的文字,比一个人几辈子都读不完的书还要多。
另据全球知名模型分发平台OpenRouter的最新统计,上周(7月27日-8月2日),DeepSeek-V4-Flash以7.22万亿Token的周调用量排名全球第一,DeepSeek-V4-Pro排在第四。全球开发者正在把生产环境中的推理流量,大规模迁移到这家中国AI公司的模型接口上,其中来自美国和欧洲开发者的访问流量占了将近一半。
7月31日,DeepSeek-V4-Flash正式版API上线公测。就在当天,全球知名独立AI模型评测平台Artificial Analysis实测了128款大模型。
结果显示,DeepSeek-V4-Flash在智能指数测试环节拿到了50分(满分100分),相比4月初代版本提升10分,距离OpenAI的GPT-5.6 Luna(51分)仅差1分。
价格更是杀到了地板:据Artificial Analysis测算,DeepSeek-V4-Flash的每百万输入Token收费0.14美元、输出Token收费0.28美元,运行成本仅为Anthropic旗舰模型Claude Fable 5的不到百分之一。这个价格,在全球主流模型中处于最低水平。
价格优势,显然是调用量激增的直接推手。就在DeepSeek-V4-Flash公测的前一天,7月30日,OpenAI宣布对GPT-5.6系列大幅调价,轻量级模型Luna输出价格从每百万Token6美元降至1.2美元,降幅达80%。但即便如此,受益于缓存机制带来的约98%折扣,DeepSeek-V4-Flash的实际任务成本仍显著低于调整后的GPT-5.6 Luna。
于是,这两天海内外社交平台上冒出来一个新词:DeepSeek斩杀线。
Artificial Analysis绘制了一张模型性价比散点图,横轴是单次任务成本,纵轴是智能指数得分。DeepSeek-V4-Flash所在的点位成了一条分界线。性能在同一梯队但定价明显更高的,或者性能不如它价格还更贵的,通通被划入了“斩杀区”,面临被淘汰的风险。
另外,在OpenRouter这份最新的周榜单中,紧随DeepSeek-V4-Flash之后的第二到第五名,分别是:小米MiMo-V2.5、腾讯Hy3、DeepSeek-V4-Pro,以及智谱GLM5.2。全球调用量前五,已被中国AI大模型包圆。这也是中国大模型周调用量连续14周超过美国,稳居全球首位。
过去很长一段时间,全球大模型市场的规则都是由硅谷巨头在定。很多团队选择那些大厂的模型,不是觉得它们好到无可替代,而是因为一直缺少性价比足够高的备选项。如今,当具备一线梯队能力的低价模型出现,市场的“用脚”投票,可能来得比谁都快。
“人工智能永远只能是辅助”
它们从杭州来,替未来打样
杭州面向全球开出500万“英雄帖”
点喜欢