这样骇人的模型,一次对话的上下文最多 32K(标准版 8K)。运行它需要庞大的算力,输入 100 万 token 要付 60 美元。 一个月前,DeepSeek V4-Flash 发布:上下文 1M,知道自己调用工具解决问题,Artificial Analysis 智能指数得分 50,远超 GPT-4 的 7 分。而它高峰时段的定价,也只有每百万 token 3 元人民币。 DeepSeek 和智谱稍晚发布的 Flash 模型,比当年的 GPT-4 反应更快、更能解决问题、更符合 “智能” 的定义,价格却不到 GPT-4 的 1%。 进步来自中美十几家大模型团队的竞争,也来自历史上最大的人造项目。按高盛估算,到 2026 年底,AI 数据中心总投入将达 1.8 万亿美元,并将在两年内追上美国二战期间的全部军工生产开支(折算通胀后 3.2 万亿美元)。 编程确实在加速工作,视频生成让人上瘾,大模型公司看到了卖 token 赚钱的希望。几家中国公司去年还在退订算力、取消 GPU 订单,今年重拾信仰,把国内 B300 服务器的价格抬到去年的 5 倍。 今年各家发布的同级别模型都在涨价。在这个激烈的市场里,定价大致反映模型能力。我们梳理了过去三年多模型性能和 token 定价的变化。(图文丨黄帧昕 黄俊杰)
这样骇人的模型,一次对话的上下文最多 32K(标准版 8K)。运行它需要庞大的算力,输入 100 万 token 要付 60 美元。 一个月前,DeepSeek V4-Flash 发布:上下文 1M,知道自己调用工具解决问题,Artificial Analysis 智能指数得分 50,远超 GPT-4 的 7 分。而它高峰时段的定价,也只有每百万 token 3 元人民币。 DeepSeek 和智谱稍晚发布的 Flash 模型,比当年的 GPT-4 反应更快、更能解决问题、更符合 “智能” 的定义,价格却不到 GPT-4 的 1%。 进步来自中美十几家大模型团队的竞争,也来自历史上最大的人造项目。按高盛估算,到 2026 年底,AI 数据中心总投入将达 1.8 万亿美元,并将在两年内追上美国二战期间的全部军工生产开支(折算通胀后 3.2 万亿美元)。 编程确实在加速工作,视频生成让人上瘾,大模型公司看到了卖 token 赚钱的希望。几家中国公司去年还在退订算力、取消 GPU 订单,今年重拾信仰,把国内 B300 服务器的价格抬到去年的 5 倍。 今年各家发布的同级别模型都在涨价。在这个激烈的市场里,定价大致反映模型能力。我们梳理了过去三年多模型性能和 token 定价的变化。(图文丨黄帧昕 黄俊杰)

JPG
长图
JPG
长图
GIF
长图
JPG
长图
JPG
长图
JPG
长图