打开网易新闻 查看精彩图片

整理 | Ziyu

行业热点

DeepSeek API 价格再调

DeepSeek 将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规则做出调整,北京时间周末(周六、周日)全天不再区分峰谷时段,统一按照低谷时段价格收取调用费用。

打开网易新闻 查看精彩图片

  • 空闲时段价格为高峰时段价格的一半。高峰时段为北京时间 9:00 - 12:00、14:00 - 18:00(其余为空闲时段)。将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规则做出调整,周末(周六、周日)全天不再区分峰谷时段,统一按照低谷时段价格收取调用费用。

  • 发送给 deepseek-v4-flash-vision-exp 的图片会按其尺寸换算成 token,与文本 token 一并计费。换算规则详见图像理解:Token 用量。

相比 8 月 17 日上一轮峰谷定价,此次 DeepSeek 主要调整周末计费规则,周六、周日全天统一执行低谷价,工作日峰谷价格不变。

此前,8 月 17 日,DeepSeek API 正式涨价。DeepSeek 官方公众号 8 月 13 日曾发布消息称,对 DeepSeek API 价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间 9:00-12:00、14:00-18:00(其余为空闲时段)。

以旗舰模型 DeepSeek-v4-pro 为例,高峰时间段,V4 Pro 每百万 tokens 输入(缓存未命中)9 元,涨幅 200%;输出 27 元,涨幅 350%;缓存命中输入 0.3 元,涨幅 1100%。空闲时间段,V4 Pro 每百万 tokens 输入(缓存未命中)4.5 元,输出 13.5 元,缓存命中输入低至 0.15 元。DeepSeek-V4-Pro 正式版于 8 月 13 日发布,该版本增强了 Agent 能力。当时,DeepSeek-V4-Pro 价格是轻量级模型 V4 Flash 的大约三倍。以每百万 tokens 计算,V4 Pro 输入是 0.025 元(缓存命中)和 3 元(缓存未命中),输出则是 6 元。相比之下,V4 Flash 对应的价格分别为 0.02 元、1 元和 2 元。

据了解,DeepSeek 此次推出峰谷定价的核心初衷,是平衡日间算力拥堵问题。借助市场化价格杠杆,引导企业开发者错峰调度大模型任务,分流高峰算力压力,从而提升整体平台运行稳定性。

GPT-5.6 Sol 模型价格下调, Codex 额度问题引争议

OpenAI 宣布未来 3 个月内将 GPT-5.6 Sol 的 API 与 Credit 调用价格下调 20% 以上,其中每 100 万 Tokens 输入从 5 美元降至 4 美元、输出从 30 美元降至 20 美元,缓存及长上下文档位价格也同步下调,该功能已在 API 上线并面向 ChatGPT Work 和 Codex credits 方案推送,Pro、Plus 和 Business 订阅方案的使用规则及权益保持不变。此外,OpenAI 还下调了 GPT-5.6 Luna AI 模型费用。

近期,大量 Codex 用户发现,自己的周额度突然变得特别不经用。社区通过 NerfTrack 等工具追踪发现,有 Plus 用户的周额度从约 160 美元降到 80 美元,直接砍半;还有 Pro 5x 用户从约 674 美元降到 157 美元,缩水约 77%。这和之前的水平差距非常大。

随后,Codex 团队的 Tibo 回应称,OpenAI 并没有偷偷修改额度,部分异常用户其实使用了 Sub2API,将订阅转成 API 再共享或中转,从而触发了风控。但网友显然不买账,因为大量用户表示,自己从没用过 Sub2API,老老实实用官方 Codex,额度照样缩水。

随后,其表示本周 Codex 活跃用户数量已经达到了 2000 万。为庆祝,将为每一位使用 Codex 和 ChatGPT 工作的用户提供一次免费的重置功能,用户可以随时使用这个功能。

针对在使用限制导致资源消耗加快的情况下,Tibo 表示没有观察到任何异常现象。在之后的推文中,Tibo 表示发现了一些用户的缓存命中率要比之前更低,或许这是造成用户资源消耗快的原因。

打开网易新闻 查看精彩图片

中国机器人打破人类百米世界纪录,宇树预赛小组垫底

22 日在国家速滑馆开赛的第二届世界人形机器人运动会上演田径大型组 100 米预赛。现场成绩公告显示,“天卓队”以 9 秒 39 的成绩率先撞线,超越牙买加名将博尔特保持的、9 秒 58 的男子 100 米世界纪录。

打开网易新闻 查看精彩图片

新纪录的产生拉开了本届运动会的序幕。据介绍,本次赛事吸引了来自六大洲的 666 支队伍、2056 台机器人同台竞技,参赛队伍数量较首届增长 138%,机器人数量翻了两番。

22 日晚,宇树科技发布声明称,在这次大会上大家将看到多款宇树人形机器人亮相赛场。与往届情况相仿,其中部分为宇树自有团队参赛,其余则由宇树的客户或合作伙伴,基于宇树机器人平台进行二次开发后参与赛事。

宇树科技表示:“很遗憾,受限于时间精力和新款机器人数量和测试的限制,我们只能缩减几项已报名参赛项目。公司过往精力主要在量产产品上,很抱歉没能顾全赛事准备。感谢社会各界长期以来对我们的关注与支持,预祝所有参赛队伍赛出风采,共同刷新机器人运动的全新纪录。”

英伟达 AI 服务器涨价超 15%

8 月 23 日,《彭博社》报道,随着内存芯片成本大幅上涨,英伟达部分最大客户已被告知,搭载其 AI 芯片的服务器价格在将上涨超过 15%。

此次涨价将从明年初出货的系统开始生效,涉及包括旗舰 Vera Rubin 和 Grace Blackwell 芯片在内的系统,具体涨幅将取决于英伟达芯片的代际以及内存配置。为微软、谷歌、甲骨文等大型数据中心运营商代工服务器的企业,近期已经向客户通知即将到来的价格上涨。

即便是行业中占据绝对主导地位的英伟达,也无法维持原有价格或自行消化不断上升的成本,这显示出在 AI 基础设施需求激增之际,三星电子、SK 海力士和美光等内存芯片厂商拥有强大的议价能力。包括苹果、高通在内的多家大型科技公司近期都表示,由于芯片短缺,不得不提高旗下产品的价格。

追觅造车办公地:工位大片闲置、几十个总监集中在外求职

2025 年 8 月 28 日,追觅正式官宣,要造世界上最快的车。创始人俞浩在公开信中写道:“造车,是工业的王冠、技术的终极战场,也是一场‘九死一生’的远征。”但这场声势浩大的“造车远征”,在不到一年时间便迎来急转向。

过去四个月,记者通过多方信息交叉求证,结合工商资料、项目现场走访、办公场所实地观察以及多位内部知情人士信源了解到,追觅汽车高管已密集开启外部求职,项目员工出现批量离职与被裁,办公区域大量工位闲置……多重迹象显示,追觅轰轰烈烈的造车计划正遭遇不小的挫折。

黄仁勋女儿探访多家中国机器人企业

8 月 21 日 2026 世界机器人大会首日,英伟达物理人工智能平台产品与技术营销高级总监黄敏珊(黄仁勋之女)到场,参观越疆、光轮智能等多家机器人企业展台,体验普勒机器人产品,还到访京东展区了解其机器人相关体系与演示,多次赞叹。

黄敏珊长期主导英伟达 Omniverse 平台及机器人产品线市场工作,是英伟达物理 AI 与机器人生态战略核心推动者,此次到访释放出全球算力巨头与中国具身智能头部企业协同,正从芯片、模型层面向真实物理世界延伸的重要行业信号。

Meta 成微软最大 AI 客户之一:年采购额达数亿美元,每周消耗数万亿 token

8 月 20 日消息,据外媒报道,Meta 正通过微软 Azure 云服务采购 AI 服务,年支出高达数亿美元,已成为微软规模最大的 AI 客户之一。知情人士称,Meta 每周通过 Azure 消耗的模型调用量达到了数万亿 token。目前,微软 Azure 正通过 Foundry 平台提供来自多家供应商的 AI 模型,包括 OpenAI、Anthropic、DeepSeek、Mistral AI、xAI、Meta 等,总数达 11604 个。截至今年 7 月,该平台已有 10 万名客户。

对于 Meta 而言,该公司采购的 AI 算力主要用于软件开发等工作。据知情人士透露,Meta 会根据模型的可用性和成本,通过不同平台采购模型。Meta 开发人员还曾通过 Foundry 使用 OpenAI 的技术,以评估自研模型的输出效果。此外,Meta 自身也在开发面向外部客户的 AI 模型 API 服务,允许用户通过 API 使用不同模型。该业务未来可能与微软 Foundry 等平台形成竞争,并有助于 Meta 减少对外部 AI 服务的依赖。

Anthropic 组建自研芯片团队,挖来谷歌 TPU 创始人

Anthropic 已聘请谷歌定制芯片项目创始人 AmirSalek,为这家 AI 实验室进军自研半导体领域做准备。

Anthropic 周五表示,Salek 将加入 Anthropic 的算力团队,并向 JamesBradbury 汇报。Salek 曾负责谷歌的张量处理单元(TPU)业务直至 2022 年,并参与推出了前七代 TPU 芯片。Anthropic 目前从英伟达、谷歌和亚马逊等多个供应商采购芯片,但近期已释放出建立自有芯片业务的意愿。

这家总部位于旧金山的公司已开始为相关项目招聘,并发布职位信息。与其他 AI 巨头一样,Anthropic 正加紧获得足够的数据中心基础设施,以支撑其发展目标。自研芯片有望帮助公司应对供应短缺,同时根据自身需求定制芯片设计。

AI 快讯

DeepSeek Harness 首发新版本:多模态能力升级

DeepSeek Harness v0.1.0-rc.8 版本上线,带来 14 项调整,重点补齐多模态能力,支持原生图片请求和图文混合输入,/goal、/plan 等命令可接收图片,@菜单新增文件和会话引用。子代理体系扩充,可按需安装 Claude Code 和 Codex。优化 Windows 终端体验,修复图片请求、流式生成、自定义网关等问题。

此外,该版本为纯文本模型搭建工具层视觉,通过调用 OCR、颜色统计、像素扫描等工具将图片转为结构化信息供文本模型推理。同时,此次更新还强化了插件化思路,加入 web_search 并发查询等优化,提升了相关性能。

另外,DeepSeek-V4-Flash-Vision-Exp 在 DeepSeek API 平台也已上线,文本能力与 DeepSeek-V4-Flash 持平,涵盖 agent、推理和世界知识等领域,在多模态智能体基准测试中性能较 V4-Flash 大幅提升,接近 Opus-4.8。

GLM-5.3 上线:60 分跻身全球前沿,与 Kimi K3 并列开源模型第一

8 月 19 日上午消息,智谱凌晨上线新一代基座模型 GLM-5.3 API。该模型擅长复杂编码、防御性网络安全与长程任务,在 Artificial Analysis Intelligence Index 中取得 60 分,进入全球前沿模型能力区间,与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰处于同一水平,并与 Kimi K3 并列开源模型第一。

当前,前沿模型正从比拼更大参数规模,转向比拼单位成本下的有效智能。据悉,GLM-5.3 以更小的参数规模、更高的参数效率和更低的调用成本达到前沿模型水平,实现前沿旗舰模型中最低的单任务成本,并将“智能—成本”的帕累托前沿显著推进,利好 AI 应用加速落地与规模化普及。

GLM-5.3 并非依靠单纯扩大参数规模实现跃升,其与上一代 GLM-5.2 沿用同一基础模型,性能提升主要来自后训练。这表明前沿能力向前推进不必依赖更大的参数规模和更高的算力投入。

目前,该模型已接入 ZCode、GLM Coding Plan 等官方产品,API 定价与 GLM-5.2 保持一致,模型权重将于下周五开源。同日,国家超算互联网上线 GLM-5.3 API 调用服务,企业和开发者无需繁琐环境配置,登录超算互联网即可一键调用该旗舰模型。

英伟达将向 AI 模型初创企业 Poolside 支付 60 亿美元,用于授权及人才收购交易

据财联社消息,英伟达同意向 Poolside 支付 60 亿美元,换取其人工智能模型的使用许可;同时向 Poolside 的 100 多名员工发出聘用邀请;另承诺提供 10 亿美元战略投资,对应投前估值 120 亿美元。Poolside 继续独立运营。

Poolside 最早研发代码 AI 智能体,之后转向数据中心开发,随后依托英伟达服务器芯片推出了自家开源 AI 模型。信件内容提到,Poolside 将于明年年底前,把这 60 亿美元分配给各位投资者。信件还称,英伟达将以 120 亿美元的投前估值,向 Poolside 投资 10 亿美元。

这笔投资和两家企业九个月前洽谈的交易方案相近,但当时并未得到官方确认。该初创企业的三位联合创始人将继续留任;信件表明,本次交易不属于收购,也并非“人才收购”——人才收购是指以获取人才为主要目的的交易。

小红书悄悄开源发布了自己的大模型,内容平台也要造底座

记者获悉,小红书 dots 模型实验室首次开源 dots3 note preview(预览版)。该模型总参数 280B,激活参数 16B,支持 512K 超长上下文窗口,具备文本、视觉与语音多模态理解能力,并针对复杂推理和长程 Agent 任务进行了优化。

据悉,dots3 note 正式版也将于近期开源。dots3 note 是 dots 3 系列中最轻量的版本,完整 dots3 系列将涵盖 note、jazz 和 aria 三个层级,分别面向不同任务复杂度、响应速度和计算成本的应用需求。

IT 业界

王兴兴:具身智能“ChatGPT 时刻”最快 2—3 年到来,物理 AI 自进化开启机器人规模化新机遇

8 月 20 日,宇树科技创始人、董事长王兴兴在 2026 世界机器人大会发言表示,人形机器人尚未大规模推广的核心原因在于效率仍低于人工,且新任务需重新训练,泛用性能力不足,行业有望在 2 至 10 年内迎来关键技术突破,迈入具身智能的“ChatGPT 时刻”。

在他看来,具身智能的“ChatGPT 时刻”有着明确的衡量标准:在 80%的陌生场景中,通过语音或文字指令,机器人能够顺利完成大约 80%的任务。王兴兴判断,“迈向具身智能的 ChatGPT 时刻,理想情况下需要 2—3 年,或者更长 5—10 年的时间。”他表示,目前最核心的挑战是 AI 大模型的输入输出与真实机器人的对齐问题。

谈及产业发展前景,王兴兴表示,下一个十年,在 AI 大爆发的背景下,机器人进化速度已远超预期,“这是一个全新的起点”。

Stripe 以 75 亿美元收购 OpenRouter

8 月 19 日,故事有了最戏剧性的结局:Stripe——全球最大的在线支付公司——正式宣布收购 OpenRouter,传闻交易额75 亿美元。其中 15 亿美元归属创始人团队。这是 Stripe 迄今最大一笔收购案,较 OpenRouter 2026 年 5 月约 13 亿美元的估值溢价超过 5 倍。

OpenRouter 成立仅三年,平台聚合 400 余个 AI 模型、覆盖 80 余家供应商,日均处理 Token 量超 10 万亿,客户包括 NVIDIA、Zoom 和 Lovable。值得关注的是,据 OpenRouter 数据分析师 Justin Summerville 7 月披露,中国开源模型在平台上运行成本比 Anthropic、OpenAI 等头部模型低 60%–90%,自 2026 年 2 月 8 日起,美国企业 Token 消耗中中国模型占比从未低于 30%,峰值达 46%。

据 Stripe 官方声明,CEO Patrick Collison 表示"Token 是 AI 企业的核心货币",收购后将帮助客户在收入端和成本端同时优化盈利能力。值得注意的是,OpenRouter 联合创始人 Alex Atallah 此前曾创建 NFT 交易平台 OpenSea——该项目在 2022 年加密市场回调前估值一度达 133 亿美元。

GitHub 公布本周八小时宕机事故原因

最大的代码托管平台 GitHub 本周发生了一次持续了近八小时的宕机事故,再次在开发者中间引发了寻找替代平台的讨论。

GitHub 今年频繁发生宕机事故,已促使多个知名开源项目宣布迁移出去。本周的宕机事故始于 8 月 17 日 13:28 UTC,直至 21:15 UTC 才完全解决——持续 7 小时 47 分钟的事故导致 Issues、Pull Requests、API、Actions 和 Copilot 等服务大量出错。

GitHub 解释说,事故直接原因是位于公司美国中部数据中心的负载均衡器网络饱和,而自动扩容策略的配置错误,以及 Visual Studio Code 中一个导致流量放大 10 倍的重试 bug 等一系列连锁反应导致了此次事故持续了如此长时间。

会议推荐

QCon 全球软件开发大会·2026(上海站)现已正式启动。本届大会聚焦 Harness AI 时代的工程实践,从「构建 AI」到「驾驭 AI」,围绕 AI Native 架构、Agent Runtime、AI Infra、Agent 安全与可观测、Loop Engineering、具身智能与世界模型等热门技术方向,邀请全球技术社区与产业一线实践者,共同分享 AI Native 时代最具价值的工程经验。