打开网易新闻 查看精彩图片

AI+快报,唯快不破

AI 每日动态 — 2026年08月14日(周四) 今日重点关注

1. SpaceX 600 亿美元全股票收购 Cursor 正式完成,Cursor 并入 SpaceXAI 团队8 月 14 日,SpaceX 向 SEC 提交 8-K 文件,宣布全股票收购 Anysphere(Cursor 母公司)正式生效,Cursor 隐含股权价值 600 亿美元,成为 SpaceX 全资子公司。Cursor 股东获 389,289,254 股 SpaceX A 类普通股,未归属 RSU 和期权分别转换为约 2913 万份和 4437 万份。Cursor 团队将加入 SpaceXAI,共同改进 Grok Build、Grok Bot、Grok API 及 Cursor 本身,聚焦软件工程并扩展至知识工作领域。这是 SpaceX 上市后首起并购案,也是史上最大规模科技收购之一。

关注理由:600 亿美元全股票交易——马斯克用"零现金"吞下全球最火的 AI 编程工具,Cursor 团队直接为 Grok 输血。xAI 的编程 Agent 战力一夜补齐,AI 编程赛道格局剧变。

2. 智谱发布 GLM-5.3:编程能力开源第一,后训练涌现网络安全能力智谱 8 月 14 日发布 GLM-5.3,与 GLM-5.2 共享同一 743B 基座模型,全部提升来自后训练 Scaling。编程能力较前代提升 50%,Terminal Bench 3.0 得分从 4.6 跃升至 28.3(开源第一),DeepSWE 1.1 达 66.9%,CyberGym 得分 84.5% 超过 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%)。发布前两周联合安全团队发现 2404 个潜在漏洞(1088 个中高危),最古老的漏洞潜伏超 40 年。模型权重将在两周后开源,即日起上线 ZCode、AutoClaw 等平台。

关注理由:不换基座、只靠后训练就能把编程能力拉到接近 Claude Fable 5——"后训练 Scaling"的天花板远未到顶。更值得关注的是 GLM-5.3 涌现的网络安全攻防能力,开源防御模型的逻辑是"如果攻击能力在扩散,防守能力就不能只在少数闭源公司手中"。

3. 苹果联合阿里巴巴训练中国专属大模型,Apple Intelligence 数月内入华据路透社报道,苹果在阿里巴巴支持下专门为中国市场训练了一款大语言模型,标志着其中国 AI 策略从"依赖第三方模型"转向"自研+合作"双轨制。此前苹果曾计划主要使用通义千问等本土模型驱动中国版 Apple Intelligence,如今转为自研专属模型。7 月 15 日,国家网信办已正式备案苹果的生成式 AI 服务。Apple Intelligence 预计在未来数月内随 iOS 更新正式在中国上线,苹果有望成为首家获准在华提供自研 AI 模型的外国公司。

关注理由:苹果不再只做"本地化移植",而是真金白银训练中国专属模型——这是中美科技企业之间罕见合作的信号。对华为、小米等本土 AI 手机厂商而言,苹果补齐 AI 短板后将直接杀回牌桌。

4. OpenAI 预览 GPT-5.6 Sol Ultrafast 模式:推理速度提升 14 倍,由 Cerebras 驱动8 月 14 日凌晨,OpenAI 联合 Cerebras 预览 GPT-5.6 Sol 的 Ultrafast 模式,输出速度最高达每秒 750 token,较 Standard 模式(约 53 token/s)提升 14 倍,且不降质量。在"人类最后的考试"(HLE)2500 道题基准上,Ultrafast 仅用 11 小时 11 分钟答完全部题目,而 Claude Fable 5 需要 78 小时 27 分钟。GDP-Val 经济价值基准上实现 5.6 倍端到端加速。该模式初期仅通过 OpenAI API 向部分客户开放有限预览,核心技术依赖 Cerebras 晶圆级芯片(WSE-3)的片上 SRAM 架构。

关注理由:速度成为新的定价杠杆。750 token/s 意味着以前需要几小时的 Agent 任务可压缩至几分钟,"思考"与"迭代"的等待成本趋近于零。OpenAI 借 Cerebras 摆脱对英伟达的完全依赖,推理速度竞赛正式开打。

5. DeepSeek V4 Pro API 峰谷定价生效,最高涨幅 11 倍8 月 13 日,DeepSeek 宣布 V4 Pro 正式版上线,同步引入峰谷定价机制,空闲时段价格为高峰时段的一半。高峰时段(北京时间 9:00-12:00、14:00-18:00)V4 Pro 每百万 tokens 输出 27 元(原价 6 元,涨 350%),缓存命中输入 0.3 元(原 0.025 元,涨 1100%)。新价格将于 8 月 17 日 0 时生效。V4 Flash 同步调价,高峰时段输出 9 元/百万 tokens。普通用户网页端和 App 端不受影响。

关注理由:DeepSeek 不再是"白菜价"代名词。峰谷定价本质是把算力供需写成价格信号,倒逼开发者错峰用模型。对重度 API 用户而言成本可能翻 4-12 倍,但相比国际竞品仍有价格优势——这是 DeepSeek 从"赔本赚吆喝"走向可持续商业化的关键一步。
模型发布/更新
  1. Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型 — Google DeepMind Blog
    08月13日 17:04
    距 3.6 Flash 仅三周,Gemini 3.7 Flash 主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。已在 Gemini 网页版和移动端逐步推送,Antigravity CLI 默认升级至该版本。

  2. 小红书开源 dots3-note Preview:280B MoE 轻量模型,主打长程智能体与多模态推理 — 公众号:小红书技术(dots.llm)
    08月14日 11:25
    dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,针对复杂推理和长程 Agent 任务优化。

  3. DeepSeek V4 Pro 登陆硅基流动:1M 上下文,三档推理强度 — X:硅基流动 SiliconFlow
    08月14日 04:55
    DeepSeek-V4-Pro-0813 正式上线硅基流动,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,侧重编码、工具调用与智能体工作流,保持 MIT 开源协议。输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。

  4. 阿里 Qwen3.8-27B 发布:27B 稠密视觉语言模型,262K 原生上下文 — X:通义千问 / Qwen
    08月14日 13:08
    Qwen3.8 系列新增 27B 稠密视觉语言模型,原生 262K 上下文可扩展至约 1M,支持文本、图像、视频输入,兼容 Transformers/vLLM/SGLang/TokenSpeed,思维模式默认开启(xhigh/medium/low 三档)。同步发布 Qwen3.8-Max 开源权重,但采用自定义许可证:年收入超 5000 万美元的企业需另签商业协议。

  5. MiniMax Music 3.0 发布:AI 生成最长 5 分钟完整歌曲,分层自回归架构 — MiniMax Blog / IT之家
    08月13日 16:52
    新一代音乐生成模型,可根据创意概念和歌词一次性完成作曲、编曲、演奏与制作。Global LLM 参数 8B(基于 Qwen3-8B 初始化),Local LLM 0.6B,输出 32kHz/16-bit 立体声 WAV。开源权重。

  6. 小红书开源 dots.tts:20 亿参数连续自回归语音合成模型 — 公众号:小红书技术(dots.llm)
    08月13日 09:59
    全连续端到端自回归 TTS 模型,在 Seed-TTS-Eval 三个子集上取得最佳平均内容准确度和平均说话人相似度。

  7. 微软首发自研推理模型 MAI-Thinking-1:约 1T 参数、35B 激活 — X:Mustafa Suleyman / The Win Central
    08月12日 16:00
    微软 AI 团队首个推理模型,从零构建,256K 上下文,已在 Microsoft Foundry 进入私人预览。官方称 SWE-Bench Pro 上与 Claude Opus 4.6 相当,盲测中比 Claude Sonnet 4.6 更受偏好。

  8. Needle 2:45M 参数开源工具调用模型,14MB 二进制、28MB RAM 可运行 — MarkTechPost
    08月14日 05:45
    Cactus Compute 发布的超轻量工具调用模型,以 14MB 二进制文件发布,约 28MB RAM 即可运行完整会话,适合边缘部署。

  9. DeepSeek-V4-Pro 正式版上线:Agent 能力大幅增强 — DeepSeek API 更新日志
    08月13日 11:16
    已在 APP、网页端和 API 同步上线,模型名 deepseek-v4-pro。HLE(wo/w tools)达 42.7/60.0,Terminal Bench 2.1 为 87.9,支持 Responses API 与 Codex 智能体工具。

  10. GLM-5.3 登陆 Go 语言生态:1M 上下文同价 — X:opencode
    08月14日 06:19
    GLM-5.3 现已在 Go 中可用,支持文本与 1M 上下文,与 GLM-5.2 定价相同。已上线 ZCode、AutoClaw、TraeWork、WorkBuddy、Qoder、OpenCode 等编码平台。

产品发布/更新
  1. DeepSeek Harness v0.1 开发者预览版发布:一切皆插件的智能体框架 — X:DeepSeek
    08月13日 13:02
    基于 Cordis 元框架构建,MIT 开源。核心设计"一切皆插件"——模型、工具、技能、会话、沙箱、文件系统、循环、编排及 UI 均可自由组合、替换和扩展。可在多模型间即时切换并连接视觉模型。

  2. Cursor 推出 builds:云智能体启动速度提升至 3 倍 — Cursor Blog
    08月13日 12:00
    后台持续准备就绪的开发环境副本,让云智能体启动时无需从零搭建,内部环境启动快 10 倍,首个 token 生成快 3 倍。8 月 17 日起所有环境默认启用,无需额外费用。

  3. Google Sheets 推出 Sheets canvas:用 Gemini 将表格数据变为交互式迷你应用 — Google Blog: AI
    08月13日 16:45
    用户只需自然语言提示词即可将表格数据转化为交互式仪表盘、学习追踪器、座位表等"迷你应用"。

  4. Anthropic 为 Claude Code 新增自动继续功能 — X:Kim
    08月14日 11:09
    任务未完成但资源用尽时,开启后会在额度重置后自动从断点继续。Claude Code 在 Anthropic 内部日常维护中已自动开出 388 个 PR,合并率 46%。

  5. 谷歌 Chrome 测试 AI 修改密码功能:Gemini 帮你改弱密码 — IT之家
    08月14日 13:15
    Chrome Canary 正在测试由 Gemini 完成修改弱密码或重复密码的流程,原"修改密码"按钮替换为带 Gemini 标识的"帮我修改"按钮。正式版有望在数月后实装。

  6. 百度 GenFlow 更名"库库 AI":月活超 2500 万,推独立办公端 — X:百度 / IT之家
    08月14日 10:52
    原名 GenFlow(4 月月活破 1 亿),现定名 Kuku AI,上线 PC 客户端、网页端、小程序及企业版,可并行调用 Office Agent 完成 PPT、Excel、Word 跨模态文件生成与编辑。

  7. WorkBuddy 上线远程控制:手机实时同步电脑端任务与工作空间 — 公众号:数字生命卡兹克
    08月13日 04:32
    将 PC、App 和小程序打通,手机端可实时同步电脑端的任务、对话、工作空间和产物,支持一台手机连接多台电脑并随时切换。App 需 1.2.0+,电脑端需 5.3.8+,连接无需扫码。

  8. Gemini 与 Flow 新增可见水印开关 — X:Josh Woodward (Google Labs VP)
    08月14日 13:39
    可在 Gemini 和 Flow 中开启或关闭可见水印,适用于所有图片(Nano Banana)、视频(Omni)和歌曲(Lyria),法律规定必须保留水印的国家除外。

  9. Bullet(YC S26)发布:定位更快的编码代理 — Hacker News
    08月14日 11:08
    核心优势在于更精简的编排层,主打速度提升,面向需要高效编码辅助的开发者。

  10. Arcads Actor+ 让 AI 视频逼近真实:由 Seedance 2.5 驱动 — X:Rohan Paul
    08月14日 12:33
    号称最逼真的 AI 演员库,AI 视频质量正成为感知问题——一旦演员在手机镜头下像正常人,剩余差距将更难察觉,片段已"令人不安地接近"真实。

行业动态
  1. 英伟达下一代 GPU"Feynman"将采用台积电 A16 制程 — IT之家 / 电子时报
    08月14日 10:46
    英伟达正将研发与供应链资源转向下一代 GPU"Feynman",预计采用台积电 2nm 升级版 A16 制程,提高 SoIC 3D 堆叠技术导入,搭配定制 HBM 和共封装光学(CPO),朝 3D 小芯片与 SoIC 方向发展。

  2. OpenAI 首席营收官丹尼斯离职,Wiz 总裁达利·拉伊奇接任 — IT之家
    08月14日 07:30
    OpenAI 聘请 Wiz 总裁兼 COO 达利·拉伊奇出任新任首席营收官,接替去年 12 月加入的丹尼斯·德雷瑟。本周第二位出走的核心高管。OpenAI 称年化营收运行率 7 月环比增长超 20%,企业客户业务增长 32%,上周活跃用户突破 10 亿。

  3. 月之暗面发严正声明:不存在"朋友基金""老股额度"等,已向公安机关反映 — IT之家
    08月14日 12:10
    针对市场上冒用其名义虚假融资、涉嫌违法犯罪的行为已向公安机关反映。近期公司完成超 35 亿美元 F 轮融资,投后估值 350 亿美元,并发布总参数 2.8 万亿的旗舰大模型 Kimi K3。

  4. CoreWeave 烧钱加剧但股价涨 19%:亏损翻倍、季度自由现金流 -57.4 亿美元 — X:Rohan Paul
    08月14日 12:17
    上季度亏损翻倍、支出飙升,现金流消耗比营收多近 60 亿美元,但股价仍涨 19%。投资者看中 1037 亿美元 backlog 及 Q3 新增超 250 亿美元客户承诺,收入同比增长 112%。2026 年资本开支指引上调至 350 亿-390 亿美元。

  5. SK 集团会长崔泰源致歉存储涨价:2027 年短缺最严重,苹果也受影响 — IT之家
    08月14日 11:23
    SK 海力士正投资 7200 亿美元建设全球最大存储芯片工厂网络,目标到 2034 年产能提升至当前三倍。据 Counterpoint 数据,2026 年 Q1 SK 海力士在全球 HBM 市场占有 58% 份额。

  6. 中芯国际 AI 芯片产能告急涨价:Q2 营收突破 30 亿美元 — X:X.PIN
    08月14日 06:07
    AI 相关逻辑、BCD 和光模块芯片需求供不应求,已实施 Q3 新定价,产能利用率保持 95% 附近,平均售价上涨 5.7%。

  7. LG 与 NVIDIA 签署谅解备忘录:2027Q1 公开亮相人形机器人 — IT之家
    08月14日 06:07
    LG 计划 2027Q1 公开亮相基于 Jetson Thor 芯片的双足人形机器人,2028H1 建成 80MW AI 工厂,双方多领域 AI 合作转入执行阶段。

  8. Uber 与 Pony.ai 扩大 Robotaxi 合作:欧洲部署 2000 辆 — X:X.PIN
    08月14日 08:18
    两家公司计划在欧洲部署 2000 辆自动驾驶出租车,合作扩展至中东。3 月已在克罗地亚萨格勒布推出欧洲首个商业 robotaxi 服务,下一阶段将新增四个欧洲城市。

  9. 闪迪 HBF 高带宽闪存:2027 年出样品、2028 年量产 — IT之家
    08月14日 08:42
    已完成首款产品流片,HBF 结合 HBM 级读取带宽并实现 8-16 倍容量,第一版最高支持 512GB,内部数据显示 4 块 GPU 可达 HBM 系统 8 块 GPU 的 Token 输出量。

  10. 地平线星空芯片获头部新能源车企定点:行业首个纯国产舱驾一体高端 AI 座舱 — IT之家
    08月14日 05:41
    单芯片一体化设计实现算力池化与数据互通,可帮助车企缩小约 50% 车载硬件空间占用,单车综合硬件成本下降 1500-4000 元,研发交付周期由 18 个月缩短至 8 个月。

  11. 芯擎科技车规级 7 纳米 AI 加速芯片"天工 100"量产:硬件成本降至千元级 — IT之家
    08月14日 07:31
    国内首款面向端侧智能体 AI 应用的独立车规大模型加速芯片,96 TOPS INT8 算力,支持 3B-7B 大模型运行,通过 AEC-Q100 Grade3 与 ISO26262 ASIL-B 认证,较双控 AI BOX 方案成本至少减半。

  12. 腾讯混元资深研究员徐灿转岗微信 WeLM,微信 AI 或进入加速阶段 — IT之家
    08月14日 10:29
    徐灿此前在混元 LLM 体系中担任后训练方向负责人,此次转岗正值微信强化自研大模型和 Agent 能力阶段。微信近期在招聘 WeLM 推理优化及 Agent 方向研究人员。

论文研究

Anthropic 研究:新兴多智能体系统的模式与问题 — Anthropic Research
08月13日 01:20
实验显示,45 个协调智能体在 2700 万 token 运行中发现 266 个漏洞,而独立并行方法在 650 万 token 中发现 21 个,两种方法仅 12 个重叠。研究警示个体层面的良性行为怪癖可能叠加为意外的系统性失败。

MIT 新框架统一描述深度学习架构:可一键转换为图表或 PyTorch 代码 — X:Rohan Paul
08月14日 14:18
提出一种数学框架用于表示、操作和编译深度学习架构,为模型提供统一描述语言,精确涵盖张量操作的连接与行为,旨在让软件自动分析和优化模型架构。论文见 arxiv.org/abs/2604.07242。

面壁智能等发布 SciDC:将科学知识转化为解码约束,减少模型幻觉 — X:面壁智能 OpenBMB
08月14日 14:00
联合清华 NLP、南京大学等发布,无需微调即可使本地部署的领域模型只在专家规则定义的可行域内生成。在工业配方设计、临床诊断等任务上平均准确率提升 +11.6,真实医疗记录上 Qwen3-14B 精确匹配从 33.5% 提升至 45.1%。

三星推出健康 AI 基础模型:学习智能手表生物信号数据 — Artificial Intelligence News
08月14日 13:30
三星美国研究院数字健康团队推出两款 AI 基础模型,涵盖心脏活动、睡眠和身体活动,用于分析可穿戴设备采集的生物信号数据。

OpenAI 发布研究报告:组织如何使用 AI——来自 ChatGPT 的证据 — Hacker News / OpenAI
08月14日 07:59
基于企业实际使用数据,分析组织采用 AI 的模式与效果,揭示不同规模、行业组织在部署 ChatGPT 时的典型场景、效率提升幅度及面临的挑战。

技巧与观点

  1. Claude 接管应用日常维护:数周内自动开出 388 个 PR,合并率 46% — X:Boris Cherny / The Decoder
    08月13日 21:27
    Boris Cherny 让 Claude 通过 Slack 频道运行崩溃模糊测试、重复代码统一、死代码移除等日常任务。数周内自动开出 388 个 PR,其中 180 个经 Claude Code Review 和人工审核后合并。Claude 通常一次就能改对。

  2. FDE 成 AI 圈最闷声发大财的岗位:国内大厂开到 35-70k×15 薪,岗位量涨 42 倍 — X:阿易 AI Notes
    08月14日 11:36
    FDE(落地工程师)需兼具代码与客户沟通能力,负责将大模型真正接入企业并解决数据孤岛、幻觉、权限合规等落地问题。OpenAI、Anthropic、字节、智谱等均在疯抢,美国资深岗总包可达百万美金,且无 35 岁危机。

  3. 70 天超 10 款模型:CNBC 称美国限制反而催化中国 AI 创新 — IT之家
    08月14日 09:06
    自今年 6 月以来,9 家中国 AI 公司已推出 10 款模型,在推理、编程和智能体等关键领域逐步逼近美国顶尖闭源模型。IDC 调查显示安全合规与性能优势是企业采用中国 AI 模型的最主要原因。

  4. a16z 图表:Neocloud 增长远超早期云巨头,但成本高企 — a16z News
    08月14日 14:11
    CoreWeave 约 25 个季度即达 AWS 第 40 个季度时的 26 亿美元季度营收。但巨额 Capex 及超营收半数的芯片折旧与利息支出下,其股价一年跌约 16%。Atlassian 云业务同比增长 31%,AI 助手 Rovo 用户支出增速接近非用户两倍。

  5. Phone Harness 实机教程:让 Codex 控制 iPhone 跑任务,无需越狱 — X:阿易 AI Notes
    08月14日 06:32
    让 Codex、Claude Code 等 Agent 无需越狱即可控制锁屏 iPhone,完成开 APP、点按钮、读屏幕等操作。作者实测合盖睡觉时 Agent 在云端手机自动跑任务,醒来邮箱已收到整理好的 12 个新 AI 岗位。

  6. 为什么 Opus 5 用起来反而感觉更差? — Hacker News
    08月14日 12:11
    作者认为 Opus 5 在基准测试上媲美 Fable、强于 Opus 4.7 和 4.8,但使用体验像降级——在意图不明时不会停下来提问,常擅自假设或改动计划。推测源于前沿实验室追求高基准分数,而基准任务自包含、无需澄清,反而筛选出敢于大胆假设的模型。

  7. AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求 — GitHub Blog
    08月12日 18:00
    AutoGPT 维护者将指令放在 AGENTS.md 和技能文件中,通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制管理智能体提交的 PR。CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与智能体的"人类探测器"。

  8. AI 文本水印技术的工作原理 — Hacker News
    08月14日 05:08
    详细解析 AI 文本水印的嵌入与检测机制,探讨如何在生成文本中嵌入不可见标记以及水印技术的局限性与对抗方法。

来源:The Verge、The Decoder、Cerebras、MarkTechPost、StockTitan、a16z 等、央广网、证券时报、科技日报、IT之家、财联社、南都、红星资本局、中国基金报等)→ 官方/一手来源核验(DeepSeek API 文档、Google DeepMind Blog、Z.ai Blog、OpenAI 官网等)

为伟大思想而生!

AI+互联网思想时代(wanging0123)

第一必读自媒体