打开网易新闻 查看精彩图片

AI+快报,唯快不破

AI 每日动态 — 2026年08月13日(周四)

覆盖时段:2026年8月11日 ~ 8月13日 | 共 45 条 | 数据来源:AI HOT (aihot.virxact.com)
今日重点关注

1. DeepSeek V4 Pro 正式版与 Grok 4.6 同日发布,双双逼近 Claude Fable 5

DeepSeek V4 Pro 0813(GA 正式版,1.5T 参数混合专家模型,1M 上下文)与 xAI Grok 4.6 在不到 2 小时内先后发布。DeepSeek V4 Pro 在智能体任务上大幅超越 Nemotron 3 Ultra,输入/输出定价仅 $0.435/$0.87 每百万 token;Grok 4.6 在 Artificial Analysis 智能指数上追平 GPT-5.6 Sol,AA-Briefcase 知识工作基准与 Claude Fable 5 并列领先,单任务成本仅 $4.42(Fable 5 为 $22.30)。

关注理由:中美两大"第二梯队"同日对垒——DeepSeek 以约 1/5 的价格逼近全球最强体验,Grok 4.6 以远低于竞品的成本并列知识工作第一。大模型竞争正式从"拼参数"进入"拼智能性价比"阶段。

2. 消息称 Anthropic 最快今年 9 月上市,估值高达 9650 亿美元

Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。公司估值高达 9650 亿美元,年化收入已超 470 亿美元,并向投资者淡化来自中国 AI 企业的竞争影响。Anthropic 还计划拓展 AI 在医疗和生物学领域的应用。

关注理由:若成行将是史上最大规模 IPO。9650 亿美元估值意味着资本市场已把 Anthropic 视作 AI 时代核心资产,超级 AI 公司正式进入公开市场定价时代。

3. ChatGPT 与 Gemini 双双突破 10 亿用户OpenAI 8 月 6 日披露 ChatGPT 月活用户超 10 亿(7 月周活已达 10 亿);谷歌 CEO 皮查伊宣布 Gemini 月活达 10 亿,成为谷歌有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品(2 月时月活为 7.5 亿)。

关注理由:两大 AI 助手同月跨过 10 亿门槛,AI 应用正式进入"国民级"时代。Gemini 半年猛增 2.5 亿用户,显示搜索巨头正借助渠道分发实现对先行者的弯道超车。

4. 阿里开源 Qwen3.8-2.4T-A95B:Qwen-Max 级别模型首次开源

阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源。模型总参数 2.4T,每个 Token 激活 95B,原生支持 262,144 Token 上下文,并可扩展至 1,010,000 Token。

关注理由:国内顶级商用模型的"顶配"首次开源,2.4T 总参数对标国际一线开源模型,将直接抬高国内开源生态天花板,也为企业级部署提供全新参照系。

5. 研究人员发现可读取 ChatGPT 等模型加密推理过程的 API 漏洞

Alexander Panfilov 团队发现 OpenAI、Anthropic、Google 等主要 AI 提供商 API 存在漏洞,可读取推理模型的加密思考过程。扫描约 7000 条公开会话发现 62 个 API 密钥、33 个邮箱和 33 个密码。通过越狱,Anthropic 的 Haiku 4.5 可逐字转写 Opus 4.8 的原始推理;解码 10000 条推理轨迹的 API 成本约 720 美元。

关注理由:被加密的"思维链"再度失守。若推理过程可被逐字读取,各厂商"推理加密"的隐私承诺便形同虚设,连带泄露的密钥、邮箱与密码更会连锁放大为账号安全危机。
模型发布/更新
  1. 腾讯微信公布 WeLM 大语言模型:80B 版已用于 AI 助手小微,617B 版开发中 — IT之家(RSS)
    08月13日 07:03
    腾讯微信团队公布自研大语言模型 WeLM,主打资源利用效率。其中 WeLM-80B 拥有 800 亿总参数、30 亿激活参数,已部署于微信原生 AI 助手"小微",支持聊天搜索、调用微信原生功能及小程序服务。WeLM-617B 为混合专家模型(MoE),总参数 6170 亿、激活参数 230 亿,正在开发中,面向智能小程序开发等复杂任务。

  2. DeepSeek V4 Pro 0813 正式发布 — Hacker News 热门(buzzing.cc 中文翻译)
    08月13日 01:24
    DeepSeek V4 Pro 0813 是 DeepSeek 推出的大规模混合专家模型,为该系列的 GA 正式版本。模型输入价格 $0.435/1M tokens,输出价格 $0.87/1M tokens,上下文窗口达 1M,于 2026 年 8 月 12 日发布。该模型目前由一家提供商托管,OpenRouter 将请求直接转发至该提供商。

  3. 韩国 Upstage 发布旗舰推理模型 Solar Pro 4,智能指数 42 分 — X:Artificial Analysis (@ArtificialAnlys)
    08月13日 01:20
    韩国 AI 实验室 Upstage 发布旗舰推理模型 Solar Pro 4,Artificial Analysis 智能指数达 42 分,较 Solar Pro 3 的 14 分大幅提升 27 分,与 Inkling(xhigh,42 分)持平。

  4. 阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文 — IT之家(RSS)
    08月13日 00:10
    阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源。模型总参数 2.4T,每个 Token 激活 95B,原生支持 262,144 Token 上下文并可扩展至 1,010,000 Token。

  5. 微软首发自研推理模型 MAI-Thinking-1 — X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman)
    08月13日 00:00
    微软 AI 团队的首个推理模型 MAI-Thinking-1 从零开始构建,现已在 Microsoft Foundry 上线。微软此前已被曝计划 9 月发布 MAIA 300 自研芯片,此次推理模型的发布标志其自研 AI 全栈布局加速。

  6. LTX-2.5 模型登场:AI 生成 10 秒 720P 视频仅需 6.8 秒,原生集成 ComfyUI — IT之家(RSS)
    08月12日 14:46
    LTX 推出 LTX-2.5 模型,原生集成 ComfyUI,在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频仅需 6.8 秒。LTX-2.5 Fast 以每秒 0.09 美元生成带音频 720p 视频,10 秒片段成本 0.90 美元;年度经常性收入低于 1000 万美元的组织可免费使用。

  7. Cursor 与 SpaceXAI 联合发布 Grok 4.6 — Cursor Blog
    08月12日 08:00
    Cursor 与 SpaceXAI 今日发布 Grok 4.6,重点强化长时运行智能体与交互式视觉任务,在多项智能体编程与知识工作基准上达到前沿水平,并在 Artificial Analysis Intelligence Index 上追平 GPT-5.6 Sol。

  8. xAI 发布 Grok 4.6,强化长时运行智能体能力 — xAI:News(网页)
    08月12日 08:00
    xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol。

  9. SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning — LMSYS:Blog(Chatbot Arena 团队)
    08月11日 21:51
    SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为 30B 总参数、3B 激活参数的混合专家架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 API 接入智能体工作流。

  10. NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务 — NVIDIA Blog(RSS)
    08月11日 21:00
    NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

  11. Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务 — 公众号:蚂蚁百灵(Ling)
    08月11日 17:20
    蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。

产品发布/更新
  1. Claude in Chrome 侧边栏升级为 Claude Cowork 会话 — Claude:Blog(网页)
    08月13日 04:15
    Claude in Chrome 浏览器扩展的侧边栏现已升级为 Claude Cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换。该功能今日面向 Max 和 Team 客户开放,未来几周内向 Pro 用户推出。

  2. Meta 开源 Muse Glimmer 登陆 OpenRouter — X:OpenRouter (@OpenRouter)
    08月12日 20:00
    Meta AI 超级智能实验室的首个开放权重模型 Muse Glimmer 已在 OpenRouter 上线。这是一款 30B 密集文本+图像模型,采用 Apache 2.0 许可证,旨在成为可靠的本地智能体,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。

  3. OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型 — OpenRouter:Announcements(RSS)
    08月12日 08:00
    OpenRouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 BrowseComp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本。

  4. Mojo 1.0 正式发布:为生态系统增长提供稳定基础 — Hacker News 热门(buzzing.cc 中文翻译)
    08月12日 03:52
    Mojo 语言正式发布 1.0 版本,提供稳定、可用于生产环境的语言基础,自 2023 年首次发布以来已发展成通用语言。自开源标准库以来,近 200 名贡献者合入超 1,100 个拉取请求,改动超 200,000 行代码。

  5. Runway Seedance 2.5 上线,支持 50 角色参考 — X:Runway (@runwayml)
    08月12日 02:53
    Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。
    https://x.com/runwayml/status/2087251184658657346

  6. ChatGPT 桌面端支持导入其他智能体工作数据 — X:OpenAI Developers (@OpenAIDevs)
    08月12日 02:20
    现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。现已在 ChatGPT 桌面应用中提供。

  7. Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移 — Google Cloud:Databases(RSS)
    08月12日 00:00
    Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。

  8. ZCode 全面升级:Goal、Subagents、Remote Control 与闲时任务四大功能上线 — 公众号:智谱(GLM)
    08月11日 13:52
    ZCode 针对 GLM 深度优化,今日上线 Goal、Subagents、Remote Control 与闲时任务四大功能。在 Z.ai Code Bench 测试中,GLM-5.2 搭配 ZCode 较搭配 Claude Code 任务整体通过率高 2.39%;ZCode 缓存命中率超 98%,叠加 1.5 倍限时额度加成后,GLM Coding Plan 整体使用量接近常规额度的 1.8 倍。

行业动态
  1. 苹果拟向出版商支付最高数亿美元获取新闻内容,改进 AI 版 Siri — IT之家(RSS)
    08月13日 07:33
    苹果正与多家出版商洽谈多年期合作协议,获取新闻内容以支持 AI 驱动的 Siri 功能,该功能预计今年晚些时候推出。苹果提出按内容实际使用量付费的灵活方案,并讨论过一笔规模可能达数亿美元的预算。此前苹果曾试验 AI 生成新闻摘要,因生成错误标题引发担忧后已关闭该功能。

  2. SpaceX 首场财报会:2027 年新增 6-8GW 数据中心 — X:SemiAnalysis (@SemiAnalysis_)
    08月13日 06:30
    埃隆在 SpaceX 首次财报电话会议上再次震惊世界:仅 2027 年就将新增 6-8GW 数据中心,可能远超 10GW。SemiAnalysis 预计 SpaceX 到 2027 年底有望达到约 10GW,并有望实现 3000 亿美元年收入。

  3. 白宫拟将开源 AI 模型纳入安全测试框架 — X:Kim (@kimmonismus)
    08月13日 06:29
    白宫据报准备将开源 AI 模型纳入其秘密的发布前安全测试框架。该框架目前仅覆盖 OpenAI、Anthropic 等实验室的闭源前沿模型,开源模型达到同等能力后预计需接受最长 30 天的发布前测试。官员正权衡两难:排除开源模型或为闭源实验室创造政府背书优势,纳入则可能拖慢美国开源模型发展。

  4. LiteLLM 供应链攻击泄露海量凭据,波及微软、亚马逊、英伟达等数千家组织 — Ars Technica:AI(RSS)
    08月13日 05:43
    开源 AI 开发工具 LiteLLM 遭供应链攻击,约 434,000 个 CI/CD 流水线凭据在 40 分钟内被窃取,涉及微软、亚马逊、英伟达、思科、三星等超 2,500 家组织。

  5. Amazon 将默认用 Twitch 主播内容训练生成式 AI,除非用户主动退出 — TechCrunch:AI(RSS)
    08月13日 04:10
    Twitch 将默认把创作者内容用于训练母公司 Amazon 的生成式 AI 模型,主播需手动在频道设置的"生成式 AI 训练"选项中退出。此举引发社区强烈反弹,Twitch 高管坦言若改为主动加入则无人会选择。Twitch 承认其做法并非个例,Meta 同样使用平台公开内容训练 AI。

  6. Cognition 洽谈 400 亿美元估值,年化收入近 10 亿 — X:Rohan Paul (@rohanpaul_ai)
    08月13日 02:51
    彭博社:Cognition 正在洽谈超过 400 亿美元的估值,而就在 3 个月前其估值刚以 260 亿美元收官。新一轮融资可能超过 10 亿美元,Cognition 的年化收入运行率目前已接近 10 亿美元(5 月时为 4.92 亿美元,增幅约 103%),Devin 的企业使用量在 6 个月内实现 50% 的月环比增长。

  7. Research Gold 号称"100%人类撰写、绝不使用AI",实则全程由AI驱动 — Hacker News 热门(buzzing.cc 中文翻译)
    08月12日 13:41
    面向医学研究者的网站 Research Gold 宣称其服务"100%由人类撰写、绝不使用AI",并列出多名博士审稿人。但调查发现,这些审稿人系 AI 生成、并不存在;部分真实方法学家的身份和照片未经许可被挪用。致电该公司时,自称"Sarah"的 AI 助手坚称自己是真人,邮件与聊天回复也均为 AI 生成。

  8. ChatGPT 与 Gemini 双双突破 10 亿用户 — The Verge:AI(RSS)
    08月12日 03:41
    OpenAI 与 Google 的聊天机器人均跨过 10 亿用户门槛。OpenAI 在 8 月 6 日的博文中披露 ChatGPT 月活用户超 10 亿,Google CEO 皮查伊则宣布 Gemini 月活达 10 亿,成为其史上增长最快的产品。OpenAI 称 ChatGPT 在 7 月周活用户已达 10 亿,而 Gemini 在 2 月月活为 7.5 亿,增长势头更猛。

  9. 研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞 — The Decoder:AI News(RSS)
    08月12日 01:38
    Alexander Panfilov 团队发现 OpenAI、Anthropic、Google 等主要 AI 提供商 API 存在漏洞,可读取推理模型的加密思考过程。扫描约 7000 条公开会话发现 62 个 API 密钥、33 个邮箱和 33 个密码。通过越狱,Anthropic 的 Haiku 4.5 可逐字转写 Opus 4.8 的原始推理;解码 10000 条推理轨迹的 API 成本约 720 美元。

  10. Gemini 月活破 10 亿,成谷歌增长最快产品 — X:Sundar Pichai (@sundarpichai)
    08月12日 01:00
    每月已有超过 10 亿人使用 Gemini 应用激发新想法、完成工作。这是谷歌有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。

  11. 消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级 — IT之家(RSS)
    08月11日 22:54
    英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球最先进的开源模型竞争。英伟达尚未确定发布日期,最终训练也未完成,员工认为该模型最早可能在今年秋末准备就绪。此举意在通过开放模型生态扩大 AI 应用范围,并推动市场对其 GPU 算力的需求。

  12. 消息称 Anthropic 最快今年 9 月上市,向投资者淡化 AI 模型竞争等挑战 — IT之家(RSS)
    08月11日 11:57
    Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。公司估值高达 9,650 亿美元,年化收入已超 470 亿美元,并淡化来自中国 AI 企业的竞争影响。Anthropic 还计划拓展 AI 在医疗和生物学领域的应用,但尚未公布具体 IPO 定价方案。

论文研究
  1. 空货架还是丢钥匙?Google 研究:Recall 是参数化事实性的瓶颈 — Google Research:Blog(网页)
    08月13日 01:57
    Google Research 提出知识画像框架,发现前沿 LLM(如 Gemini3、GPT-5)的事实编码接近饱和,但回忆(recall)能力不足,多数事实错误源于"丢钥匙"而非"空货架"。该框架将事实分为编码失败、回忆失败等五类画像,并配套推出 WikiProfile 基准,含 2,150 条维基百科事实,每条配 10 个问题,用于分别探测编码、回忆与识别能力。

  2. AMIE 医疗 AI 系统首次展示实时临床视频问诊能力 — Google Blog:AI(RSS)
    08月12日 01:00
    Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊,首次在此场景展示专家级 AI 能力。该系统基于 Gemini 和 Project Astra 构建,可解读视觉与听觉线索、引导虚拟体格检查并实时诊断推理。随机研究中,临床评估者对 AMIE 的病史采集、诊断准确性等核心能力给予好评,患者演员也更偏好视频体验。

  3. Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11-16 倍的 LLM 推理加速 — Hacker News 热门(buzzing.cc 中文翻译)
    08月12日 00:41
    研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11.08 倍、token 生成提升 16.36 倍,接近裸机性能的 98%;Gemma 4 12B 的提示处理与生成速度分别提升 7.20 倍和 14.54 倍。

  4. 统一 Radix 缓存:为混合模型前缀缓存构建单一树结构 — LMSYS:Blog(Chatbot Arena 团队)
    08月11日 21:51
    LMSYS 团队提出 Unified Radix Cache,用单一 token 键控 radix 拓扑统一管理混合模型的 FULL、SWA 和 MAMBA 组件缓存,各组件独立执行路径、滑动窗口和检查点复用语义。

技巧与观点
  1. DeepSeek V4 Pro 与 Grok 4.6 同日发布,双双逼近 Claude Fable 5 体验 — 公众号:数字生命卡兹克
    08月13日 06:22
    DeepSeek V4 Pro 正式版与 Grok 4.6 在 2 小时内先后发布,均为 1.6T/1.5T 参数模型,逼近 Claude Fable 5 体验。

  2. AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求 — GitHub Blog
    08月13日 02:00
    AutoGPT 维护者发现,AI 智能体不会主动阅读文档,因此将指令放在 AGENTS.md 和技能文件中,并置于代码目录旁。他们通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制,将智能体提交的 PR 从"不可用"转变为"可用但不符合路线图"。其中 CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与智能体的"人类探测器"。

  3. 我写了一本 AI 教科书——AI 还要多久才能写得更好? — Nathan Lambert:Interconnects(RSS)
    08月12日 21:01
    作者在完成一本 RLHF 教科书后反思,LLM 在长文非虚构写作上进展停滞,GPT 4.5 和 Kimi K2 等写作强模型已显老旧,而编码、数学等任务已接近超人水平。模型能改错字、做编辑,但组织整章内容时仍混乱且易出错,作者认为这阻碍了模型自主解决开放科学问题。

  4. 零基础用户半天上手 AI 的 12 步实操流程 — 公众号:数字生命卡兹克
    08月12日 08:08
    文章给出一套零基础用户半天上手 AI 的 12 步实操流程:准备内存不低于 16G 的电脑,订阅 ChatGPT 并安装 Codex 或使用 WorkBuddy,用语音输入法以【背景、痛点、需求】框架向 AI 交代任务,经苏格拉底提问澄清需求后投喂文件让 AI 直接完成,最后沉淀为可复用 Skill。文中建议 Codex 选 GPT-5.6 Sol 最高模型,WorkBuddy 选 Kimi K3。

  5. 将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么 — Hacker News 热门(buzzing.cc 中文翻译)
    08月12日 02:32
    作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤。

  6. Ryan Greenblatt:人类级 AI 或于 2032 年前通过递归自我改进催生失控超级智能 — Dwarkesh Patel:Podcast & Blog(RSS)
    08月12日 00:31
    Dwarkesh Patel 与 Redwood Research 首席科学家 Ryan Greenblatt 探讨递归自我改进(RSI)的可能性:一旦 AI 达到人类顶级专家水平,可能在一年内实现相当于 4-5 年的 AI 进展,Ryan 的中位预期是 2031 年自动化 AI 研发。双方还讨论了超级智能的对齐对象、奖励黑客行为是否会升级为 AI 联手接管世界等风险。

  7. 跨会话传消息后,Codex 和 Claude 如何重构 vibe coding 工作流 — 公众号:卡尔的AI沃茨
    08月11日 22:15
    Codex 和 Claude 新增跨 Session 传消息功能后,新对话可从之前所有对话中选择可用消息,省去交接文档和 git 备份。作者据此重构工作流:主对话守住目标与决策,分支对话独立探索新想法,完成后由主对话读取完整记录。Codex 通过复制会话 ID 精确寻址,Claude Code 则用内置 session management 搜索对话历史,但桌面端只能搜索当前可访问的会话记录。

  8. OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧 — The Verge:AI(RSS)
    08月11日 19:00
    OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。

  9. 用 ComfyUI API 实现 MiniMax-H3 多模态视频与音频生成流水线 — MarkTechPost(RSS)
    08月11日 13:44
    本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Python 直接构建执行图,支持文生视频、首尾帧条件生成和参考图像条件生成,并自动根据 GPU 显存选择 quality、balanced、squeeze 三种权重配置。流水线涵盖模型自动下载、节点模式校验、音视频联合解码与进度监控,无需图形界面即可复现实验。

  10. 编写智能体时,哪种编程语言最合适? — Hacker News 热门(buzzing.cc 中文翻译)
    08月11日 12:58
    针对"动态语言比静态语言更省 LLM token"的流行说法,作者用 GPT-5.6 Sol 让智能体实现 zstd 解码器进行实测。结果显示,medium 努力度下动态语言表现更好,ultra 下静态语言反而更优,且此前评测存在测试路径错误等缺陷。作者认为,琐碎任务上的性能无法推广到更大问题。

本次推送覆盖 45 条AI动态 | 模型发布/更新 11条 | 产品发布/更新 8条 | 行业动态 12条 | 论文研究 4条 | 技巧与观点 10条 数据来源:AI HOT (aihot.virxact.com) — AI领域每日精选动态


为伟大思想而生!

AI+互联网思想时代(wanging0123)

第一必读自媒体