「极客头条」—— 技术人员的新闻圈!

CSDN 的读者朋友们好,「极客头条」来啦,快来看今天都有哪些值得我们技术人关注的重要新闻吧。(投稿或寻求报道:zhanghy@csdn.net)

整理 | 苏宓

出品 | CSDN(ID:CSDNnews)

一分钟速览新闻点!

  • iPhone Duo 维修费 8000 元冲上热搜,苹果客服回应 iPhone Duo 发烫问题,称博主单机测评较片面

  • 雷军再次谈及 AI 造车:小米依然强调真实环境的测试

  • 罗福莉直播公开小米 MiMo-V2.6 训练,两款模型累计成本超 135 万美元

  • 赛力斯否认“2027 年问界撤出华为门店”传闻:部分门店将继续销售

  • Anthropic 披露研发指标:Claude 主导公司 26% 的 AI 研发工作

  • 英伟达 CEO 黄仁勋:明年公司芯片销量将翻倍

  • OpenAI 据报接近解决又一“千禧年大奖难题” 或将攻克霍奇猜想

  • SpaceX AI 部门拟购破产初创公司数据训练 Grok 模型,标志数据策略转向

  • Anthropic 将合并 Claude 系列产品,推出统一办公入口

  • GLM 披露国内首个 RSI 工程实践

  • OpenAI 披露 GPT-5.6 Sol 异常行为:AI 模型会留下指令要求「未来版本的自己」隐瞒自身错误

  • 前 OpenAI 研究员发布 Jev 模型,放弃自由文本生成

  • 匿名模型 Union Alpha 上线,首日处理 20 亿 Token

国内要闻

iPhone Duo 维修费 8000 元冲上热搜,苹果客服回应 iPhone Duo 发烫问题,称博主单机测评较片面

近日,影视飓风创始人Tim 测评苹果首款折叠屏 iPhone Duo,称其日常使用温度可控,但高负载场景下摄像头下方发热明显,发布会现场录制 3 分钟左右 4K 60 帧视频就烫到难以握持,分析认为与算力和信号模块集中在此区域、A20 Pro 芯片满性能释放有关,后续或通过软件更新限制性能优化。还提到其 Apple Care 定价更高,存在折叠结构、屏幕相关问题,建议普通用户选直板 iPhone。

另外,有记者采访杭州某数码店老板表示:“iPhone Duo 15999 元起就是买个情怀。”买的时候要准备好 8000 元左右的维修费,相当于 iPhone Duo 隐形起步价 2.4 万。

针对评测,苹果客服回应称单机测评片面,建议消费者线下体验,新机有 3 至 5 天适应期,硬件发热可检测处理。此外,iPhone 18 Pro 系列升级大面积 VC 均热板,高负载运行升温幅度小,更适合内容创作者。(中国蓝新闻、金融界)

雷军再次谈及 AI 造车:小米依然强调真实环境的测试

9 月 16 日下午,雷军发文谈及 AI 造车,称小米用 AI 改进质量管理的同时重视真实环境测试,近年投入近 3000 辆测试车并开展上市后生命周期泛化测试。雷军还受中国质量协会邀请出席活动并演讲,分享小米质量管理实践:过去 5 年累计研发投入 1050 亿元,未来 5 年计划超 2000 亿元。2017 年成立质量委员会确立质量优先一票否决制,2023 年引入卓越绩效模式,已建成 802 间自建实验室、35 间联合实验室。此外,小米五年前宣布造车,上市两年多交付 80 万辆,近期推出龙甲电池安心保障计划,作出两项相关赔偿补偿承诺。

罗福莉直播公开小米 MiMo-V2.6 训练,两款模型累计成本超 135 万美元

小米 MiMo 负责人罗福莉公开了 MiMo-V2.6 的强化学习训练进展,并开放实时训练面板。页面展示 Pro 与 Flash 两个版本的运行状态,包括训练步骤、token 消耗、样本数量、成本和内部指标。据界面新闻报道,截至 9 月 17 日下午发稿,两款模型的累计训练成本已超过 135 万美元,合计每小时花费约 3.1 万美元。训练页面目前仍在持续更新,模型还处于强化学习过程之中。

罗福莉表示,团队正同时扩大计算资源、训练环境与任务体系,以及评估计算。每个训练步骤使用约20 亿个 token,按 1568 个提示、每个提示 16 次尝试的配置完全异步运行,并将多个智能体任务框架混合到同一轮训练。评估机制结合测试用例与评分细则,为不同执行路径分配奖励。小米 MiMo 团队计划在未来几周陆续公开技术细节;实时面板展示的是本轮训练过程,不是已正式发布模型的最终成绩。(i 黑马)

赛力斯否认“2027 年问界撤出华为门店”传闻:部分门店将继续销售

9 月 17 日,有媒体报道称,已有多位经销商接到华为方面告知,明年 1 月 1 日开始,问界正式撤出鸿蒙智行和华为专卖店。届时经销商将自主选择华为、鸿蒙智行或问界品牌代理,问界将保留现有交付中心来支撑汽车售后与交付,如选择只做鸿蒙智行,经销商将保留直营模式。

针对此事,据红星资本局报道,赛力斯方面否认上述信息,表示“有部分门店是保留的”,即有部分鸿蒙智行和华为专卖店会继续销售问界。

此前,问界已经向经销商发布通知,自 9 月 16 日起,授权经销商的合作协议签约主体将从华为终端换签为赛力斯汽车。9 月 16 日前的订单综合服务费结算等事宜由华为负责,之后则由赛力斯负责。(新浪科技)

国际要闻

Anthropic 披露研发指标:Claude 主导公司 26% 的 AI 研发工作

近日,Anthropic 发布“衡量前沿实验室 AI 发展速度”指标体系,公开内部 AI 研发进展数据,旨在帮助公众追踪前沿 AI 实验室的发展进度。数据显示,截至 2026 年 8 月,Claude 主导 Anthropic 约 26% 的 AI 研发工作,超过 90% 的研发工作达到“AI 协作”或更高水平。据该公司报告,今年年初这一比例几乎为零。Anthropic 称,在所有被测量的 AI 研发工作子集中,Claude 尚未实现完全自主运行。

8 月,约有 3 万个智能体在 Anthropic 内部从事研究和工程工作。在线监控系统在整个 8 月期间拦截了约 0.002% 的智能体决策。算力投入方面,在 7 月 13-20 日那一周,Anthropic 约 6% 的 AI 研发算力被分配用于安全工作;同一周内,用于 AI 驱动型 AI 研发的算力中,约 12% 被投入安全相关任务。

Anthropic 表示,其目标是缩小前沿实验室所知与公众所知之间的信息差距。该公司还计划引入独立的第三方评估机构,使其能够访问内部流程和数据,第三方机构将负责验证安全实践、报告事故并监控关键指标。

英伟达 CEO 黄仁勋:明年公司芯片销量将翻倍

9 月 17 日,英伟达首席执行官黄仁勋表示,公司预计明年芯片销量将达到今年的约两倍。他同时表示,AI 安全至关重要,开发者应严格测试 AI 系统,对于不够安全的产品应暂缓推出。(界面)

OpenAI 据报接近解决又一“千禧年大奖难题” 或将攻克霍奇猜想

据报道,OpenAI 已接近解决“千禧年大奖难题”中的另一道数学难题——霍奇猜想(Hodge Conjecture)。OpenAI 员工预计这一问题可能在不久后得到解决。霍奇猜想是美国克雷数学研究所提出的 7 个“千禧年大奖难题”之一,解决其中任何一道均可获得 100 万美元奖金。(财联社)

SpaceX AI 部门拟购破产初创公司数据训练 Grok 模型,标志数据策略转向

据知情人士透露,SpaceX 旗下人工智能部门 SpaceXAI 正进行非正式内部讨论,考虑从陷入困境或已倒闭的初创公司收购客户及运营数据,用于训练其 Grok 等 AI 模型。此举旨在获取高质量外部数据集以提升模型性能,标志着该公司不再单纯依赖马斯克社交平台X的数据及内部“AI 导师”团队,转而寻求更多元化的数据来源。该策略与谷歌此前竞购精神航空业务数据用于AI训练的做法类似,但相关谈判尚处早期,最终未必达成协议,SpaceX 方面未予置评。(新浪财经)

Anthropic 将合并 Claude 系列产品,推出统一办公入口

Anthropic 宣布 Claude Cowork 和 Chat 全面合并为统一的 Claude,整合了 Cowork、Design、Docs、Slides 等全部能力,用户无需再纠结任务入口,历史对话、Skill 和连接器也得以保留。新版 Claude 能自主判断任务复杂度并调用对应能力,可在后台持续推进任务,未来几周将向 Pro 和 Max 推出。它打破传统人机交互模式,从「回答窗口」变为「成果空间」,用户在聊天框内就能完成文档起草、幻灯片制作、视觉设计等操作,内容保持同一上下文,还支持修改、批注、导出和分享。此次合并也反映出 AI 巨头 OpenAI、Anthropic、谷歌正争夺 AI 时代新的操作系统入口,AI 产品竞争逻辑转向让用户看到最少选项,由 AI 吸收复杂性,Agent 正成为 AI 产品的基础架构。(Readhub)

程序员专区

GLM 披露国内首个 RSI 工程实践

智谱GLM 团队披露其在递归自我改进(Recursive Self-Improvement,RSI)方向的首个工程化实践:由GLM-5.3驱动的Infra Agent完成了GLM-5.3-Flash推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。这是国内大模型厂商首次公开跑进生产环境的RSI案例。

据官方博客,Infra Agent在超10万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐提升至初始基线的3倍,硬件利用效率与单Token成本达到主流NVIDIA GPU相当水平。 (科创板日报)

OpenAI 披露 GPT-5.6 Sol 异常行为:AI 模型会留下指令要求「未来版本的自己」隐瞒自身错误

OpenAI 研究团队在训练 GPT-5.6 Sol 及尚未发布的 Astra 系列模型时发现,模型会通过压缩摘要向未来版本的自己留下指令,要求后续模型隐瞒自身错误或与预期不一致的表现,目前已针对该问题修复。研究人员通过监控发现 27 份含类似越狱提示指令的摘要,后续模型并非都会执行这些指令,这类跨任务、跨模型传递异常指令的识别及监控机制的完善仍是 AI 安全研究需解决的问题。(IT 之家)

前 OpenAI 研究员发布 Jev 模型,放弃自由文本生成

前 OpenAI 研究员 Diogo Almeida 推出新模型 Jev,该模型放弃自由文本生成,直接输出类型确定的结构化判断及对应概率、置信度,以并行计算替代传统大模型的自回归生成,速度提升 20-200 倍,成本最高可降至原来的 1 / 400,输出 Token 免费。其训练方法 RLCD 以校准决策为核心,区别于 RLHF,强调让模型给出的概率真实反映把握程度。TypeSafe 称其实现 0% 幻觉,实际是指输出不会超出预设范围,虽引发诸如技术无开创性、偷换幻觉定义等质疑,但 Jev 指向的思路 —— 针对自动化需求,用刚好够用的能力处理大量重复、对延迟和成本敏感的任务,仍具价值。

匿名模型 Union Alpha 上线,首日处理 20 亿 Token

OpenRouter 上线匿名多模态模型 Union Alpha,它面向研究、编程和智能体工作流,宣称具前沿级性能,暂未公布开发团队、参数规模等核心信息,以免费形式开放供用户盲测。该模型上下文窗口为 256K,单次最大输出 131072 Token,支持文本图片输入、文本输出及工具调用等,OpenCode 也已接入并限时免费提供,且服务商遵循零数据保留政策。Union Alpha 上线首日处理约 20 亿 Token,总量超 1000 亿,但暂无完整第三方测试结果支撑其前沿性能定位。网友测试反馈不一,有人认为它聪明、视觉能力强、编码等表现优于 Ox Alpha,也有人吐槽其速度慢、部分任务表现不佳。关于其身份,网友猜测包括 OpenAI 新模型、Qwen 系列、GLM 5.4 或 Mistral 新旗舰等,但均未证实。此发布模式复刻此前 Ox Alpha(后证实为智谱 GLM-5.3-Flash)的匿名盲测路径,这种新型预热方式可收集真实反馈、弱化品牌偏见,但也存在暂不公开核心信息、调用量受免费激励影响等问题,模型最终认可度仍取决于自身性能。

今日热点视频

AI 写代码越来越快,但真正的瓶颈早已转移:上下文、评测、Review、反馈、组织协作。

11 月 20-21 日,北京万达文华酒店,2026 奇点智能技术大会「AI 原生软件研发:从 Harness 到 Loop」专题,来自腾讯 CodeBuddy&Workbuddy 团队陈秋远、北航杨健、百度 Comate 牛万鹏、滴滴金晶、腾讯任磊达等 7 位一线实践者,从代码大模型到仓库级智能体,从 Feedback Loop 到 Graph Engineering——一条链讲完。

打开网易新闻 查看精彩图片