打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

编辑:前沿在线 编辑部

今日 AI 圈核心主线:海外头部大模型厂商新品节奏全面提速,OpenAI 超大预训练模型、Anthropic 新版 Sonnet、Composer 3 编码模型接连曝光,性能与成本优势同步显现;英伟达、xAI、Meta、谷歌同步放出开源语音、图像、智能体工具,技术底座持续下沉。国内人形机器人龙头开启 IPO 申购,海外巨头大手笔收购编程工具、布局 AI 气象预测,模型迭代、开源生态、资本并购三条主线同步推进,行业进入高密度更新周期。

打开网易新闻 查看精彩图片

OpenAI 最大预训练模型 Doug 曝光 规模超以往或 11 月前推出

行业消息披露,OpenAI 代号 Doug 的全新预训练模型正在推进中,是当前 OpenAI 体系内参数规模最大的训练项目,整体体量超越此前所有版本。

打开网易新闻 查看精彩图片

内部推进节奏显示,模型有望在今年 11 月之前正式推出,训练依托新一代超算算力集群完成,目标直指综合推理、多模态、长链路任务能力的全面跃升。

作为 OpenAI 下一代旗舰级底座,Doug 的落地将进一步拉高全球大模型能力上限,推动通用 AI 向更强推理、更复杂任务处理方向演进。

打开网易新闻 查看精彩图片

Composer 3 泄露:编码超 Opus 5 和 GPT-5.6 Sol,价格仅 1/5

Composer 3 新一代编码模型相关测试信息流出,实测代码生成、工程调试、复杂项目重构能力超越 Claude Opus 5 与 GPT-5.6 Sol 两大旗舰模型。

打开网易新闻 查看精彩图片

模型在保持顶级编码性能的同时,推理成本大幅下探,定价仅为对标旗舰模型的五分之一,性价比优势显著,有望重塑高端编码模型市场的价格体系。

高性价比顶级编码能力的落地,将大幅降低企业级 AI 编程智能体开发的算力门槛,推动代码智能体在更多中小团队中普及应用。

打开网易新闻 查看精彩图片

英伟达开源全双工语音模型 VoiceChat 11B,支持工具调用

英伟达正式开源 VoiceChat 11B 全双工语音大模型,参数规模 110 亿,原生支持实时全双工对话交互,用户可随时打断、插话,对话流畅度接近真人交流。

打开网易新闻 查看精彩图片

模型内置完整工具调用能力,语音对话过程中可自主调用外部 API、执行查询操作、触发业务流程,无需额外中转文本模型,打通语音交互与工具执行直连链路。

开源后将面向智能体、人形机器人、车载语音、智能客服等场景开放,降低全双工语音交互的技术门槛,推动语音智能体从问答式走向主动交互式。

打开网易新闻 查看精彩图片

Anthropic 新 Sonnet 泄露:200 万上下文,性能逼近旗舰

Anthropic 新版 Sonnet 模型相关测试信息曝光,上下文窗口大幅提升至 200 万 Token,可一次性处理超长文档、完整代码库、多轮历史对话。

打开网易新闻 查看精彩图片

综合性能层面,新版 Sonnet 大幅拉近与自家旗舰 Opus 系列的差距,在长文档分析、企业知识库、代码工程等场景表现接近旗舰水平。

定位中端的 Sonnet 实现能力越级,将进一步压缩大模型性能分层差距,为企业提供更具性价比的长上下文解决方案,加速大模型在企业级场景的规模化落地。

打开网易新闻 查看精彩图片

Meta 新研究:EvoHarness-RL 让智能体自主学习工具编排策略

Meta 发布 EvoHarness-RL 最新研究成果,提出基于强化学习的智能体工具编排自主学习方案,让 AI 智能体自行摸索多工具组合调用策略。

打开网易新闻 查看精彩图片

区别于传统依赖人工预设提示词、固定流程的工具调用模式,EvoHarness-RL 通过环境反馈持续优化工具选择、调用顺序、参数组合,面对陌生任务也能自主探索最优执行路径。

该研究突破了智能体工具使用依赖人工设计的瓶颈,为通用智能体处理复杂、开放任务提供了全新技术路径,推动 Agent 从被动执行走向主动学习。

打开网易新闻 查看精彩图片

谷歌将 Gemma 4 改为扩散模型,成本不到原预算一成

谷歌调整 Gemma 4 技术路线,放弃传统 Transformer 架构,转向扩散模型方案,整体研发与训练成本大幅压缩至原计划的十分之一以内。

打开网易新闻 查看精彩图片

扩散架构在多模态生成、图像理解、内容创作场景具备天然优势,Gemma 4 转向扩散路线后,将兼顾文本生成与多模态能力,同时显著降低算力开销。

技术路线的切换,体现出大模型行业正在从单纯堆参数、堆算力转向架构创新、效率优先的发展思路,开源模型的性价比竞争进入新阶段。

打开网易新闻 查看精彩图片

支持 5 张参考图融合与智能扩图,xAI Imagine Image 2.0 正式上线

xAI 正式发布 Imagine Image 2.0 图像生成模型,新增多参考图融合能力,最多支持同时输入 5 张参考图,自动融合风格、元素、构图生成全新图像。

打开网易新闻 查看精彩图片

模型同步上线智能扩图功能,可基于画面内容向外延展画布,自动补全周边场景,保持整体风格与逻辑一致性,拓展了图像创作的灵活度。

xAI 在图像生成领域的持续迭代,补齐了 Grok 生态的多模态短板,形成文本、语音、图像一体化的 AI 创作工具矩阵。

打开网易新闻 查看精彩图片

宇树科技今日启动申购:中签率远低于长鑫,中一签或赚 20 万

宇树科技今日正式开启新股申购,作为人形机器人赛道标志性企业,市场认购热情极高,预估中签率远低于此前上市的长鑫存储。

打开网易新闻 查看精彩图片

市场测算显示,若上市后表现符合预期,中一签潜在收益或达到 20 万元,成为今年最受关注的科技新股之一。

宇树科技登陆资本市场,标志着人形机器人行业从技术研发阶段正式进入规模化量产与资本验证阶段,对整个具身智能赛道具备标杆意义。

打开网易新闻 查看精彩图片

SpaceX 600 亿美元收购 Cursor 最快下周完成 Cursor 品牌将退出

市场消息显示,SpaceX 计划以 600 亿美元收购 AI 编程工具 Cursor,交易最快下周正式落地,完成后 Cursor 原有品牌将逐步退出市场。

打开网易新闻 查看精彩图片

收购完成后,Cursor 的核心技术与团队将并入 SpaceX AI 体系,深度整合进 Grok 编程能力,服务于航天工程、机器人、大模型研发等内部场景。

这笔大手笔收购反映出头部科技企业对 AI 编程工具战略价值的高度重视,编程智能体成为巨头争夺的核心入口级产品。

打开网易新闻 查看精彩图片

谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时

谷歌正式发布 WeatherNext 气旋 AI 气象模型,专门针对飓风、台风等极端气旋天气做专项优化,实现高精度短临预报。

打开网易新闻 查看精彩图片

相比传统数值气象预报方案,WeatherNext 对飓风路径、强度的预测准确率显著提升,平均预警时间提前 24 小时,为防灾减灾争取更多准备窗口。

AI 大模型在气象领域的突破,体现出 AI for Science 的落地价值持续显现,极端天气预测正从传统物理模拟转向 AI 驱动的精准预报新时代。

打开网易新闻 查看精彩图片
前沿动态前沿大会前沿人物
打开网易新闻 查看精彩图片
前沿动态前沿大会前沿人物

「在看」,给前前加鸡腿