7月18日消息,在2026世界人工智能大会(WAIC)期间,商汤科技正式发布旗舰级多模态大模型SenseNova U1 Pro。该模型定位于面向长程任务的原生多模态智能体基座,通过统一理解、生成与行动能力,推动多模态AI从传统“内容生成”迈向“系统级内容交付”。
商汤科技方面介绍,SenseNova U1 Pro是“日日新SenseNova U”系列旗舰版本,基于统一架构实现语言与视觉能力融合,可围绕复杂目标持续完成理解、规划、执行、检查与修正等全过程任务,支持长程、多轮智能体协同生成。
据了解,U1 Pro重点提升了复杂图片创作能力,具备专业级设计美感、8K原生超高清输出、高信息密度图文生成以及长程Agent生成闭环等能力。其中,模型支持最高8K分辨率输出,可完成超长、超大画幅创作,并在复杂版式下保持文字、图标及内容布局稳定。
技术架构方面,U1 Pro基于商汤NEO-unify原生统一架构,通过统一语言与视觉表征,打通理解与生成能力。商汤科技方面表示,今年4月开源的SenseNova U1发布以来,真实应用持续增长,今年6月用户日均生图量较5月提升近3倍。截至7月中旬,SenseNova U1及集成其能力的SenseNova-Skills代码库在GitHub累计Star数已突破8000。
与此同时,商汤开源的SenseNova-Vision统一视觉大模型也成为U1 Pro的重要能力基础。该模型将实例分割、目标检测等传统视觉任务融入统一多模态模型,实现视觉理解能力原生化,为复杂场景下的智能体应用提供支撑。
现场展示环节,商汤演示了U1 Pro在多个复杂场景中的应用能力。其中包括为WAIC九周年创作4:1超宽画幅《智会世图》水墨长卷,完成高信息密度文字、图标及视觉元素统一排版;生成包含完整世界观设定及22个连续镜头的影视分镜方案;以及将世界杯比赛数据、战术分析和推理结果自动生成可视化分析报告,实现从数据分析到视觉交付的完整流程。
商汤科技方面表示,U1 Pro未来将应用于办公、电商、教育及内容创作等多个场景,包括自动生成商业PPT、企业信息图、产品海报、教学图解、影视概念设计及动漫分镜等。目前,该能力已在商汤旗下“小浣熊”办公助手和Seko视频创作平台中落地,服务个人用户、企业客户及AI原生组织。
据介绍,SenseNova U1 Pro预览版本已启动邀请测试,并将随着推理资源扩容逐步开放体验。正式版本计划于今年8月向公众开放,同时推出API服务及商业化定价。(定西)
热门跟贴