端侧AI的"记性"一直是个老大难问题——手机上的模型用久了就"忘事",用户偏好记不住,历史对话理不清。近日,OPPO联合中文开放知识图谱(OpenKG)社区,推出了行业首个面向端侧AI记忆能力的评测基准MobileMem,试图给这个难题立一把"标尺"。
这个基准最硬核的地方在于数据规模:累计历史上下文规模达百万词元的评测数据集,专门用来模拟真实用户长期使用AI的过程。换句话说,它不是在实验室里考"短时记忆",而是直接对标你连续用上几个月的真实场景。
打开网易新闻 查看精彩图片
高校团队下场共建
打开网易新闻 查看精彩图片
这次不是OPPO单打独斗。浙江大学、同济大学、东南大学等高校专家团队也参与其中,共同建设这套评测体系。多方背景的加入,让MobileMem在学术严谨性和产业实用性之间找到了平衡点——既不是纯论文指标,也不是厂商自说自话。
聚焦端侧AI的真实使用场景与长期个性化需求,是MobileMem的核心设计逻辑。相比云端大模型动辄千亿参数的"海量记忆",端侧AI受限于算力和存储,记忆能力一直是短板。有了统一的评测基准,厂商才能量化"谁家的端侧模型更懂用户"。
打开网易新闻 查看精彩图片
这套基准的推出,意味着端侧AI的竞争开始从"跑分"转向"体验"。当记忆能力可以被标准化衡量,手机厂商在AI助手、个性化推荐上的军备竞赛,就有了新的赛点。
热门跟贴