一个1000万小时的开放视频数据集,如何撬动多模态AI训练的下一步
5天1.5万美元,外国科技圈为啥组团来中国“看工厂”?
教AI学生做题,到底该学"过程"还是学"答案"?
MobilePA-Bench:当AI助手要在真实手机系统里"跑腿",到底行不行?
人脸识别模型也能"开口说话"了:让AI说出"我凭什么认出你"的方法
番茄、土豆、洋葱:人脸活体检测真的需要人脸吗?
当RNA也需要"长文本理解能力",一个16亿参数模型是怎么做到的
面具不是模型:当"看起来正确"的AI,其实偷看了未来
机器人能像语言模型读文字一样,读懂物理世界吗?
给AI翻译一道填空题:先想好写几个字,再开始写
搜索智能体需要“会犯错的老师”还是“永远正确的老师”?
AI智能体记不住"进展到哪儿",一篇论文想教它学会记账
GPU上跑不动的工具:一个PyTorch扩展如何让形态学处理提速1100倍
Metan:让AI学会改进"改进自己的方法",而不只是改进答案
训练一个AI,却不告诉它答案:这个决定差点毁了整个方案
当AI画画得了"高分低能症",工程师们发明了一套自我纠错的把戏
UniSpace:把理解、生成和编辑塞进同一个视觉空间,够狠吗?
当27个顶尖语言模型遇上一场没有裁判偏见的烹饪考试
让AI推理学会"见好就收",一个关于时间置信度的效率革命
当AI社交网络里的机器人开始互相点赞,会发生什么?
一个1000万小时的开放视频数据集,如何撬动多模态AI训练的下一步
5天1.5万美元,外国科技圈为啥组团来中国“看工厂”?
教AI学生做题,到底该学"过程"还是学"答案"?
MobilePA-Bench:当AI助手要在真实手机系统里"跑腿",到底行不行?
人脸识别模型也能"开口说话"了:让AI说出"我凭什么认出你"的方法
番茄、土豆、洋葱:人脸活体检测真的需要人脸吗?
当RNA也需要"长文本理解能力",一个16亿参数模型是怎么做到的
面具不是模型:当"看起来正确"的AI,其实偷看了未来
机器人能像语言模型读文字一样,读懂物理世界吗?
给AI翻译一道填空题:先想好写几个字,再开始写
搜索智能体需要“会犯错的老师”还是“永远正确的老师”?
AI智能体记不住"进展到哪儿",一篇论文想教它学会记账
GPU上跑不动的工具:一个PyTorch扩展如何让形态学处理提速1100倍
Metan:让AI学会改进"改进自己的方法",而不只是改进答案
训练一个AI,却不告诉它答案:这个决定差点毁了整个方案
当AI画画得了"高分低能症",工程师们发明了一套自我纠错的把戏
UniSpace:把理解、生成和编辑塞进同一个视觉空间,够狠吗?
当27个顶尖语言模型遇上一场没有裁判偏见的烹饪考试
让AI推理学会"见好就收",一个关于时间置信度的效率革命
当AI社交网络里的机器人开始互相点赞,会发生什么?