日前,据海外博主「Chetaslua」消息,智谱下一代模型(或为 GLM-5)将采用 DeepSeek 同款架构。
据Chetaslua 分析,GLM-5 将采用了 DeepSeek-V3/V3.2 架构,其中包含稀疏注意力机制(DSA)和多 Token 预测(MTP);模型总参数量达 745B,将会是上一代 GLM-4.7 的 2 倍。
据一位知情人士向TechCrunch 透露,人工智能视频生成初创公司Runway已完成 3.15 亿美元的 E 轮融资,估值几乎翻了一番,达到 53 亿美元。
过去一天,国内外AI行业还有更多热点可以关注,硅基君带你一起看看。
大模型
1)智谱新模型架构曝光:DeepSeek 同款稀疏注意力
日前,据海外博主「Chetaslua」消息,智谱下一代模型(或为 GLM-5)将采用 DeepSeek 同款架构。
据Chetaslua 分析,GLM-5 将采用了 DeepSeek-V3/V3.2 架构,其中包含稀疏注意力机制(DSA)和多 Token 预测(MTP);模型总参数量达 745B,将会是上一代 GLM-4.7 的 2 倍。
值得一提的是,近期有一个名为「Pony Alpha」的神秘模型上线全球模型服务平台 OpenRouter,并且引发较高热度。其中不乏有人分析指出,该模型或为智谱新的模型。
而据第一财经消息,智谱目前有相关保密项目在推进中,该神秘模型,是智谱即将发布新一代模型GLM-5。
2)字节上架图像生成新模型 Seedream 5
近期,字节跳动旗下AI 视频生成大模型 Seedance 2.0 走红。而在昨日,字节又上线了最新生图模型「Seedream 5.0」。据悉,Seedream 5.0 拥有联网实时检索、编辑精准可控、智能逻辑推理 三大亮点。
3)腾讯混元推出 0.3B 端侧模型
2 月 10 日,腾讯混元推出面向消费级硬件场景的「极小」模型 HY-1.8B-2Bit。该模型基于 1.8B 参数的小尺寸模型,通过 2Bit 量化技术,等效参数量约为 0.3B,实际存储占用仅约 600MB,比常用的一些手机应用还小,实现了端侧部署的新突破。
4)千问上线新生图模型
昨天,阿里千问大模型推出新一代图像生成基础模型Qwen-Image-2.0。性能方面,在 AI Arena 的测试中,Qwen-Image-2.0 作为一个生图编辑二合一的模型,同一模型在文生图和图生图基准中获得优越性能。
AI应用
1)ChatGPT 广告上线
据CNBC 报道,OpenAI 计划在昨日开启 ChatGPT 的广告测试。
报道援引知情人士消息,OpenAI 预计广告收入在长期内的表现,不会超过其收入的一半。
根据OpenAI 此前的说法,ChatGPT 将会在免费以及 Go 订阅用户中打广告,且广告不会影响 ChatGPT 的回答,并会确保用户的对话对广告商保密,但还指出广告仍将「根据对您最有帮助的内容进行优化」。
投融资情报
1)AI视频初创公司Runway融资3.15亿美元,估值达53亿美元
据一位知情人士向TechCrunch 透露,人工智能视频生成初创公司Runway已完成 3.15 亿美元的 E 轮融资,估值几乎翻了一番,达到 53 亿美元。
根据Runway公司在其博客文章中宣布的融资消息,这笔新资金将使该公司能够“预训练下一代世界模型,并将其应用于新产品和行业”。世界模型是一种人工智能系统,它能够构建环境的内部表征,从而预测未来事件。许多顶尖专家认为,世界模型对于突破大型语言模型的局限至关重要。
2)Hauler Hero 的人工智能废物管理软件筹集了 1600 万美元
据TechCrunch 报道,总部位于纽约的初创公司 Hauler Hero 在由 Frontier Growth 领投的 A 轮融资中筹集了 1600 万美元,K5 Global 和 Somersault Ventures 等也参与了投资。迄今为止,Hauler Hero 已累计获得超过 2700 万美元的风险投资。
Hauler Hero 为废物管理公司开发了一款功能齐全的一体化软件平台,涵盖客户关系管理、计费和路线规划等多种功能。现在,和许多其他软件公司一样,Hauler Hero 也计划向其客户提供人工智能代理服务。
PS:如果你对AI大模型领域有独特的看法,欢迎扫码加入我们的大模型交流群。
热门跟贴