观点网讯:8月11日,据The Information和Bloomberg援引多名参与Nemotron项目的员工消息报道,英伟达正在开发全新开源人工智能模型Nemotron 4。
报道显示,英伟达计划打造Nemotron 4系列中规模最大的基础模型,目标性能对标全球顶尖开源大模型。多名项目员工透露,旗舰版Nemotron 4参数量目标至少达到1万亿级别,这一规模大约是英伟达当前旗舰模型Nemotron 3 Ultra(6月发布)的两倍。
研发资源投入也在同步加码。英伟达上一代旗舰大模型相关论文拥有570名作者,员工表示Nemotron 4参与研发人员规模将进一步扩大,一名前员工称:“现阶段所有人都希望能够参与其中。”
需要指出的是,“至少1万亿参数”目前仍是员工口径下的计划目标,最终参数规模存在调整可能,Nemotron 4的发布时间目前也尚不明确。即便达到万亿参数,该模型体量依旧小于美国头部开源大模型;不过英伟达十分看重模型压缩技术,依靠该技术,更小体量模型也有望实现更优表现。
从战略层面看,英伟达正从芯片供应商向AI全栈平台延伸。公司希望借助自研大模型拉动硬件需求,但此举也意味着其或将与自身客户、合作伙伴形成竞争,对开源大模型生态及现有竞争格局的影响有待观察。
近期英伟达在开源模型领域动作密集。周二,公司发布Nemotron 3.5 Lightning轻量化模型,包括开放版300亿参数混合专家模型,可通过OpenRouter、英伟达开发者平台及云合作伙伴获取,可在英伟达RTX个人电脑、DGX Spark等平台本地运行,并已与vLLM、Ollama等合作,主打高效、高速运行智能体,同时推出免费模型路由软件NeMo Switchyard,帮助企业将不同AI任务分配给适配且成本最优的模型。
市场层面,英伟达美股盘前涨近2%。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
热门跟贴