曦望发布新一代推理GPU芯片启望S3,单位Token推理成本降低90%
界面新闻
·上海
·界面新闻官方网易号
1月27日,界面新闻记者获悉,国产GPU厂商曦望(Sunrise)发布新一代推理GPU芯片启望S3。这是曦望在近一年累计完成约30亿元战略融资后的首次集中公开亮相。2025年,曦望芯片交付量已突破万片。
启望S3为面向大模型推理的定制化GPGPU芯片。界面新闻记者了解到,其在典型推理场景下的整体性价比较上一代提升超10倍。算力与存储设计上,该芯片支持FP16至FP4精度切换,采用LPDDR6显存方案,显存容量提升4倍。在DeepSeek V3/R1满血版等主流大模型推理中,单位Token成本较上一代降低约90%。
热门跟贴