9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型,作为其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。超算互联网即刻上线DeepSeek V4.1 Flash模型API服务与权重文件。

打开网易新闻 查看精彩图片

据介绍,用户可登录国家超算互联网官网(www.scnet.cn)PC端,从首页进入「模型服务」页面,即可快速打开DeepSeek V4.1 Flash模型API调用界面。开发者无需繁琐环境配置,即可在超算互联网一键调用DeepSeek V4.1 Flash模型API服务,快速将模型能力集成至自有应用与业务系统。

打开网易新闻 查看精彩图片

依托超算互联网海量国产算力资源池,以及平台安全可信的Notebook开发环境,企业、科研机构及开发者亦可在AI社区快速下载DeepSeek V4.1 Flash模型权重文件,开展二次开发、本地部署与技术研究。

DeepSeek V4.1 Flash大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。本次DeepSeek V4.1 Flash上线超算互联网,将进一步丰富平台AI能力供给,降低企业和开发者使用前沿大模型的门槛。

打开网易新闻 查看精彩图片

2024年,国家超算互联网平台在天津滨海高新区正式上线。作为全国一体化算力网的核心载体和代表性实践,目前已接入30余家骨干算力中心,汇聚近70种规格算力资源,为科研院所、科创企业及开发者提供大模型训练、微调、部署一站式算力与模型服务,推动算力普惠共享,支撑国产AI技术创新与产业落地。

超算互联网AI社区现已汇集1800余款国内外热门开源大模型,并陆续接入DeepSeek、GLM、Qwen、Kimi等主流国产大模型API,覆盖文本、图像、视频生成、语音合成、多模态等全维度AI能力。企业、开发者与科研人员可快速接入、灵活调用,依托国家级算力底座开展AI研发与场景落地。

来源:津滨海,转载请注明出处