2026年4月30日,威联通(QNAP)正式发布QAI-h1290FX边缘AI存储服务器。该产品精准定位私有部署场景,专为私有部署大语言模型(LLM)、检索增强生成(RAG)搜索引擎及各类生成式AI应用量身打造,助力企业实现AI本地化高效部署。
该服务器搭载威联通基于ZFS文件系统开发的QuTS hero企业级操作系统,具备企业级数据完整性保障、近乎无限次快照及内联重复数据删除能力,有效守护AI数据安全与可用性,避免数据丢失或损坏。
依托QNAP Container Station(容器工作站)可实现容器原生显卡直通,借助Virtualization Station(虚拟化工作站)可为虚拟机分配显卡透传资源。IT运维团队、开发者及科研人员可灵活运行推理模型、生成式AI应用与RAG业务流程,全程自主掌控性能调度与资源分配,适配多样化使用需求。
设备预装精选多款AI工具,包括AnythingLLM、OpenWebUI、Ollama等,可快速搭建私有大语言模型业务流程,实现开箱即用;同时还在持续整合Stable Diffusion、ComfyUI、n8n、vLLM等主流AI应用,进一步拓展功能生态,助力用户在安全、可扩展、完全自主可控的环境中,快速搭建本地AI平台并实现工作流自动化。
产品核心特性
1、搭载16核 AMD EYPC 7302P处理器
拥有32线程服务器级算力,可高效适配AI推理、虚拟化及高并发重载并行业务负载,为各类AI任务提供稳定、强劲的算力支撑,确保多任务同时运行时依然流畅高效。
2、全闪存存储架构
配备12个U.2 NVMe/SATA固态硬盘插槽,为高频AI模型运行、海量数据流转提供极速IO读写支撑,有效降低AI任务延迟,大幅提升模型加载、数据处理的整体运行效率。
3、专业显卡适配架构
可选配英伟达RTX PRO 6000 Blackwell Max-Q专业工作站显卡,最高搭载96GB显存,支持CUDA、TensorRT及Transformer引擎加速,可大幅提升本地大模型推理、AI图像生成及深度学习任务的运行效率,轻松应对高负载AI应用场景。
4、容器化AI环境与显卡资源管理
兼容Docker、LXD容器架构,支持可视化显卡资源分配,操作便捷高效;内置AI应用中心,可一键启动各类AI工具,无需复杂命令行配置即可完成显卡资源精准调配,降低IT运维及开发者的操作门槛。
5、纯本地部署 零云端依赖
可私有化部署AI对话助手、文档搜索引擎、企业知识库等核心应用,确保敏感数据全程在内网留存,保障数据主权与隐私安全,同时显著提速AI业务流程,避免云端传输延迟与数据泄露风险。
6、高速网络与可扩展架构
标配双25GbE+双2.5GbE高速网口,PCIe插槽支持选配升级100GbE网络,满足高带宽AI数据传输需求;同时兼容威联通JBOD扩展柜,可灵活扩容存储容量,适配大规模AI数据存储场景,兼顾当下需求与未来扩展。
典型应用场景
1、企业内部AI助手/本地对话交互界面
该服务器可用于搭建私有化AI对话入口,用于企业知识查询、员工培训、规章制度问答,全程自主管控数据与服务,保障企业内部信息安全,提升员工办公效率。
2、企业检索增强生成(RAG)搜索
依托私有RAG业务链路,对合同、报表、内部文档等企业核心数据进行快速语义检索与智能解析,快速挖掘关键信息,提升信息获取效率与准确性。
嗯嗯嗯3、创意团队AI图像生成
可用于部署Stable Diffusion、ComfyUI等专业工具,赋能AI设计工作流与视觉内容创作,助力创意团队提升产出效率与作品质量,降低设计成本。
4、AI驱动IT自动化运维
通过n8n平台实现推理任务、内容生成、告警通知等流程自动化,将AI能力无缝融入企业业务流程,降低IT运维成本,提升运维效率与响应速度。
总体而言,借助QAI-h1290FX,威联通为企业提供了一套实用、高性能且高安全的本地化生成式AI部署方案。无论是法务、人事、创意设计还是IT运维等不同场景,该产品都能助力团队提升工作效率、满足行业合规要求,并在边缘侧牢牢掌控自身AI战略布局与数据主权。
小编将在第一时间分享更多相关最新动态和爆料,敬请关注。
热门跟贴