NVIDIA RTX GPU 为开发者提供高性能解决方案,借助Qwen3.8-27B,在本地运行前沿水准的编程智能体。

作为Qwen3.8-Max的本地搭档,这款270 亿参数开放模型可在单个GPU上运行,专为需要调用本地文件、工具和项目上下文信息的快速响应式编程工作流打造。开发者可将敏感代码、专有数据和项目上下文信息保留在自己的系统中,同时在整个开发过程中获得强大的AI 辅助。

打开网易新闻 查看精彩图片

NVIDIA RTX GPU 为该模型提供首日支持,包括NVIDIA RTX PRO GPU 和NVIDIA GeForceRTX 5080。经多Token预测优化后,Qwen3.8-27B借助MTP 可在单个GeForce RTX GPU上,为智能体编程、工具调用和长时开发任务提供高速的本地推理能力。

开发者现在即可在llama.cpp、Ollama、Unsloth和LMStudio Bionic上部署。这些工具均支持在NVIDIA RTX GPU上运行Qwen3.8-27B。NVIDIARTX 的高性能、CUDA软件生态和开发者熟悉的开源工具协同配合,为新模型提供广泛支持,并为高响应速度的本地智能体编程工作流奠定坚实基础。

该模型还支持DGX Spark,更多优化即将推出,包括为所有NVIDIA 本地AI 设备提供NVFP4支持。Qwen3.8-27B将前沿水准的本地编程智能体带到NVIDIA 全天候运行的个人AI 系统中。

除PC 和个人AI 系统外,NVIDIAJetson 为边缘端侧Qwen3.8-27B提供首日支持。NVIDIA发现该模型能力出众,具备强大的推理和智能体能力,而通过MTP实现的推测解码则可在边缘端提供快速、高速响应的本地推理。