p99延迟低于2微秒,每秒推理量最高达5,000万次;经审计的基准测试结果于今日在伦敦STAC峰会上公布
英国剑桥2026年10月6日--myrtle.ai今日宣布,其VOLLO®推理加速器在针对梯度提升树的STAC-MLMarkets(推理)基准测试中创下新纪录。与此前最佳成绩相比,其第99百分位延迟降低超过30%,吞吐量提升至少5倍。这组经STAC®审计的测试结果于今日在伦敦举行的STAC峰会上公布。
IndependentlyauditedbySTAC
VOLLO运行于BlackcoreICON3132-SM+服务器内的AMDAlveo™V80LL计算加速卡上,在全部三个模型的测试中,p99延迟均低于2微秒。在规模最小的模型上,VOLLO持续实现每秒5,000万次推理,p99延迟仅为1.77微秒。
在电子交易中,从接收到市场数据到作出决策所需的时间,会直接影响收益。低且可预测的延迟,使交易机构能够运行规模更大、准确性更高的模型,同时避免错失交易时机,从而无需再在模型质量与运行速度之间取舍。
myrtle.ai首席执行官PeterBaldwin表示:“交易机构希望在保持速度的同时,运行更强大的模型,而这些测试结果表明,两者可以兼得。如今,开发者无需具备任何FPGA专业知识,即可在VOLLO上测试自己的模型,亲身体验性能差异。”
继4月公布STACTacana测试结果后,VOLLO现已同时保持决策树和神经网络推理的确定性延迟纪录。VOLLO已在生产环境中得到验证,累计支持实盘交易数十万小时,为全球众多领先交易机构创造超额收益。凭借对多种模型的灵活支持,VOLLO也已成为电信、网络安全及国防领域青睐的平台。
STAC-MLMarkets(推理)是针对实时市场数据推理的技术基准测试标准。该标准由领先金融机构的量化专家和技术人员共同设计,用于评估能够运行指定模型的各类技术栈的性能、资源利用效率及质量。完整测试结果详见STAC报告(被测系统编号:MRTL2026905):。
机器学习开发者即日起便可评估自己的模型在VOLLO上的运行表现,无需使用FPGA工具,也无需具备相关专业知识。
关于myrtle.ai
myrtle.ai是一家人工智能与机器学习软件公司,为各大主流FPGA供应商的FPGA平台提供超低延迟推理加速器。其加速器适用于金融交易、无线通信、大语言模型、语音处理及推荐系统等应用场景。
“STAC”及所有STAC名称均为StrategicTechnologyAnalysisCenter,LLC的商标或注册商标。AMD、AMD箭头标识、Alveo及其组合均为AdvancedMicroDevices,Inc.的商标。
热门跟贴