myrtle.ai 表示,其 VOLLO® 推理加速器在 STAC-ML Markets(Inference)梯度提升树基准测试中创下新纪录,将 99 分位延迟降低超过 30%,并将吞吐量提高至少 5 倍。STAC® 审核后的结果于今天在伦敦举行的 STAC Summit 上公布。
在一台搭载 AMD Alveo™ V80LL Compute Accelerator 的 Blackcore 代币发行N 3132-SM+ 服务器上,VOLLO 在三种模型上的 p99 延迟均低于 2 微秒。对于最小的模型,它实现了每秒 5000 万次推理,p99 延迟仅为 1.77 微秒。
myrtle.ai 称,在电子交易中,市场数据到达与做出决策之间的时间会直接影响收益。低且可预测的延迟使机构能够运行更大、更准确的模型,而不会错过市场机会,因此模型质量不再需要为了速度而妥协。
myrtle.ai 首席执行官 Peter Baldwin 表示:“交易公司希望在不牺牲速度的情况下运行越来越强大的模型,而这些结果表明他们可以做到。开发者现在无需任何 FPGA 专业知识,就能在 VOLLO 上测试自己的模型,并亲自看到差异。”
继 4 月公布的 STAC Tacana 结果之后,VOLLO 现在同时保持着决策树和神经网络的确定性延迟纪录。公司表示,该产品已经在生产环境中得到验证,数十万小时的实盘交易为全球许多领先交易公司创造了 alpha。其模型灵活性也使其成为电信、网络安全和国防领域的优选平台。
STAC-ML Markets(Inference)是用于实时市场数据推理的技术基准标准。该基准由来自领先金融机构的量化和技术人员设计,用于报告任何能够运行所提供模型的技术栈的性能、资源效率和质量。完整结果可在 STAC 报告(SUT ID MRTL2026905)中查看,网址为 www.STACresearch.com/MRTL2026905。
ML 开发者目前即可评估自己的模型在 VOLLO 上的表现,无需 FPGA 工具或相关经验。访问 myrtle.ai/vollo-trees 或联系 [email protected]。
关于 myrtle.ai
myrtle.ai 是一家 AI/ML 软件公司,在各大 FPGA 供应商的平台上提供超低延迟推理加速器。其加速器应用于金融交易、无线电信、LLM、语音处理和推荐等场景。
VOLLO、VOLLO Accelerator 和 VOLLO 标识是 myrtle.ai 的注册商标。“STAC”及所有 STAC 名称是 Strategic Technology Analysis Center, LLC 的商标或注册商标。AMD、AMD Arrow 标识、Alveo 及其组合均为 Advanced Micro Devices, Inc. 的商标。












