英伟达详解下一代 AI 专用 Vera CPU 称速度是其他 CPU 的两倍多
英伟达发文称,DeepInfra 的基准测试结果显示,NVIDIA Vera CPU 的速度是其他 CPU 的两倍多,并且能够支持更多并发的 AI 代理。云平台 DeepInfra 是 NVIDIA 开放 AI 生态系统的早期体验参与者,独立设计并运行了基于其生产型 AI 代理基础设施的基准测试。DeepInfra 每周处理近五万亿个代币,其中约 30%由代理系统驱动。其云平台专为高通量 AI 推理而建。基准测试显示,在相同服务质量下,支持最多 1.6 倍的并发 AI 代理,协同速度高达 2.2 倍,同时提升基础设施利用率和成本效益。这些结果表明,NVIDIA Vera CPU 能够实现生产代理人工智能所需的成本效益、低延迟和吞吐量。随着 AI 代理承担更复杂的推理、规划、工具使用和数据流动,CPU 性能在围绕每次模型调用的协调工作中变得越来越重要。作为英伟达对 AI 工厂极端联合设计策略的一部分,Vera CPU 专为代理性工作负载设计。DeepInfra 的基准测试强调了 NVIDIA Vera CPU 如何帮助云服务提供商提升基础设施利用率、提高成本效率,并在相同服务质量下支持更多并发的 AI 代理。
英伟达发文称,DeepInfra 的基准测试结果显示,NVIDIA Vera CPU 的速度是其他 CPU 的两倍多,并且能够支持更多并发的 AI 代理。云平台 DeepInfra 是 NVIDIA 开放 AI 生态系统的早期体验参与者,独立设计并运行了基于其生产型 AI 代理基础设施的基准测试。DeepInfra 每周处理近五万亿个代币,其中约 30%由代理系统驱动。其云平台专为高通量 AI 推理而建。基准测试显示,在相同服务质量下,支持最多 1.6 倍的并发 AI 代理,协同速度高达 2.2 倍,同时提升基础设施利用率和成本效益。这些结果表明,NVIDIA Vera CPU 能够实现生产代理人工智能所需的成本效益、低延迟和吞吐量。随着 AI 代理承担更复杂的推理、规划、工具使用和数据流动,CPU 性能在围绕每次模型调用的协调工作中变得越来越重要。作为英伟达对 AI 工厂极端联合设计策略的一部分,Vera CPU 专为代理性工作负载设计。DeepInfra 的基准测试强调了 NVIDIA Vera CPU 如何帮助云服务提供商提升基础设施利用率、提高成本效率,并在相同服务质量下支持更多并发的 AI 代理。