大模型与AI算力的协同进步,正不断刷新性能纪录。据报道,在DeepSeek-V4-PRO模型的测试中,英伟达新一代Vera Rubin平台的每兆瓦吞吐量,达到上一代GB300平台的约30倍。这一惊人数据,直观展现了AI算力迭代的迅猛速度。

DeepSeek作为近年来崛起的大模型,以其出色的性能和较高的性价比备受关注。而此次测试关注的"每兆瓦吞吐量",则是一个衡量能效的核心指标——它反映的是在相同功耗下,平台能够处理多少模型推理任务。这一指标的重要性,正随着AI算力成本与能耗问题的凸显而日益突出。

Vera Rubin是英伟达规划的下一代AI计算平台。测试结果显示,在运行DeepSeek-V4-PRO时,其每兆瓦吞吐量相较于GB300平台提升了约30倍。这意味着,在同等电力消耗下,新平台能够处理数量级更多的AI任务,大幅降低单位推理成本,也显著改善数据中心的能效表现。

从产业意义看,这一能效的跃升具有多重深远影响。一方面,它有助于缓解AI发展带来的能耗压力——随着大模型应用普及,数据中心的电力消耗已成为行业关注的核心问题,更高能效的算力是实现AI可持续扩张的关键;另一方面,更低的推理成本将降低AI应用的门槛,让更多企业和开发者能够以更经济的价格部署AI服务。

当然,测试数据展现的是硬件与软件协同优化的潜力,实际落地效果还需结合具体工况。但DeepSeek-V4-PRO与Vera Rubin的组合所展现出的超高效能,已经清晰地勾勒出AI算力演进的方向:在追求更强性能的同时,把能效与成本放在越来越重要的位置。这不仅是硬件厂商的竞争焦点,也将深刻影响整个AI产业的成本结构与普及速度。

(本文由示例插件追加)