半泽直树
DeepSeek-V4-PRO AI 模型测试:英伟达 Vera Rubin 每兆瓦吞吐量达 GB300 的 30 倍_我的网站

A | 8 月 24 日消息,英伟达昨日使用 SemiAnalysis AgentX 工作负载,以 DeepSeek-v4-PRO 1.6T 模型评估测试,显示 Vera Rubin 每兆瓦吞吐量达到 Blackwell 的 30 倍。 距离韩国定于2027年2月全面生效的禁食狗肉法案仅剩最后数月时间,今年夏天也就成了韩国境内可以合法交易、食用狗肉的最后一个伏季,延续数百年的狗肉消费传统即将在当地正式画上句点。

B | 每兆瓦吞吐量(Tokens per Megawatt,简称 tokens / MW)是衡量 AI 数据中心在固定电力额度下能产出多少 AI Token 的核心能效指标。按照流传多年的传统习俗,韩国人进入三伏天之后,习惯喝一碗热气腾腾的狗肉汤补养身体,往年这段时间也都是全国各地狗肉馆生意最火爆的消费旺季,不少开了几十年的老店整个伏期都要排队迎客。援引博文介绍,SemiAnalysis AgentX 通过 4 项指标,重点评估智能体编程推理工作负载:端到端归一化交互性按请求提交至最终 Token 到达的完整时间计算,反映包含首个 Token 等待时间在内的用户可见输出效率;标准交互性只统计首个 Token 至最后一个 Token 之间的生成阶段。 随着禁令落地的时间进入最后倒计时,首尔以及韩国多个城市经营多年的狗肉馆,最近突然迎来了大量专程赶来吃最后一碗狗肉汤的老食客,不少结伴而来的都是喝着狗肉汤长大的中老年当地人,打算赶在禁令正式生效前最后回味一次老味道。端到端延迟统计单次请求从提交到最终输出 Token 到达的总时长首个 Token 延迟(TTFT)则统计提交请求到首个输出 Token 到达的时间。在 DeepSeek-v4-PRO 1.6T 工作负载中,采用 GB300 NVL72 的 Grace Blackwell 服务器,每兆瓦吞吐量达到 H200 NVL8 Hopper 方案的 15 倍。Blackwell 每百万 Token 成本约为上一代的 1/10,运营方可以在相同电力和基础设施预算下支持更多智能体,或以更低运营成本维持相同智能体容量。

C | 而 Vera Rubin 进一步提升该优势,在 DeepSeek V4 Pro 模型上,Vera Rubin NVL72 的每兆瓦吞吐量约为 GB300 NVL72 的 30 倍。Vera Rubin NVL72 的每百万 Token 成本是 GB300 NVL72 的 35 分之一,能够持续、大规模地运行智能体,满足客户各种工作负载的需求。随着禁食狗肉法案落地进入倒计时,整个韩国狗肉馆相关的上下游行业都在逐步走向落幕。最近这些年当地宠物饲养普及率连年攀升,民众的动物福利意识也明显提升,整个社会舆论的风向早就发生了根本性转向,韩国此前发布的全民民调结果显示,超过八成民众都明确支持禁食狗肉的相关法案。这次全面落地的禁令,也给大量依靠狗肉产业链生存的餐饮从业者带来了不小的生存与转型压力。

D | 部分经营了十几年的餐馆已经开始尝试调整菜单,把主打食材从狗肉替换成黑山羊肉,改做黑山羊汤维持门店运营。但几乎所有做了转型尝试的经营者都反馈,黑山羊汤的受众群体和原来的狗肉汤食客重叠度很低,新菜品的营收收益完全填不上过去狗肉热销时期的利润缺口,而当地政府承诺给从业者提供的转型援助补贴也十分有限,根本不足以支撑整个行业完成平稳过渡。 。
Current article:http://uv4zh.liawucunsainantaonao.sbs/0j44b5/20260826/91561.html
Published on:10:08:53




