资讯🔥7.0
SemiAnalysis:谷歌TPU杀入英伟达腹地,Ironwood每美元性能最高领先B200 50%
📋总体概括
SemiAnalysis发布谷歌TPUv7 Ironwood首份第三方推理测试:在每用户每秒100 token条件下,每百万token推理成本约0.181美元,比B200的0.222美元、B300的0.276美元分别低约19%和34%,每美元性能最高领先50%。谷歌同步推进TorchTPU原生PyTorch后端并于10月开源,降低外部使用门槛;Anthropic承诺采购逾百万颗TPU,成最大外部客户,谷歌正式向英伟达AI推理市场腹地发起冲击。
⚡关键信息
- ▸SemiAnalysis首测TPUv7:每百万token成本0.181美元,较B200低19%、较B300低34%,每美元性能最高领先50%
- ▸高并发下按谷歌TCO口径,Ironwood对B200每美元性能优势扩大至76.7%,对B300达130.2%
- ▸谷歌10月开源TorchTPU原生PyTorch后端,取代局限较多的TorchAX,降低开发者迁移门槛
- ▸Anthropic承诺采购逾百万颗TPU,成最大外部用户,2029年用量预计超过DeepMind自身
- ▸PD Disaggregation、投机解码等优化落地后,TPUv7有望与GB200/GB300 NVL72正面竞争
🔥犀利点评
这份报告最狠的不是那50%,而是Anthropic百万颗订单——推理市场的胜负手从来不是跑分,而是有人真金白银下注。谷歌TCO口径下130%的领先水分不小,自家芯片自己算成本总有美化空间,第三方0.181美元对0.222美元才是硬数字。但真正决定格局的是TorchTPU:CUDA护城河的根基是开发者惯性,PyTorch原生后端若成熟,迁移成本骤降,英伟达定价权才会真正松动。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 华尔街见闻 阅读全文 →