云霞资讯网

OpenAI 第一次造芯片,跑分就赢了英伟达 Blackwell。Jalapeño 在 DeepSeek R1 上,每千瓦吞吐是英伟达 1.7 倍,单用户生成速度 700 token/s 对 169 token/s,快 4.9 倍。更夸张的是,这颗芯片从设计到流片只用了 9 个月——行业常规是 18 到 24 个月。 为什么 OpenAI 能这么快?因为它是自己最大的客 ​

OpenAI 第一次造芯片,跑分就赢了英伟达 Blackwell。Jalapeño 在 DeepSeek R1 上,每千瓦吞吐是英伟达 1.7 倍,单用户生成速度 700 token/s 对 169 token/s,快 4.9 倍。更夸张的是,这颗芯片从设计到流片只用了 9 个月——行业常规是 18 到 24 个月。

为什么 OpenAI 能这么快?因为它是自己最大的客户。Richard Ho 团队对模型推理负载的理解,直接来自每天跑在自家集群里的一线数据。反观英伟达,哪怕性能领先,离客户现场终究远了一步,很难精准捕捉模型架构变化的真实痛点。

模型厂商自研芯片,会从「倒装」变成新常态吗?