詹姆斯叉 | JamesX|2026年08月26日 00:33
OpenAI不是在造一块芯片。
它是在把每个Token的利润率,从Nvidia手里收回来。
OpenAI刚刚公布自研推理芯片Jalapeño的首轮实测:
每瓦AI工作量提高1.5—1.9倍
端到端延迟降低1.7—3.6倍
计划今年底开始内部部署
这不代表Nvidia马上被替代。
Jalapeño目前主要解决推理,不是训练;初期部署规模也不会与Nvidia全球供应链处于同一量级。
但AI商业模式已经发生变化:
过去,模型公司向芯片公司购买算力,再按Token卖给用户。
未来,头部模型公司会同时控制:
模型+推理软件+芯片+网络+机架。
每降低一次Token成本,它们就可以选择:
降低API价格;
提高免费额度;
让Agent运行更多步骤;
或者把节省的成本变成利润。
五年后,AI行业最大的竞争可能不只是“谁的模型最聪明”。
而是:
谁能以最低成本生产一个有用的Token。(詹姆斯叉 | JamesX)
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接