英伟达护城河又挨一刀:「牛来」模型GLM-5.3 Flash爆量23万亿Token,全部跑在国产芯片上

律动BlockBeats
律动BlockBeats|2026年08月26日 15:29
GLM-5.3 Flash 发布后,智谱确认了一个此前没公开的细节:Ox Alpha 匿名测试期间的流量,全部由中国国产 AI 芯片提供推理算力。Ox Alpha 在 OpenRouter 上线 6 个完整自然日就处理了 23.2 万亿 Token,是同期 DeepSeek-V4-Flash 的 2 倍多。OpenCode 此前甚至称,后台有能力提供每天 100 万亿 Token 的免费额度。智谱称,他们在相同中国国产硬件上把端到端推理性能优化到了最初的 3 倍,现在硬件效率和单 Token 成本已经能做到接近主流英伟达 GPU。SemiAnalysis 特意把这一点挑了出来。此前外界看到每天 100 万亿 Token 的供给能力,还在猜这种规模是不是只有顶级实验室和英伟达 GPU 扛得住。结果这次从头到尾用的都是中国国产芯片。[原文链接](动察 Beating AI 快)
+3
曾提及
分享至:

脈絡

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀