英伟达护城河又挨一刀:「牛来」模型GLM-5.3 Flash爆量23万亿Token,全部跑在国产芯片上
- GLM0%
- NVDAX0%
- GPU0%
- Token-54.39%
动察 Beating AI 快讯,GLM-5.3 Flash 发布后,智谱确认了一个此前没公开的细节:Ox Alpha 匿名测试期间的流量,全部由中国国产 AI 芯片提供推理算力。
Ox Alpha 在 OpenRouter 上线 6 个完整自然日就处理了 23.2 万亿 Token,是同期 DeepSeek-V4-Flash 的 2 倍多。OpenCode 此前甚至称,后台有能力提供每天 100 万亿 Token 的免费额度。
智谱称,他们在相同中国国产硬件上把端到端推理性能优化到了最初的 3 倍,现在硬件效率和单 Token 成本已经能做到接近主流英伟达 GPU。
SemiAnalysis 特意把这一点挑了出来。此前外界看到每天 100 万亿 Token 的供给能力,还在猜这种规模是不是只有顶级实验室和英伟达 GPU 扛得住。结果这次从头到尾用的都是中国国产芯片。
来源:BlockBeats
免责声明:当前内容均来自第三方观点或由AI直接翻译第三方观点,CoinEx不保证内容的真实性、准确性和原创性,不构成CoinEx相关的任何投资建议。数字资产价格波动剧烈,请注意潜在风险。
热搜榜
- 币种价格24H涨跌