[新闻] 智谱“牛来”模型算力全由大陆国产芯片

楼主: Joery1994   2026-08-27 19:47:35
智谱“牛来”模型算力全由大陆国产芯片支撑 效率或与辉达GPU相当
2026-08-27 18:52 联合报/黄雅慧
智谱26日晚间上线并开源GLM-5.3-Flash(320B-A18B),并官方确认其正是过去一周刷屏
海外开发者社区的匿名模型Ox-Alpha,中文社区称之为“牛来”。该模型为GLM-5系列首
个原生多模态模型。值得注意的是,其算力由10万张大陆国产芯片承载,有机构称,硬件
效率及单token成本已达到与主流辉达GPU相当水平。
综合晚点LatePost、科创板日报报导,智谱称,Ox-Alpha测试期间产生的请求流量全部由
大陆国产芯片提供算力支持。智谱披露,上述全部流量均由国产芯片承载,调用超过10万
张国产芯片集群用于推理服务,这是国产算力芯片首次大规模直接服务全球真实负载 。
相关人士获悉上述国产算力芯片或来自华为、海光、摩尔线程。
Ox-Alpha以“隐身模型”身份悄然上线全球最大模型聚合平台OpenRouter,首日调用量即
登顶并创下单日历史纪录,同时终结DeepSeek在OpenCode长达56天的霸榜,单日处理
tokens达62T,迅速成为两大平台当周最受欢迎模型,刷新双平台历史纪录。智谱揭露其
正是GLM-5.3-Flash。
据智谱介绍,这是GLM-5系列首个原生多模态模型,总参数规模为320B,其中激活参数为
18B。智谱表示,测试期间,Ox-Alpha成为当周两个平台上较受欢迎的模型之一,并刷新
了相关调用量纪录。
在模型能力上, GLM-5.3-Flash在Artificial Analysis Intelligence Index中拿下57分
,与Anthropic旗下最受欢迎的Claude Opus 4.8持平,高于GLM-5.2的53分和DeepSeek
V4 Pro正式版的53分。直接对标国际旗舰模型。
在价格方面,智谱表示,GLM-5.3-Flash常规定价约为GLM-5.3的十分之一,在限时折扣期
间约为GLM-5.3的二十分之一;与Claude Opus 4.8相比,其价格约为后者的四十分之一。
https://udn.com/news/story/7333/9718374
牛来小兵立大功~

Links booklink

Contact Us: admin [ a t ] ucptt.com