云霞资讯网

数博会现场聊“牛来”,这背后藏着一个算力信号! 今儿数博会逛到一半,看到朋友圈

数博会现场聊“牛来”,这背后藏着一个算力信号!

今儿数博会逛到一半,看到朋友圈有人发智谱正式认领“牛来”模型,就是GLM-5.3 Flash。和我一起去的朋友跟我说他们组昨天就在猜了,分词器指纹对上了,妥妥的智谱血统。

这几天“牛来”在全球AI圈确实火得离谱,匿名上线首日就登顶OpenRouter调用量榜首,但更值得琢磨的,是这波操作的算力底色。

智谱官方确认,“牛来”全部线上流量由国产芯片承载,能把大规模加速卡稳定跑起来、支撑62T Token调用量的国产算力供应商,掰着手指头数得过来。

巧的是,海光这次在数博会上刚刚发布了Agent to Token开放计算架构。这个架构的核心逻辑就是CPU管调度编排、DCU管Token生成,各司其职。而“牛来”这种级别的模型负载,正好需要的就是这种分工协同。芯模一体,才是把模型跑顺的关键。

顺着这个思路想,“牛来”这次跑通全球市场,某种意义上也是对国产算力体系的一次压力测试。国产卡承载海外真实负载,能跑下来、跑得稳,本身就是个信号。而海光Agent to Token开放计算架构强调的从调度到生成全链路打通,正好回答了这种规模负载怎么组织的问题。
数博会 海光信息