4096张卡塞进一个节点,这不是科幻

9月17日,华为全联接大会2026在上海开幕。

张平安站上台,第一句话就是:"昇腾960超节点,全球首发。"

单节点4096张卡。8 EFLOPS FP8算力。1PB HBM内存。可用度99.8%。

现场掌声还没停,他又补了一句:"这不是PPT,风冷版明年二季度上市,液冷版三季度。"

同一天,智谱GLM-5.3-FlashX推理速度飙到200 tokens/s,阿里Qwen3.8-Omni-Flash把音视频成本砍了93%。

💬 国产AI一天三连击,你最看好哪家?评论区扣1:华为算力 / 扣2:智谱模型 / 扣3:阿里全模态

昇腾960到底强在哪?

先搞清楚一个概念:什么是"超节点"?

以前训练大模型,需要把几千张卡连成一个集群,卡与卡之间靠网络通信。延迟高、带宽瓶颈、故障点多。

华为的做法是:用NPO近封装光学技术,把4096张卡直接封装在一个节点里。卡与卡之间的通信,变成了"片内总线"级别的速度。

📊 单节点算力:8 EFLOPS FP8 / 16 EFLOPS FP4

📊 内存容量:1PB HBM,比上一代提升4倍

📊 可用度:99.8%,意味着全年停机不到18小时

📊 配套总线:灵衢UnifiedBus,支持百万级处理器互联

📌 数据来源:华为全联接大会2026官方发布(2026年9月17日);证券时报《华为昇腾960超节点首发》(2026年9月18日)

更狠的是昇腾960DT——2 PFLOPS FP8的桌面级算力,2027年一季度上市,比原计划提前了三个季度。

这意味着什么?以后个人开发者也能在本地跑千亿参数模型。

智谱和阿里,同一天放大招

华为搞算力,智谱和阿里搞模型。

① 智谱GLM-5.3-FlashX:速度提升5倍

推理速度最高200 tokens/s,比GLM-5.3-Flash快5倍。定价只涨2.5倍,性价比直接拉满。API全面开放,10万张国产芯片推理集群上线即打满。港股智谱股价当天涨5.34%。

② 阿里Qwen3.8-Omni-Flash:全模态+1M上下文

原生支持文本、图像、音频、视频四种输入。30项评测平均提升超26%。音视频输入成本降93%,音频成本降98%。这意味着什么?以后你扔一段视频进去,AI能直接看懂画面+听懂对话+读出字幕。

📌 数据来源:智谱AI官方公告(2026年9月18日);阿里千问官方发布(2026年9月18日);21世纪经济报道《国产大模型加速迭代》(2026年9月18日)

💬 如果200 tokens/s的推理速度成真,你第一个想用它来做什么?评论区聊聊

资本已经用脚投票了

9月18日,AI指数盘中涨2.47%。

人工智能ETF华富(515980)近5日净流入超7000万元。

这不是散户追涨,是机构在调仓。

👉 算力层:华为昇腾960把国产算力拉到全球第一梯队

👉 模型层:智谱+阿里证明国产模型在速度和成本上能打赢

👉 应用层:全模态模型让AI从"能聊天"变成"能看懂世界"

国产AI的三层护城河,正在同一天成型。

LeafStay的话:我见过太多人还在纠结"国产模型能不能用"。答案是:能,而且越来越能。昇腾960的4096卡超节点、智谱200 tokens/s的推理速度、阿里93%的成本降幅——这些数字不是宣传,是已经落地的能力。如果你还在用"国产不行"当借口不学习,半年后你会发现,不是国产不行,是你跟不上。

你觉得国产AI现在到什么水平了?评论区说说你的判断。

觉得有用,转给还在犹豫要不要学AI的朋友。

Logo

鲲鹏昇腾开发者社区是面向全社会开放的“联接全球计算开发者,聚合华为+生态”的社区,内容涵盖鲲鹏、昇腾资源,帮助开发者快速获取所需的知识、经验、软件、工具、算力,支撑开发者易学、好用、成功,成为核心开发者。

更多推荐