华为昇腾960发布:4096卡超节点,但国产AI的护城河在哪
4096张卡塞进一个节点,这不是科幻
9月17日,华为全联接大会2026在上海开幕。
张平安站上台,第一句话就是:"昇腾960超节点,全球首发。"
单节点4096张卡。8 EFLOPS FP8算力。1PB HBM内存。可用度99.8%。
现场掌声还没停,他又补了一句:"这不是PPT,风冷版明年二季度上市,液冷版三季度。"
同一天,智谱GLM-5.3-FlashX推理速度飙到200 tokens/s,阿里Qwen3.8-Omni-Flash把音视频成本砍了93%。
💬 国产AI一天三连击,你最看好哪家?评论区扣1:华为算力 / 扣2:智谱模型 / 扣3:阿里全模态
昇腾960到底强在哪?
先搞清楚一个概念:什么是"超节点"?
以前训练大模型,需要把几千张卡连成一个集群,卡与卡之间靠网络通信。延迟高、带宽瓶颈、故障点多。
华为的做法是:用NPO近封装光学技术,把4096张卡直接封装在一个节点里。卡与卡之间的通信,变成了"片内总线"级别的速度。
📊 单节点算力:8 EFLOPS FP8 / 16 EFLOPS FP4
📊 内存容量:1PB HBM,比上一代提升4倍
📊 可用度:99.8%,意味着全年停机不到18小时
📊 配套总线:灵衢UnifiedBus,支持百万级处理器互联
📌 数据来源:华为全联接大会2026官方发布(2026年9月17日);证券时报《华为昇腾960超节点首发》(2026年9月18日)
更狠的是昇腾960DT——2 PFLOPS FP8的桌面级算力,2027年一季度上市,比原计划提前了三个季度。
这意味着什么?以后个人开发者也能在本地跑千亿参数模型。
智谱和阿里,同一天放大招
华为搞算力,智谱和阿里搞模型。
① 智谱GLM-5.3-FlashX:速度提升5倍
推理速度最高200 tokens/s,比GLM-5.3-Flash快5倍。定价只涨2.5倍,性价比直接拉满。API全面开放,10万张国产芯片推理集群上线即打满。港股智谱股价当天涨5.34%。
② 阿里Qwen3.8-Omni-Flash:全模态+1M上下文
原生支持文本、图像、音频、视频四种输入。30项评测平均提升超26%。音视频输入成本降93%,音频成本降98%。这意味着什么?以后你扔一段视频进去,AI能直接看懂画面+听懂对话+读出字幕。
📌 数据来源:智谱AI官方公告(2026年9月18日);阿里千问官方发布(2026年9月18日);21世纪经济报道《国产大模型加速迭代》(2026年9月18日)
💬 如果200 tokens/s的推理速度成真,你第一个想用它来做什么?评论区聊聊
资本已经用脚投票了
9月18日,AI指数盘中涨2.47%。
人工智能ETF华富(515980)近5日净流入超7000万元。
这不是散户追涨,是机构在调仓。
👉 算力层:华为昇腾960把国产算力拉到全球第一梯队
👉 模型层:智谱+阿里证明国产模型在速度和成本上能打赢
👉 应用层:全模态模型让AI从"能聊天"变成"能看懂世界"
国产AI的三层护城河,正在同一天成型。
LeafStay的话:我见过太多人还在纠结"国产模型能不能用"。答案是:能,而且越来越能。昇腾960的4096卡超节点、智谱200 tokens/s的推理速度、阿里93%的成本降幅——这些数字不是宣传,是已经落地的能力。如果你还在用"国产不行"当借口不学习,半年后你会发现,不是国产不行,是你跟不上。
你觉得国产AI现在到什么水平了?评论区说说你的判断。
觉得有用,转给还在犹豫要不要学AI的朋友。
鲲鹏昇腾开发者社区是面向全社会开放的“联接全球计算开发者,聚合华为+生态”的社区,内容涵盖鲲鹏、昇腾资源,帮助开发者快速获取所需的知识、经验、软件、工具、算力,支撑开发者易学、好用、成功,成为核心开发者。
更多推荐



所有评论(0)