在 7 月的上海世界人工智能大会(WAIC)开幕周的展馆里,108 款芯片、200 余款智能计算产品同时亮相,背后是同一个判断:单卡峰值算力的比拼正让位于 CPU GPU 协同、同一颗芯片同时跑超算与 AI 负载的异构双模,以及覆盖软硬件栈的整体效率。
在 7 月的上海世界人工智能大会(WAIC)开幕周的展馆里,108 款芯片、200 余款智能计算产品同时亮相,背后是同一个判断:单卡峰值算力的比拼正在让位于 CPU-GPU 协同、异构双模与节点级全栈效率。业内首款超算+智算的大规模计算底座,在WAIC上我们找到了
这套转向并非只来自一家厂商的发布会。AMD CEO 苏姿丰在 2026 年第一季度财报电话会上指出,单节点 CPU 与 GPU 的配比正从"一对多"向"一对一"靠拢,并可能在某些场景倒挂为 CPU 主导。同一时间,阿里云把 Agentic 时代的资源调度概括为"有状态调度 + 无状态执行"的混合范式,把优化焦点从单卡峰值拉到 CPU-GPU 高效协同。国盛证券最新研报则把 2026 年直接称为"国产超节点量产元年",并判断算力竞争范式正从单点峰值性能全面转向系统级全栈效率。业内首款超算+智算的大规模计算底座,在WAIC上我们找到了
WAIC 2026 的展台上,至少四家国产芯片厂商在同周发布可对标的产品。华为展出 Atlas 950 SuperPoD,沐曦带来曦景 S 系列超节点,阿里平头哥把真武 M890 与磐久 AL128 拼成整机柜方案,太初(杭州)集成电路有限公司("太初元碁")则首次公开 T2 Ultra 芯片与 HCU 异构融合计算架构。四家厂商在产品规格表上各讲各的故事,但发布会上的关键词高度重合:CPU-GPU 协同、节点级全栈效率、可重构配比、训推与科学计算统一底座。业内首款超算+智算的大规模计算底座,在WAIC上我们找到了
太初元碁 T2 Ultra 把"双模"写在标牌上。公布的参数覆盖 FP64 至 FP4 全精度:HPC 端 FP64 38 TFLOPS,AI 端 FP16 1200 TFLOPS(稀疏)、FP4 4800 TFLOPS(稀疏)。双模指的是同一颗芯片既可作为独立算力节点运行,也可作为加速器挂载。HCU 架构把 CPU 与 AI 算力核心放在同一根高速总线上,支持 M:N 可重构配比,并配套热/冷数据分级的共享存储。在产品形态上,T2 Ultra 与 HyperIntelliX 超智融合计算系统绑定,定位为覆盖 AI 训练、推理与 AI4S(AI for Science,把人工智能用于科学研究,例如天气预报、量子模拟、新药筛选)的全国产化平台。业内首款超算+智算的大规模计算底座,在WAIC上我们找到了
太初元碁出身于 HPC(高性能计算)一侧。团队此前三次拿到 Gordon Bell 奖(超算领域的最高奖项之一),WAIC 现场披露的 AI4S 案例顺势铺开:全球天气预报可视化系统、TecoQSim 量超融合模拟器、大规模虚拟药物筛选,覆盖气象、量子计算、生物医药三条主线。这与公司 CEO 杨晋喆在现场的判断一致:"算力产业已从单卡性能比拼进入系统级竞争阶段。"业内首款超算+智算的大规模计算底座,在WAIC上我们找到了
WAIC 现场报道同时给出两个反面判断。其一是"国产 AI 芯片普遍面临量产难、落地更难",其二是"生态迁移是国产芯片真正的硬骨头"。生态一端的工作量是具体的:太初元碁公布的人工智能开发者社区 2.0 适配了 Megatron-LM、DeepSpeed、PaddleHelix、PyTorch、vLLM 等主流训练与推理框架,并配套新一代全国产化 AI4S 计算平台。能否把这些框架在双模硬件上跑顺、跑出客户愿意付费的性能,决定了"系统级"是产品形态还是发布会话术。业内首款超算+智算的大规模计算底座,在WAIC上我们找到了
采购评估可以落在三个具体问题上。第一,这家厂商的芯片族是否在产线里真正同时承担 HPC(FP64)与 AI(FP4/FP16)两类工作负载,还是双模只是路线图上的一个名词。第二,生态工具链对 Megatron-LM、DeepSpeed、PaddleHelix、PyTorch、vLLM 等主流框架的适配到底覆盖到什么程度,剩多少在 TODO 列表里。第三,AI4S 那一栏是真实装机量,还是把"推理业务"重新贴一层"科学计算"标签的营销延伸。
这一轮转向的下一个分水岭大概率不会出现在下一个展台,而会落在 2026 年下半年各厂商的产线、框架适配账单与客户愿意付费的效率上。