7月20日,在2026世界人工智能大会(WAIC 2026)上,百度旗下昆仑芯首次公开展示了面向大模型推理的第四代AI芯片M100实物。
据了解,昆仑芯M100基于全国产供应链打造,核心定位为高性价比推理应用芯片,主要对标NVIDIA面向中国市场推出的特供产品H20。
二者在性能上各有侧重,M100的HBM容量略低于H20,但凭借国产供应链优势和优化设计,在推理场景中具备突出的性价比优势。
作为对比,NVIDIA H20基于Hopper架构打造,配备96GB HBM3显存,显存带宽达4.0TB/s,FP8算力为296 TFLOPS,FP16算力为148 TFLOPS,TDP功耗400W。
尽管其算力参数相比H100大幅削减,但96GB大显存和高带宽的特性,使其在大模型推理场景中仍拥有较强竞争力。
实际上,昆仑芯M100并非首次被提及。早在2025年11月的百度世界大会上,昆仑芯就首次披露了M100的相关信息,同时还公布了面向超大规模多模态大模型训练与推理的M300,该款芯片计划于2027年初上市。
此次WAIC 2026,是M100芯片实物的首次公开亮相,标志着该产品已进入实质性落地阶段。
除了全新的M100芯片,昆仑芯在本次展台上还展出了已实现大规模出货的P800加速卡。
这款加速卡是昆仑芯2024年推出的第三代AI加速器,基于自研XPU架构,配备96GB HBM显存,FP16算力达345 TFLOPS,支持FP8、FP16、FP32等多种精度计算,适配多类AI应用场景。
P800加速卡的规模化应用成果也十分亮眼。2025年4月,百度成功点亮了基于P800的3.2万卡超级集群;2026年4月,基于P800的天池256卡超节点首次点亮,其吞吐性能较上一代产品提升25%,推理效率更是提升了50%,充分验证了该产品的稳定性和高性能。
在产品研发布局上,昆仑芯并未止步。据透露,昆仑芯目前正在研发新一代P系列高性能AI芯片,核心对标华为昇腾950,未来将进一步完善国产AI算力产品矩阵,提升高端算力领域的竞争力。





























