
发布时间:2026-07-23
阅读量:786
M100的产品定位极具针对性:基于全国产供应链打造,核心对标英伟达H20,主攻高性价比推理应用场景。
作为参照,英伟达H20基于Hopper架构,配备96GB HBM3显存,显存带宽达4.0TB/s,FP8算力为296 TFLOPS,FP16算力为148 TFLOPS,TDP功耗为400W。作为面向中国市场的特供版本,H20的算力虽较H100大幅缩减,但凭借大显存和高带宽,在推理场景中依然表现强劲。而M100的目标,正是在H20最擅长的推理赛道中,以更低成本和更高能效比实现替代。
在核心规格上,M100的HBM容量略低于H20,但在整体能效比和单位算力成本方面具备明显优势,更适合对成本敏感、推理吞吐要求高的大规模部署场景。在国产替代的大趋势下,一款“全国产化”的推理芯片,其意义远不止于参数层面的追赶。
不止M100:昆仑芯产品矩阵全面拓展
M100并非昆仑芯的首款产品。在本次WAIC上,已实现大规模出货的P800加速卡也同台展出。
据了解,P800是昆仑芯于2024年推出的第三代AI加速器,采用自研XPU架构,配备96GB HBM,FP16算力达345 TFLOPS,并支持FP8、FP16、FP32等多种精度计算。
P800的落地进程同样迅速:2025年4月,百度成功点亮基于P800的3.2万卡超级集群;2026年4月,基于P800的天池256卡超节点首次点亮,吞吐性能较上一代提升25%,推理效率提升50%。目前,P800已适配文心、DeepSeek、GLM、MiniMax等主流模型,并在招商银行、中国移动、国家电网等行业实现落地。
在产品规划方面,昆仑芯的路线图清晰明确:除M系列推理芯片外,新一代P系列高性能AI芯片也在研发中,直接对标华为昇腾950。此外,计划于2027年初推出的M300也在筹备之中,昆仑芯正加速构建“训练+推理”双线并进的产品体系。
市场格局:国产AI加速卡占比突破四成
M100的亮相,恰逢国产AI芯片市场份额的关键转折期。
据IDC数据,2025年中国AI加速卡总出货量约400万张,其中国产厂商合计出货约165万张,占比达41%。具体来看,华为昇腾以81.2万张位居第一;阿里平头哥出货26.5万张排名第二;昆仑芯与寒武纪各出货约11.6万张,并列第三。而几年前,英伟达在中国AI芯片市场的份额还曾高达95%。
从“有没有”到“好不好用”,国产AI芯片正迈入新的竞争阶段。随着M100等新一代产品陆续落地,推理侧的国产替代进程有望进一步提速。