7-8月国产大模型催化
1. 月之暗面 Kimi K3,7月17日上线2.8T参数MoE开源旗舰模型。
2. 阿里通义千问Qwen3.8,2.4万亿参数原生多模态模型,7月底正式版上线并全量开源;配套千问AI智能耳机、AR端侧硬件同步亮相(端侧AI)。
3. DeepSeek V4 Pro Max7月19日开启内测,7月20日全量上线;总参数1.6万亿。
4. MiniMax M3 Pro8月上旬,2.7万亿参数旗舰模型发布。
5. 智谱GLM-5.5,8月中下旬,创始人称有史诗级提升。
本次集中发布的全部是1.6T~2.8T 万亿级 MoE 长上下文旗舰模型,需要高显存的机型服务器,首先受益的是高端英伟达算力租赁,其次国产算力租赁,最近各大模型也在持续推进国产算力适配。
而高端英伟达算力从5月31日起, BIS 穿透管制升级,只要有一点中资的背景都买不到高端算力,包括利通。
算力租赁核心公司:
①行云科技:国内已清关入境最大规模DGX-B300 原厂整机集群(880~950 台)约6000+ P,单卡 288GB 超大显存,万亿 MoE 模型,最缺就是大显存机型,存量稀缺性持续抬升租金溢价。
②利通电子:境内自有约 450 台 H800 服务器 + 150 台 H200 服务器,合计 1.6 万 P。
另外协创数据有存量1200~1500 台 HGX-B300,约1万P。宏景科技传闻约1500 台左右 HGX-B300。
顶级稀缺:DGX-B300(原厂整机,288GB 显存) >
次顶级:HGX-B300(ODM 组装)>B100(192GB)>H800(80GB)
看单卡的话,昇腾 950 单卡显存 144GB,和 H200 非常接近,高于 H800。组成超节点后也能跑万亿 MoE 大模型,就是存在效率差距。
