AMD MI455X全面交付:2nm GPU+432GB HBM4+重塑训练基准
2026年7月28日,AMD在发布会上披露了Instinct MI455X的详细参数,代号"Helios"的机架级系统随之启动量产。该GPU采用业界首款2nm工艺,显存升级至HBM4,总线带宽达到23.3TB/s,在多个维度重新设定了AI训练硬件的基线。在AMD以DeepSeek-V3为基准的公开测试中,MI455X的吞吐达到MI355X的34倍。同周另一端的英伟达则继续以Vera Rubin NVL72在多卡互联效率上保持领先,两家从不同维度展开新一轮竞争。
这场发布背后有三点变化值得记录。第一,MI400系列单卡显存从96GB跃升至432GB,长上下文训练不再需要显存换出,大幅降低了KV-cache迁移开销。第二,ROCm软件栈通过与Anthropic的50亿美元股权合作获得了早期深度适配,Anthropic团队反向参与ROCm Runtime的接口定义,CUDA生态的护城河正在被AI Agent逐步瓦解。第三,AMD宣布Helios机架(由MI455X+EPYC Venice 9006组成)在Q3末量产,综合性能宣称较Vera Rubin NVL72提升15%、内存带宽多50%、每美元吞吐高30%。
同周内,关于"Vera Rubin延期"的传言在X平台被多家外媒转发,英伟达官方与AMD官方均未对此表态,市场仍在观望年底前两款产品的实际出货情况。但一个事实已经成立:全球AI算力供应从"英伟达独占"转向"双雄并行",任何依赖单一芯片来源的算力规划都正在变成高风险决策。
小米MiMo-V2.5登顶+中国模型份额63.5%:开源生态从"可能"走向"被验证"
如果说AMD代表算力侧的多极化,OpenRouter榜单则印证了模型侧的格局变化。OpenRouter于7月28日公布最新一周数据:小米MiMo-V2.5以周调用10.5万亿Token夺冠OpenRouter双榜(周调用量榜与综合实力榜),前五全部为中国模型——DeepSeek V4系、腾讯HY3、智谱GLM-5.2等;Top 20中,中国模型总份额从两个月前的不到28%飙升至63.5%。
这次领先的原因与上一代"中国模型出海"的尝试有本质差异。首先,MiMo-V2.5的多任务能力已超越主流闭源对手的关键基准,在企业研发和代码评审场景中被海外开发者大量采用。其次,DeepSeek V4与智谱GLM-5.2是昇腾原生训练、训练过程完全可控,合规层面打消了海外政企客户的疑虑。最后,价格战让全球开发者对闭源模型的依赖度大幅下降,中国模型的Token价格仅为美国同档闭源模型的1/8至1/12。这一格局与周一K3全量开源产生的"可跨平台调用"生态形成正向耦合,共同重塑全球AI话语权。
杭州GOAI大赛500万奖金池:开源AI从"宣言"走向"落地"
同一天,总部位于杭州的中国开源AI基金会主办的GOAI世界人工智能开源大赛官网上线,设立500万人民币奖金池。主要承办方为之江实验室、阿里云、蚂蚁集团、群核空间,要义对冲实际商业场景痛点的开源项目。赛题覆盖多模态、Agent、RAG、RLHF体系、AI Infra等多个赛道,首次将"可被采购的开源资产"作为评审标准之一。
另一个背景是本周初发布的《APEC成都声明》首次将"开源参与"列为部长级合作议题,呼应中国在AI治理上"开放+共建"的姿态。这意味着中国AI开源生态已从"单点突破"走向"体系化运营":上游有K3、GLM-5.2等顶级开源模型,中游有GOAI大赛汇聚社区,下游有昇腾/MI455X等多元化算力。
对开发者与企业的实际意义是:未来12个月,可"开箱即用"的开源AI技术栈将显著完善,企业自建专有AI能力的边际成本会进一步降低。
一道科技技术观察:本周全球AI进入"多渠道临界点"。算力以AMD MI455X、昇腾910C、英伟达Rubin为三个并存节点;模型以K3全量开源、OpenRouter份额反转、MiMo兴起为三个趋势点;生态以GOAI大赛、APEC开源声明、安全合规框架为三个落地支点。一道科技在为客户进行AI架构设计时,已将多主体AI架构(多基座·多算力·多交付模式)作为默认选项,提高客户业务在趋势动荡中的适应能力。关于GOAI世界开源大赛报名与技术趋势深度剖析,请访问一道科技行业资讯中心。