调用量登顶:7.22万亿Token/周

据8月初AI快报,DeepSeek V4-Flash在OpenRouter周调用量达7.22万亿Token,位居全球第一;且全部核心算子基于Triton自研、彻底脱离CUDA生态,国产GPU可直接部署。真实流量正在为"开源+高效率"投票。

单卡可跑+成本1/105

V4-Flash单颗AMD MI300X即可生产运行,任务成本仅为Anthropic Fable的约1/105。当先进模型既"跑得便宜"又"跑得开",企业的模型选型逻辑从"追品牌"转为"算成本与效率"。

一道科技解读:流量即证据

调用量第一说明:开发者用脚投票选了"高性价比+可私有化"。一道科技在为客户做模型选型时,也会把"真实调用成本"作为核心指标纳入POC评估。