调用量登顶:7.22万亿Token/周
据8月初AI快报,DeepSeek V4-Flash在OpenRouter周调用量达7.22万亿Token,位居全球第一;且全部核心算子基于Triton自研、彻底脱离CUDA生态,国产GPU可直接部署。真实流量正在为"开源+高效率"投票。
单卡可跑+成本1/105
V4-Flash单颗AMD MI300X即可生产运行,任务成本仅为Anthropic Fable的约1/105。当先进模型既"跑得便宜"又"跑得开",企业的模型选型逻辑从"追品牌"转为"算成本与效率"。
一道科技解读:流量即证据
调用量第一说明:开发者用脚投票选了"高性价比+可私有化"。一道科技在为客户做模型选型时,也会把"真实调用成本"作为核心指标纳入POC评估。