结论先行:2026年9月9日至10日这一轮动向,主线是「AI开始被计量」。工信部印发《信息通信行业发展「十五五」规划》提出2030年智能算力达9800 EFLOPS;北京市把「每度电生成词元数量」从2025年500万个提升到2030年2000万个写进规划;重庆就词元经济行动计划征求意见;DeepSeek发布V4.1-Flash把KV缓存压到约四分之一;蚂蚁发布原生安全Agent OS。对企业而言,含义很直接:算力总量不再稀缺,单位算力的产出效率与执行权的治理边界,才是新的成本变量。这也是杭州一道科技为客户做架构设计时重点考量的两条线。

总量侧:9800 EFLOPS 是一张施工图,不是口号

《信息通信行业发展「十五五」规划》于9月10日正式印发,提出到2030年智能算力规模达9800 EFLOPS,有序推进万卡及十万卡以上智算集群部署,并明确6G、卫星互联网、量子信息等前沿方向。这是信息通信领域承接「人工智能+」的国家级施工图,为智算基建与算力网建设定下总量与节奏。配套动作同步落地:京东云与摩尔线程9月9日宣布共建十万卡国产智算集群,中国联通「星罗」算力调度平台综合算效提升至300%。对企业客户的现实影响是,智算供给的稀缺性将继续下降,训练与推理的边际成本长期向下;此时把预算压在自建算力上,性价比通常低于按需采购与模型瘦身

效率侧:从「卖算力」到「计量智能」

更值得关注的是计量口径的变化。北京市9月9日发布的《「十五五」时期数字经济发展规划》提出,到2030年数字经济增加值占地区生产总值比重超过50%,并把每度电生成词元(Token)数量由2025年500万个提升至2030年2000万个写进预期性指标。重庆市大数据应用发展管理局9月9日就《培育发展词元经济行动计划(2026—2028年)》公开征求意见,提出打造词元交易服务平台、探索词元交易标准与结算规则,目标到2028年全市可调度智算规模超10万P当AI被折算成「每度电多少词元」,企业的成本核算口径也随之改变——从按项目买服务器,转向按业务产出计量智能消耗。

模型与治理:效率跃迁与安全底座同步成型

模型侧,DeepSeek于9月10日发布V4.1-Flash:采用全新Causal Encoder-Decoder架构并支持原生视觉理解,为552B参数MoE(prefill激活8B、decode激活16B),上下文窗口1M,全局KV缓存降至每token约890字节,约为V4-Flash的四分之一,API价格同步下调。上下文成本与显存占用同时下探,意味着长文档、长会话类应用的可行性边界被显著外推。治理侧,蚂蚁集团在9月9日的外滩大会展示原生安全Agent OS,把任务调度、权限控制、身份校验放进底座,并通过分布式引擎让彼此隔离的智能体共享资源;同场启动《智能体身份鉴别与授权技术框架》《智能体运行时安全技术要求》两项团体标准编制。共同指向是:安全正从「事后补丁」变成系统原生能力

企业应对:三条可执行建议

基于上述变化,我们给企业客户的建议是三条。第一条按产出计量而非按资源采购:建立词元消耗与业务指标(工单处理量、质检件数、客服会话数)的对应关系,先算清单次业务的智能成本,再决定自建还是采购。第二条把长上下文用在刀刃上:KV缓存成本下降不等于可以无节制投喂,检索质量与切片策略对效果的影响通常大于上下文长度,应先把知识库治理做扎实。第三条把身份、权限、日志、关停前置到设计阶段:智能体安全标准正在从原则走向可执行条款,事后改造需重构调用链与数据通路,成本高一个数量级。企业还需同步配套数据挖掘与软件外包能力:前者把业务数据结构化为Agent可调用的工具与知识,后者把Agent接进既有业务系统。相关实践见一道科技行业资讯

关于本文与AI落地,你可能还想问

「每度电生成词元数」这个指标对企业有什么实际意义?

它把AI的能耗与产出直接挂钩,本质是衡量单位算力的智能产出效率。对企业而言,这意味着评估AI方案时不应只看算力单价,而应折算成单条业务(如一次客服会话、一次质检判定)的词元消耗,才能得到真实的单位成本。

智能算力总量持续扩大,企业还需要自建算力吗?

多数企业不需要。随着9800 EFLOPS总量落地与十万卡国产集群推进,算力稀缺性下降;加上模型侧KV缓存与推理成本持续下探,按需采购通常更划算。例外是数据合规要求严格、必须本地闭环的行业,可采用私有化小规模部署加弹性外部扩容的混合模式。

一道科技能在降本与治理两方面提供什么?

降本侧提供模型选型、知识库治理、检索与切片优化、小模型替大模型快筛的方案设计;治理侧交付智能体的身份鉴别、授权边界、执行环境隔离与审计留痕底座,并负责与ERP、MES、CRM等既有系统集成。团队位于杭州,支持私有化与混合部署。