结论先行:大模型价格正在进入高频调整期——涨价与降价同时发生。智谱把新上线的 GLM-5.3-Flash 定价压到 GLM-5.3 的 1/10(限时低至 1/20,仅为 Opus 4.8 的 1/40),DeepSeek 在 8 月 17 日全面上调 API 价格后,又从 8 月 23 日起把周末全天统一按低谷时段计费,MiniMax 与月之暗面则把计费口径改为按 Token 与分档套餐。对企业来说,关键不是追着价格表跑,而是把调用成本、工程成本、数据资产成本三笔账分开算。

一周三次调价:涨的涨、降的降

8 月 26 日晚,智谱宣布上线并开源 GLM-5.3-Flash(320B-A18B),官方公众号显示其定价为 GLM-5.3 的 1/10,限时折扣期内低至 1/20。而在此前一周,DeepSeek 刚完成一轮价格调整:8 月 22 日官方公告称,自 8 月 23 日起优化峰谷计费规则,周末(周六及周日)全天不再区分峰谷时段,统一按低谷时段价格计费;更早的 8 月 17 日起,DeepSeek 已对 V4 全系列正式版 API 价格做了大幅上调。

把时间轴拉长看,今年以来阿里云、腾讯云、百度智能云、月之暗面等国内厂商都做过集体调价。6 月,MiniMax 在发布旗舰大模型 M3 的 API 后,计费由按次改为按 Token,Token Plan 分 Plus 49 元、Max 119 元、Ultra 469 元三档;7 月,月之暗面发布 Kimi K3,API 输入(缓存未命中)20 元、输出 100 元/百万 Token,同时面向 C 端推出 Andante 49 元/月、Moderato 99 元/月、Allegretto 199 元/月、Allegro 699 元/月五档会员。

为什么会这样:算力刚性成本倒逼,商业化仍在早期

天使投资人、资深人工智能专家郭涛的判断是:本轮调价潮本质是算力刚性成本持续高企倒逼的结果,但并不代表大模型已迈入成熟商用阶段,行业仍处在商业化发展的早期。前期跑马圈地阶段,厂商普遍以低价甚至补贴抢夺调用量,优先追求用户规模而淡化现金流健康度;随着行业回归理性,企业需要修复毛利、缓解亏损压力,涨价就成了商业层面的必然选择。而对需求方来说,这意味着“按调用量线性增长”的成本模型不再稳定,必须留出弹性。

三笔账:企业AI的真实TCO怎么算

第一笔是调用成本。它最直接,也最容易被降价新闻误导。峰谷计费规则普及后,批处理类任务(报表生成、批量质检归档、历史数据回溯、夜班日志总结)挪到周末与夜间执行,成本可以明显下降——这是几乎零改造就能拿到的收益。

第二笔是工程成本。把通用模型变成能跑通排产、质检、运维的行业大模型,需要场景诊断、数据治理、模型微调、系统集成与持续优化。业界经验是,这部分往往超过调用成本,也是多数企业卡在“下载了模型却跑不起业务”的原因。

第三笔是数据资产成本与收益。每一次调用都在产生数据,但只有经过治理、沉淀为自有语料与知识库的调用,才会形成复利。否则企业只是在为别人的模型优化付学费。

降本组合拳:分层用模 + 峰谷调度 + 私有化兜底

结合本轮调价,一道科技建议企业采用“分层用模”策略:高频、简单、可标准化的任务(如表单识别、常规问答、日志摘要)用开源 Flash 级模型或本地小模型承担;复杂推理与长上下文任务调用云端旗舰模型;涉密与高价值数据则走私有化部署的内网闭环。再叠加峰谷调度把批处理任务排到低谷时段,可以在不牺牲效果的前提下显著压低单位成本。对数据敏感的制造业与政企客户,私有化还能一并解决合规与知识产权问题。

一道科技解读:价格会波动,能力要沉淀

价格表每个月都可能在变,但企业的能力沉淀不该随之摇摆。杭州一道科技建议制造企业按“场景诊断 → 数据治理 → 轻量微调验证 → 私有化部署 → 持续迭代”的路径推进,先在一个高频高价值场景跑通 ROI,再横向复制。一道科技已服务之江实验室、正泰集团、杭州市政府等标杆客户(详见客户案例),提供AI大模型定制开发数据挖掘与软件外包的全链路服务,并可为企业提供免费场景诊断。

关于本文与AI落地,你可能还想问

这篇文章讲的AI趋势,一道科技能帮企业落地吗?

能。一道科技已服务之江实验室、正泰集团、杭州市政府等标杆客户,提供大模型定制开发、智能体构建与私有化部署全链路服务,帮助企业把前沿趋势转化为可量化效益。

企业想做AI化,第一步该做什么?

先做场景诊断与数据盘点,选高频高价值场景切入,再逐步扩展到模型定制与私有化部署。可联系杭州一道科技获取免费诊断。

支持私有化部署、保障数据安全吗?

支持内网闭环私有化部署,数据不出域,具备权限隔离与敏感信息过滤,满足合规审计,适合政企与制造业客户。