谷歌出牌:Gemini 3.7 Flash价格腰斩,押注性价比与Agent入口
8月13日,谷歌发布Gemini 3.7 Flash,主打编程与Agent工作流:高推理模式智能得分56,输出速度约340 token/秒,在Artificial Analysis覆盖的186款模型中输出速度排名第一。价格更激进——年底前每百万token输入/输出价0.75/3.75美元,为前代标准价的一半。业界解读为:谷歌放弃押注超大规模旗舰,转而聚焦性价比突出的Flash级模型,以争夺"Agent默认入口"。其节奏本身就是护城河:每隔约三周推出一个更便宜、更强的Flash,"最新模型"成了移动靶。
Agent时代拉开:DeepSeek Harness开源"一切皆插件"
8月14日,DeepSeek发布首款Agent产品Harness v0.1预览版,采用MIT协议开源,定位为本地Agent工作台。它内置极简、标准、代码、创造四种预设模式,支持多Agent并行编排、上下文管理与联网搜索,最颠覆的设计是"一切皆插件"架构——内测期间用户已开发约300个插件,覆盖跨会话记忆、界面修改、工具扩展;并可接入近40家第三方模型。市场将其视为Agent时代的"安卓系统":谁掌握了智能体的运行与分发层,谁就握住了下一代软件入口。
速度与成本:OpenAI Ultrafast提速14倍,Grok 4.6主打长程可靠
在效率赛道,OpenAI推出Ultrafast模式,GPT-5.6 Sol处理速度达标准模式14倍、每秒最多750 token,由Cerebras提供算力,面向事故响应、客服等企业场景,目前预览版仅向少量客户开放。xAI则于8月12日发布Grok 4.6:未换更大底座,而是在1.5T同基上做后训练升级,Artificial Analysis智能指数达61(与GPT-5.6 Sol并列、仅次于Claude Fable 5),重点强化多步自我验证与新的"xhigh"推理档,主打长程Agent的可靠性,并同日集成进其收购的Cursor。
后训练Scaling:智谱GLM-5.3靠"不换底座"把智能上抬
与"堆参数"相反,智谱GLM-5.3用事实说明:相同基座之上仍有巨大智能上界。它通过数十倍规模的长程任务环境、更丰富的环境类型与超长后训练时间,使性能较上代提升50%,编程与智能体能力逼近Claude Fable 5。这印证了一个行业转向——当前基础架构仍有可观的后训练余量,头部团队正把算力花在"多步可靠"而非"规模膨胀"上。
一道科技解读:工程效率时代,企业AI落地更看重什么
当模型从"参数竞赛"转向"工程效率+Agent入口",企业选型的标尺也在变:不再是榜单上的峰值分数,而是单位成本的稳定产出、能否接入自有系统与工具、以及长程任务的可靠执行。一道科技在为企业落地AI时,始终强调"可编排、可审计、可私有化"——把大模型与业务系统、数据管线打通,让智能体真正跑在产线与流程里。
无论是构建企业级Agent工作台,还是将开源模型集成进现有IT架构,欢迎与我们交流。更多技术趋势,请关注一道科技行业资讯中心。