DeepSeek V4 GA:开源模型的又一次「效率+能力」双升级
7月20日,DeepSeek正式发布V4 GA(General Availability)正式版,并采用MIT协议开源。这是继Kimi K3之后,中国开源大模型阵营在本周放出的又一重磅消息。V4分为Pro和Flash两个版本:
- V4-Pro:MoE架构,总参数1.6万亿,激活参数49B,支持100万Token上下文,在Codeforces Rating上取得3206分,超过GPT-5.4;
- V4-Flash:参数284B(激活13B),在多数基准测试上超过上一代V3.2,输出定价为每百万Token 0.28美元。
值得注意的是,V4首次引入峰谷分时计费模式,工作日特定时段价格翻倍。这种精细化的定价策略,既是对算力供需波动的响应,也为企业客户在成本与性能之间提供了更灵活的选择。旧版接口deepseek-chat和deepseek-reasoner将于7月24日下线,意味着DeepSeek正加速推进用户向新一代模型迁移。
阿里Qwen3.7-Plus:为Agent而生的多模态基座
几乎在同一时间,阿里巴巴发布多模态大模型Qwen3.7-Plus,官方将其定位为统一的Agent基座。该模型在文本能力基础上增强了视觉语言能力,集成GUI和CLI交互能力,可实现从原型到软件工程的端到端自动化。据官方披露,Qwen3.7-Plus具备自主闭环能力,可在11小时内完成真实APP开发,在Vision Arena排行榜上表现强劲。
与DeepSeek的「开源+API」路径不同,阿里千问系列更注重「模型即开发环境」的Agent化体验。Qwen3.7-Plus的发布意味着,国产大模型不仅在文本推理上追赶国际前沿,更在多模态理解、工具调用、自主执行等Agent核心能力上加速布局。
字节Seed Audio 1.0:AI音频创作进入全场景时代
字节跳动Seed团队在同日发布音频创作模型Seed Audio 1.0。该模型面向完整声音场景,在统一框架下联合建模人声、音效和环境声等多种音频要素,端到端完成影视级音频创作。官方披露其三大优势:多要素统一编排与精细时间控制、音色风格可控且长时稳定、支持多语种自然生成。目前该模型已在火山方舟体验中心上线。
Seed Audio 1.0的发布意味着,AI内容生成正从文本、图像向音频全领域延伸,短视频、广告、游戏、影视等行业的音频制作流程有望被进一步重塑。
自研芯片暗战:大模型公司的「算力自主」焦虑
据路透社报道,全球头部大模型公司纷纷启动自研AI芯片项目。DeepSeek已秘密启动自研AI推理芯片约一年,目标是降低对外部供应商的依赖;Anthropic引入AMD作为新GPU供应商;谷歌则研发Frozen v2芯片,将Gemini架构固化进硬件。低电压AI芯片企业Etched正在洽谈200亿美元估值融资,显示出资本市场对AI专用芯片的热情。
这一趋势表明,模型竞争正在从单一算法能力延伸到算力自主可控的全栈能力。对于中国制造业客户而言,这意味着未来选择AI基础设施时,不仅要考虑模型性能,还要评估供应链安全与长期成本结构。
一道科技技术观点:企业AI落地的三个新变量
一道科技分析:本周技术密集发布为企业AI落地带来三个新变量——
1. 成本变量:DeepSeek V4的峰谷定价和Flash版低价策略,将显著降低企业高频推理成本;
2. 能力变量:Qwen3.7-Plus的Agent基座定位,让「模型即开发环境」成为可能,缩短POC到生产的距离;
3. 场景变量:Seed Audio 1.0等多模态模型,正在打开文本之外的内容生成与交互场景。
作为杭州的AI技术公司,一道科技(yidaoit.cn)在AI大模型定制开发、数据挖掘与软件外包领域积累了丰富经验。我们帮助客户从模型选型、数据准备、Agent架构设计到私有化部署,构建端到端的AI应用系统。无论是基于开源模型的本地化部署,还是面向制造业、供应链、营销场景的智能体开发,我们都能提供贴合业务需求的落地方案。