中国大模型行业近期迎来密集调整,多家企业通过不同策略寻求突破。DeepSeek宣布将于8月17日对旗下DeepSeek-V4-Flash和DeepSeek-V4-Pro两款模型实施峰谷计价模式,同时推出Harness开发者预览版工具框架。这一举措被视为在价格调整背景下维持用户粘性的关键布局。智谱科技则选择聚焦后训练技术,发布基于现有基座模型升级的GLM-5.3版本,通过强化学习将编程能力提升50%。阿里云延续开源战略,正式开源Qwen3.8系列模型,其中270亿参数规模的Qwen3.8-27B可在家用显卡运行,进一步降低使用门槛。
行业观察指出,大模型竞争正从单纯的价格战转向技术生态构建。DeepSeek推出的Harness系统采用插件式架构,将模型、工具、用户界面等核心能力模块化,允许开发者自由组合替换。这种设计理论上支持接入其他主流大模型,形成开放生态。Nextie创始人李笛分析称,智能体时代需要更复杂的管控系统,单纯依赖模型性能已不足以满足应用需求,Harness类工具正在成为技术竞争的新焦点。
价格策略调整引发市场关注。DeepSeek新收费体系显示,V4-Flash模型空闲时段百万Tokens输入价格分0.05元(缓存命中)和1.5元(缓存未命中)两档,输出价格为4.5元;高峰时段价格翻倍。V4-Pro模型对应价格分别为0.15元、4.5元和13.5元,高峰时段同样上涨1倍。这种差异化定价策略反映出企业对不同时段资源利用率的优化考量。
在商业化路径探索上,各家呈现差异化选择。阿里云8月动作频繁,除模型开源外,还升级企业级分析产品Quick BI、启动视频生成模型Wan3.0公测、上线语音生产力平台CosyVoice Studio等,形成从基础设施到应用层的完整布局。智谱科技则通过后训练技术实现性能跃升,GLM-5.3在网络安全任务中的表现已与Mythos 5持平,这种"不换基座换打法"的策略显著降低了研发成本。
应用端反馈显示,代码生成能力正成为模型竞争力的核心指标。金山办公旗下AI办公助手灵犀专业版在接入DeepSeek-V4-Pro当日,即同步接入GLM-5.3模型,特别强调两者的代码处理优势。这种双重接入现象反映出企业客户对技术可靠性的审慎态度,也印证了王超等分析师的观点——当前大模型商业价值尚未完全释放,B端市场仍存在大量探索空间。
国际数据平台OpenRouter最新统计显示,中国大模型在全球调用量排名中表现突出。本周全球前十模型中,国产模型占据六席,除GPT-5.6 Luna外,前五名均为中国模型。这种市场格局变化与技术路线选择密切相关,各家企业通过开源生态、工具链建设、垂直领域优化等不同路径,正在重塑行业竞争版图。











