中国大模型行业在近期迎来新一轮发展高潮,各大厂商纷纷推出新举措,展现出行业从价格竞争向技术深度和生态构建转型的明显趋势。8月中旬,DeepSeek、智谱和阿里云等头部企业接连发布重要动态,引发市场广泛关注。
DeepSeek宣布将于8月17日起对旗下DeepSeek-V4-Flash和DeepSeek-V4-Pro两款模型实施峰谷计价策略,成为行业首个采用差异化定价的企业。根据新方案,DeepSeek-V4-Flash在空闲时段的百万Tokens输入价格(缓存命中)为0.05元,输出价格为4.5元;高峰时段价格翻倍。V4-Pro版本的价格则更高,空闲时段输入(缓存命中)为0.15元,输出达13.5元,高峰时段同样上涨一倍。这一调整标志着大模型行业正式告别"低价圈地"阶段,进入精细化运营的新时期。
为缓解涨价可能带来的用户流失风险,DeepSeek同步推出了Harness开发者预览版。这套智能体管控系统采用插件式开放架构,将模型、工具、技能等核心能力均设计为可自由组合的插件模块。开发者无需修改系统源码,即可根据需求选择、替换或扩展各项功能。这种设计理念不仅提升了系统的灵活性,更暗示着DeepSeek正从单一模型提供商向平台化服务商转型。据业内人士分析,Harness的开放架构理论上支持接入其他主流大模型,这可能重塑行业竞争格局。
在商业化路径探索上,各家企业展现出不同策略。智谱选择通过后训练技术提升模型性能,而非更换基座模型。其最新发布的GLM-5.3版本在保持与前代相同基座的情况下,通过优化训练方法使编程能力提升50%,在多个公开基准测试中取得开源模型第一的成绩。这种"不换基座换打法"的策略显著降低了研发成本,同时满足了企业对代码生成能力的迫切需求。金山办公旗下AI办公智能体灵犀专业版在发布当日即接入GLM-5.3,凸显出代码能力已成为模型商业化的关键指标。
阿里云则延续开源战略,正式推出Qwen3.8系列模型,其中270亿参数规模的Qwen3.8-27B可在家用显卡上运行,进一步降低了大模型的使用门槛。与此同时,阿里云在算力基础设施和产品生态方面持续发力,8月以来相继上线灵骏真武M890超节点实例、发布视频生成模型Wan3.0公测版、推出AI语音生产力平台CosyVoice Studio等系列产品。这种全链条布局显示出阿里云构建云生态系统的雄心。
行业数据反映出国产模型的强劲势头。AI模型聚合平台OpenRouter最新统计显示,本周全球模型调用量排名前十的模型中,有六个来自中国厂商。其中DeepSeek-V4-Flash-0731、Hy3等模型表现突出,GLM-5.2也稳居前五。这种市场格局的变化,既得益于国内厂商在算力成本上的优势,也反映出其在模型效果优化上的显著进步。
面对商业化挑战,行业专家指出,大模型企业需要突破传统互联网的边际成本递减思维。Nextie创始人李笛认为,当前大模型技术先进性与商业模式陈旧性形成鲜明对比,厂商必须在价格调整的同时提供更深度的服务。文渊智库创始人王超则表示,国内模型厂商的商业模式尚未定型,B端市场、生态建设等方向都存在探索空间。在这场转型中,谁能率先找到技术深度与商业可行性的平衡点,谁就能在未来的竞争中占据主动。











