近日,人工智能领域迎来新动态,月之暗面公司推出的Kimi K3模型引发广泛关注。该模型于7月16日正式上线,凭借其强大的性能参数迅速成为行业焦点。作为Kimi系列迄今为止能力最强的模型,Kimi K3拥有2.8万亿参数规模,支持100万Tokens的上下文处理能力,主要面向长程编程和端到端知识工作场景设计。
据公开计费标准显示,Kimi K3模型采用差异化收费模式:缓存命中时每百万输入Tokens收费2元,未命中时收费20元,输出费用则为每百万Tokens100元。这种定价策略既考虑了技术成本,也体现了对不同使用场景的适配性。值得注意的是,该模型即将开放权重,这一举措预计将进一步推动其在开发者社区的应用普及。
市场反应超出预期。数据显示,在7月17日K3正式发布当天,月之暗面的年化收入(ARR)出现历史性单日最大增幅,打破了此前平缓的增长曲线。这一现象既印证了市场对高性能AI模型的需求,也给企业运营带来新的挑战。Kimi团队在7月19日发布的公告中坦言,用户请求量在48小时内激增至现有集群承载极限,迫使公司采取紧急应对措施。
为保障现有用户的服务质量,Kimi决定即日起暂停C端新用户订阅服务,将全部算力资源集中用于维护已订阅用户的权益。同时,团队正在加速推进算力扩容工程,计划随着新算力陆续投入使用,逐步恢复并扩大订阅服务规模。针对未来新用户,公司将调整权益结构,把Kimi主权益(涵盖Web、App、Work)与Kimi Code权益拆分,以实现更精准的算力匹配。
Kimi总裁张予彤在7月18日的朋友圈动态中特别强调,2.8万亿参数的模型规模不仅代表着技术突破,更意味着对算力基础设施的全新考验。她透露,团队正在探索多种技术优化方案,包括模型压缩、分布式推理等,以在现有硬件条件下提升服务效率。这种技术探索与商业运营的平衡之道,或将成为AI企业规模化发展的关键课题。











