随着企业对人工智能部署成本的敏感度不断攀升,市场对降低成本的呼声也日益迫切。虽然开源模型能够显著削减单token的消耗费用,但在海量模型中精准挑选出最契合业务需求的选项往往并不容易。
针对这一行业痛点,面向营销人员提供AI工具与智能体的企业Writer于本周四正式推出了全新旗舰模型Palmyra X6。该模型基于Z.ai的开源模型GLM-5. 2 进行了深度后训练调整,旨在为用户提供具备直接部署能力的高性价比方案。Writer官方预计,通过新模型与升级后的大模型调用框架双管齐下,基础任务的处理成本有望最高削减50%。
在发布新模型的同时,Writer也对标准智能体调用框架进行了重大升级,并于周四起全面面向客户开放。Writer首席执行官May Habib指出,企业客户已经对无休止地追逐各项跑分基准感到疲惫,他们真正渴望的是平稳可控的成本支出,而当前很少有实验室能兑现这一承诺。
全新的技术方案将重心集中在高效处理多步骤复杂任务上,致力于在缩减token消耗的同时提升运行速度。Writer研究人员近期发布的一篇论文也佐证了这一思路:他们在多个不同模型上对框架效率进行了微调测试,结果显示优化框架往往比单纯更换模型更具成本效益,测试中的整体开销平均下降了约40%。
尽管新推出的Palmyra X6 依然保持了模型中立的特性,能够与Writer自家的其他产品或通过Azure、Amazon Bedrock引入的外部模型协同运作,但成本激增的现状正促使企业首席信息官对各大主流AI实验室产生信任动摇。Habib认为,现有的AI实验室在帮助企业真正通过人工智能获得切实收益方面,仍有很长的路要走。











