随着AI技术在企业中的普及,高昂的Token费用让不少用户大呼吃不消。为了帮企业打破“越用越贵”的困境,AI服务商Writer于本周四正式推出了全新旗舰模型 Palmyra X6,并对底层的智能代理运行程序(harness)进行了重大升级。
据悉,Palmyra X6 建立在 Z.ai 开源模型 GLM-5.2 的后训练变体基础之上。结合全新的运行框架优化,该系统能够针对基础任务将客户成本大幅削减高达 50%。企业首席执行官 May Habib 表示,当前的行业现状让许多 CIO 感到厌倦,企业需要的不是盲目追逐下一个跑分天花板,而是真正可控的成本。
除了推出新模型,运行程序的架构优化也成为了此次升级的核心亮点。该公司近期发布的一项研究表明,相比单纯挑选不同的大模型,微调运行效率往往是更可靠的降本途径,其测试显示相关成本平均下降了 40%。运行框架作为底层组件,能够成倍提升组织内部运行所有模型的效率。
目前,Palmyra X6 已经向企业客户全面开放。用户可以将其与现有工具结合使用,或者通过云平台进行调用。业内人士认为,这一动作折射出当前市场环境的变化:在AI部署成本不断飙升的背景下,如何通过技术手段遏制支出,正成为各大企业当下的首要考量。



