原文标题:Writer introduces new AI model and upgraded harness to contain token costs
在整个人工智能行业,用户越来越意识到他们的部署成本有多高,并感受到削减成本的新紧迫性。但是,尽管开源模型的单位代币成本显着降低,但为特定工作找到合适的模型可能很困难。
周四,为营销人员提供人工智能工具和代理的 Writer 推出了一款名为 Palmyra X6 的新旗舰机型,旨在为用户解决这一问题。作为 Z.ai 开源模型 GLM-5.2 的训练后变体,Writer 表示新系统应该以低得多的价格提供部署就绪的功能。该公司估计,新模型与公司利用基础设施的变化相结合,将为客户节省多达 50% 的基本任务成本。
与新车型一起,该公司还对其标准代理安全带进行了重大升级。这两项功能将从周四开始向 Writer 客户开放。
“我认为企业已经厌倦了追逐下一个基准,”首席执行官 May Habib 告诉 TechCrunch。 “他们想要压平成本,但似乎没有人能做到这一点。”
新方法特别强调复杂的多步骤任务,执行速度更快,并且使用的令牌更少。 Writer 认为线束优化是实现这一目标的关键杠杆。
Writer 研究人员最近发表的一篇论文证实了这种方法,测试了多个不同模型中线束效率的微小变化。研究发现,在许多情况下,改变线束是比选择型号更可靠的降低成本的方法,在测试中成本平均下降了 40%。
研究人员写道:“线束是一个组件,其效率在组织当前和未来运行的每个模型中都会成倍增加。”
对于 Writer 的客户来说,体验仍然与模型无关:Palmyra X6 将与其他 Writer 模型或通过 Azure 或 Amazon Bedrock 导入的外部模型并存。但哈比卜也认为,削减成本的努力会导致人们对主要人工智能实验室产生更广泛的不信任,因为这些实验室有经济动机来推动代币的使用。
Habib 向 TechCrunch 表示:“对于客户来说,成本爆炸式增长是前所未有的,首席信息官们放弃实验室的程度也是如此。”他补充说,人工智能实验室“并没有深入了解如何帮助企业从人工智能中获益。”