隨着企業對人工智能部署成本的敏感度不斷攀升,市場對降低成本的呼聲也日益迫切。雖然開源模型能夠顯著削減單token的消耗費用,但在海量模型中精準挑選出最契合業務需求的選項往往並不容易。
針對這一行業痛點,面向營銷人員提供AI工具與智能體的企業Writer於本週四正式推出了全新旗艦模型Palmyra X6。該模型基於Z.ai的開源模型GLM-5. 2 進行了深度後訓練調整,旨在爲用戶提供具備直接部署能力的高性價比方案。Writer官方預計,通過新模型與升級後的大模型調用框架雙管齊下,基礎任務的處理成本有望最高削減50%。
在發佈新模型的同時,Writer也對標準智能體調用框架進行了重大升級,並於週四起全面面向客戶開放。Writer首席執行官May Habib指出,企業客戶已經對無休止地追逐各項跑分基準感到疲憊,他們真正渴望的是平穩可控的成本支出,而當前很少有實驗室能兌現這一承諾。
全新的技術方案將重心集中在高效處理多步驟複雜任務上,致力於在縮減token消耗的同時提升運行速度。Writer研究人員近期發佈的一篇論文也佐證了這一思路:他們在多個不同模型上對框架效率進行了微調測試,結果顯示優化框架往往比單純更換模型更具成本效益,測試中的整體開銷平均下降了約40%。
儘管新推出的Palmyra X6 依然保持了模型中立的特性,能夠與Writer自家的其他產品或通過Azure、Amazon Bedrock引入的外部模型協同運作,但成本激增的現狀正促使企業首席信息官對各大主流AI實驗室產生信任動搖。Habib認爲,現有的AI實驗室在幫助企業真正通過人工智能獲得切實收益方面,仍有很長的路要走。
