隨着AI技術在企業中的普及,高昂的Token費用讓不少用戶大呼吃不消。爲了幫企業打破“越用越貴”的困境,AI服務商Writer於本週四正式推出了全新旗艦模型 Palmyra X6,並對底層的智能代理運行程序(harness)進行了重大升級。

據悉,Palmyra X6 建立在 Z.ai 開源模型 GLM-5.2 的後訓練變體基礎之上。結合全新的運行框架優化,該系統能夠針對基礎任務將客戶成本大幅削減高達 50%。企業首席執行官 May Habib 表示,當前的行業現狀讓許多 CIO 感到厭倦,企業需要的不是盲目追逐下一個跑分天花板,而是真正可控的成本。

除了推出新模型,運行程序的架構優化也成爲了此次升級的核心亮點。該公司近期發佈的一項研究表明,相比單純挑選不同的大模型,微調運行效率往往是更可靠的降本途徑,其測試顯示相關成本平均下降了 40%。運行框架作爲底層組件,能夠成倍提升組織內部運行所有模型的效率。

目前,Palmyra X6 已經向企業客戶全面開放。用戶可以將其與現有工具結合使用,或者通過雲平臺進行調用。業內人士認爲,這一動作折射出當前市場環境的變化:在AI部署成本不斷飆升的背景下,如何通過技術手段遏制支出,正成爲各大企業當下的首要考量。