人工智慧公司 Anthropic 在 7 日推出新一代輕量級語言模型 Claude Haiku 5.5,主打低成本與高速反應,鎖定需要大量重複運算的工作場景。官方形容這是歷來速度最快、能力最強的 Haiku 系列模型,整體平均執行成本比前代降低約七成五。
Haiku 是 Anthropic 產品線中定位最輕量的模型家族,常見用途包括文件摘要、資料分類、資料庫查詢,以及即時客服對話。它也可以搭配體積較大的 Sonnet 與 Opus 模型,擔任程式開發代理人的子代理人,負責處理範圍較小的子任務;涉及複雜推理與多步驟開發的場景,仍由 Sonnet 與 Opus 負責。
這次更新最受注目的變化是價格。提示詞在十萬 Token 以內的請求,每百萬輸入 Token 收費零點一美元,輸出 Token 收費零點五美元,相較前代降低九成。超過十萬 Token 的請求,輸入與輸出則分別收費零點五美元與二點五美元,降幅五成。
官方表示,前代 Haiku 約九成的請求都落在十萬 Token 以內,把新版 Token 使用量的變化納入計算後,整體平均成本大約降低七成五。
開發者 Simon Willison 的實測則提醒,帳面降幅未必完全反映實際支出。Haiku 5.5 在十萬 Token 以內的定價,與 OpenAI 的 GPT-6 Luna 相同,但提示詞超過十萬 Token 後,費率立刻提高到五倍,而 Luna 要到二十七點二萬 Token 才適用較高費率。
他也發現,同樣一段長提示詞在 Haiku 5.5 消耗的 Token 量,大約比前代增加兩成五,換算下來實際省到的錢,可能不如定價降幅看起來那麼多。
效能方面,Haiku 5.5 在電腦操作評測 OSWorld 2.1 拿下七成二點四的成績,遠高於前代的一成五點七。在知識工作評測 GDPval-AA v2.1 中,分數也從七百三十五提高到一千六百二十。
這也是 Haiku 系列首款支援推理強度控制的模型,提供 Low、Medium、High、Xhigh、Max 等設定,讓開發者依照任務需求,在運算投入與成本之間自行調配。
Anthropic 同步把 Sonnet 5.5 的快取讀取價格減半,預估可讓代理人工作成本降低約兩成。
官方也宣布,向 Claude Max 與 Team 訂閱用戶提供每月一百至五百美元不等的 API 額度,鼓勵開發者打造更多應用程式與 AI 代理人。
Haiku 5.5 目前已經透過自家 Claude Platform 上線,同時也登上 AWS、Google Cloud 與 Microsoft Azure 等雲端平台。
從價格策略來看,Anthropic 顯然想把輕量級模型打造成開發者的日常主力,尤其瞄準代理人架構中高頻、低單價的子任務市場。價格戰的下一個戰場,恐怕就在十萬 Token 之後的費率設計。