AI 小模型戰升溫,Anthropic 推 Haiku 5.5,價格更低、Agent 能力卻更強?
大模型 LLMAI 生成

重點整理
- AI 小型模型的競爭,正從價格延伸到能承接多少實際工作。Anthropic 在美國時間 10/7 推出新 AI 模型 Claude Haiku 5.5,API 價格最高調降 90%,電腦操作測試表現更大幅超越前代,甚至領先 OpenAI GPT-6 Luna。隨著小型模型逐漸具備執行多步驟任務的能力,Haiku 5.5 究竟適合接手哪些工作?
- 電腦操作成功率躍升,小模型能做的事越來越多 Anthropic 將 Haiku 5.5 定位為適合大量、高頻且對成本敏感任務的小型模型。除了摘要、資料分類、資料庫查詢等工作,新模型的能力也進一步延伸至瀏覽器與電腦操作,能夠執行涉及多個步驟的工作。
- OSWorld 主要測試 AI Agent 能否實際操作電腦,完成需要多個步驟的任務。根據 Anthropic 公布的測試,Haiku 5.5 在 OSWorld 2.1 電腦操作評測的離線子集取得 72.4% 成功率,較前代 Haiku 4.5 的 15.7% 提升 56.7 個百分點,也超越 GPT-6 Luna 的 48.9%。
- 在衡量 AI 透過終端機執行複雜工作的 Terminal-Bench 4.0 測試中,Haiku 5.5 […]






