Claude Sonnet 5.5 登場:用一半價格,拿到接近 Opus 5.5 的表現

Claude Sonnet 5.5 登場:用一半價格,拿到接近 Opus 5.5 的表現

企業常用 Sonnet 處理量大的日常工作,遇到吃重的任務才改用 Opus。Anthropic 於 2026 年 9 月 28 日發表 Claude Sonnet 5.5,牌價與 Sonnet 5 一樣,知識工作評測只比 Opus 5.5 少 2 分。

30 秒看結論

  • 使用 Sonnet 5:可以優先改用 Sonnet 5.5。牌價不變,官方測得每件工作的成本最多少 30%
  • 使用 Opus 5.5:修 bug、整理文件與簡報這類範圍明確的工作,可以改用 Sonnet 5.5,牌價只有一半;需要長時間判斷的複雜工作,繼續留在 Opus 5.5
  • API 串接的系統:切換前檢查三類相容性變更,並重新測試推理強度設定
  • 在台灣導入:Claude API 與 AWS、Google Cloud、Azure 都能使用;雲端帳務與企業版採購,可由勤英科技協助

Claude Sonnet 5.5 升級了什麼?

Claude Sonnet 5.5 是 Anthropic 於 2026 年 9 月 28 日發表的新一代 Sonnet 模型,接替 6 月底推出的 Claude Sonnet 5。它是 Claude 5.5 系列的第二款,API 模型代號為 claude-sonnet-5-5。官方表示 Haiku 5.5 會在接下來幾週推出。

官方把它定位成 Claude Opus 5.5 的搭檔:Opus 5.5 處理需要仔細判斷的複雜工作,Sonnet 5.5 擅長範圍明確的日常工作,例如修 bug,以及製作文件、簡報與試算表。

簡報與客服工作的實測表現

官方的一項內部測試,交給它一家上市公司的季報資料、法說會逐字稿與簡報範本,要求做出 10 頁的營運檢討簡報,兩位專家都判斷初稿可以直接寄出。早期測試者 Zendesk 則用數百個真實客服案例測試,工單處理速度快了 20%。

Claude Sonnet 5.5 以一半價格交出接近 Opus 5.5 成果的示意

輸出快三成,完成同樣工作用的 token 更少

Sonnet 5.5 的輸出速度比 Sonnet 5 快三成以上,是目前最快的 Sonnet 模型。早期測試者也發現它完成同一件工作的步驟更少,例如 Slack 在不改提示的情況下,輸出的 token 少了約 14%。

Sonnet 5.5 跟 Sonnet 5、Opus 5.5 差在哪?

官方對照表共列出八項評測。下表挑出與企業工作最相關的五項:

評測項目 Sonnet 5.5 Sonnet 5 Opus 5.5
Terminal-Bench 4.0(終端機程式代理) 70.6% 10.3% 66.4%
CursorBench 4.0(程式代理) 55.5% 34.1% 57.8%
GDPval-AA v2.1(知識工作,Elo 分數) 1844 1449 1846
OSWorld 2.1(電腦操作,部分給分) 80.1% 57.0% 81.8%
Humanity’s Last Exam(跨領域推理,可用工具) 64.5% 54.9% 67.7%

官方發表文裡的完整對照表如下:

Anthropic 官方公布的 Claude Sonnet 5.5 評測對照表
圖:Anthropic 官方發表文的評測對照表,2026 年 9 月 29 日查閱。Opus 5.5 的 Terminal-Bench 4.0 分數取該模型的最高分(推理強度 xhigh)。

多數項目逼近 Opus 5.5,只有一項超過

與 Sonnet 5 相比,五項全部大幅進步。與 Opus 5.5 相比,只有終端機程式代理高出 4.2%,其餘四項都略低,知識工作只差 2 分。

官方也提醒,評測分數只反映模型能力的一部分。在 Anthropic 與外部測試者的實際使用中,需要持續判斷的複雜、開放式工作,Opus 5.5 仍明顯較強。

Sonnet 5.5 的價格有變嗎?

牌價與 Sonnet 5 相同

以下為每百萬 token 的牌價。token 是模型計費的單位,大致對應文字切分後的片段。

項目 Sonnet 5.5 Sonnet 5 Opus 5.5
輸入 $2 $2 $4
輸出 $10 $10 $20
快取讀取 $0.20 $0.20 $0.20
快取寫入(5 分鐘) $2.50 $2.50 $5

Sonnet 5 發表時的 $2/$10 原本是限時早鳥價,Anthropic 之後宣布永久維持,Sonnet 5.5 沿用同樣的價格。批次處理同樣是五折。

省的是 token:每件工作最多少 30%

牌價沒變,成本下降來自用量。官方指出,Sonnet 5.5 完成同樣的工作通常需要少很多的 token,每件工作的成本最多比 Sonnet 5 少 30%。

評測中的差距更大:它用低或中等推理強度就超過 Sonnet 5 的最佳分數,每件成本約為十分之一,但這是評測條件下的比較,一般工作不一定省到這個幅度。

推理強度的預設值不同,要重新測試

推理強度決定模型思考多久:調高品質通常較好,每件工作的成本也較高。Sonnet 5.5 在 Claude API 預設為 high,在 Claude 應用程式與 Claude Code 預設為 medium。

官方建議不要直接沿用 Sonnet 5 的設定,起點可以這樣抓:

  • 一般工作先從 high 開始
  • 範圍明確的程式代理與多步驟工具任務,從 medium 開始,較難的再調高
  • 聊天這類重視回應速度的工作,從 medium 或 low 開始

要用 Sonnet 5.5 還是 Opus 5.5?

使用 Sonnet 5 的企業可以優先改用

價格相同,速度與分數都更高,Sonnet 5.5 是 Sonnet 5 用戶最直接的升級。Sonnet 5 目前仍可使用,官方承諾不早於 2027 年 6 月 30 日退役。

使用 Claude 應用程式的團隊改用門檻最低;透過 API 串接的系統,則要先完成相容性檢查,再切換正式流量。

日常工作交給 Sonnet 5.5,複雜判斷留給 Opus 5.5

Sonnet 5.5 的牌價是 Opus 5.5 的一半。官方的成本比較顯示,推理強度調低時,Sonnet 5.5 最划算;推理強度調高後,兩者的表現與每件成本都接近,這時選複雜工作較強的 Opus 5.5 較合理。所以從 Opus 5.5 移過來的工作,先用較低的推理強度測試品質是否足夠。

實務上可以這樣分工:

  • 改用 Sonnet 5.5:修 bug、客服回覆、整理文件與簡報這類範圍明確、量大的工作
  • 留在 Opus 5.5:需求模糊、要長時間自行判斷的任務,或本來就要把推理強度調到最高的工作

還分不清工作屬於哪一類時,官方模型總覽頁的建議是先從 Opus 5.5 開始,再挑出範圍明確的工作改用 Sonnet 5.5,比較品質與成本。拿自家工作比較每件成本的做法,可參考AI 模型怎麼選?排行榜與牌價之外,先量每件任務的成本。

在台灣可以從哪些管道使用 Sonnet 5.5?

Sonnet 5.5 已在各個管道上線,企業可以沿用目前的採購方式:

  • Claude 應用程式與 Claude Code:已可使用。方案差異可參考Claude 方案完整比較
  • Claude API:模型代號 claude-sonnet-5-5,以美元計價,一般帳戶以信用卡付款。台灣公司常遇到的統編、發票與信用卡問題,整理在台灣公司怎麼買 Claude API
  • 雲端平台:Amazon Bedrock、Google Cloud 與 Microsoft Foundry(Azure)都已提供,費用併入各雲端平台的帳單
  • MixRoute:勤英科技自行開發的 AI 閘道,已提供 Sonnet 5.5;同一組 API key 也能呼叫 Opus 5.5 與其他廠商的模型,方便用同一批工作比較兩者的品質與成本,費用照原廠牌價計算

已經在使用 AWS 或 Google Cloud 的企業,選擇雲端平台通常最容易納入既有的採購與帳務流程。勤英科技作為 AWS 與 Google Cloud 的雲端代理商,透過 AI 服務 協助企業評估 Sonnet 5.5 在 Bedrock 或 Google Cloud 上的部署與區域設定,雲端費用也可由勤英以台幣計費、開立統一發票。

需要 Claude 企業版的公司,勤英科技也提供 Claude Enterprise 的 AWS Marketplace 採購整合、台幣三聯式發票與 SSO 帳號設定協助。

換之前要確認哪些事?

Sonnet 5.5 API 串接的三個相容性提醒

只把模型代號改成 claude-sonnet-5-5,原本的程式仍可能出現錯誤或流程失效,需要先確認以下三項:

  1. 關閉思考的請求會回傳 400 錯誤。 Sonnet 5 關閉思考的寫法不能再用,要改成 Sonnet 5.5 新增的最低思考設定;這個設定只能搭配 high 以下的推理強度
  2. 強制指定工具會回傳 400 錯誤。 不能再要求模型在特定回合一定使用某個工具,官方建議改由模型自行判斷是否呼叫,並在提示中寫明何時使用
  3. 思考內容會綁定模型、對話與帳號。 對話中途換到 Opus 5.5 等其他模型時,先前的推理內容不會帶過去;程式若會回頭修改先前的對話內容,2026 年 8 月 31 日之後建立的帳號,請求會被拒絕

這三項之外,官方遷移指南另列有電腦操作工具等較少用到的變更,有用到的團隊再逐項核對。

資安防護首次套用在 Sonnet

Sonnet 5.5 的資安能力與上一代 Opus 5 相當,因此是第一個套用與最高階模型相近資安防護的 Sonnet 模型。一般的找 bug、修 bug 不受影響;高風險的資安請求會改由 Sonnet 5 處理。

透過 API 呼叫時,被攔下的請求預設直接回傳拒答,要自行設定備援,才會改由 Sonnet 5 回答。生物相關的防護與 Sonnet 5 相同,部分微生物與病毒學請求可能被誤判。

從事資安服務或生技研發的企業,導入前要先確認這些防護是否影響主要用途。

結論

Sonnet 5.5 可以接替 Sonnet 5,也能分擔一部分原本交給 Opus 5.5 的日常工作,導入時主要的工作量在 API 相容性檢查與推理強度重新測試。

使用 Sonnet 5 的企業可以直接規劃切換,使用 Opus 5.5 的企業先挑範圍明確的工作試用;需要透過雲端平台或企業版導入時,勤英科技可以協助評估部署與帳務。

資料來源

Anthropic Claude Sonnet