Capture record
- Canonical URI: https://www.bnext.com.tw/article/92356/anthropic-claude-opus-5-5-launch-cost-cut
- Source class: secondary synthesis。BusinessNext(李先泰,初稿 AI 編撰)整理 Anthropic 官方公告、Artificial Analysis X 貼文與評測報告、《Every》7 天實測、METR 評估摘要與台灣銀行牌告匯率;本輪直接讀取 BusinessNext canonical article、Anthropic 官方公告與 Artificial Analysis Claude Opus 5.5 model page,保留各來源 attribution,不把媒體整理或供應商宣稱升格為 AI Ark 的獨立結論,維持
status: draft。 - 原文標題: Anthropic推出Claude Opus 5.5!評測效能媲美Fable 5.1,運行成本大降40%成高CP值選項
- 作者/出版者: 李先泰/數位時代 BusinessNext
- 發布/修改時間: 2026-09-23T11:00:00+08:00(BusinessNext
NewsArticleJSON-LD,datePublished 與 dateModified 相同) - 擷取時間: 2026-09-23T05:03:24+00:00
- Retrieval method: 以 Python
urllib直接 HTTP GET 讀取 BusinessNext canonical article,再以 Pythonurllib直接 HTTP GET 讀取 Anthropic 官方公告與 Artificial Analysis Claude Opus 5.5 model page(web_extract後端本輪不可用,改走直接 HTTP)。全程未使用 browser;只保存本 wrapper、metadata、faithful summary、claim ledger、必要來源連結與 rights boundary,不保存文章、HTML、圖片或其他完整 payload。 - HTTP metadata: BusinessNext status
200、responseDate: Wed, 23 Sep 2026 05:03:24 GMT、response 416,632 bytes、JSON-LDdatePublished/dateModified為2026-09-23T11:00:00+08:00、articleBody3,356 字元。Anthropic 官方公告 status200(responseDate: Wed, 23 Sep 2026 05:04:08 GMT、619,938 bytes);Artificial Analysis model page status200(responseDate: Wed, 23 Sep 2026 05:04:45 GMT、3,824,302 bytes)。BusinessNext HTML payload SHA-256 為f5b5c11d9caa669ce8581fcbce257478a7af1971be9ca6d48db221de0d853259,僅供抓取 audit。 - Saved payloads and SHA-256: 無;未保存 BusinessNext HTML、Anthropic 完整公告、Artificial Analysis 完整頁面、圖片、影片或其他附件。
Faithful summary
BusinessNext 報導 Anthropic 於美國時間 2026-09-22(台灣時間 2026-09-23)發布 Claude Opus 5.5,是新一代 Claude 5.5 家族的第一款模型;官方表示其在多數工作上的表現已達更高階的 Claude Fable 5.1 水準,實際運行成本比前一代 Opus 5 少約 40%。文章整理的 API 單價為:input 由每百萬 token 5 美元降至 4 美元、output 由 25 美元降至 20 美元(各降 20%)、cache read 由 0.5 美元降至 0.2 美元(降 60%);官方另稱輸出生成速度快逾 30%,並同步調高 Pro/Max/Team/Enterprise 的 5 小時用量上限、發放一次可自訂時點的用量重置。12
Anthropic 官方公告直接支持上述定價表(含 cache write 由 6.25 美元降至 5 美元、fast mode 8/40 美元)、預設設定下典型工作負載成本較 Opus 5 低約 40%、以及「單價下降加上每任務 token 更少」的效率敘事;官方 benchmark 表列出 Terminal-Bench 4.0(xhigh effort)66.4%、FrontierCode v1.1 (Main) 54.4%、CursorBench 4.0 57.8%、GDPval-AA v2.1 1846、AutomationBench 40.0%(Zapier 執行)、Humanity’s Last Exam 67.7% (with tools)、Terminal-Bench-Science 0.1 58.7% 與 OSWorld 2.0 81.8% (partial),並明示 safeguard intervention 時資安任務由 Opus 4.8、生物與前沿 LLM 開發任務由 Opus 5 代為完成,可能拉低分數。官方另列早期測試案例:68 萬行程式碼遷移不到一天、20 萬行 codebase 審計修正不到 3 小時(Opus 5 超過 20 小時且 token 用量 2.5 倍)、HAProxy C→Rust 重寫 9.5 小時完成且成本較 Fable 5.1 低 51%。2
Artificial Analysis 的獨立測試方面,BusinessNext 報導 Opus 5.5 在綜合智力指數拿下 58 分登上榜首;本輪直接讀取的 Artificial Analysis model page(max with fallback)顯示 Intelligence Index 為 57.62、xhigh 55.99、high 53.58,且同頁比較資料中 Claude Fable 5.1 (max) 為 53.35、GPT-6 Astra (max) 為 52.67。BusinessNext 另轉述 Artificial Analysis X 貼文:Opus 5.5 在 Terminal-Bench 4.0 拿下 59.6%、與 GPT-6 Astra 打平,比 Opus 5 高 11 個百分點;AA-Briefcase v1.1 取得 1,822 Elo、比 Fable 5.1 高 143 分。該站同時指出在最高推理強度下 Opus 5.5 每任務平均產出約 11.9 萬 token(Opus 5 的 1.6 倍),每任務成本最後與 Opus 5 差不多,因此「省 40%」是否成立取決於推理強度設定。13
《Every》團隊的 7 天實測(Claude Code 與 Claude 桌面版)維持 first-hand case attribution:Cora 總經理 Kieran Klaassen 已把 Opus 5.5 換成日常主力、估計寫程式能力約為 Fable 5.1 的九成;設計師 Tyler Nishida 表示「這周我至少被驚豔了五、六次」;評測主管 Mike Taylor 的 10 分鐘流程表測試中模型先思考近 5 分鐘、時間到仍未交付;《Every》執行長 Dan Shipper 總結它是「小一號的 Fable」、更快更便宜,但知識工作與寫作他仍偏好 OpenAI 的模型。1
安全與治理方面:Anthropic 官方稱 Opus 5.5 在其自動化行為稽核(近 2,000 個情境)上取得迄今最佳表現、比 Opus 5 更抗 prompt injection,並因資安與生物能力接近 Mythos 5.1 而比照 Fable 5.1 加上防護——日常開發的找錯/修程式不受影響,多數資安任務自動改由 Opus 4.8 處理;經審核的學術實驗室、新創與藥廠可申請「生命科學驗證計畫」。METR 上線前測試認為其 AI 研發能力比 Fable 5.1 小幅進步、屬延續既有趨勢而非跳躍式提升。開發者須注意兩項變更:Opus 5.5 不能再關閉「思考」模式;2026-08-31 以後建立的 API 帳號會套用防止他人套取模型推理過程的新機制。Opus 5.5 已於 Claude 各平台及 AWS、Google Cloud、Microsoft Azure 上架,同家族的 Sonnet 5.5 與 Haiku 5.5 官方表示會在數周內推出。12
Claim ledger
| ID | Source claim | Status | Owning evidence and boundary |
|---|---|---|---|
| C01 | Anthropic 於 2026-09-22(美國時間)發布 Claude Opus 5.5,為 Claude 5.5 家族第一款模型。 | supported | Anthropic 官方公告與 BusinessNext JSON-LD 發布時間一致;本輪未操作產品或 API。 |
| C02 | Opus 5.5 API 價格為 input 4 美元、output 20 美元、cache read 0.2 美元(每百萬 token),較 Opus 5 的 5/25/0.5 美元分別降 20%/20%/60%。 | supported | Anthropic 官方公告定價表直接列示;實際帳單仍可能受 provider、方案或時間影響,未以 API request 核對。 |
| C03 | Opus 5.5 在預設設定下典型工作負載的執行成本比 Opus 5 低約 40%。 | supported(供應商估計) | Anthropic 官方公告直接列示;workload 組合、effort、retry 與工具使用未由本輪獨立重算,Artificial Analysis 最高推理強度下每任務成本與 Opus 5 相近的觀察顯示降幅取決於設定。 |
| C04 | Opus 5.5 輸出生成速度比 Opus 5 快逾 30%。 | supported(供應商宣稱) | Anthropic 官方公告直接列示;本輪未獨立測速,fast mode(2.5x、8/40 美元)為另一產品選項。 |
| C05 | Opus 5.5 在 Terminal-Bench 4.0 (xhigh) 66.4%、FrontierCode v1.1 54.4%、CursorBench 4.0 57.8%、GDPval-AA v2.1 1846、OSWorld 2.0 81.8% (partial)。 | supported(供應商自述) | Anthropic 官方公告 benchmark 表直接列示;評測環境、effort、safeguard intervention 與競品資料來源存在邊界,未獨立重跑。 |
| C06 | Artificial Analysis 綜合智力指數中 Opus 5.5 (max with fallback) 為 57.62、居榜首,高於 Fable 5.1 (max) 的 53.35 與 GPT-6 Astra (max) 的 52.67。 | supported(特定 composite) | Artificial Analysis model page 嵌入資料直接列示;BusinessNext 轉述「58 分」為四捨五入,且該站 X 貼文所述 Terminal-Bench 4.0 59.6% 與官方表 xhigh 66.4% 屬不同 effort/harness 設定,兩者不視為矛盾但不可混用。 |
| C07 | AA-Briefcase v1.1 中 Opus 5.5 取得 1,822 Elo、比 Fable 5.1 高 143 分。 | partially-supported | BusinessNext 轉述 Artificial Analysis;本輪讀取的 model page 未顯示該細項,保留 article attribution。 |
| C08 | 最高推理強度下 Opus 5.5 每任務平均產出約 11.9 萬 token(Opus 5 的 1.6 倍),每任務成本與 Opus 5 差不多。 | partially-supported | BusinessNext 轉述 Artificial Analysis;本輪未核對該站完整評測報告,保留 article attribution。 |
| C09 | 《Every》7 天實測:Klaassen 估計寫程式能力約為 Fable 5.1 九成、Nishida「被驚豔五、六次」、Mike Taylor 10 分鐘測試未交付流程表、Shipper 稱其為「小一號的 Fable」。 | observational | 《Every》團隊 first-hand case,經 BusinessNext 轉述;《Every》原文本輪未直接讀取,屬單一團隊短時程使用經驗,不外推為普遍生產力結論。 |
| C10 | Opus 5.5 資安與生物能力接近 Mythos 5.1,比照 Fable 5.1 加防護;多數資安任務自動改由 Opus 4.8 處理,經審核機構可申請生命科學驗證計畫。 | supported(供應商安全評估) | Anthropic 官方公告直接列置;這是部署與 safeguard 設計說法,不是獨立安全稽核或風險測量。 |
| C11 | METR 上線前測試認為 Opus 5.5 的 AI 研發能力比 Fable 5.1 小幅進步、屬延續趨勢而非跳躍式提升。 | partially-supported | BusinessNext 轉述 METR 評估摘要;METR 原始報告本輪未直接讀取,保留 attribution。 |
| C12 | Opus 5.5 不能再關閉「思考」模式;2026-08-31 以後建立的 API 帳號套用防止套取推理過程的新機制。 | supported(產品契約) | Anthropic 官方公告與 BusinessNext 一致列示;屬 API/產品行為變更,既有 harness 應重測,本輪未操作驗證。 |
| C13 | Opus 5.5 已於 Claude 各平台及 AWS、Google Cloud、Microsoft Azure 上架;Sonnet 5.5 與 Haiku 5.5 數周內推出。 | supported(供應商 rollout) | Anthropic 官方公告直接列示;本輪未逐一測試帳號、地區與實際可用性。 |
| C14 | 「Opus 5.5 效能媲美 Fable 5.1」可作為所有任務的普遍結論。 | unresolved | Anthropic 自己指出此能力水準下跑分差距已不太能反映實際使用差異,且內部使用中兩者差距比分數更小;不能由單一 composite 或標題推斷跨任務全面持平。 |
Evidence boundary
本記錄支持的最小結論是:Anthropic 已發布 Claude Opus 5.5(Claude 5.5 家族首款),API 單價較 Opus 5 降 20%、cache read 降 60%,官方估計預設設定下典型工作負載成本低約 40%;Artificial Analysis model page 顯示其 max with fallback Intelligence Index 為 57.62,高於 Fable 5.1 (max) 與 GPT-6 Astra (max);Anthropic 官方 benchmark 表列出多項 agentic coding、knowledge work 與 computer use 分數,且 safeguard intervention 會把部分資安/生物任務轉由舊模型完成。23
本記錄不能證明:Opus 5.5 在所有任務都與 Fable 5.1 持平或更便宜;40% 成本降幅在任意 effort、workload 或推理強度設定下成立(Artificial Analysis 最高推理強度下每任務成本與 Opus 5 相近);《Every》單一團隊的實測可外推為普遍生產力結論;或 METR/Anthropic 的安全評估等同獨立風險驗證。
Sources skipped or not directly read
- 《Every》7 天實測原文:BusinessNext 列為資料來源,本輪未直接讀取;維持 BusinessNext attribution(C09)。
- METR 評估摘要原始報告:BusinessNext 列為資料來源,本輪未直接讀取;維持 attribution(C11)。
- Artificial Analysis X 貼文原文與完整評測報告:BusinessNext 轉述其 Terminal-Bench 4.0 59.6%、AA-Briefcase v1.1 1,822 Elo 與最高推理強度 token 統計;本輪只讀取 model page,細項維持 article attribution(C07、C08)。
- Opus 5.5 System Card:Anthropic 公告提及完整評估細節在 system card,本輪未讀取。
- Claude API 實際 request/帳單與產品操作:本輪未操作,無法驗證帳號、地區、限額與 rollout 細節。
Rights boundary
BusinessNext、Anthropic 與 Artificial Analysis 內容均受版權或網站條款保護。本次僅保存 metadata、繁中 faithful summary、claim ledger、證據界線與來源連結;未保存完整 HTML、完整公告、完整評測頁、圖片、影片或其他完整 payload。Canonical links 保留作後續查核入口,來源 ingest 不等於取得重製授權。
Footnotes
-
BusinessNext 92356 — Anthropic推出Claude Opus 5.5!評測效能媲美Fable 5.1,運行成本大降40%成高CP值選項(數位時代 BusinessNext,李先泰,2026-09-23)。 ↩ ↩2 ↩3 ↩4
-
Anthropic — Introducing Claude Opus 5.5(2026-09-22)。 ↩ ↩2 ↩3 ↩4
-
Artificial Analysis — Claude Opus 5.5 (max with fallback) - Intelligence, Performance & Price Analysis(2026-09,retrieved 2026-09-23)。 ↩ ↩2