Capture record
- Canonical URI: https://www.bnext.com.tw/article/92405/claude-sonnet-5-5-features-price-performance
- Source class: secondary synthesis。BusinessNext(林美欣)整理 Anthropic Claude Sonnet 5.5 的官方發布頁與模型文件;本輪直接讀取 BusinessNext、Anthropic 官方發布頁與 Claude Platform 模型頁,保留供應商、文件與媒體 attribution,不把來源主張升格為 AI Ark 的獨立結論,維持
status: draft。 - 原文標題: Claude Sonnet 5.5有多強?程式功力大升級、文件、簡報製作也更成熟了
- 作者/出版者: 林美欣/數位時代 BusinessNext
- 發布/修改時間: 2026-09-29T11:33:00+08:00(BusinessNext
NewsArticleJSON-LD,datePublished 與 dateModified 相同) - 擷取時間: 2026-09-29T04:44:55+00:00
- Retrieval method: 先以
web_extract讀取 BusinessNext、Anthropic 官方發布頁與 Claude Platform 模型頁,再以 Pythonurllib直接 HTTP GET 核對 canonical URL、JSON-LD metadata 與 HTTP response。全程未使用 browser;只保存本 wrapper、metadata、faithful summary、claim ledger、證據界線、必要來源連結與 rights boundary,不保存文章、HTML、圖片、benchmark payload 或其他完整外部內容。 - HTTP metadata: BusinessNext status
200、Content-Type: text/html; charset=UTF-8、responseDate: Tue, 29 Sep 2026 04:42:34 GMT、response 372,527 bytes、JSON-LDdatePublished/dateModified為2026-09-29T11:33:00+08:00;BusinessNext HTML payload SHA-256 為cfe8eb5c47a267bf7a798ca2c50e37793c4c1c592b96bdcf8e1e2ef49c3de673,僅供抓取 audit。Anthropic 官方發布頁 status200、responseDate: Tue, 29 Sep 2026 04:42:54 GMT、response 430,222 bytes、HTML payload SHA-2568ecb067c3ad984c65e7bd76d718fa02bf7e8e9e56619a863f9071a600cded366。Claude Platform 模型頁 status200、responseDate: Tue, 29 Sep 2026 04:43:21 GMT、response 433,034 bytes、HTML payload SHA-2560331e1397c4d42d93ed69e8f5cc0a1168e11e561308bbfd2843575c0a2f113ff。 - Saved payloads and SHA-256: 無;未保存 BusinessNext HTML、Anthropic 發布頁或模型文件全文、圖片、影片、benchmark payload、模型權重、API response 或其他附件。
Faithful summary
BusinessNext 報導 Anthropic 於 2026-09-28 推出 Claude Sonnet 5.5,定位為 Claude 5.5 家族中介於旗艦級 Opus 5.5 與即將推出的 Haiku 5.5 之間的模型。Anthropic 官方發布頁宣稱,Sonnet 5.5 比 Sonnet 5 快逾 30%,多數工作成本最多低 30%,並鎖定修正程式錯誤、日常文件、簡報與試算表等範圍明確的任務。12
文章把程式能力列為主要升級:Anthropic 公布的 Terminal-Bench 4.0 分數為 Sonnet 5.5 70.6%、Sonnet 5 10.3%、Opus 5.5 66.4%;CursorBench 4.0 為 55.5%、34.1%、57.8%;GDPval-AA v2.1 為 1,844、1,449、1,846;OSWorld 2.1 為 80.1%、57.0%、81.8%(部分測試)。官方表格同時提醒不同模型的 effort/測試條件可能不同,且 Opus 5.5 的 Terminal-Bench 數字使用 Xhigh effort。12
Anthropic 官方進一步描述 Sonnet 5.5 會更快理解大型 codebase、較常合併執行工具呼叫,以較少步驟與 token 完成工作;BusinessNext 另整理其在文件、圖表辨識、電腦操作與依範本製作簡報方面的能力。文章引用一個上市公司季度財報、法說會逐字稿與簡報範本的內部測試:兩名專家評估 Sonnet 5.5 產出的 10 頁營運回顧第一版達到可直接寄出的水準。這是供應商案例,不是獨立或跨組織效果驗證。12
定價方面,Sonnet 5.5 與 Sonnet 5 的 API 單價相同:每百萬 input token 2 美元、output token 10 美元、cache write 2.5 美元、cache read 0.2 美元。官方的「單次任務最多降低 30%」說法來自較少 token 使用,而不是每 token 單價下調;實際任務成本仍會受 prompt、effort、工具回合、重試與輸出長度影響。123
Claude Platform 模型頁列示 Claude Sonnet 5.5 的 model ID 為 claude-sonnet-5-5、context window 為 1M tokens、同步 Messages API max output 為 128K tokens、input/output base pricing 為 10 per MTok,並支援 adaptive thinking 與文字/圖片輸入。該頁也列出部分從 Sonnet 5 遷移時的行為變更;本輪未操作 API、帳號或各雲端平台 rollout。3
Claude 5.5 家族分工在文章中被整理為:Opus 處理複雜且需要策略判斷的工作,Sonnet 處理日常程式與文件製作,Haiku 鎖定大量、即時且重視成本的應用。BusinessNext 稱 Sonnet 5.5 已在 Claude 各平台、AWS、Google Cloud 與 Microsoft Azure 上線;官方發布頁亦列出這些入口,但本輪未逐一登入、呼叫或核對帳號/地區可用性。12
Claim ledger
| ID | Source claim | Status | Owning evidence and boundary |
|---|---|---|---|
| C01 | Anthropic 於 2026-09-28 發布 Claude Sonnet 5.5,為 Claude 5.5 家族第二款模型。 | supported | Anthropic 官方發布頁與 BusinessNext JSON-LD/正文一致;只代表發布事件,不代表 AI Ark 已操作產品。 |
| C02 | Sonnet 5.5 輸出速度比 Sonnet 5 快逾 30%,單次任務成本最多低 30%。 | supported(供應商宣稱) | Anthropic 官方發布頁直接列示;未獨立測速、重跑 workload 或重算 task cost。 |
| C03 | Terminal-Bench 4.0、CursorBench 4.0、GDPval-AA v2.1 與 OSWorld 2.1 的表格分數如文中所列。 | supported(供應商自述) | Anthropic 官方 benchmark 表直接列示;effort、harness、partial result 與測試條件不完全同質,未獨立重跑。 |
| C04 | Sonnet 5.5 的 API 單價為 input 10、cache write 0.2(每百萬 token)。 | supported(官方定價) | Anthropic 官方發布頁與模型文件列示;provider、方案、區域與時間可能影響實際帳單,本輪未送出 API request。 |
| C05 | Sonnet 5.5 的 context window 為 1M tokens、max output 為 128K、model ID 為 claude-sonnet-5-5,並支援文字/圖片輸入。 | supported(產品文件) | Claude Platform 模型頁直接列示;本輪未在 Claude API、AWS、Google Cloud 或 Microsoft Azure 實際呼叫。 |
| C06 | Sonnet 5.5 會更常合併工具呼叫、以較少步驟/token 完成任務。 | partially-supported(供應商/早期測試者說法) | Anthropic 發布頁與 BusinessNext 直接轉述;未做同 prompt、同 harness、同 effort 的獨立比較。 |
| C07 | 以公開公司財報、法說會逐字稿與簡報範本生成 10 頁營運回顧,兩名專家認為第一版可直接寄出。 | observational | Anthropic 官方案例經 BusinessNext 轉述;樣本、評分 rubric、專家背景與重現流程未公開完整,不能外推一般知識工作品質。 |
| C08 | Sonnet 5.5 已在 Claude、AWS、Google Cloud 與 Microsoft Azure 上線。 | supported(供應商 rollout) | Anthropic 官方發布頁與 BusinessNext 直接列示;帳號、地區、方案與實際可用性未逐一核對。 |
| C09 | Sonnet 5.5 在所有任務上都等同或優於 Opus 5.5,且任務成本普遍固定低 30%。 | unresolved | 已讀來源只支持特定 benchmark、供應商 workload estimate 與特定案例;不能推導跨任務、跨 effort 或跨 harness 的普遍結論。 |
Evidence boundary
本記錄支持的最小結論是:Anthropic 已發布 Claude Sonnet 5.5,官方主張其相較 Sonnet 5 輸出更快、同任務 token 使用更少,並以特定 benchmark、API 價格與產品文件說明其 coding、knowledge work、computer use 與長 context 定位。BusinessNext 是 secondary synthesis,將官方數字與一個兩名專家的內部案例整理成繁中報導;這些內容仍保留為供應商、文件或媒體層級證據。123
本記錄不能證明:30% 速度或成本差異在任意 workload、模型設定、工具回合與 provider 上都成立;Sonnet 5.5 在所有任務都接近或超越 Opus 5.5;兩名專家的簡報評估可外推為一般企業知識工作品質;或各平台 rollout 已對所有帳號、地區與方案可用。沒有獨立 benchmark 重跑、API 實際 request、產品操作或 human verification,未加入 verified。
Sources skipped or not directly read
- Anthropic Sonnet 5.5 System Card:官方發布頁提供連結,本輪未直接讀取完整 System Card;安全、alignment 與詳細評估不作本筆 owning evidence。
- Anthropic migration guide:本輪知道官方模型頁列有遷移變更,但未把每一項 breaking change 納入本筆主要結論,也未做程式遷移測試。
- Terminal-Bench、CursorBench、GDPval-AA、OSWorld 的完整 protocol、原始資料、harness、評測 payload 與獨立重現:未直接讀取或執行。
- Claude、AWS、Google Cloud、Microsoft Azure 實際帳號/API/console:未登入、未操作,無法確認不同地區、方案與 rollout 狀態。
Rights boundary
BusinessNext 與 Anthropic 內容均受版權或網站條款保護。本次僅保存 metadata、繁中 faithful summary、claim ledger、證據界線與來源連結;未保存完整 HTML、完整發布頁、模型文件全文、圖片、影片、benchmark payload、模型權重或 API response。Canonical links 保留作後續查核入口,來源 ingest 不等於取得重製或再發布授權。