2026 年 7 月 24 日,Anthropic 發布了 Claude Opus 5,定位為旗艦中的旗艦:最強推理、最強長文處理、最強多步驟 agentic 任務執行。這是自 Opus 4.8 以來最重大的旗艦升級。
但發布後兩週,Hacker News 出現了一則標題叫做 「Why does Opus 5 feel worse to work with?」 的討論,短短幾小時累積 803 個 upvotes,成為當天前三熱門。這不是一般的「新模型懷疑論」——留言中充滿了資深開發者、研究人員、甚至 Anthropic 早期用戶的具體案例:
這篇文章就是要告訴你:Opus 5 到底真的變差了嗎,還是你用錯了場景?
Opus 5 的 Adaptive Thinking 機制在簡單問題上會「保守地快答」,讓部分用戶感覺它不如 Opus 4.8 深入。但這不是退化——這是設計上的節省。真正展現 Opus 5 實力需要複雜、多步驟、長上下文的任務。日常短對話用 Sonnet 5 本來就更划算。
這是 Opus 5 最被誤解的功能。Adaptive Thinking 不是「更慢才更好」,而是根據任務難度自動決定要花多少「思考 token」:
HN 爭議的根源在此:很多人用 Opus 5 回答簡單問題,它「自動縮水」了——但這其實是省你的錢,不是退化。
這是 Opus 5 相比 Sonnet 5 最重大的企業級差異。啟用 Zero Data Retention 後:
這對醫療、法律、金融、政府合規場景不是「加分項」,而是進入門檻。如果你的公司需要處理病歷、法律文件或金融交易,Opus 5 幾乎是唯一選擇。
Opus 5 的知識截止(knowledge cutoff)為 2026 年 5 月,比 Sonnet 5 的 2026 年 3 月更新兩個月。雖然聽起來差距不大,但對於需要引用最新 AI 模型規格(例如 DeepSeek V4、Wan 3.0)或最新法規的場景,這兩個月可能差距明顯。
長上下文視窗維持在 200K tokens,與 Sonnet 5 相同,但 Opus 5 在長文本中的資訊保真度(减少「middle-of-context」遺忘)優於 Sonnet 5,這在百頁合約審查或超長程式碼庫分析中有實際差異。
| 功能 | Opus 5 | Opus 4.8 | Sonnet 5 | GPT-5.4 |
|---|---|---|---|---|
| 輸入定價 /MTok | $10 | $15 | $3 | $10(估) |
| 輸出定價 /MTok | $30 | $75 | $15 | $30(估) |
| Adaptive Thinking | ✅ 預設 | ❌ | 部分 | ❌ |
| Zero Data Retention | ✅ 預設 | 需申請 | ❌ | ❌(需 Enterprise) |
| 知識截止 | 2026-05 | 2025-10 | 2026-03 | 2026-04(估) |
| 上下文視窗 | 200K | 200K | 200K | 128K |
| Agentic 任務 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 速度 | 中等 | 慢 | 快 | 中等 |
| 最適合場景 | 科研 / 法律 / 醫療 | 重推理任務 | 日常開發 / 寫作 | 廣泛通用 |
1. 醫療 AI 應用開發者
Zero Data Retention + HIPAA 合規 + 200K 上下文(足以容納完整病歷)。如果你在開發 AI 輔助診斷或病歷分析工具,Opus 5 是目前 API 市場裡合規成本最低的旗艦選擇。
2. 法律科技(Legal Tech)
百頁合約審查、條款對比、法律摘要。Opus 5 的長上下文保真度 + Zero Data Retention 讓它在律所與合規團隊中快速獲得採用。
3. 學術研究 / 科研寫作
Adaptive Thinking 在長篇學術分析任務中會完整觸發深度思考模式。2026 年 5 月的知識截止讓它能引用最新 AI 研究成果。實際測試顯示,Opus 5 在文獻整合與假說生成的品質明顯優於 Sonnet 5。
4. 複雜 Multi-Agent 系統的 Orchestrator
在 Claude Code / n8n / LangGraph 等 agentic 系統中,Opus 5 最適合做「主腦」——負責任務分解、子任務協調、結果整合,而把執行層任務交給更便宜的 Sonnet 5 或 Haiku。
1. 日常程式碼補全 / 問答
Sonnet 5 的速度更快、價格便宜 3.3x,對 80% 的日常開發任務品質差異不顯著。Adaptive Thinking 在簡單任務上不會全力運作,你花了旗艦價格卻得到標準答覆。
2. 高頻 API 呼叫(>100萬 tokens/天)
$10/$30 在大量呼叫下成本快速累積。除非你的場景明確需要 Zero Data Retention 或超複雜推理,否則先用 Sonnet 5 跑量,再把特定任務 route 到 Opus 5。
3. 即時對話應用(Chat UI)
延遲比 Sonnet 5 略高,且在對話中 Adaptive Thinking 的優勢難以充分展現。Claude.ai 應用本身也不以 Opus 5 為預設,這是有原因的。
這是本評測最值得深挖的部分。HN 帖子「Why does Opus 5 feel worse to work with?」在 2026 年 8 月中獲得 803 upvotes,可以說是近期 AI 社群最有共鳴的爭議之一。
分析留言後,「感覺更差」主要來自三類用戶:
Opus 4.8 以「極盡所能地回答每一個問題」聞名。不管你問多簡單,它都會深思熟慮地給出詳盡回答。Opus 5 的 Adaptive Thinking 會在判斷「這是簡單問題」後給出更精簡的答覆——這讓習慣 Opus 4.8 風格的用戶感到落差。
解法: 在 system prompt 明確要求深度分析:For every response, provide comprehensive analysis with multiple perspectives.
Claude.ai 的 Opus 5 模式會在背景進行更多安全與適當性判斷,這有時讓它在邊緣問題上更謹慎。API 直接呼叫 claude-opus-5-20260724 的體驗通常更一致、更直接。
誠實說,Opus 5 在某些特定類型的創意寫作(尤其是需要「角色入戲」的長篇小說創作)確實比 Opus 4.8 更「正確」,因此有些用戶認為創意表現退步。這是真實的取捨——Anthropic 在安全性與創意開放度之間選擇了前者。
我們在 Claude Code 中以 Opus 5 作為 orchestrator 執行了幾個測試任務:
任務:為一個 15,000 行的 Node.js monorepo 提供完整的微服務拆分計畫,包含依賴分析、風險評估、遷移路線圖。
Opus 5 表現: 識別了 23 個可拆分模組,提供了三階段遷移計畫,風險評估涵蓋資料庫鎖定風險與 API 版本相容性。整體品質明顯優於 Sonnet 5 的同樣任務輸出(後者遺漏了 4 個跨模組依賴)。
任務:審查一份 80 頁的 SaaS 服務條款,標記所有資料隱私相關條款,並與 GDPR 要求對照。
Opus 5 表現: 零資料保留下完整處理 200K token 文件,識別了 12 個潛在 GDPR 衝突點,每個都附有具體法條引用(Art. 6(1)(b)、Art. 17 等)。這個任務在 Zero Data Retention 模式下 Sonnet 5 無法完成。
任務:「Python 的 list comprehension 怎麼用?」
Opus 5 表現: 給了正確但精簡的答案,沒有 Opus 4.8 那種詳盡的附加說明。這就是 Adaptive Thinking 的「節省模式」——也是很多用戶覺得「感覺變差」的原因。
從 Claude API 整合到機器學習實作,DataCamp 有超過 500 門課程,支援 Python / R / SQL。現在加入可試用免費課程,強化你的 AI 工程師技能。
立即免費試用 DataCamp →Opus 5 的定價 $10/$30(輸入/輸出)看起來昂貴,但有幾個省錢策略:
在 multi-agent 系統中,讓 Opus 5 負責初始任務分解和最終結果審查(少量 token),將大量執行任務(程式碼生成、文件撰寫)交給 Sonnet 5。這個組合在實測中可以降低 40-60% 的 API 成本,同時保持旗艦級品質。
不緊急的任務使用 Anthropic 的 Batch API,通常有 50% 折扣,Opus 5 的批次處理價格降至 $5/$15,與 Sonnet 5 即時價格相近。
如果你的應用服務醫療、法律、金融客戶,Zero Data Retention 讓你免去了建立獨立合規架構的成本——這個成本通常遠超 Opus 5 和 Sonnet 5 的定價差異。換句話說,合規場景的 Opus 5 反而更便宜。
DigitalOcean Droplets 從 $6/月起,支援 Node.js / Python / Docker,適合快速部署 Anthropic API 整合應用。台灣使用者可選 Singapore 機房(延遲 <30ms),新用戶享 $200 試用點數。
免費獲得 $200 DigitalOcean 點數 →以下是在 Claude Code 或 API 中使用 Opus 5 的基本設定:
import anthropic
client = anthropic.Anthropic()
# 使用 Opus 5 進行複雜推理任務
message = client.messages.create(
model="claude-opus-5-20260724",
max_tokens=4096,
system="You are an expert legal analyst. Provide comprehensive analysis.",
messages=[
{
"role": "user",
"content": "審查以下合約條款的 GDPR 合規性..."
}
]
)
print(message.content[0].text)
在 .claude/config.json 中設定:
{
"model": "claude-opus-5-20260724",
"fallback_model": "claude-sonnet-5-20260601",
"routing": {
"complex_tasks": "claude-opus-5-20260724",
"simple_tasks": "claude-sonnet-5-20260601"
}
}
或在啟動時指定:
claude --model claude-opus-5-20260724
最有效的使用方式是讓 Opus 5 負責高層任務規劃,Sonnet 5 或 Haiku 負責執行:
# Orchestrator(Opus 5)
orchestrator = client.messages.create(
model="claude-opus-5-20260724",
messages=[{"role": "user", "content": f"Decompose this complex task: {task}"}]
)
# Worker(Sonnet 5,成本較低)
for subtask in parse_subtasks(orchestrator.content):
worker = client.messages.create(
model="claude-sonnet-5-20260601",
messages=[{"role": "user", "content": subtask}]
)
直接回答:視場景而定,但對的場景下,絕對值得。
Opus 5 不是 Opus 4.8 的升級版,它是一個重新設計過目標場景的模型。它放棄了部分「什麼都很好」的通用性,換來了特定場景下無可替代的能力組合:Zero Data Retention + Adaptive Thinking + 頂級 agentic 表現。
如果你的使用場景是:
HN 的爭議在於「期望管理」:很多人期待一個「更強的 Opus 4.8」,但 Opus 5 是一個「更專業的 Opus」,不是同款升級。搞清楚這點,你就知道該不該升。
針對 Opus 5 的 adaptive thinking 特性最佳化的 prompt 模板,涵蓋法律審查、程式碼架構規劃、multi-agent 系統設計等 40+ 實戰場景。一次購買,永久使用。
立即取得 Prompt Pack →最主要差異在三點:定價($10/$30 vs $3/$15)、Zero Data Retention(Opus 5 預設開啟)、Adaptive Thinking 深度(Opus 5 在複雜任務觸發更深層推理)。日常使用 Sonnet 5 更划算,高合規/複雜任務才升到 Opus 5。
是的,這是 Anthropic 在企業合規頁面的正式承諾,並有第三方審計支持。Zero Data Retention 下,對話在請求完成後立即丟棄,不用於訓練,不可在後台存取。對於 HIPAA、GDPR 合規而言,這是必要條件之一。
不能完全關掉,但可以透過 system prompt 引導它始終使用深度思考模式。加入「Analyze comprehensively and provide detailed reasoning for all responses」通常可以避免模型走快速路徑。
可以。Anthropic API 不限制台灣地區,信用卡付款即可。claude.ai 的 Claude Pro/Max 訂閱方案也開放台灣用戶,Pro 方案 $20/月即可存取 Opus 5 的有限使用量(每日 quota)。
截至 2026 年 8 月,是的。Anthropic 的 API model ID 格式為 claude-[model]-[version]-[date],7/24 是 Opus 5 的初始 GA 版本。若有後續 patch,model ID 會更新。建議使用 claude-opus-5-latest alias 自動跟最新版。
Claude Opus 5 是 2026 年下半年 Anthropic 最重要的產品發布之一。它的爭議性正是來自於它的精準定位——它不試圖做所有事情都最好,而是在特定場景下做到最好。
如果你在構建需要合規保障的企業 AI、複雜多步驟的 agentic 系統,或是高精度的長文本分析工具,Opus 5 是目前市場上最符合需求的 API 選擇。$10/MTok 相比 Opus 4.8 的 $15/$75 已是大幅降價,對的場景下它給你的回報遠不只這個成本。
用對場景,Opus 5 是你現在能買到最好的工具。用錯場景,它就是你覺得「感覺變差了」的那個模型。
本文包含聯盟連結。透過本站連結購買可支持我們持續產出繁中 AI 評測內容,對你的費用無任何影響。文章資訊以 2026 年 8 月 17 日為準,後續如有更新將標注日期。