本文說明為什麼請求可能會回退到 Claude Opus 5 或 Opus 5.5、對話切換到另一個模型時會發生什麼,以及如何管理自動切換。
為什麼某些請求會被阻止
Claude Opus 5 和 Opus 5.5 在各方面都改進了 Claude Opus 4.8。我們已根據這些功能提升調整了其安全防護。
發送到 Opus 5 或 Opus 5.5 的大多數請求不會遇到回退安全干預。一小部分高風險請求要麼回退到功能較弱的模型,要麼被直接阻止,這樣我們可以繼續支持日常工作,同時限制濫用風險。我們持續改進這些安全防護,以減少對合法請求的阻止。這包括微調我們的分類器以減少誤報,並考慮一系列帳戶信任信號。您的反饋有助於指導這項工作。
哪些請求可能會回退或被阻止
Claude Opus 5 和 Opus 5.5 對每個使用者請求執行自動安全檢查或分類器。檢查也會審查模型讀取的所有內容,不僅是您的最新訊息。這包括記憶、來自連接器的內容、網路搜尋結果和檔案,因此回退可能由您未輸入的內容觸發。
回退和阻止的工作方式取決於觸發的分類器類型:網路安全、生物學、前沿 LLM 開發或蒸餾。
網路安全
當我們的網路安全分類器標記潛在高風險的攻擊性網路安全請求時,Opus 5 或 Opus 5.5 可能會回退到 Opus 4.8,例如:
漏洞利用生成
基於二進位的漏洞掃描
滲透測試
您仍然可以使用 Opus 5 和 Opus 5.5 進行安全編碼,包括掃描原始碼中的漏洞、分類安全問題和構建安全程式碼。
生物學
雖然 Claude Opus 5 在生物學方面改進了 Opus 4.8,但在可能導致重大風險的新穎研究發現的真實長期任務方面,它不如 Fable 5 強大。因此,Opus 5 不會在生物學、化學或生命科學問題上回退。它對這些主題使用與 Opus 4.8 類似的安全防護。
Opus 5.5 由於功能相比 Opus 5 有所提升,因此對生物學具有類似於 Claude Fable 5 的安全分類器。當您在病毒學、毒理學和分子設計等領域提交雙用途請求時,這些分類器會導致 Claude 從 Opus 5.5 回退到 Opus 5。您仍然可以使用 Opus 5.5 進行日常健康和教育問題,包括解釋實驗室結果、理解症狀和學習生物學。
前沿 LLM 開發(僅限 Opus 5.5)
Opus 5.5 具有類似於 Fable 模型的分類器,用於與前沿 LLM 開發相關的一小部分功能,例如某些 ML 加速器的核心開發。它們不應影響絕大多數傳統 AI 或 ML 開發、研究或一般編碼。這些分類器會導致 Claude 從 Opus 5.5 回退到 Opus 5。
注意:這些前沿 LLM 開發分類器僅適用於 Opus 5.5。Opus 5 不會在前沿 LLM 開發問題上回退。
蒸餾
Opus 5 和 Opus 5.5 具有檢測和直接阻止嘗試提取模型內部推理的分類器。蒸餾阻止不會回退到另一個模型,請求會被直接阻止。
被阻止的請求示例包括要求 Claude 逐字重複其推理或將其完整思維鏈寫入外部輸出的提示。您仍然可以要求 Claude 解釋其推理、教您一個概念或逐步進行程式碼審查。「您為什麼這樣做?」之類的對話請求不受影響。
回退後會發生什麼
自動模型切換預設為啟用。當您的請求回退時,Claude 會在同一對話中的功能較弱的模型上重新執行您被阻止的請求。所有回退都是透明的,這意味著您會看到一個通知,說明模型已切換,回應將標記為回答的模型。
切換後,模型選擇器在對話的其餘部分保持在功能較弱的模型上。您可以隨時從模型選擇器切換回 Opus 5 或 Opus 5.5。
注意:如果您在自動模型切換後切換回 Opus 5 或 Opus 5.5,如果您的原始請求仍然是對話的一部分,相同的安全防護可能會導致 Claude 再次回退。在重試之前編輯您的上一條訊息通常會有幫助。
如果回退請求也被阻止
Opus 4.8 有自己的安全系統。如果您的請求在 Opus 4.8 上也被阻止,您可以編輯您的訊息並重試。
特別是對於網路安全,如果您的使用案例有合法的防禦目的並受到這些安全防護的影響,您可以申請網路安全驗證計畫 (CVP)。深入瞭解 Claude Opus 和 Sonnet 上的即時網路安全防護。
對於生物學,如果您的組織進行合法的生命科學研究並受到這些安全防護的影響,您可以申請生命科學驗證計畫 (LSVP)。LSVP 為經過驗證的生命科學組織提供對 Claude 最強大模型的存取權限,用於內部研究和開發。在我們的部落格中深入瞭解:推出生命科學驗證計畫。
注意:Opus 5.5 目前在網路安全驗證計畫中不可用。如果您的組織已透過網路安全驗證計畫使用 Opus 4.8,現在可以存取具有較少網路安全限制的 Opus 5。Opus 5 也與零資料保留相容。
管理自動模型切換
自動切換在您首次選擇 Claude Opus 5 或 Opus 5.5 時預設為啟用。它保持預設啟用,您可以隨時關閉它:
前往 設定 > 功能(或 Claude Code 中的 設定 > 模型和輸出)。
關閉 訊息被標記時切換模型。
關閉自動模型切換後,回退的請求會暫停對話,而不是切換模型。然後您可以:
編輯您的訊息並在 Opus 5 或 Opus 5.5 上重試
手動將相同訊息發送到功能較弱的模型
使用情況和計費
回退的請求如何計費取決於阻止發生的時間和觸發的分類器:
Claude 回應前被阻止:為了破壞對我們安全防護的協調攻擊,在任何輸出之前到達的拒絕在因生物學、蒸餾或前沿 LLM 開發安全分類器而停止或回退時計費。這些是截至 2026 年 9 月誤報率最低的類別。在其他類別中在任何輸出之前被阻止的請求不收費。
Claude 開始回應後被阻止:如果請求在中途被阻止,輸入令牌和在阻止前流式傳輸的令牌按生成它們的模型費率計費。
回退請求:如果您已選擇自動模型切換,並且在阻止後對話切換到另一個模型,回退回應會單獨計費,按回應模型的費率計費。我們提供信用以補償回退請求的快取未命中。
深入瞭解 拒絕和回退。
提供反饋
如果您的請求被阻止,但似乎與上面列出的分類器無關,或者您的合法安全工作持續回退,請告訴我們。使用「傳送反饋」來報告它。不正確阻止的請求報告有助於我們縮小和改進這些安全防護。
自動模型切換適用的位置
自動模型切換在您可以使用 Claude Opus 5 或 Opus 5.5 的任何地方都以相同方式工作:
Claude 網頁版
Claude 行動版
Claude 桌面版
Claude Cowork
Claude Code
Claude Design
Claude for Microsoft 365
Claude Tag
Claude Science
重要:如果您使用 Claude API,模型切換的工作方式不同。自動切換預設不啟用,API 客戶必須選擇加入並設定回退。在設定回退之前,模型將在 API 上返回 200 回應,停止原因。有關詳細資訊,請參閱 開發人員文件。
閱讀我們的部落格以深入瞭解 Claude Opus 5 和 Claude Opus 5.5。
我們的安全防護旨在與模型的功能相匹配。有關安全防護如何在 Claude Fable 5 上工作,請參閱 為什麼 Claude 在您與 Fable 5 的對話中切換模型。
