跳至主要內容

為什麼 Claude 在您與 Sonnet 5.5 的對話中切換了模型

本文說明為什麼請求可能會回退到另一個模型或在 Claude Sonnet 5.5 上被阻止、您的聊天切換模型時會發生什麼,以及如何管理自動切換。

為什麼某些請求會被阻止

由於其網路安全功能比 Claude Sonnet 5 有了實質性的提升,Claude Sonnet 5.5 是第一個具有網路回退功能的 Sonnet 模型,類似於我們為最強大的模型開發的功能。其生物學防護措施與 Sonnet 5 相同。兩種防護措施都針對一小組高風險請求;日常軟體開發和大多數生命科學工作不受影響。

發送到 Sonnet 5.5 的大多數請求不會遇到這些防護措施。一小組較高風險的請求要麼回退到 Sonnet 5,要麼被直接阻止,這樣我們可以繼續支援日常工作,同時限制濫用風險。我們持續改進這些防護措施,使其阻止更少的合法請求,包括微調分類器以減少誤報。您的反饋有助於指導這項工作。

哪些請求可能會回退或被阻止

Sonnet 5.5 對每個請求執行自動安全檢查或分類器。檢查也會審查模型讀取的所有內容,而不僅僅是您的最新訊息。這包括記憶、來自連接器的內容、網路搜尋結果和檔案,因此回退或阻止可能由您未輸入的內容觸發。

回退和阻止的工作方式因觸發的分類器類型而異:網路安全、生物學、LLM 開發或蒸餾。

網路安全

當我們的網路分類器標記潛在的較高風險的攻擊性網路安全請求時,Sonnet 5.5 可能會回退到 Claude Sonnet 5,例如:

  • 漏洞利用生成

  • 基於二進位的漏洞掃描

  • 滲透測試

您仍然可以將 Sonnet 5.5 用於安全編碼用例,例如掃描原始碼以查找漏洞。

生物學

Sonnet 5.5 會阻止可能幫助某人造成嚴重生物學傷害的請求。生物學阻止不會回退到另一個模型,請求會被直接阻止。

Sonnet 5.5 使用與 Sonnet 5 相同的生物學防護措施集合。這些措施針對有害請求;大多數研究、教育和臨床工作不受影響,儘管某些微生物學和病毒學請求可能會被誤標記。組織可以申請我們的生命科學驗證計畫,以獲得為生物學相關工作的全面範圍設計的防護措施。

前沿 LLM 開發

Sonnet 5.5 具有與開發最先進 LLM 相關的一小組功能的分類器,例如某些 ML 加速器的核心開發。它們不應該影響絕大多數傳統 AI 或 ML 開發、研究或一般編碼。當這些分類器標記請求時,Claude 會從 Sonnet 5.5 回退到 Sonnet 5。

蒸餾

Sonnet 5.5 具有檢測並直接阻止嘗試提取模型內部推理的分類器。蒸餾阻止不會回退到另一個模型,請求會被直接阻止。

被阻止的請求示例包括要求 Claude 逐字重複其推理或將其完整思維鏈寫入外部輸出的提示。您仍然可以要求 Claude 解釋其推理、教您一個概念或逐步進行程式碼審查。「您為什麼這樣做?」之類的對話請求不受影響。

回退後會發生什麼

自動模型切換預設為啟用。當您的請求回退時,Claude 會在同一對話中的 Sonnet 5 上重新執行它。所有回退都是透明的,這意味著您會看到一個通知,說明模型已切換,回應會標記為回應的模型。

切換後,模型選擇器在聊天的其餘部分保持在 Sonnet 5。您可以隨時從模型選擇器切換回 Sonnet 5.5。

注意:如果您在自動模型切換後切換回 Sonnet 5.5,如果您的原始請求仍然是對話的一部分,相同的防護措施可能會導致 Claude 再次回退。在重試之前編輯您的上一條訊息通常會有幫助。

如果回退請求也被阻止

Sonnet 5 有自己的安全系統。如果您的請求也在 Sonnet 5 上被阻止,您可以編輯您的訊息並重試。

對於生物學,如果您的組織進行合法的生命科學研究並受到這些防護措施的影響,您可以申請生命科學驗證計畫 (LSVP) 以獲得擴展功能。在 Sonnet 5.5 上,LSVP 僅通過高風險使用附加功能放寬生物學防護措施。在我們的部落格中瞭解更多:推出生命科學驗證計畫。

Sonnet 5.5 在推出時在網路驗證計畫中不可用。很快,網路防禦者將能夠申請我們擴展的網路驗證計畫,以獲得對 Sonnet 5.5 上更多高級功能的分層存取。

注意:Claude Sonnet 5.5 與零資料保留 (ZDR) 相容。

管理自動模型切換

自動切換預設為 Sonnet 5.5 啟用,您可以隨時關閉它:

  1. 前往設定 > 功能(或 Claude Code 中的設定 > 模型和輸出)。

  2. 關閉訊息被標記時切換模型。

關閉自動模型切換後,回退的請求會暫停聊天,而不是切換模型。然後您可以:

  • 編輯您的訊息並在 Sonnet 5.5 上重試

  • 手動將相同的訊息發送到不同的模型

使用情況和計費

回退或被阻止的請求如何計費取決於阻止發生的時間和觸發它的分類器:

  • Claude 回應前被阻止:為了破壞對我們防護措施的協調攻擊,在任何輸出之前到達的拒絕在因生物學、蒸餾或 LLM 開發安全分類器停止或回退時計費。在其他類別中任何輸出之前被阻止的請求不收費。

  • Claude 開始回應後被阻止:如果請求在中途被阻止,輸入令牌和在阻止前流式傳輸的令牌按生成它們的模型的費率計費。

  • 回退請求:如果您選擇了自動模型切換,聊天在阻止後切換到 Sonnet 5,Sonnet 5 回應會單獨計費,按 Sonnet 5 的費率計費。我們提供信用以補償回退請求的快取未命中。

瞭解更多關於拒絕和回退。

提供反饋

如果您的請求被阻止,但似乎與上面列出的分類器之一無關,或者您的合法工作不斷回退,請告訴我們。使用「傳送反饋」來報告它。不正確阻止的請求報告有助於我們縮小和改進這些防護措施。

自動模型切換適用的位置

自動模型切換在您可以使用 Claude Sonnet 5.5 的任何地方都以相同的方式工作:

  • 網頁版 Claude

  • Claude 行動應用

  • Claude 桌面版

  • Claude Cowork

  • Claude Code

  • Claude Design

  • Claude for Microsoft 365

  • Claude Tag

  • Claude Science

重要:如果您使用 Claude API,模型切換的工作方式不同。自動切換預設不啟用,API 客戶必須選擇加入並設定回退。在設定回退之前,模型在 API 上返回 200 回應,停止原因為。有關詳細資訊,請參閱開發人員文件。

閱讀我們的部落格以瞭解更多關於Claude Sonnet 5.5。

我們的防護措施旨在與模型的功能相匹配。

有關 Claude Opus 5.5 上的防護措施如何工作,請參閱為什麼 Claude 在您與 Opus 5 或 Opus 5.5 的對話中切換了模型。對於 Claude Fable 5.1,請參閱為什麼 Claude 在您與 Fable 5 或 Fable 5.1 的對話中切換了模型。

是否回答了您的問題?