Claude Enterprise 讓您的組織能夠在聊天、Claude Code、Claude Cowork、Claude Design 以及您的團隊已在使用的工具(包括 Microsoft 365、Chrome 和 Slack)中存取強大的 AI。隨著這種存取權限而來的是有效管理消費的責任——確保您的團隊獲得最大價值,同時保持使用量可預測且在預算範圍內。
本指南引導 Enterprise 管理員瞭解可用於控制和最佳化 Token 消費的關鍵槓桿:設定支出上限、設定角色型存取控制、教育使用者,以及為正確的任務選擇正確的模型和工作量級別。
為什麼消費管理很重要
Claude Enterprise 採用按座位、基於使用量的定價模式。您組織的消費池在所有使用者之間共享,某些介面(特別是 Claude Code 和 Cowork)的 Token 消費速率明顯高於標準聊天。
主動設定支出限制並教育使用者的管理員可以減少浪費,並確保高價值使用案例獲得所需的容量。
瞭解各介面的 Token 強度
介面 | Token 強度及其驅動因素 |
核心聊天 | 強度較低。標準的來回對話、摘要、起草和問答。Token 使用量隨著訊息長度和對話歷史記錄而變化。 |
Claude Code | 強度較高。每個編碼工作階段都包括系統提示、檔案內容、工具呼叫和多輪推理——每個工作階段的 Token 比聊天多。 |
Claude Cowork | 強度較高。代理工作流程、多步驟任務執行和技能會產生大量中間 Token 使用量,最終使用者可能看不到。 |
其他介面也會使用您組織的使用量,並在分析、支出匯出和分析 API 中顯示為單獨的產品:(a) Claude for M365(Excel、PowerPoint、Word、Outlook 增益集),受相同的組織、群組和每位使用者支出限制以及模型限制;(b) Claude Design(測試版),按標準 API 費率從您組織的消費計費,並套用組織、群組和每位使用者的限制;(c) Chrome 中的 Claude,其側面板作為 Claude Cowork 工作階段執行,因此多步驟瀏覽任務的消費方式與其他 Cowork 代理工作相同(在組織設定 > Cowork 下管理);(d) Claude Tag(Slack 中的 Claude,測試版),其頻道工作計費到組織的使用量餘額,而不是個別座位,因此每位使用者和群組限制不會限制它;在 claude.ai/admin-settings/usage/claude-tag 設定 Claude Tag 支出限制(以及選用的每個頻道限制)。與 Claude Tag 的直接訊息計費到寄件者自己的座位。
管理員提示:與您的團隊設定期望
執行 Claude Code 或 Cowork 工作流程的使用者可能沒有意識到他們的工作階段有多麼耗費 Token。單一 Cowork 任務或 Claude Code 偵錯工作階段可以消費遠多於聊天的 Token。在您傳送的任何使用者上線內容中包含此內容。
角色型存取控制
角色型存取控制 (RBAC) 讓您可以將使用者分組,並以單位形式管理他們對 Claude 介面和消費預算的存取權限,而不是逐個管理。這是在較大組織中管理使用量的最可擴展方式。
如何結構化群組
根據工作職能和使用案例(而不是組織階層)來考慮群組。以下是一些原則:
建立對應於不同使用模式的群組,而不是組織圖方塊。「工程」和「銷售」比「北美」和「EMEA」對消費管理更有用。
限制群組增殖。超過 8-10 個群組變得難以管理。從 4-6 開始,只有在使用模式明顯不同時才分割。
使用群組來限制對高強度介面的存取。例如:只有「工程」群組的成員可以存取 Claude Code;其他使用者只能看到聊天和 Cowork。存取權限由您指派給每個群組的自訂角色授予,它只對組織角色設定為「自訂」的成員生效。保留在內建「使用者」角色上的成員在整個組織中保持所有功能啟用。群組可以手動建立或從您的身分提供者同步。請參閱 在 Enterprise 方案上設定角色型權限。
指派群組級別的支出上限作為起點,然後在使用者級別為異常值覆蓋(例如,需要 Claude Code 進行特定專案的非技術 PM)。
群組支出管理
設定群組後:
在初始推出期間每週檢查群組消費,之後每月檢查一次。
當群組持續接近其上限時,在自動提高之前進行調查——正確的回應可能是模型指導(使用 Sonnet 而不是 Opus),而不是更多預算。
考慮在每個部門指派一位「群組擁有者」,負責檢查使用量並回答團隊成員的問題。這分散了管理負擔,並讓具有業務背景的人參與其中。您不需要讓這些人成為擁有者或管理員:建立授予分析(可檢視)管理員權限的自訂角色——以及選用的計費(可檢視),以便他們可以看到使用量頁面——並將其指派給小型「使用量檢查者」群組。管理員權限只適用於角色設定為「自訂」的成員,分析檢視存取權限是組織範圍的,而不是限於其群組。
治理提示:將介面存取作為第一道關卡
在擔心 Token 級別的限制之前,請確保合適的人員可以存取合適的介面。在第一天為所有人提供 Claude Code 和 Cowork 存取權限是產生意外消費的最快方式。分波推出高強度介面,從最可能有效使用它們的團隊開始。
設定支出限制
支出限制是您控制消費的主要工具。Claude Enterprise 讓管理員在三個級別設定限制:組織級別、群組級別(使用 RBAC)和個別使用者級別。我們建議的方法是從 RBAC 群組級別限制和每位使用者限制開始——這些提供精確、有針對性的控制,而不會因為達到限制而切斷整個組織的風險。
組織級別支出限制
組織級別限制可作為所有使用者和介面的硬性上限,但請謹慎使用:達到它會同時影響所有人,這可能會造成中斷。大多數管理員發現在群組和使用者級別管理消費能提供更好的結果,同時降低營運風險。
群組支出限制
群組支出限制讓您可以將每位使用者的每月支出限制指派給整個群組,因此該群組的每個成員都繼承相同的限制,而無需個別設定。這是在中型到大型組織中管理消費的最可擴展方式,也是管理員應該開始的地方。
請注意以下優先順序規則:
個別限制始終覆蓋群組限制,無論哪個更高。
如果使用者屬於多個具有不同限制的群組,支出預設值下的多群組支出限制設定控制是否套用更高或更低的限制。座位類型預設限制包含在此比較中。
組織範圍的限制仍然是硬性上限。
任何地方都沒有限制 = 沒有限制。如果成員沒有個別限制,其群組都沒有限制,則其支出不受限制。
如何設定:組織設定 → 使用量 → 按群組。將限制設定為特定美元金額或「無限制」。
使用者級別支出上限
使用者級別上限讓您可以為個別帳戶設定消費限制。對於使用量在角色之間差異很大的組織來說,這是必不可少的——每天使用 Claude Code 的開發人員的需求與使用聊天進行文案撰寫的行銷人員的需求非常不同。
使用者級別上限的最佳實踐:
在推出前根據角色類型定義消費層級。分層結構(例如輕量、標準、強大)使得更容易一致地指派和調整上限。
保守地開始。根據使用者的要求增加上限比處理超額對話要容易得多。
給予進階使用者(工程師、資料科學家、研究人員)更高或無上限的個人限制,但透過確保他們為正確的任務使用正確的 Claude 模型來平衡這一點。
每月監控個人使用報告以識別異常值——既包括持續達到上限的使用者(可能需要更多),也包括消耗很少的使用者(可能尚未啟用)。
模型選擇指南
管理員可以做的最有影響力的事情之一是為使用者設定清晰的指導,說明哪個模型適合哪些任務。模型選擇對支出有直接且重大的影響。
努力程度是第二個消耗槓桿。使用者可以選擇 Claude 對每個回應應用多少思考,更高的努力程度比更低的努力程度消耗更多的 token。鼓勵使用者僅為最具挑戰性的任務保留最大努力,並為日常任務使用較低的努力程度。
正確任務的正確模型
模型 | 最適合 | Token 密度 | 建議使用 |
Claude Fable | 長期自主代理編碼工作和推理任務 | 非常高 | 保留用於您最高價值、最複雜的自主代理工作。高級定價和比 Opus 更快的使用速度。 |
Claude Opus | 複雜推理、研究、多步驟任務 | 高 | 僅保留給進階使用者或特定工作流程 |
Claude Sonnet | 日常任務、寫作、分析、問答 | 中等 | 所有使用者的預設模型——設定為您的組織範圍預設值(見下文) |
Claude Haiku | 簡單查詢、摘要、快速回應 | 低 | 大量、輕量級自動化任務 |
設定您組織的預設模型
除了引導使用者選擇正確的模型外,您還可以設定組織中所有人的新對話開始使用的模型。這是最直接的消耗槓桿之一——預設值決定了大多數使用者每天運行的內容。
您有兩個選項:
Anthropic 推薦——隨著新模型發佈自動更新,因此您的組織始終使用我們目前推薦的通用模型,無需手動維護。
選擇您自己的——將特定模型設定為組織預設值並保持不變,直到您更改它。當您想要標準化已知模型以實現消耗可預測性時使用此選項(例如,預設為 Sonnet 而不是 Opus)。
此設定適用於聊天、Claude Cowork、Claude Code(CLI 2.1.199 或更新版本)和 Claude for Microsoft 365 中的新對話。如果選定的模型在產品中不可用,則使用 Anthropic 的推薦預設值。如果您還透過受管設定為 Claude Code 固定模型,該設定對 CLI 和 IDE 優先。請參閱 為您的組織設定預設模型。
您也可以透過自訂角色按角色設定模型預設值,以便不同的群組可以從不同的模型開始——例如,將您的工程群組預設為一個模型,將組織的其餘部分預設為另一個模型。這與您已配置的 RBAC 群組自然配對(見第 2 節)。
如何配置:組織設定 → 模型。
注意:使用者目前的新對話模型選擇可能會被清除,因此他們將在下一次對話時採用組織預設值。
管理您組織的模型存取
除了設定預設值外,您還可以限制哪些模型可用——這是比單純指導更強有力的槓桿。這在兩個層級上運作:
組織層級:每個模型對所有人(包括擁有者和管理員)啟用或停用。在此停用模型會將其從整個組織的每個選擇器中移除。
自訂角色層級:對於自訂角色上的成員,每個角色授予對組織層級啟用內容的子集的存取權限。角色無法授予組織已停用的模型——組織設定始終是上限。
如果成員屬於具有不同自訂角色的多個群組,存取權限是累加的——他們獲得其任何角色授予的每個模型(只要它在組織範圍內啟用)。
按角色限制努力程度
除了限制角色可以使用的模型外,您還可以限制該角色上的成員每個模型可以選擇的最大努力程度——這是上面已涵蓋的努力指導的更精細版本。這僅適用於自訂角色,不適用於組織層級。如果成員有多個角色,這些角色中最高的努力上限獲勝。
管理員提示:配對模型 + 努力限制
如果模型指導(「Sonnet 是您的預設值」訊息)沒有奏效,您仍然看到大量 Opus 消耗,限制 Opus 存取特定角色——或將非進階使用者角色的努力限制為中等/高而不是最大——是下一個槓桿。為深度推理真正有回報的角色保留完全存取權限。
適用範圍
模型存取和努力限制在大多數 Claude 產品中強制執行,包括聊天(網頁、桌面、行動),Claude Cowork 和 Claude Code(CLI 2.1.199 或更新版本——較早版本仍會顯示受限選項,但使用它們的請求會被拒絕)。Chrome 中的 Claude 和 Claude Security 尚不支援此功能。如需目前支援產品的清單,請參閱 管理您組織的模型存取。
如何配置:組織設定 → 角色 → 選擇角色 → 模型標籤。設定模型存取、每個模型的選擇性努力上限和選擇性角色層級預設模型。若要管理整個組織的配置,請前往組織設定 → 模型。 更多詳細資訊請參閱 管理您組織的模型存取。
管理員配置建議
如果您有大量、低複雜度的工作流程(例如,摘要支援票證、生成初稿電子郵件),請評估 Haiku 是否更適合——它可以顯著減少這些使用案例的消耗。
定期審計您的使用者實際選擇的模型。如果您的大部分消耗都在 Opus 上,這表示您的模型指導沒有產生預期效果。
如何向使用者說明模型選擇
Sonnet 是您的日常工作模型。它速度快、功能強大,專為大多數任務設計——撰寫、分析、編碼協助和問答。
Opus 用於更困難、更複雜的工作。當您處理真正複雜的多步驟問題,或品質比速度更重要時,請使用它。
如有疑問,請從 Sonnet 開始。如果您需要更深入的分析,可以在對話中途切換到 Opus。
使用組織指導來塑造使用者行為
組織指導讓管理員可以在整個組織的每個 Claude 對話中注入常設指導——實際上是給 Claude 一個反映您團隊規範、最佳實踐和護欄的系統提示。這是一個高槓桿工具,可以改變使用者行為而不增加摩擦,因為指導在使用時直接顯示在產品中,而不是在使用者必須查找的文件中。
您可以使用組織指導來管理消耗和使用模式的幾種方式:
勸阻令牌密集的輸出格式。如果您注意到特定工件類型的增加(例如,在跨職能執行緒中共享 HTML 儀表板,而更簡單的格式就足夠了),您可以指示 Claude 在生成前向使用者確認。這增加了輕量級檢查,而不會完全移除該功能。
將使用者指向內部資源。直接在偏好設定中參考您團隊的 wiki、最佳實踐文件或使用指南。Claude 會在相關時顯示它們——引導使用者使用正確的內部背景,而不是每次都重新發明。
強化模型選擇規範。提醒 Claude(進而提醒使用者)Sonnet 是預設值,Opus 保留用於特定工作流程。這補充了使用者教育,無需每個人都預先內化。
追蹤使用情況和支出
分析頁面
使用者選單中的分析頁面(claude.ai/analytics)是快速了解您組織情況的最快方式。它顯示每週活躍使用者、座位利用率、頂級連接器、總支出(MTD/QTD/YTD)、按模型的支出,以及前 10 名按支出排名的使用者排行榜。聊天、Claude Code、Cowork 和 Claude Design 的產品特定檢視會分解每個表面的活動。深入了解。
技能分析和每項技能的投資回報率
每項技能代表一個可重複的工作流程——準備銷售電話、審查合約——因此其成本可以直接與該工作流程的價值進行權衡。分析中的技能檢視顯示您組織中每項技能的使用者、每次使用的成本和總使用次數,可按群組(「我的法律團隊使用哪些技能?」)或產品表面進行篩選。
要執行投資回報率分析:
從技能檢視將技能表匯出為 CSV。
為每項技能分配每次執行的價值——完成任務價值的粗略估計,例如它替代的員工時間(例如,「準備銷售電話對我們來說價值約 $20」)。
在您的試算表中計算:(每次執行的價值 − 每次使用的成本) × 總使用次數 = 每項技能產生的淨價值。
計算目前在產品外進行,但 CSV 匯出使其成為快速的試算表練習。即使是粗略估計也能講述一個引人注目的故事:每次執行成本 $0.90 的電話準備技能相對於 $20 的價值,每次使用都能獲得 20 倍的回報。
支出報告 CSV 匯出
如果您需要一次性詳細分解,可以從分析頁面將每個使用者、每個模型的支出報告匯出為 CSV:在概覽標籤上的支出部分(「Claude 的成本是多少?」)中,按一下「匯出支出報告」並選擇 MTD、上個月、過去 90 天或最多 90 天前的自訂範圍。
分析聊天
分析聊天讓您可以用純語言提出有關組織使用情況的問題。輸入一個問題——「顯示過去 30 天的每日支出」、「誰是我們的最大支出者」、「我們的座位利用率是多少」——Claude 會返回一個圖表和一份簡短的書面摘要。您可以跟進以精煉、深入或轉向,無需重新開始。
當您有特定問題且不想瀏覽儀表板時,或當您探索趨勢並想要快速來回時,請使用此功能。結果預設涵蓋過去 30 天;如果您需要,請在問題中指定不同的範圍。數據每天刷新。深入了解。
分析 API
如需程式設計存取,請使用 Claude Enterprise 分析 API。提取按令牌使用或美元支出排名的使用者列表,或查看按產品、模型、RBAC 群組、上下文視窗、區域或服務層(標準與快速)細分的使用情況和成本趨勢。按 RBAC 群組對成本報告進行分組可提供每個部門的支出,用於退款,無需匯出每個使用者的列。每個請求的寬度上限為 31 天,從過去 365 天內開始,不早於 2026 年 1 月 1 日。
您的主要所有者可以在組織設定 > API 下使用 read:analytics 範圍建立金鑰。成本和使用數據通常在約四小時內到達(偶爾最多 24 小時),並可在 30 天內修訂,因此查詢 30 天以上前的日期以獲得發票級別的總計。使用者、技能、外掛程式和連接器等參與端點每天更新,大約有一天的延遲。深入了解並查看API 參考指南。
每個使用者的技能、外掛程式和連接器使用情況
分析 API 也會按使用者細分技能、外掛程式和連接器使用情況。skills、plugins 和 connectors 端點各支援 group_by[]=user_id 參數,將您在儀表板中看到的組織範圍總計轉換為每個使用者每項技能(或外掛程式或連接器)一列——因此您可以看到確切誰在執行給定的技能、執行頻率,以及哪些團隊成員實際上已調用您推出的外掛程式。您也可以按 RBAC 群組或產品表面進行分組,或按名稱篩選到單一技能、外掛程式或連接器。
這對於上述相同的每項技能投資回報率問題很有用,只是按個別使用者細分,而不是匯出到試算表——例如,確認外掛程式推出實際上已到達分發給它的團隊,而不是只檢查它是否已安裝。在 API 參考中深入了解:技能、外掛程式、連接器。
管理員 API
對於在許多群組中管理限制的組織,管理員 API 將成本控制工作流程移至指令碼中——自動化增加請求審查、標記接近限制的成員,以及大規模顯示快速變化的使用情況。該 API 讀取每個成員的有效限制和月初至今支出,並設定或清除每個使用者的覆蓋。群組、座位類型和組織級別的限制仍在組織設定中配置。管理員 API 的使用者管理端點(目前對企業組織處於測試版)也讓您可以以程式設計方式建立群組、新增或移除成員,以及讀取您的自訂角色。請參閱使用者管理。
支出閾值警報
支出閾值警報在達到組織級別支出限制的 75% 和 90% 時通知管理員,讓您有時間在任何人被阻止執行任務之前提高上限。
終端使用者教育
技術控制會讓您走大部分的路,但使用者行為驅動其餘的。了解消耗如何運作的團隊將獨立做出更好的選擇——並為您減少需要排除故障的邊界情況。
與終端使用者溝通的內容
當您上線使用者時,分享以下內容:
Claude 如何計費
使用情況以令牌衡量。長提示和長對話消耗更多令牌。
Claude Code 和 Cowork 工作階段的令牌密集程度遠高於聊天。單個長編碼工作階段可以使用比典型聊天工作階段多得多的令牌。
在設定中切換到 設定 → 使用情況來檢查您的使用情況。
如何選擇模型
Sonnet 是預設值,可以很好地處理大多數任務。只有當 Sonnet 無法讓您達到所需的位置時,才使用 Opus。
您的組織為新對話設定了預設模型;您仍然可以在對話中途切換模型,當任務需要時。
模型選擇器在介面中可見——提醒使用者檢查它,特別是如果他們正在執行複雜任務。
模型選擇器是粘性的,因此養成檢查它是您想使用的模型的習慣。
努力級別顯示在模型名稱旁邊。更高的努力意味著更徹底的回應,但令牌消耗更高,因此將其與任務相匹配。
達到上限時會發生什麼
使用者在接近支出限額時會收到產品內通知,一旦達到限額,可以點擊「申請更多使用量」向管理員發送增加請求,無需離開 Claude。告知使用者誰是核准者以及預期的處理時間。
他們已經產生的任何內容都不會遺失。已在進行中的請求會完成,但進一步的請求會被阻止,因此多步驟的 Claude Code 或 Claude Cowork 任務可能會在完成前暫停。一旦管理員提高限額,或在每月 1 日 00:00 UTC 時限額重設後,他們可以立即繼續進行工作。
與使用者分享的資源
