跳转到主要内容

Claude Enterprise 消费指南

Claude Enterprise 为您的组织提供对强大 AI 的访问权限,涵盖聊天、Claude Code、Claude Cowork、Claude Design 以及集成在您的团队已在使用的工具中的 Claude,包括 Microsoft 365、Chrome 和 Slack。随之而来的是有效管理消费的责任——确保您的团队获得最大价值,同时保持使用情况可预测且在预算范围内。

本指南将引导 Enterprise 管理员了解可用于控制和优化 token 消费的关键杠杆:设置支出上限、配置基于角色的访问控制、用户教育以及为正确的任务选择合适的模型和工作量级别。


为什么消费管理很重要

Claude Enterprise 采用按座位、基于使用量的定价模式。您组织的消费池在所有用户之间共享,某些界面——特别是 Claude Code 和 Cowork——消耗 token 的速率明显高于标准聊天。

主动配置支出限制并对用户进行教育的管理员可以减少浪费,并确保高价值用例获得所需的容量。


了解各界面的 token 强度

界面

Token 强度及其驱动因素

核心聊天

强度较低。标准的来回对话、总结、起草和问答。Token 使用量随消息长度和对话历史而变化。

Claude Code

强度较高。每个编码会话包括系统提示、文件上下文、工具调用和多轮推理——每个会话的 token 数量比聊天多。

Claude Cowork

强度较高。代理工作流、多步骤任务执行和技能生成大量中间 token 使用,这些可能对最终用户不可见。

其他界面也会使用您组织的使用量,并在分析、支出导出和分析 API 中显示为单独的产品:(a) Claude for M365(Excel、PowerPoint、Word、Outlook 加载项),受相同的组织、组和按用户支出限制以及模型限制;(b) Claude Design(测试版),按标准 API 费率从您组织的消费中计费,应用组织、组和按用户限制;(c) Chrome 中的 Claude,其侧面板作为 Claude Cowork 会话运行,因此多步骤浏览任务的消费方式与其他 Cowork 代理工作相同(在组织设置 > Cowork 下管理);(d) Claude Tag(Slack 中的 Claude,测试版),其频道工作计费到组织的使用余额而不是单个座位,因此按用户和组限制不会限制它;在 claude.ai/admin-settings/usage/claude-tag 设置 Claude Tag 支出限制(以及可选的按频道限制)。与 Claude Tag 的直接消息计费到发送者自己的座位。

管理员提示:与您的团队设定期望

运行 Claude Code 或 Cowork 工作流的用户可能没有意识到他们的会话有多么耗费 token。单个 Cowork 任务或 Claude Code 调试会话可能消耗比聊天多得多的 token。在您发送的任何用户入职信息中包含此上下文。


基于角色的访问控制

基于角色的访问控制 (RBAC) 允许您对用户进行分组,并作为一个整体而不是逐个管理他们对 Claude 界面和消费预算的访问权限。这是在较大组织中管理使用的最可扩展方式。

如何构建组

根据工作职能和用例而不是组织层级来考虑组。以下是一些原则:

  • 创建映射到不同使用模式的组,而不是组织结构框。"工程"和"销售"比"北美"和"欧洲中东非洲"对消费管理更有用。

  • 限制组的增殖。超过 8-10 个组变得难以管理。从 4-6 个开始,仅在使用模式明显不同时才拆分。

  • 使用组来限制对高强度界面的访问。例如:只有"工程"组的成员可以访问 Claude Code;其他用户只能看到聊天和 Cowork。访问权限由您分配给每个组的自定义角色授予,仅对组织角色设置为自定义的成员生效。保留在内置用户角色上的成员在整个组织范围内保持所有功能启用。组可以手动创建或从您的身份提供商同步。请参阅 在 Enterprise 计划上设置基于角色的权限

  • 分配组级支出上限作为起点,然后在用户级别为异常值覆盖(例如,需要 Claude Code 进行特定项目的非技术 PM)。

组支出管理

配置组后:

  • 在初始推出期间每周审查组消费,之后每月审查一次。

  • 当一个组持续接近其上限时,在自动提高之前进行调查——正确的响应可能是模型指导(使用 Sonnet 而不是 Opus)而不是更多预算。

  • 考虑在每个部门分配一个"组所有者",负责审查使用情况并回答团队的问题。这分散了管理负担,并让具有业务背景的人参与其中。您不需要让这些人成为所有者或管理员:创建一个授予分析(可查看)管理权限的自定义角色——以及可选的计费(可查看)以便他们可以看到使用情况页面——并将其分配给一个小的"使用情况审查者"组。管理权限仅适用于角色设置为自定义的成员,分析查看访问权限是组织范围的,而不是限制在他们的组。

治理提示:将界面访问作为第一道关卡

在担心 token 级别的限制之前,请确保合适的人员可以访问合适的界面。在第一天就给所有人 Claude Code 和 Cowork 访问权限是生成意外消费的最快方式。分阶段推出高强度界面,从最可能有效使用它们的团队开始。


设置支出限制

支出限制是您控制消费的主要工具。Claude Enterprise 允许管理员在三个级别设置限制:组织级别、组级别(使用 RBAC)和单个用户级别。我们推荐的方法是从 RBAC 组级别限制和按用户限制开始——这些提供精确、有针对性的控制,而不会因为达到限制而切断整个组织的风险。

组织级支出限制

组织级限制可用作所有用户和界面的硬性上限,但要谨慎使用:达到它会同时影响所有人,这可能会造成破坏。大多数管理员发现在组和用户级别管理消费会获得更好的结果,操作风险更低。

组支出限制

组支出限制允许您为整个组分配按用户每月支出限制,因此该组的每个成员都继承相同的限制,而无需单独设置。这是在中大型组织中管理消费的最可扩展方式,也是管理员应该开始的地方。

请注意以下优先级规则:

  • 个人限制始终覆盖组限制,无论哪个更高。

  • 如果用户属于多个具有不同限制的组支出默认值下的多组支出限制设置控制应用更高还是更低的限制。座位类型默认限制包含在此比较中。

  • 组织范围的限制仍然是硬性上限。

  • 任何地方都没有限制 = 没有限制。如果成员没有个人限制,其任何组都没有限制,则其支出不受限制。

如何配置:组织设置 → 使用情况 → 按组。将限制设置为特定美元金额或"无限制"。

用户级支出上限

用户级上限允许您为单个账户设置消费限制。对于使用情况在角色之间差异很大的组织来说,这是必不可少的——每天使用 Claude Code 的开发人员的需求与使用聊天进行文案撰写的营销人员的需求非常不同。

用户级上限的最佳实践:

  • 在推出前根据角色类型定义消费层级。分层结构——例如轻量级、标准、高级——使得更容易一致地分配和调整上限。

  • 保守地开始。根据用户的请求增加上限比处理超额对话要容易得多。

  • 为高级用户(工程师、数据科学家、研究人员)设置更高或无上限的个人限制,但通过确保他们为正确的任务使用正确的 Claude 模型来抵消这一点。

  • 每月监控个人使用情况报告,以识别异常用户——既包括持续达到上限的用户(可能需要更多),也包括消费很少的用户(可能尚未激活)。


模型选择指南

管理员可以做的最有影响力的事情之一是为用户设置清晰的指导,说明哪个模型适合哪些任务。模型选择对支出有直接且重大的影响。

努力程度是第二个消费杠杆。用户可以选择 Claude 对每个响应应用多少思考,更高的努力程度比更低的努力程度消耗更多的令牌。鼓励用户仅为最具挑战性的任务保留最大努力,并为日常任务使用较低的努力程度。

正确的任务使用正确的模型

模型

最适合

令牌强度

推荐用途

Claude Fable

长期代理编码工作和推理任务

非常高

保留用于您最高价值、最复杂的代理工作。高级定价和比 Opus 更快的使用速度。

Claude Opus

复杂推理、研究、多步骤任务

仅保留给高级用户或特定工作流

Claude Sonnet

日常任务、写作、分析、问答

中等

所有用户的默认模型——设置为您的组织范围默认值(见下文)

Claude Haiku

简单查询、摘要、快速响应

大容量、轻量级自动化任务

设置您的组织的默认模型

除了指导用户选择正确的模型外,您还可以为组织中的每个人设置新对话开始时使用的模型。这是最直接的消费杠杆之一——默认值决定了大多数用户每天运行的内容。

您有两个选项:

  • Anthropic 推荐——随着新模型的发布自动更新,因此您的组织始终使用我们当前推荐的通用模型,无需手动维护。

  • 选择您自己的——将特定模型设置为组织默认值,并将其保持在那里,直到您更改它。当您想要标准化已知模型以实现消费可预测性时使用此选项(例如,默认使用 Sonnet 而不是 Opus)。

此设置适用于聊天、Claude Cowork、Claude Code(CLI 2.1.199 或更高版本)和 Claude for Microsoft 365 中的新对话。如果所选模型在产品中不可用,则使用 Anthropic 的推荐默认值。如果您还通过托管设置为 Claude Code 固定模型,该设置对 CLI 和 IDE 优先。请参阅 为您的组织设置默认模型

您还可以通过自定义角色按角色设置模型默认值,以便不同的组可以从不同的模型开始——例如,将您的工程组默认为一个模型,将组织的其余部分默认为另一个模型。这与您已配置的 RBAC 组自然配对(见第 2 部分)。

如何配置:组织设置 → 模型。

注意:用户对新对话的当前模型选择可能会被清除,因此他们将在下一次对话时选择组织默认值。

为您的组织管理模型访问权限

除了设置默认值外,您还可以限制哪些模型可用——这是比仅指导更强的杠杆。这在两个级别上工作:

  • 组织级别:每个模型对所有人(包括所有者和管理员)启用或禁用。在此处禁用模型会将其从整个组织的每个选择器中删除。

  • 自定义角色级别:对于自定义角色上的成员,每个角色授予对组织级别启用内容的子集的访问权限。角色无法授予组织已禁用的模型——组织设置始终是上限。

如果成员属于具有不同自定义角色的多个组,访问权限是累加的——他们获得其任何角色授予的每个模型(只要它在组织范围内启用)。

按角色限制努力程度

除了限制角色可以使用的模型外,您还可以限制该角色上的成员每个模型可以选择的最大努力程度——这是上面已涵盖的努力指导的更精细版本。这仅适用于自定义角色,不适用于组织级别。如果成员有多个角色,这些角色中最高的努力上限获胜。

管理员提示:配对模型 + 努力限制

如果模型指导("Sonnet 是您的默认值"消息)没有奏效,您仍然看到大量 Opus 消费,限制 Opus 访问权限到特定角色——或将非高级用户角色的努力限制为中等/高而不是最大——是下一个杠杆。为深度推理真正有回报的角色保留完全访问权限。

适用范围

模型访问和努力限制在大多数 Claude 产品中强制执行,包括聊天(网络、桌面、移动)、Claude Cowork 和 Claude Code(CLI 2.1.199 或更高版本——早期版本仍显示受限选项,但使用它们的请求被拒绝)。Claude in Chrome 和 Claude Security 尚不支持此功能。有关支持的产品的当前列表,请参阅 为您的组织管理模型访问权限

如何配置:组织设置 → 角色 → 选择角色 → 模型选项卡。设置模型访问权限、每个模型的可选努力上限和可选角色级别默认模型。要在整个组织中管理配置,请转到组织设置 → 模型 更多详情请参阅 为您的组织管理模型访问权限

管理员配置建议

  • 如果您有大容量、低复杂性的工作流(例如,总结支持工单、生成初稿电子邮件),请评估 Haiku 是否更合适——它可以显著减少这些用例的消费。

  • 定期审计用户实际选择的模型。如果大部分消费都在 Opus 上,这表明你的模型指导没有有效传达。

如何向用户说明模型选择

Sonnet 是你的日常工具。它速度快、功能强大,专为绝大多数任务设计——写作、分析、编码帮助和问答。

Opus 用于更复杂的工作。当你处理真正复杂的多步骤问题,或质量比速度更重要时,使用它。

不确定时,从 Sonnet 开始。如果需要更深入的分析,你可以在对话中途切换到 Opus。


使用组织指导来塑造用户行为

组织指导让管理员可以在整个组织的每个 Claude 对话中注入常规指导——有效地为 Claude 提供反映团队规范、最佳实践和防护栏的系统提示。这是一个高杠杆工具,可以改变用户行为而不增加摩擦,因为指导在使用时直接显示在产品中,而不是在用户必须查找的文档中。

你可以使用组织指导来管理消费和使用模式的几种方式:

  • 劝阻令牌密集型输出格式。如果你注意到某种特定工件类型的增加(例如,在跨职能线程中共享的 HTML 仪表板,而更简单的格式就足够了),你可以指示 Claude 在生成前向用户确认。这增加了一个轻量级检查,而不会完全移除该功能。

  • 引导用户使用内部资源。在偏好设置中直接引用你团队的 wiki、最佳实践文档或使用指南。Claude 会在相关时显示它们——引导用户使用正确的内部上下文,而不是每次都重新发明。

  • 强化模型选择规范。提醒 Claude(进而提醒用户)Sonnet 是默认选项,Opus 保留用于特定工作流。这补充了用户教育,而不需要每个人都提前内化。


跟踪使用情况和支出

分析页面

用户菜单中的分析页面(claude.ai/analytics)是快速了解你的组织的最快方式。它显示每周活跃用户、座位利用率、热门连接器、总支出(MTD/QTD/YTD)、按模型的支出和前 10 名按支出排名的用户排行榜。聊天、Claude Code、Cowork 和 Claude Design 的产品特定视图分别显示每个界面的活动。了解更多

技能分析和每项技能的投资回报率

每项技能代表一个可重复的工作流——准备销售电话、审查合同——所以其成本可以直接与该工作流的价值进行权衡。分析中的技能视图显示你的组织中每项技能的用户、每次使用的成本和总使用次数,可按组("我的法律团队使用哪些技能?")或产品界面进行筛选。

要运行投资回报率分析:

  1. 从技能视图将技能表导出为 CSV。

  2. 为每项技能分配每次运行的价值——完成任务价值的粗略估计,例如它替代的员工时间(例如,"准备销售电话对我们来说价值约 $20")。

  3. 在电子表格中计算:(每次运行的价值 − 每次使用的成本)× 总使用次数 = 每项技能产生的净价值。

计算目前在产品外进行,但 CSV 导出使其成为快速的电子表格练习。即使是粗略估计也能讲述一个引人注目的故事:一项成本为 $0.90 的通话准备技能,相对于 $20 的价值,每次使用都能获得 20 倍的回报。

支出报告 CSV 导出

如果你需要一次性详细的分解,你可以从分析页面将按用户、按模型的支出报告导出为 CSV:在概览选项卡上的支出部分("Claude 的成本是多少?")中,点击"导出支出报告"并选择 MTD、上个月、过去 90 天或最多 90 天前的自定义范围。

分析聊天

分析聊天让你用自然语言提问关于你的组织使用情况的问题。输入一个问题——"显示过去 30 天的每日支出"、"谁是我们的最大支出者"、"我们的座位利用率是多少"——Claude 会返回一个图表和一个关于它发现的内容的简短书面总结。你可以跟进以细化、深入或转向,而无需重新开始。

当你有一个具体问题且不想浏览仪表板时,或当你在探索趋势并想要快速的来回时,使用此功能。结果默认涵盖过去 30 天;如果你需要,在你的问题中指定不同的范围。数据每天刷新。了解更多

分析 API

对于程序化访问,使用 Claude Enterprise 分析 API。拉取按令牌使用或美元支出排名的用户列表,或查看按产品、模型、RBAC 组、上下文窗口、区域或服务层(标准与快速)分解的使用和成本趋势。按 RBAC 组对成本报告进行分组可获得每个部门的支出,用于退款,而无需导出按用户行。每个请求的宽度上限为 31 天,从过去 365 天内开始,不早于 2026 年 1 月 1 日。

你的主要所有者可以在组织设置 > API 下使用 read:analytics 范围创建密钥。成本和使用数据通常在大约四小时内到达(偶尔长达 24 小时),可以在 30 天内修订,因此查询 30 天以上前的日期以获得发票级别的总计。用户、技能、插件和连接器等参与端点每天更新,大约有一天的延迟。了解更多并查看API 参考指南

按用户的技能、插件和连接器使用情况

分析 API 还按用户分解技能、插件和连接器的使用情况。skillspluginsconnectors 端点各支持 group_by[]=user_id 参数,将你在仪表板中看到的组织范围总计转换为每个用户每项技能(或插件或连接器)一行——所以你可以看到确切谁在运行给定的技能、频率如何,以及哪些团队成员实际上调用了你推出的插件。你也可以按 RBAC 组或产品界面分组,或按名称筛选到单个技能、插件或连接器。

这对于上述相同的按技能投资回报率问题很有用,只是按个人用户分解而不是导出到电子表格——例如,确认插件推出实际上与分发给它的团队一起进行,而不仅仅是检查它是否已安装。在 API 参考中了解更多:技能插件连接器

管理员 API

对于在许多组中管理限制的组织,管理员 API 将成本控制工作流移到脚本中——自动化增加请求审查、标记接近限制的成员,以及大规模显示快速变化的使用情况。该 API 读取每个成员的有效限制和月初至今的支出,并设置或清除按用户的覆盖。组、座位类型和组织级别的限制仍在组织设置中配置。管理员 API 的用户管理端点(目前对企业组织处于测试阶段)还允许你以编程方式创建组、添加或删除成员以及读取你的自定义角色。请参阅用户管理

支出阈值警报

支出阈值警报在达到组织级别支出限制的 75% 和 90% 时通知管理员,让你有时间在任何人被阻止中途任务之前提高上限。


最终用户教育

技术控制会让你走大部分路,但用户行为驱动其余的。理解消费如何运作的团队会独立做出更好的选择——并为你减少需要排查的边界情况。

与最终用户沟通的内容

当你入职用户时,分享以下内容:

Claude 如何计费

  • 使用以令牌衡量。长提示和长对话消耗更多令牌。

  • Claude Code 和 Cowork 会话的令牌密集程度明显高于聊天。单个长编码会话可以使用比典型聊天会话多得多的令牌。

  • 通过切换到设置 → 使用情况在设置中检查你的使用情况。

如何选择模型

  • Sonnet 是默认选项,可以很好地处理大多数任务。仅当 Sonnet 无法让你达到目标时才使用 Opus。

  • 你的组织为新对话设置了默认模型;你仍然可以在对话中途切换模型,当任务需要时。

  • 模型选择器在界面中可见——提醒用户检查它,特别是如果他们在运行复杂任务。

  • 模型选择器是粘性的,所以养成检查它是你想使用的模型的习惯。

  • 努力级别显示在模型名称旁边。更高的努力意味着更彻底的响应,但令牌消耗更高,所以将其与任务相匹配。

达到上限时会发生什么

  • 用户在接近支出限额时会收到产品内通知,一旦达到限额,可以点击"请求更多使用量"向管理员发送增加请求,无需离开Claude。告知用户谁是批准者以及预期的处理时间。

  • 他们已经生成的任何内容都不会丢失。已在进行中的请求会完成,但进一步的请求会被阻止,因此多步骤的Claude Code或Claude Cowork任务可能会在完成前暂停。一旦管理员提高限额,或在每月1日00:00 UTC时限额重置后,他们可以立即继续工作。

与用户分享的资源

这是否解答了您的问题?