Claude Enterprise предоставляет вашей организации доступ к мощному ИИ через чат, Claude Code, Claude Cowork, Claude Design и Claude в инструментах, которые ваши команды уже используют, включая Microsoft 365, Chrome и Slack. С этим доступом приходит ответственность за эффективное управление потреблением — обеспечение максимальной ценности для вашей команды при сохранении предсказуемого использования и соответствии бюджету.
Это руководство помогает администраторам Enterprise разобраться с ключевыми инструментами управления потреблением токенов: установка лимитов расходов, настройка управления доступом на основе ролей, обучение пользователей и выбор подходящей модели и уровня усилий для каждой задачи.
Почему управление потреблением важно
Claude Enterprise использует модель ценообразования на основе количества мест и использования. Пул потребления вашей организации общий для всех пользователей, и некоторые поверхности — особенно Claude Code и Cowork — потребляют токены значительно быстрее, чем стандартный чат.
Администраторы, которые активно устанавливают лимиты расходов и обучают пользователей, могут снизить потери и обеспечить, чтобы высокоценные варианты использования получили необходимую емкость.
Понимание интенсивности токенов на разных поверхностях
Поверхность | Интенсивность токенов и что её определяет |
Core Chat | Низкая интенсивность. Стандартный диалог, суммирование, составление текстов и вопросы-ответы. Использование токенов масштабируется в зависимости от длины сообщения и истории беседы. |
Claude Code | Высокая интенсивность. Каждая сессия кодирования включает системные подсказки, контекст файлов, вызовы инструментов и многоходовое рассуждение — больше токенов за сессию, чем в чате. |
Claude Cowork | Высокая интенсивность. Агентские рабочие процессы, многошаговое выполнение задач и Skills генерируют значительное промежуточное использование токенов, которое может быть невидимо для конечных пользователей. |
Другие поверхности также используют ресурсы вашей организации и отображаются как отдельные продукты в Analytics, экспорте расходов и Analytics API: (a) Claude для M365 (Excel, PowerPoint, Word, надстройки Outlook), подчиняется тем же лимитам расходов организации, группы и пользователя, а также ограничениям модели; (b) Claude Design (бета), который выставляет счета из потребления вашей организации по стандартным ставкам API с применением лимитов организации, группы и пользователя; (c) Claude в Chrome, боковая панель которого работает как сессия Claude Cowork, поэтому многошаговые задачи просмотра потребляют как другая агентская работа Cowork (управляется в Organization settings > Cowork); (d) Claude Tag (Claude в Slack, бета), работа канала которого выставляет счета на баланс использования организации, а не на отдельные места, поэтому лимиты пользователя и группы его не ограничивают; установите лимит расходов Claude Tag (и дополнительные лимиты по каналам) на claude.ai/admin-settings/usage/claude-tag. Прямые сообщения с Claude Tag выставляют счета на место отправителя.
Совет администратора: установите ожидания с вашей командой
Пользователи, запускающие рабочие процессы Claude Code или Cowork, могут не осознавать, насколько интенсивны их сессии по токенам. Одна задача Cowork или сессия отладки Claude Code может потребить намного больше токенов, чем чат. Включите этот контекст в любое обучение пользователей, которое вы отправляете.
Управление доступом на основе ролей
Управление доступом на основе ролей (RBAC) позволяет группировать пользователей и управлять их доступом к поверхностям Claude и бюджетам потребления как единицей, а не по отдельности. Это наиболее масштабируемый способ управления использованием в крупных организациях.
Как структурировать группы
Думайте о группах с точки зрения функции работы и варианта использования, а не организационной иерархии. Несколько принципов:
Создавайте группы, которые соответствуют различным моделям использования, а не ячейкам организационной схемы. «Engineering» и «Sales» более полезны, чем «North America» и «EMEA» для управления потреблением.
Ограничьте распространение групп. Более 8–10 групп становится сложно управлять. Начните с 4–6 и разделяйте только если модели использования явно расходятся.
Используйте группы для ограничения доступа к высокоинтенсивным поверхностям. Например: только члены группы «Engineering» могут получить доступ к Claude Code; другие пользователи видят только Chat и Cowork. Доступ предоставляется пользовательскими ролями, которые вы назначаете каждой группе, и вступает в силу только для членов, чья организационная роль установлена на Custom. Члены, оставленные на встроенной роли User, сохраняют всё включённым на уровне организации. Группы можно создавать вручную или синхронизировать с вашего поставщика идентификации. См. Set up role-based permissions on Enterprise plans.
Назначьте лимиты расходов на уровне группы в качестве отправной точки, затем переопределите на уровне пользователя для исключений (например, нетехнический PM, которому нужен Claude Code для конкретного проекта).
Управление расходами группы
После настройки групп:
Проверяйте потребление группы еженедельно во время начального развёртывания, ежемесячно после этого.
Когда группа постоянно приближается к своему лимиту, проведите расследование перед автоматическим его повышением — правильный ответ может быть рекомендацией модели (используйте Sonnet вместо Opus), а не большим бюджетом.
Рассмотрите возможность назначения «владельца группы» в каждом отделе, который отвечает за проверку использования и ответы на вопросы своей команды. Это распределяет нагрузку администратора и вовлекает кого-то с деловым контекстом. Вам не нужно делать этих людей Owners или Admins: создайте пользовательскую роль, которая предоставляет разрешение администратора Analytics (Can view) — и опционально Billing (Can view), чтобы они могли видеть страницу Usage — и назначьте её небольшой группе «usage reviewers». Разрешения администратора применяются только к членам, чья роль установлена на Custom, и доступ к просмотру Analytics охватывает всю организацию, а не ограничивается их группой.
Совет по управлению: доступ к поверхностям как первый фильтр
Прежде чем беспокоиться о лимитах на уровне токенов, убедитесь, что нужные люди имеют доступ к нужным поверхностям. Предоставление всем доступа к Claude Code и Cowork в первый день — это самый быстрый способ создать неожиданное потребление. Развёртывайте высокоинтенсивные поверхности волнами, начиная с команд, которые с наибольшей вероятностью будут их использовать продуктивно.
Установите лимиты расходов
Лимиты расходов — это ваш основной инструмент управления потреблением. Claude Enterprise позволяет администраторам устанавливать лимиты на трёх уровнях: уровень организации, уровень группы (с RBAC) и уровень отдельного пользователя. Наш рекомендуемый подход — начать с лимитов на уровне группы RBAC и лимитов на пользователя — они дают вам точное, целевое управление без риска отключить всю организацию, если лимит будет достигнут.
Лимиты расходов на уровне организации
Лимит на уровне организации доступен как жёсткий потолок для всех пользователей и поверхностей, но используйте его осторожно: его достижение влияет на всех одновременно, что может быть разрушительным. Большинство администраторов обнаруживают, что управление потреблением на уровне группы и пользователя даёт им лучшие результаты с меньшим операционным риском.
Лимит расходов группы
Лимиты расходов группы позволяют назначить ежемесячный лимит расходов на пользователя для всей группы, поэтому каждый член группы наследует один и тот же лимит без его индивидуальной установки. Это наиболее масштабируемый способ управления потреблением в средних и крупных организациях, и это то, с чего должны начать администраторы.
Обратите внимание на следующие правила приоритета:
Индивидуальные лимиты всегда переопределяют лимиты группы, независимо от того, какой выше.
Если пользователь принадлежит нескольким группам с разными лимитами, параметр Multi-group spend limit в разделе Spending defaults определяет, применяется ли более высокий или более низкий лимит. Лимит по умолчанию для типа места включён в это сравнение.
Лимиты на уровне организации остаются жёстким потолком.
Нет лимита нигде = нет лимита. Если у члена нет индивидуального лимита и ни одна из его групп не имеет лимита, его расходы не ограничены.
Как настроить: Organization settings → Usage → By group. Установите лимиты на определённую сумму в долларах или «Unlimited».
Лимиты расходов на уровне пользователя
Лимиты на уровне пользователя позволяют устанавливать лимиты потребления для отдельных учётных записей. Они необходимы для организаций, где использование значительно варьируется в зависимости от ролей — разработчик, использующий Claude Code ежедневно, имеет совсем другие потребности, чем маркетолог, использующий чат для написания текстов.
Лучшие практики для лимитов на уровне пользователя:
Определите уровни потребления на основе типа роли перед развёртыванием. Структурированная система — например, light, standard, power — облегчает последовательное назначение и корректировку лимитов.
Начните консервативно. Легче увеличить лимит по запросу пользователя, чем разбираться с переполнением.
Дайте опытным пользователям (инженерам, специалистам по данным, исследователям) более высокие или неограниченные индивидуальные лимиты, но компенсируйте это, убедившись, что они используют правильную модель Claude для правильной задачи.
Ежемесячно отслеживайте отчеты об использовании, чтобы выявить выбросы — пользователей, постоянно достигающих лимита (может потребоваться больше), и пользователей, потребляющих очень мало (возможно, еще не активированы).
Рекомендации по выбору модели
Одно из самых эффективных действий администратора — дать четкие рекомендации пользователям о том, какую модель использовать для каких задач. Выбор модели напрямую и значительно влияет на расходы.
Уровень усилий — второй рычаг потребления. Пользователи могут выбирать, сколько размышлений Claude применяет к каждому ответу, и более высокие уровни усилий потребляют больше токенов, чем более низкие. Рекомендуйте пользователям зарезервировать максимальное усилие только для самых сложных задач и использовать более низкие уровни для рутинных задач.
Правильная модель для правильной задачи
Модель | Лучше всего подходит для | Интенсивность токенов | Рекомендуемое использование |
Claude Fable | Многодневная агентивная работа по кодированию и задачи рассуждения | Очень высокая | Зарезервируйте для вашей наиболее ценной и сложной агентивной работы. Премиум-цены и более быстрое потребление, чем Opus. |
Claude Opus | Сложное рассуждение, исследования, многошаговые задачи | Высокая | Зарезервируйте только для опытных пользователей или конкретных рабочих процессов |
Claude Sonnet | Повседневные задачи, написание, анализ, вопросы и ответы | Средняя | Модель по умолчанию для всех пользователей — установите как стандартную для всей организации (см. ниже) |
Claude Haiku | Простые поиски, резюме, быстрые ответы | Низкая | Высокообъемные задачи легкой автоматизации |
Установите модель по умолчанию для вашей организации
Помимо рекомендаций пользователям выбирать правильную модель, вы можете установить модель, с которой начинаются новые беседы для всех в вашей организации. Это один из наиболее прямых рычагов потребления — стандартная модель определяет, что большинство пользователей используют ежедневно.
У вас есть два варианта:
Рекомендуется Anthropic — автоматически обновляется при выпуске новых моделей, поэтому ваша организация всегда начинает с нашей текущей рекомендуемой универсальной модели без ручного обслуживания.
Выберите свою — устанавливает конкретную модель как стандартную для организации и сохраняет ее там, пока вы не измените ее. Используйте это, когда хотите стандартизировать известную модель для предсказуемости потребления (например, использование Sonnet вместо Opus).
Этот параметр применяется к новым беседам в чате, Claude Cowork, Claude Code (CLI 2.1.199 или позже) и Claude для Microsoft 365. Если выбранная модель недоступна в продукте, используется рекомендуемое по умолчанию значение Anthropic. Если вы также закрепляете модель для Claude Code через управляемые параметры, этот параметр имеет приоритет для CLI и IDE. См. Установите модель по умолчанию для вашей организации.
Вы также можете установить стандартные модели по ролям через пользовательские роли, чтобы разные группы начинали с разными моделями — например, установить группе инженеров одну модель, а остальной организации другую. Это естественно сочетается с группами RBAC, которые вы уже настроили (см. раздел 2).
Как настроить: Параметры организации → Модели.
Примечание: Текущий выбор модели пользователями для новых бесед может быть очищен, поэтому они будут использовать стандартную модель организации в следующей беседе.
Управляйте доступом к моделям для вашей организации
Помимо установки стандартной модели, вы можете ограничить, какие модели доступны вообще — более сильный рычаг, чем просто рекомендации. Это работает на двух уровнях:
Уровень организации: каждая модель включена или отключена для всех, включая владельцев и администраторов. Отключение модели здесь удаляет ее из каждого выбора по всей организации.
Уровень пользовательской роли: для членов с пользовательскими ролями каждая роль предоставляет доступ к подмножеству того, что включено на уровне организации. Роль не может предоставить модель, которую организация отключила — параметр организации всегда является потолком.
Если член принадлежит нескольким группам с разными пользовательскими ролями, доступ суммируется — они получают каждую модель, которую предоставляет любая из их ролей (при условии, что она включена на уровне организации).
Ограничение уровня усилий по ролям
Помимо ограничения моделей, которые может использовать роль, вы можете ограничить максимальный уровень усилий, который члены этой роли могут выбрать для каждой модели — более детальная версия рекомендаций по усилиям, уже рассмотренных выше. Это применяется только к пользовательским ролям, а не на уровне организации. Если у члена несколько ролей, применяется наивысший лимит усилий среди этих ролей.
Совет администратора: объедините ограничения модели и усилий
Если рекомендации по модели (сообщение «Sonnet — ваша стандартная модель») не срабатывают и вы все еще видите интенсивное потребление Opus, ограничение доступа к Opus для конкретных ролей или ограничение усилий до среднего/высокого вместо максимального для ролей, не являющихся опытными пользователями, — это следующий рычаг. Зарезервируйте полный доступ для ролей, где глубокое рассуждение действительно окупается.
Где это применяется
Ограничения доступа к моделям и усилиям применяются в большинстве продуктов Claude, включая чат (веб, рабочий стол, мобильный), Claude Cowork и Claude Code (CLI 2.1.199 или позже — более ранние версии по-прежнему показывают ограниченные параметры, но запросы с их использованием отклоняются). Claude в Chrome и Claude Security пока не поддерживают это. Для текущего списка поддерживаемых продуктов см. Управляйте доступом к моделям для вашей организации.
Как настроить: Параметры организации → Роли → выберите роль → вкладка Модели. Установите доступ к модели, необязательный лимит усилий для каждой модели и необязательную стандартную модель на уровне роли. Для управления конфигурацией по всей организации перейдите в Параметры организации → Модели. Дополнительные сведения см. в Управляйте доступом к моделям для вашей организации.
Рекомендации по конфигурации администратора
Если у вас есть высокообъемные рабочие процессы низкой сложности (например, резюмирование билетов поддержки, создание первых черновиков писем), оцените, подходит ли Haiku лучше — он может значительно снизить потребление для этих случаев использования.
Периодически проверяйте, какие модели на самом деле выбирают ваши пользователи. Если большая часть потребления приходится на Opus, это сигнал того, что ваши рекомендации по выбору модели не работают.
Что рассказать пользователям о выборе модели
Sonnet — ваш основной инструмент. Он быстрый, очень способный и разработан для подавляющего большинства задач — написание текстов, анализ, помощь в кодировании и ответы на вопросы.
Opus предназначен для более сложной работы. Используйте его, когда вы работаете над действительно сложной многоэтапной задачей или когда качество важнее скорости.
Если сомневаетесь, начните с Sonnet. Вы всегда можете переключиться на Opus во время разговора, если вам нужна большая глубина анализа.
Использование инструкций организации для формирования поведения пользователей
Инструкции организации позволяют администраторам внедрять постоянные рекомендации в каждый разговор Claude во всей организации — фактически давая Claude системный промпт, который отражает нормы, лучшие практики и ограничения вашей команды. Это мощный инструмент для изменения поведения пользователей без добавления трений, поскольку рекомендации появляются в продукте в момент использования, а не в документации, которую пользователи должны искать.
Несколько способов использования инструкций организации для управления потреблением и паттернами использования:
Отговаривайте от форматов вывода, требующих много токенов. Если вы заметили распространение определённого типа артефакта (например, HTML-панели управления, которые делятся в кросс-функциональных потоках, где подошёл бы более простой формат), вы можете указать Claude подтвердить с пользователем перед созданием. Это добавляет лёгкую проверку без полного удаления возможности.
Направляйте пользователей на внутренние ресурсы. Ссылайтесь на вики вашей команды, документы с лучшими практиками или рекомендации по использованию прямо в настройке. Claude будет выводить их, когда это уместно — направляя пользователей к правильному внутреннему контексту вместо того, чтобы каждый раз всё переделывать.
Закрепляйте нормы выбора модели. Напомните Claude (и, соответственно, пользователям), что Sonnet — это стандартная модель, а Opus зарезервирована для конкретных рабочих процессов. Это дополняет обучение пользователей без необходимости, чтобы все это усвоили с самого начала.
Отслеживание использования и расходов
Страница аналитики
Страница аналитики в меню пользователя (claude.ai/analytics) — это самый быстрый способ получить представление о вашей организации. Она показывает еженедельно активных пользователей, использование мест, основные коннекторы, общие расходы (MTD/QTD/YTD), расходы по моделям и топ-10 пользователей по расходам. Специализированные представления для чата, Claude Code, Cowork и Claude Design разбивают активность для каждой поверхности. Узнайте больше.
Аналитика навыков и ROI по каждому навыку
Каждый навык представляет повторяемый рабочий процесс — подготовка звонка с продажами, проверка контракта — поэтому его стоимость можно напрямую сравнить с тем, что стоит этот рабочий процесс. Представление навыков в аналитике показывает пользователей, стоимость за использование и общее количество использований для каждого навыка в вашей организации, фильтруемое по группам («какие навыки использует моя юридическая команда?») или поверхности продукта.
Для проведения анализа ROI:
Экспортируйте таблицу навыков в CSV из представления навыков.
Назначьте стоимость за запуск для каждого навыка — примерную оценку того, что стоит выполненная задача, например время сотрудника, которое она заменяет (например, «подготовка звонка с продажами стоит для нас примерно $20»).
Вычислите в своей электронной таблице: (стоимость за запуск − стоимость за использование) × общее количество использований дает чистую стоимость, которую каждый навык создал.
Расчёт в настоящее время происходит вне продукта, но экспорт CSV делает это быстрым упражнением в электронной таблице. Даже грубые оценки рассказывают убедительную историю: навык подготовки звонков, стоящий $0,90 за запуск против $20 стоимости, возвращает 20-кратную прибыль при каждом использовании.
Экспорт CSV отчёта о расходах
Если вам нужна одноразовая детальная разбивка, вы можете экспортировать отчёт о расходах по пользователям и моделям в виде CSV со страницы аналитики: в разделе расходов («Сколько стоит Claude?») на вкладке обзора нажмите «Экспортировать отчёт о расходах» и выберите MTD, прошлый месяц, последние 90 дней или пользовательский диапазон до 90 дней назад.
Чат аналитики
Чат аналитики позволяет вам задавать вопросы об использовании вашей организацией на простом языке. Введите вопрос — «покажи мне ежедневные расходы за последние 30 дней», «кто наши крупнейшие плательщики», «какой у нас коэффициент использования мест» — и Claude вернёт диаграмму и краткое письменное резюме того, что он обнаружил. Вы можете продолжить, чтобы уточнить, углубиться или изменить направление без начала заново.
Используйте это, когда у вас есть конкретный вопрос и вы не хотите ориентироваться в панели управления, или когда вы исследуете тренды и хотите быстрый обмен информацией. Результаты по умолчанию охватывают последние 30 дней; укажите другой диапазон в вашем вопросе, если вам это нужно. Данные обновляются ежедневно. Узнайте больше.
API аналитики
Для программного доступа используйте Claude Enterprise Analytics API. Получите ранжированный список пользователей по использованным токенам или потраченным долларам, или посмотрите на тренды использования и стоимости во времени, разбитые по продукту, модели, группе RBAC, размеру контекстного окна, региону или уровню обслуживания (стандартный или быстрый). Группировка отчёта о стоимости по группе RBAC дает расходы по отделам для возврата средств без экспорта строк по пользователям. Каждый запрос ограничен 31 днём, начиная с последних 365 дней, и не ранее 1 января 2026 года.
Ваш основной владелец может создать ключ с областью read:analytics в разделе параметров организации > API. Данные о стоимости и использовании обычно поступают примерно через четыре часа (иногда до 24 часов) и могут быть пересмотрены в течение 30 дней, поэтому запрашивайте даты 30+ дней в прошлом для итогов уровня счёта-фактуры. Конечные точки взаимодействия, такие как пользователи, навыки, плагины и коннекторы, обновляются ежедневно с примерно однодневной задержкой. Узнайте больше и ознакомьтесь с руководством по справочнику API.
Использование навыков, плагинов и коннекторов по пользователям
API аналитики также разбивает использование навыков, плагинов и коннекторов по пользователям. Конечные точки skills, plugins и connectors каждая поддерживает параметр group_by[]=user_id, превращая организационные итоги, которые вы видите в панели управления, в одну строку на пользователя на навык (или плагин, или коннектор) — так что вы можете увидеть ровно кто запускает данный навык, как часто, и какие члены команды на самом деле вызвали плагин, который вы развернули. Вы также можете группировать по группе RBAC или поверхности продукта, или фильтровать до одного навыка, плагина или коннектора по имени.
Это полезно для тех же вопросов ROI по каждому навыку выше, просто разбитых по отдельному пользователю вместо экспорта в электронную таблицу — например, подтверждение того, что развёртывание плагина действительно достигло команды, для которой оно было распределено, а не просто проверка того, что оно было установлено. Узнайте больше в справочнике API: навыки, плагины, коннекторы.
Admin API
Для организаций, управляющих ограничениями во многих группах, Admin API переводит рабочие процессы контроля затрат в скрипты — автоматизируя проверки запросов на увеличение, отмечая членов, близких к своим ограничениям, и выявляя быстро меняющееся использование в масштабе. API читает эффективный лимит каждого члена и расходы в месяц и устанавливает или очищает переопределения для каждого пользователя. Ограничения на уровне группы, типа места и организации по-прежнему настраиваются в параметрах организации. Конечные точки управления пользователями Admin API (в настоящее время в бета-версии для организаций Enterprise) также позволяют вам создавать группы, добавлять или удалять членов и программно читать ваши пользовательские роли. См. Управление пользователями.
Оповещения о пороге расходов
Оповещения о пороге расходов уведомляют администраторов на 75% и 90% от лимита расходов на уровне организации, давая вам время поднять лимит, прежде чем кто-либо будет заблокирован в середине задачи.
Обучение конечных пользователей
Технологические средства контроля помогут вам большую часть пути, но поведение пользователей определяет остальное. Команда, которая понимает, как работает потребление, будет делать лучший выбор независимо — и выявлять меньше граничных случаев для вас, чтобы устранить неполадки.
Что сообщить конечным пользователям
При подключении пользователей поделитесь следующим:
Как выставляется счёт Claude
Использование измеряется в токенах. Длинные подсказки и длинные разговоры потребляют больше токенов.
Сеансы Claude Code и Cowork требуют значительно больше токенов, чем чат. Один длительный сеанс кодирования может использовать намного больше токенов, чем типичный сеанс чата.
Проверьте своё использование в параметрах, переключившись на Параметры → Использование.
Как выбрать модель
Sonnet — это стандартная модель и хорошо справляется с большинством задач. Используйте Opus только когда Sonnet не помогает вам достичь нужного результата.
Ваша организация имеет стандартную модель, установленную для новых разговоров; вы всё ещё можете переключать модели во время разговора, когда задача это требует.
Селектор модели виден в интерфейсе — напомните пользователям проверить его, особенно если они выполняют сложные задачи.
Селектор модели является липким, поэтому сделайте практику проверки того, что это модель, которую вы хотите использовать.
Уровень усилий отображается рядом с названием модели. Более высокий уровень усилий означает более тщательные ответы, но более высокое потребление токенов, поэтому сопоставьте его с задачей.
Что происходит при достижении лимита
Пользователи получают уведомления в приложении по мере приближения к лимиту расходов, и после его достижения могут нажать «Запросить дополнительное использование», чтобы отправить запрос на увеличение администраторам, не покидая Claude. Сообщите пользователям, кто их утверждающий, и ожидаемое время обработки.
Ничего из того, что они уже создали, не теряется. Уже отправленный запрос завершается, но дальнейшие запросы блокируются, поэтому многоэтапная задача Claude Code или Claude Cowork может приостановиться перед завершением. Они могут возобновить работу сразу же, как только администратор повысит лимит, или когда лимиты сбросятся в 00:00 UTC 1-го числа месяца.
Ресурсы для совместного использования с пользователями
