Независимо от того, только ли вы начинаете процесс настройки защиты для развертывания API Claude или ваше развертывание уже работает, вот некоторые стратегии, которые следует учитывать при создании собственной программы безопасности ИИ. Эти рекомендации предназначены для помощи в соответствии с нашими Условиями обслуживания и Политикой использования, которые запрещают определенные способы использования Claude. Несоблюдение Условий и Политики использования может привести к приостановке или прекращению доступа к услугам.
Базовая защита
Сохраняйте идентификаторы, связанные с каждым вызовом API, чтобы при необходимости выявить конкретный нарушающий контент у вас была возможность найти его в ваших системах.
Рассмотрите возможность назначения идентификаторов пользователям, что может помочь вам отследить конкретных лиц, нарушающих AUP Anthropic, позволяя принимать более целенаправленные меры в случаях неправомерного использования.
Выбор передачи идентификаторов в Anthropic через API остается за вами. Однако, если они предоставлены, мы можем более точно выявить нарушения. Чтобы защитить конфиденциальность конечных пользователей, любые переданные идентификаторы должны быть криптографически хеширован.
Рассмотрите требование к клиентам зарегистрировать учетную запись на вашей платформе перед использованием Claude
Убедитесь, что ваши клиенты понимают допустимые способы использования
Предупреждайте, ограничивайте или приостанавливайте пользователей, которые повторно нарушают Условия обслуживания и Политику использования Anthropic
Промежуточная защита
Создавайте фреймворки настройки, которые ограничивают взаимодействие конечных пользователей с Claude ограниченным набором подсказок или позволяют Claude только проверять определенный корпус знаний, который у вас уже есть, что снизит способность пользователей участвовать в нарушающем поведении.
Anthropic по умолчанию запускает защиту в реальном времени для входных и выходных данных API. Нет дополнительного фильтра для включения. Вы можете добавить свой собственный уровень модерации в своем приложении; см. рекомендации по модерации в документации разработчика.
Для клиентов Bedrock:
Активируйте свой приватный бакет S3 для сохранения подсказок и завершений для вашей собственной оценки
Продвинутая защита
Запустите API модерации для всех подсказок конечных пользователей перед их отправкой в Claude, чтобы убедиться, что они не вредоносны
Комплексная защита
Установите внутреннюю систему проверки человеком для отметки подсказок, которые помечены Claude (используется для модерации контента) или API модерации как вредоносные, чтобы вы могли вмешаться и ограничить или удалить пользователей с высокими показателями нарушений.
