Passer au contenu principal

Outils de protection des API

Que vous commenciez tout juste à mettre en place des protections pour votre déploiement d'API Claude ou que votre déploiement soit déjà en cours d'exécution, voici quelques stratégies à considérer lors de la création de votre propre programme de sécurité de l'IA. Ces suggestions sont conçues pour vous aider à respecter nos Conditions de service et notre Politique d'utilisation, qui interdisent certains usages de Claude. Le non-respect des Conditions et de la Politique d'utilisation peut entraîner la suspension ou la résiliation de votre accès aux services.

Protections de base

  • Stockez les identifiants associés à chaque appel API, afin que si vous ayez besoin de localiser un contenu spécifique violant les règles, vous puissiez le retrouver dans vos systèmes.

  • Envisagez d'attribuer des identifiants aux utilisateurs, ce qui peut vous aider à suivre les individus spécifiques qui violent la politique d'utilisation d'Anthropic, permettant une action plus ciblée en cas d'abus.

    • Le choix de transmettre des identifiants à Anthropic via l'API vous appartient. Cependant, s'ils sont fournis, nous pouvons localiser les violations de manière plus précise. Pour aider à protéger la confidentialité des utilisateurs finaux, tous les identifiants transmis doivent être hachés de manière cryptographique.

  • Envisagez d'exiger que les clients créent un compte sur votre plateforme avant d'utiliser Claude

  • Assurez-vous que vos clients comprennent les usages autorisés

  • Avertissez, limitez ou suspendez les utilisateurs qui violent à plusieurs reprises les Conditions de service et la Politique d'utilisation d'Anthropic

Protections intermédiaires

  • Créez des cadres de personnalisation qui limitent les interactions des utilisateurs finaux avec Claude à un ensemble limité d'invites ou qui permettent uniquement à Claude d'examiner un corpus de connaissances spécifique que vous possédez déjà, ce qui réduira la capacité des utilisateurs à adopter un comportement violant les règles.

  • Anthropic exécute des protections en temps réel sur les entrées et sorties de l'API par défaut. Il n'y a pas de filtre d'activation supplémentaire. Vous pouvez ajouter votre propre couche de modération dans votre application ; consultez les conseils de modération dans la documentation pour les développeurs.

  • Pour les clients Bedrock :

    • Activez votre compartiment S3 privé pour stocker les invites et les complétions à des fins d'évaluation

Protections avancées

Protections complètes

  • Mettez en place un système d'examen humain interne pour signaler les invites marquées par Claude (utilisées pour la modération de contenu) ou une API de modération comme nuisibles afin que vous puissiez intervenir pour restreindre ou supprimer les utilisateurs ayant des taux de violation élevés.

Avez-vous trouvé la réponse à votre question ?