跳转到主要内容

API 保护工具

无论您是刚开始为 Claude API 部署设置保护措施,还是您的部署已在运行,以下是构建自己的 AI 安全计划时需要考虑的一些策略。这些建议旨在帮助您遵守我们的服务条款使用政策,这些条款禁止对 Claude 的某些使用方式。不遵守服务条款使用政策可能导致您的服务访问权限被暂停或终止。

基本保护措施

  • 存储与每个 API 调用关联的 ID,以便在需要查找特定违规内容时,您能够在系统中找到它。

  • 考虑为用户分配 ID,这可以帮助您追踪违反 Anthropic 使用政策的特定个人,在滥用情况下采取更有针对性的行动。

    • 是否通过 API向 Anthropic 传递 ID 由您决定。但如果提供,我们可以更精确地查明违规行为。为了保护最终用户的隐私,传递的任何 ID 都应进行加密哈希处理。

  • 考虑要求客户在使用 Claude 之前在您的平台上注册账户

  • 确保您的客户了解允许的使用方式

  • 对于重复违反 Anthropic服务条款使用政策的用户,发出警告、限流或暂停其访问权限

中级保护措施

  • 创建自定义框架,将最终用户与 Claude 的交互限制在有限的提示集合内,或仅允许 Claude 审查您已有的特定知识库,这将降低用户从事违规行为的能力。

  • Anthropic 默认对 API 输入和输出运行实时保护措施。没有额外的选择加入过滤器可启用。您可以在应用程序中添加自己的审核层;请参阅开发者文档中的审核指南。

  • 针对 Bedrock 客户:

    • 激活您的私有 S3 存储桶,以存储提示和完成结果供您自己评估

高级保护措施

综合保护措施

  • 建立内部人工审查系统,标记由 Claude(用于内容审核)或审核 API 标记为有害的提示,以便您可以进行干预,限制或删除违规率高的用户。

这是否解答了您的问题?