无论您是刚开始为 Claude API 部署设置保护措施,还是您的部署已在运行,以下是构建自己的 AI 安全计划时需要考虑的一些策略。这些建议旨在帮助您遵守我们的服务条款和使用政策,这些条款禁止对 Claude 的某些使用方式。不遵守服务条款和使用政策可能导致您的服务访问权限被暂停或终止。
基本保护措施
存储与每个 API 调用关联的 ID,以便在需要查找特定违规内容时,您能够在系统中找到它。
考虑为用户分配 ID,这可以帮助您追踪违反 Anthropic 使用政策的特定个人,在滥用情况下采取更有针对性的行动。
是否通过 API向 Anthropic 传递 ID 由您决定。但如果提供,我们可以更精确地查明违规行为。为了保护最终用户的隐私,传递的任何 ID 都应进行加密哈希处理。
考虑要求客户在使用 Claude 之前在您的平台上注册账户
确保您的客户了解允许的使用方式
中级保护措施
创建自定义框架,将最终用户与 Claude 的交互限制在有限的提示集合内,或仅允许 Claude 审查您已有的特定知识库,这将降低用户从事违规行为的能力。
Anthropic 默认对 API 输入和输出运行实时保护措施。没有额外的选择加入过滤器可启用。您可以在应用程序中添加自己的审核层;请参阅开发者文档中的审核指南。
针对 Bedrock 客户:
激活您的私有 S3 存储桶,以存储提示和完成结果供您自己评估
高级保护措施
在所有最终用户提示发送到 Claude 之前,对其运行审核 API,以确保它们不有害
综合保护措施
建立内部人工审查系统,标记由 Claude(用于内容审核)或审核 API 标记为有害的提示,以便您可以进行干预,限制或删除违规率高的用户。
