Claude의 API 배포를 위한 보안 설정을 시작하는 단계이든, 이미 배포가 실행 중이든, 자체 AI 안전 프로그램을 구축할 때 고려해야 할 전략들을 소개합니다. 이 제안들은 Claude의 특정 사용을 금지하는 서비스 약관 및 사용 정책을 준수하도록 돕기 위해 설계되었습니다. 약관 및 사용 정책을 준수하지 않으면 서비스 접근이 중단되거나 종료될 수 있습니다.
기본 보안 조치
각 API 호출과 연결된 ID를 저장하여 위반 콘텐츠를 특정해야 할 때 시스템에서 찾을 수 있도록 합니다.
사용자에게 ID를 할당하는 것을 고려하세요. 이를 통해 Anthropic의 AUP를 위반하는 특정 개인을 추적하고 오용 사례에 대해 더 정확한 조치를 취할 수 있습니다.
API를 통해 Anthropic에 ID를 전달하는 것은 선택사항입니다. 다만 제공된 경우, 위반 사항을 더 정확하게 파악할 수 있습니다. 최종 사용자의 개인정보 보호를 위해 전달되는 모든 ID는 암호화 해시 처리되어야 합니다.
Claude를 사용하기 전에 고객이 플랫폼에서 계정을 만들도록 요구하는 것을 고려하세요
고객이 허용된 사용 방식을 이해하도록 하세요
중급 보안 조치
Claude와의 최종 사용자 상호작용을 제한된 프롬프트 세트로만 제한하거나 이미 보유한 특정 지식 기반만 검토하도록 허용하는 커스터마이제이션 프레임워크를 만들어 사용자의 위반 행동 가능성을 줄입니다.
Anthropic은 기본적으로 API 입력 및 출력에 대한 실시간 보안 조치를 실행합니다. 추가 옵트인 필터는 없습니다. 애플리케이션에 자체 조정 계층을 추가할 수 있습니다. 개발자 문서의 조정 지침을 참조하세요.
Bedrock 고객의 경우:
프롬프트와 완성도를 자체 평가하기 위해 저장할 수 있도록 프라이빗 S3 버킷을 활성화하세요
고급 보안 조치
Claude로 전송되기 전에 모든 최종 사용자 프롬프트에 대해 조정 API를 실행하여 해롭지 않은지 확인하세요
포괄적 보안 조치
Claude(콘텐츠 조정에 사용됨) 또는 조정 API에 의해 해롭다고 표시된 프롬프트를 플래그하는 내부 인간 검토 시스템을 설정하여 위반 비율이 높은 사용자를 제한하거나 제거할 수 있도록 합니다.
