無論您是剛開始為 Claude API 部署設置保護措施,還是您的部署已在運行,以下是在構建自己的 AI 安全計畫時應考慮的一些策略。這些建議旨在幫助您遵守我們的服務條款和使用政策,這些政策禁止對 Claude 的某些使用。未能遵守服務條款和使用政策可能導致您對服務的訪問被暫停或終止。
基本保護措施
存儲與每個 API 呼叫相關聯的 ID,以便在需要查找特定違規內容時,您能夠在系統中找到它。
考慮為用戶分配 ID,這可以幫助您追蹤違反 Anthropic AUP 的特定個人,允許在濫用情況下採取更有針對性的行動。
是否通過 API 將 ID 傳遞給 Anthropic 由您決定。但是,如果提供,我們可以更精確地查明違規。為了幫助保護最終用戶的隱私,傳遞的任何 ID 應進行密碼雜湊處理。
考慮要求客戶在使用 Claude 之前在您的平台上註冊帳戶
確保您的客戶了解允許的使用方式
中級保護措施
創建自訂框架,將最終用戶與 Claude 的互動限制在有限的提示集合中,或僅允許 Claude 審查您已有的特定知識庫,這將降低用戶從事違規行為的能力。
Anthropic 默認對 API 輸入和輸出運行實時保護措施。沒有額外的選擇加入篩選器可啟用。您可以在應用程式中添加自己的審核層;請參閱開發人員文檔中的審核指南。
針對 Bedrock 客戶:
啟用您的私有 S3 儲存桶,以存儲提示和完成結果供您自己評估
進階保護措施
在將所有最終用戶提示發送到 Claude 之前,針對它們運行審核 API,以確保它們不有害
全面保護措施
設置內部人工審查系統,以標記由 Claude(用於內容審核)或審核 API 標記為有害的提示,以便您可以進行干預,限制或移除違規率高的用戶。
