Claude Enterprise Inference Hooks: 모든 프롬프트 앞에 DLP 검사점을 놓는 방법
요약
Anthropic은 2026년 8월 5일 Claude Enterprise에 Inference Hooks 베타를 출시했다. 모든 직원 프롬프트가 조직의 DLP(Data Loss Prevention) 또는 보안 서버를 통과한 뒤 모델에 도달하는 구조다. 프롬프트가 claude.ai 서버에 도착하면 Anthropic이 해당 대화 트랜스크립트를 서명된 HTTPS POST로 조직 서버에 전송하고, 서버는 5초 이내 allow 또는 deny 판정을 돌려준다. 판정 없이는 Claude가 추론을 시작하지 않는다.
기존 클라이언트-사이드 DLP 프록시(CASB, 브라우저 확장)가 커버하지 못했던 API, Claude Code CLI, Cowork를 단일 조직 설정 하나로 통제할 수 있다는 점이 핵심이다. 판정은 이진값(allow/deny)이며 프롬프트 수정·마스킹은 지원하지 않는다. 응답 측 검사는 문서화 기준으로 현재 미지원, 향후 예정이다.
배경: 기업 Claude 도입과 DLP 공백
기존 거버넌스 계층
Claude Enterprise는 출시 시점부터 조직 프롬프트를 모델 학습에 사용하지 않는 정책과 SSO/SCIM, 역할 기반 접근 제어, 감사 로그를 제공해 왔다. 그러나 인라인 콘텐츠 검사는 빠져 있었다.
기업 보안팀이 LLM 도입 시 실제로 우려하는 시나리오는 세 가지다.
| 시나리오 | 위험 | 기존 방어 한계 |
|---|---|---|
| PII/개인정보 포함 프롬프트 | GDPR·CCPA 위반 | 직원 교육에 의존, 자동 차단 불가 |
| 소스코드·설계 문서 업로드 | IP 유출 우려 | API 키 관리 외 기술 통제 없음 |
| 내부 보고서·재무 수치 | 내부자 정보 규정 위반 | 엔드포인트 DLP가 웹 앱 커버 미흡 |
CASB 방식의 한계
Cloud Access Security Broker(CASB)를 통해 브라우저 트래픽을 검사하는 방식은 HTTP 프록시 경로로 동작한다. claude.ai 웹 인터페이스는 HTTPS이므로 TLS 인스펙션이 설정된 경우에만 프롬프트 본문을 볼 수 있다. Claude Code CLI, API를 직접 호출하는 파이프라인, 서버리스 함수에서는 CASB가 투명하게 동작하지 않는다. Inference Hooks는 Anthropic 서버 내부에 검사점을 놓기 때문에 클라이언트 경로와 무관하게 동작한다.
Inference Hooks 아키텍처
요청 페이로드 구조
Anthropic이 조직 DLP 서버로 전송하는 POST 요청에는 다음이 포함된다.
- 대화 트랜스크립트: 현재 턴까지의 messages 배열 (user, assistant, tool_result 포함)
- 사용자 식별자: 조직 내 사용자 ID (SSO 연동 기준)
- 요청 메타데이터: 타임스탬프, 채널(claude.ai / claude-code / cowork / api), 조직 ID
- 서명: Anthropic이 발급한 비밀키로 서명된 HMAC (서버 위조 방지용)
DLP 서버는 이 페이로드를 파싱해 allow 또는 deny 값을 JSON으로 돌려준다. 그 외 필드는 허용되지만 Anthropic이 처리하지 않는다.
POST https://dlp.company.com/inference-hook
Content-Type: application/json
X-Anthropic-Signature: sha256=<hmac>
{
"messages": [...],
"user_id": "emp-1234",
"channel": "claude-code",
"timestamp": "2026-08-05T09:23:11Z"
}응답 예시:
{ "verdict": "allow" }
{ "verdict": "deny", "reason": "PII_DETECTED" }적용 범위
Inference Hooks는 조직 수준의 단일 설정으로 Claude의 모든 접근 경로를 커버한다.
| 채널 | 적용 여부 |
|---|---|
| claude.ai 웹 인터페이스 | ✅ |
| Claude 데스크톱 앱 | ✅ |
| Claude Code CLI | ✅ |
| Claude Cowork | ✅ |
| Claude API (직접 호출) | ✅ |
| MCP 커넥터 통한 요청 | ✅ |
| 플러그인/Extensions | ✅ |
하나의 DLP 엔드포인트 URL을 관리 콘솔에 등록하면 모든 경로에 동시 적용된다.
운영 모드: 섀도우에서 강제 적용까지
| 모드 | 동작 | 권장 사용 시점 |
|---|---|---|
| Shadow mode | 판정 결과를 로그만 수집, 항상 allow | 도입 초기, 정책 정확도 검증 |
| Percentage rollout | 지정 비율(%)의 요청에만 강제 적용 | 단계적 확산, 영향도 측정 |
| Role-based exclusion | 특정 역할(예: 보안팀)은 훅 우회 | 보안 점검, 테스트 계정 |
| Full enforcement | 모든 요청에 판정 적용 | 정책 안정화 후 운영 |
섀도우 모드에서 DLP 서버가 실제로 deny할 비율을 측정하고, 그 중 오탐(false positive)을 분류한 뒤 강제 적용 전환하는 순서가 권장된다.
지원 DLP 솔루션
발표 시점에 Anthropic이 공식 통합 파트너로 발표한 DLP 솔루션은 아래와 같다.
| 벤더 | 제품 | 통합 방식 |
|---|---|---|
| Netskope | Netskope Platform | 네이티브 통합, 정책 콘솔 |
| Palo Alto Networks | Prisma Access / NGFW | REST 통합 |
| Zscaler | Zscaler Internet Access | SaaS DLP 정책 연동 |
| Proofpoint | Information Protection | Webhook 통합 |
Anthropic이 공개한 Webhook 스키마(서명 방식 포함)를 따르면 자체 보안 서버도 통합할 수 있다.
중요 제약사항
판정은 이진값 (Binary Verdict)
DLP 서버는 allow/deny만 반환할 수 있다. 프롬프트에서 민감한 부분만 마스킹해 Claude에 전달하는 리라이팅(rewriting) 기능은 지원하지 않는다. 차단된 요청은 사용자에게 정책 위반 메시지가 반환된다.
이는 의도적인 설계다. 리라이팅을 허용하면 조직 서버가 프롬프트를 수정해 Claude의 행동을 조작할 수 있는 경로가 생긴다.
응답 측 검사 미지원 (현재)
현재 Inference Hooks는 프롬프트(요청)에만 적용된다. Claude가 생성한 응답에서 민감한 정보가 포함된 경우를 차단하는 Response Hooks는 문서에 "향후 지원 예정"으로 명시되어 있으나 베타 시점에는 제공되지 않는다.
5초 타임아웃 SLA
DLP 서버가 5초 이내에 응답하지 않으면 Anthropic은 기본값으로 allow 처리한다. 이는 DLP 서버 장애가 업무 완전 중단으로 이어지는 것을 방지하기 위한 설계다. 조직은 DLP 서버의 P99 응답 시간을 1초 이내로 유지할 것을 권고한다.
Claude Enterprise 전용 (현재)
추론 훅은 Claude Enterprise 계약 고객에게만 제공된다. Pro, Max, API 전용 고객은 현재 적용 대상이 아니다.
기존 보안 계층과의 관계
Inference Hooks는 기존 보안 아키텍처를 대체하지 않는다. 각 계층의 역할은 다음과 같이 구분된다.
누가 사용하는가
어떤 기능에 접근하는가
무엇을 요청했는가 (사후)
어떤 데이터에 연결하는가
프롬프트 콘텐츠를 실시간 검사
— 추론 전 DLP 통과 강제
도입 체크리스트
- [ ] DLP 서버 엔드포인트 준비 (Netskope·Palo Alto·Zscaler·Proofpoint 통합 또는 자체 구현)
- [ ] Webhook 서명 검증 로직 구현 (HMAC-SHA256)
- [ ] P99 응답 시간 1초 이내 확인 (5초 타임아웃 여유 확보)
- [ ] DLP 정책 초안 작성 (PII 유형, 소스코드 패턴, 파일명 키워드)
- [ ] 섀도우 모드로 2~4주 운영, 오탐률 측정 및 정책 보정
- [ ] 역할 기반 제외 계정 목록 정의 (보안팀, 테스트 계정)
- [ ] 강제 적용 전환 전 에스컬레이션 채널 확보 (직원 질의 대응)
- [ ] 응답 측 검사(Response Hooks) 출시 시 업그레이드 계획 준비
요점 정리
- Inference Hooks는 Claude Enterprise에서 모든 프롬프트가 조직 DLP 서버를 거쳐야 모델에 도달하도록 강제하는 베타 기능이다 (2026-08-05 출시).
- 적용 범위는 claude.ai, Claude Code, Cowork, API 등 모든 Claude 접근 경로를 단일 설정으로 커버한다.
- 판정은 allow/deny의 이진값이며 프롬프트 수정은 지원하지 않는다. DLP 서버 응답 시간이 5초를 초과하면 기본값으로 allow 처리된다.
- 응답 측 검사(Response Hooks)는 현재 미지원이며 향후 지원 예정이다.
- 섀도우 모드 → 단계적 롤아웃 → 전면 강제 적용의 순서로 도입을 권고한다.
References
- Anthropic Inference Hooks 발표 (2026-08-05): <https://www.anthropic.com/news/claude-inference-hooks>
- The Next Web — Anthropic inference hooks DLP: <https://thenextweb.com/news/anthropic-inference-hooks-dlp-claude-enterprise>
- Unite.AI — Anthropic Inference Hooks 개요: <https://www.unite.ai/anthropic-puts-inline-data-loss-prevention-inside-claude-enterprise/>
- Proofpoint — Claude Inference Hooks 통합: <https://www.proofpoint.com/us/blog/data-security/real-time-data-loss-prevention-claude-inference-hooks>
- Claude's Inference Hooks DLP Guide: <https://www.digitalapplied.com/blog/claude-enterprise-inference-hooks-dlp-guide>
- Anthropic Release Notes August 2026: <https://releasebot.io/updates/anthropic>