Date: 2026-08-20 (KST) Topic: AI Privacy and Safety Primary source: OpenAI
OpenAI가 2026년 8월 19일 기업용 API 고객의 대화 내용을 자사가 보관하거나 직원이 들여다보지 않으면서도, 여러 차례에 걸친 악용 징후를 자동으로 찾는 ‘Private Safety Processing’을 공개했다. 현재 일부 초기 고객과 시험 중이며, 9월부터 배포를 시작하고 기술 백서도 내놓을 계획이다.
기존 제로 데이터 보존(Zero Data Retention·ZDR)은 요청 처리가 끝나면 프롬프트와 응답을 남기지 않는 방식이다. 새 기능은 이 원칙을 유지하면서 여러 상호작용의 흐름까지 살핀다. 금융·의료·연구처럼 민감한 정보를 AI에 연결하는 기업이 주요 대상이다.
다만 아직 정식 운영 결과나 외부 검증 자료는 공개되지 않았다. 따라서 이번 발표는 개인정보 보호 문제가 해결됐다는 결론이라기보다, 강력한 AI의 장기적인 악용을 감시하면서 고객 데이터의 통제권을 지킬 수 있다는 설계를 제시한 단계로 보는 편이 정확하다.
What Happened
OpenAI는 적격 API 고객에게 제공해 온 ZDR을 프런티어 모델에서도 계속 지원하기 위해 Private Safety Processing을 설계했다고 밝혔다. ZDR에서는 요청 처리가 끝난 뒤 고객의 프롬프트와 모델 응답을 OpenAI가 보관하지 않으며, 기업 고객 데이터는 고객이 명시적으로 동의하지 않는 한 모델 학습에도 쓰이지 않는다.
악의적인 사용은 한 번의 요청에서 드러나지 않을 수 있다. 공격자가 작업을 여러 세션으로 나누거나, 여러 계정에서 조금씩 안전장치를 시험하면 요청 단위 검사만으로 전체 의도를 파악하기 어렵다. 에이전트가 중단 지시 뒤에도 행동을 이어가는 위험 역시 긴 작업 흐름을 봐야 발견할 수 있다.
Key Details
OpenAI가 설명한 작동 구조는 다음과 같다.
- ZDR 환경에서는 고객 콘텐츠가 고객이 통제하는 인프라에 남는다.
- OpenAI 저장 방식을 이용할 때는 고객 관리 키로 암호화해 직원이 원문을 열 수 없도록 하는 선택지를 개발 중이다.
- 자동화 시스템이 여러 상호작용에서 악용 패턴을 찾아도 OpenAI에는 활동 유형을 나타내는 제한된 경고 신호만 전달한다. 고객은 필요할 때만 조사나 이의 제기에 필요한 내용을 자발적으로 공유한다.
- 기능은 초기 고객과 시험 중이며, OpenAI는 9월부터 배포하고 기술 백서를 공개할 계획이다.
예외도 있다. 아동 성착취물 의심 이미지는 법적 신고와 수동 검토를 위해 ZDR 환경에서도 보존될 수 있다. 따라서 ‘어떤 데이터도 어떤 상황에서도 남지 않는다’는 뜻은 아니다.
Why This Is Difficult
AI 사업자에게 안전 감시와 데이터 최소화는 서로 당기는 요구다. 요청 한 건만 검사하면 정보 노출은 줄지만 장기간 이어지는 공격 준비나 반복적인 우회 시도를 놓칠 수 있다. 대화 전체를 중앙 서버에 모으면 탐지는 쉬워져도 영업기밀·의료정보·소스코드가 보존되는 위험이 커진다.
Anthropic은 지정된 ‘Covered Models’를 쓰는 일부 ZDR 조직의 프롬프트와 출력을 30일 보존한다. 평소 직원은 읽을 수 없고 위험이 표시됐을 때 승인된 소수 검토자만 통제된 절차로 접근한다. 두 회사 모두 여러 요청을 연결해 악용을 찾으려 하지만, 원문을 일정 기간 보존할지에서 선택이 갈린다.
Core Lens
이번 발표의 핵심은 감시를 없애는 것이 아니라, 안전 판단에 필요한 신호와 고객의 원문 데이터를 분리할 수 있는지를 시험하는 데 있다.
What It Means
기업은 이제 AI 성능뿐 아니라 데이터 처리 방식도 제품 선택 기준으로 봐야 한다. 금융 기록이나 환자 정보, 미공개 연구 자료를 연결한다면 “학습에 쓰지 않는다”는 약속을 넘어 저장 위치, 암호화 키 소유자, 직원 접근 가능성과 경고 후 조사 절차까지 확인해야 한다.
설명대로 작동한다면 기업은 데이터 통제권을 유지하면서 여러 세션의 악용을 탐지할 수 있다. 그러나 지금은 설계와 시험 계획만 공개됐다. 탐지 정확도와 오탐률, 고객의 운영 부담, 규제기관의 평가는 아직 확인되지 않았다.
What To Watch
- 9월 기술 백서가 패턴 분석과 데이터 흐름을 어디까지 설명하는지
- 고객 관리 키를 쓰는 OpenAI 저장 방식이 언제 제공되는지
- 오탐이 발생했을 때 고객이 근거를 확인하고 이의를 제기할 수 있는지
- 외부 감사와 국내 규제 검토로 “원문에 접근하지 않는다”는 주장이 확인되는지
“데이터를 보지 않는다”는 약속을 기술적으로 강제하고 감사할 수 있는지가 관건이다. 9월 백서와 초기 고객의 운영 경험이 실효성을 판단할 첫 자료가 될 전망이다.