← 블로그 목록
AI 뉴스6분 분량

OpenAI Agents API는 샌드박스를 자체 호스팅해도 ZDR을 열어주지 않는다, 대화 기록은 하네스가 있는 곳에 남기 때문이다

추가 요금 0원 뒤에 붙은 두 줄, 미국 상주와 ZDR 미지원을 먼저 읽는다

OpenAI가 9월 10일 Codex 하네스를 API로 빌려주는 Agents API를 공개 베타로 열었다. 컴퓨트는 세 곳 중 고르지만 세션·컨텍스트 압축·복구는 전부 OpenAI 쪽에서 돈다. 베타 조건은 미국 데이터 상주와 ZDR 미지원이며, 자체 샌드박스로도 풀리지 않는다.

에이전트 도입 검토 회의에서 보안팀이 가장 먼저 묻는 것은 모델 성능이 아니다. "대화 기록이 어디에 남느냐"다. 지난 1년 동안 이 질문의 답은 API 계약서의 Zero Data Retention(ZDR) 조항 한 줄로 끝났다. 모델 호출은 저장하지 않는다는 약속을 받으면 됐다.

에이전트가 되면 이 답이 흔들린다. 에이전트는 한 번의 호출이 아니라 수십 턴의 세션이고, 그 세션을 누군가 붙들고 있어야 한다. 도구 호출 결과를 쌓고, 컨텍스트가 넘치면 압축하고, 끊기면 이어 붙이는 층이 필요하다. 이 층을 하네스라 부른다. 그리고 하네스가 있는 곳에 기록이 남는다.

OpenAI의 9월 10일 발표는 이 하네스를 통째로 빌려주는 상품이다. Codex와 ChatGPT를 돌리는 것과 같은 하네스를 API 한 번으로 쓰게 하고, 추가 요금은 받지 않는다. 대신 문서 두 줄이 조건을 적는다.

하네스가 벤더로 가면 기록의 주소도 벤더로 간다

개발자 문서의 개요 페이지는 역할을 분명히 가른다. OpenAI가 맡는 것은 세션, 오케스트레이션, 컨텍스트 압축, 복구다. 고객 애플리케이션이 맡는 것은 도구 제공과 실행 환경 선택이다. 같은 페이지의 베타 제한이 이 글의 논지다. 데이터 상주는 현재 미국만 지원하고, ZDR은 지원하지 않는다. 그리고 한 줄이 더 붙는다. 자체 호스팅 샌드박스를 써도 ZDR 자격이 생기지 않는다.

이 문장은 우연이 아니다. 아키텍처 문서는 구성 요소를 셋으로 나눈다. 모델과 도구 루프를 도는 OpenAI 호스팅 Codex 인스턴스, 명령과 파일 작업이 실행되는 환경, 작업을 제출하고 이벤트를 받는 고객의 애플리케이션 서버다. 고객이 옮길 수 있는 것은 두 번째뿐이다. 턴마다 쌓이는 항목, 압축된 컨텍스트, 재개를 위한 세션 상태는 전부 첫 번째에 있다.

샌드박스의 위치와 기록의 위치는 다른 문제다.

같은 주에 같은 질문에 반대 방향으로 답한 벤더가 있다. Anthropic은 Enterprise Frontier Safeguards 발표에서 오남용 탐지용 안전장치를 고객이 통제하는 클라우드에 두어 ZDR과 탐지를 같이 가져가게 했다. 이 접근은 안전장치의 주소가 벤더 서버에서 고객의 버킷으로 바뀌었다에서 다뤘다. OpenAI는 반대로 하네스를 벤더에 두고 ZDR을 베타 범위 밖으로 뺐다. 어느 쪽이 옳다는 이야기가 아니다. 계약서에 있던 ZDR이 에이전트 상품에서는 기본값이 아니라는 뜻이다.

세 가지 환경 중 어느 것도 기록을 돌려주지 않는다

아키텍처 문서의 환경 세 종류를 ZDR 관점에서 다시 적으면 이렇다.

환경컴퓨트 제공내장 Bash·apply-patch세션 기록 위치ZDR
none없음불가, 함수 도구·원격 MCP만OpenAI 하네스미지원
openai_hostedOpenAI가능OpenAI 하네스미지원
self_hosted고객executor 경유로 가능OpenAI 하네스미지원

self_hosted를 고르면 늘어나는 것은 통제가 아니라 책임이다. 문서는 컴퓨트 프로비저닝, 재접속, 종료를 고객이 맡고, 컴퓨트를 내리기 전에 "대기 중인 실행이 없음을 확인"하라고 적는다. 파일과 명령은 우리 서버에서 돌지만, 그 명령을 내린 추론과 결과를 요약한 컨텍스트는 여전히 OpenAI에 남는다. 규제 산업에서 자체 호스팅을 고르는 이유가 기록 통제였다면, 이 옵션은 그 이유를 채우지 못한다.

청구서도 셋으로 갈라진다. 가격표에 따르면 모델 토큰은 선택한 모델의 표준 요율, 도구는 도구 요율, OpenAI 호스팅 샌드박스는 컨테이너 요율이다. 컨테이너는 분 단위 과금에 5분 최소이고, 20분 세션 기준 1GB 0.03달러부터 64GB 1.92달러까지다. 문서 예시의 기본 모델인 GPT-6 Astra는 입력 100만 토큰당 10달러, 출력 50달러이며 롱 컨텍스트 구간은 20달러와 75달러다. "추가 요금 없음"은 하네스 값이 0이라는 뜻이지, 세션 값이 싸다는 뜻이 아니다.

가져갈 것

에이전트 파일럿에 Agents API를 올리기 전에 보안·법무와 같은 자리에서 답할 질문이다.

  • 우리 API 계약에 ZDR 조항이 있고, 그 조항이 Responses API 호출뿐 아니라 Agents API 세션에도 적용된다고 벤더가 서면으로 확인했는가? (개요 문서 기준 현재 답은 "아니오")
  • 세션 기록이 미국 리전에만 상주해도 되는 데이터인가? 국내 상주가 필요한 개인정보·금융 데이터가 프롬프트나 도구 결과에 섞이는가?
  • self_hosted를 고르는 이유가 "기록 통제"인가 "컴퓨트 통제"인가? 전자라면 이 API로는 충족되지 않는다는 점을 검토서에 적었는가?
  • 컨테이너 20분 세션 요율(4GB 0.12달러, 16GB 0.48달러)과 GPT-6 Astra 출력 100만 토큰당 50달러를 합쳐 세션 1건의 예상 비용을 계산했는가?
  • 컴퓨트를 내리기 전 "대기 중 실행 없음"을 확인하는 절차가 우리 애플리케이션 서버 코드에 있는가?

안 되는 경우

  • ZDR이 원래 필요 없는 조직에는 이 논지가 비용이 아니다. 개발 도구용 코드 저장소처럼 이미 벤더에 올려둔 데이터만 다루는 에이전트라면 하네스 위치는 성능과 가격 문제로만 남는다.
  • 공개 베타 조건이다. 개요 문서는 미국 상주와 ZDR 미지원을 "현재" 제한으로 적고 있으며, 정식 출시 시점에 바뀔 수 있다. 언제 바뀌는지는 소스가 밝히지 않는다.
  • 소스는 세션 기록의 보존 기간, 압축된 컨텍스트가 원문과 별도로 저장되는지, 학습 제외 여부를 Agents API 기준으로 따로 적지 않는다. 이 글은 ZDR 미지원과 미국 상주 두 문장에서만 추론했다.
  • Azure나 Bedrock 경로로 GPT-6 Astra를 쓸 때 Agents API의 하네스가 같은 조건인지는 소스에 없다.

이번 주에 바꿀 것은 에이전트 도입 검토서의 첫 질문이다. "모델이 어디서 도나"가 아니라 "세션 기록이 어디에 남고 ZDR이 그 기록까지 덮나"를 먼저 적고, 벤더 문서에서 그 답을 찾아 붙인다. Claude Managed Agents 첫 도입은 코드 리뷰가 아니라 팀장이 사인하는 YAML 리뷰에서 시작한다에서 말한 것과 같은 자리, 즉 도입 전 서명 단계에서 이 질문이 나와야 한다. 하네스를 빌리는 계약은 모델을 빌리는 계약과 다른 문서라는 관점으로 검토를 다시 열어 보길 권한다. 사업영역 →

출처

AI뉴스Agents API데이터 보존

Contact

이런 교육이 필요하다면

AI·데이터 교육 도입을 검토 중이라면 카카오 오픈채팅으로 편하게 문의하세요.

Newsletter

조녁컴퍼니 뉴스레터

AI 전환과 교육 현장의 기록을 메일로 받아보세요.