기업의 AI 도입 계획서에는 대체로 벤더 로드맵이 상수로 들어가 있다. "하반기에 차기 모델이 나오면 정확도 문제가 해소된다"는 식의 문장이다. 로드맵은 늦어질 수는 있어도 멈추지는 않는다는 가정 위에서다.
그 가정이 8월 18일(현지시간) 깨졌다. OpenAI는 배포 예정 최신 모델들의 강화학습(RL) 훈련을 2주간 중단했고, 계획했던 최대 규모의 프런티어 RL 훈련은 여전히 보류 중이라고 밝혔다. 외부 규제나 사고 때문이 아니다. 자체 Preparedness Framework 평가에서 사이버 능력이 'Critical' 등급에 도달했을 가능성을 배제할 수 없다는 결과가 나왔기 때문이다.
멈춘 지점이 배포가 아니라 훈련이다
지금까지 프런티어 랩의 안전 게이트는 배포 단계에 있었다. 모델을 다 만든 뒤 안전장치를 붙이고, 위험 능력은 접근을 제한해 내보내는 방식이다. Anthropic이 Claude Sonnet 5부터 실시간 사이버 안전장치를 기본값으로 켜서 출시한 것도, 최상위 사이버 능력 모델의 접근을 소수 파트너로 제한한 것도 같은 층위의 통제다.
이번 조치는 층위가 다르다. OpenAI가 정의한 Critical은 "사람 개입 없이 강화된 실제 시스템의 제로데이 익스플로잇을 찾아 만들어내거나, 목표만 주면 엔드투엔드 공격 전략을 세워 실행하는" 수준이다. 이달 초 OpenAI는 차기 모델 Astra를 이 기준의 첫 'critical' 후보로 지정했고, 이번 발표에서는 훈련을 계속하는 행위 자체를 심사 대상으로 올렸다. 완성된 모델을 내보내는 것만이 아니라, 그런 모델을 만드는 과정이 위험하다고 판단한 것이다.
위험 표면이 사용자에서 연구 환경으로 넓어졌다
훈련을 멈춘 2주 동안 OpenAI가 한 일은 연구 환경 하드닝과 레드팀, 모니터링 범위 확장이었다. 병행 조치도 내부를 향한다. 격리된 테스트 환경, 모델 가중치 보호 강화, 위험 행동에 대한 전면 모니터링, 보안 요건을 못 채운 내부 활동의 중단. 공격 능력이 임계에 도달한 모델은 배포 전이라도 — 훈련장 안에서도 — 위험 자산이라는 판단이다.
동시에 OpenAI는 방어 쪽 통로를 연다. 사이버 방어 업무를 하는 사용자에게 강화된 능력을 단계별로 열어주는 프로그램과, 외부 방어 전문가를 참여시키는 Frontier Risk Council이다. 같은 능력이 공격과 방어 양쪽의 원료이므로, 능력을 묶는 대신 방어자에게 먼저 흘려보내겠다는 설계다.
도입 계획에서 로드맵 칸을 지워야 한다
실무 함의는 명확하다. 차기 모델의 출시 시점은 이제 엔지니어링 일정이 아니라 안전 심사 결과다. 심사는 통과를 보장하지 않으므로, "다음 모델이 나오면"으로 시작하는 계획은 조건문이 아니라 도박이 된다. Forbes가 이번 중단을 두고 지적했듯, 향후 프런티어 모델의 개발 속도 자체가 가변적이라는 것이 새 기본값이다. 지금 쓸 수 있는 모델로 성립하는 업무 설계, 그리고 모델이 늦거나 바뀌어도 버티는 교체 가능한 구조 — 두 가지가 로드맵 의존을 대체해야 한다.
교육과 AX 전환의 현장에서 이 뉴스가 말하는 것은 하나다. 조직이 통제할 수 없는 벤더의 달력이 아니라, 조직이 통제할 수 있는 프로세스와 검증 체계에 도입 계획을 거는 법을 가르쳐야 한다. 사업영역 →