← 블로그 목록
개발 노트6분 분량

Claude Opus 4.7은 모델 ID 한 줄로 갈아타지만, 토큰 배수와 프롬프트는 실제 트래픽으로 다시 잰다

갈아탈 이유는 단가표가 만들어 두었다. 남은 것은 우리 쪽 토큰 수와 프롬프트다.

4월 16일 나온 Claude Opus 4.7은 4.6과 단가가 같고, 방향은 긴 작업의 신뢰성으로 옮겼다. 토크나이저가 바뀌어 같은 입력이 최대 1.35배 토큰이 되고, 지시는 적힌 그대로 실행된다. 모델 ID를 바꾸기 전에 실제 트래픽으로 토큰 수를 재고, 느슨한 프롬프트부터 대조한다.

이 글은 2026년 4월 기준이다. 새 모델이 나올 때마다 먼저 오는 질문은 "그냥 바꿔도 되나요"다. Anthropic이 4월 16일 정식 공개한 Claude Opus 4.7은 답하기 쉬운 쪽이다. 4월 17일 원문에 정리했듯 입력 100만 토큰당 5달러, 출력 25달러로 Opus 4.6과 값이 같고, API 모델 ID를 claude-opus-4-7로 바꾸면 그대로 붙는 direct upgrade다. 붙는 경로도 하나가 아니어서, Claude 제품 전체와 Bedrock(Amazon)·Vertex AI(Google Cloud)·Foundry(Microsoft) 세 클라우드에도 같은 모델이 올라왔다.

그런데 "바꿔도 되나"와 "바꾸면 무엇이 달라지나"는 다른 질문이다. 원문은 4.7을 지능이 오른 모델이 아니라 사람이 자리를 비워도 되는 모델로 정리했고, 그 뒤에 주의 둘이 붙는다. 토크나이저가 바뀌어 토큰 수가 늘 수 있고, 지시를 문자 그대로 받아들여 프롬프트를 손봐야 할 수 있다. 단가가 같다고 마이그레이션 비용이 0은 아니며, 잴 곳은 벤치마크 표가 아니라 자기 트래픽과 자기 프롬프트다.

4.7의 방향은 점수가 아니라 자리를 비워도 되는 시간이다

원문이 옮긴 테스터 반응은 "이전엔 옆에 붙어서 감독해야 했던 어려운 코딩 작업을 이제 그냥 던져놓고 가도 된다"였다. 벤치마크 1위에서 긴 작업의 신뢰성으로 방향이 옮겼다는 것이 원문의 정리다.

항목Opus 4.6 (2월)Opus 4.7 (4월 16일)
방향벤치마크 1위긴 작업의 신뢰성
시각 입력기본긴 변 2,576픽셀, 약 3.75MP (3배 이상)
지시 해석유연하게 해석적힌 그대로 실행
effort 레벨low / medium / high / maxxhigh 추가
단가 (100만 토큰)입력 5달러 / 출력 25달러동일

이 방향을 받치는 기능은 Claude Code에 세 가지가 함께 나왔다.

  • effort 레벨에 high와 max 사이의 xhigh가 생겼고, Claude Code에서는 모든 플랜의 기본값이 xhigh로 올라갔다. 코딩·에이전트 용도는 high나 xhigh에서 시작하라는 권장이 붙었다.
  • /ultrareview 슬래시 명령은 변경 사항을 읽고 버그와 설계 문제를 찾는 리뷰 전용 세션이다. Pro·Max 사용자는 3회 무료다.
  • auto mode가 Max 사용자에게도 열렸다. 권한을 매번 묻지 않고 스스로 결정하며 긴 작업을 이어간다.

파일 기반 메모리도 나아져 세션을 넘겨 노트를 기억하고, 새 작업마다 다시 설명할 맥락이 줄었다. 시각 입력은 긴 변 2,576픽셀(약 3.75메가픽셀)까지 처리해 이전의 3배 이상이며, 컴퓨터 유즈 에이전트의 화면 읽기와 차트 해석에 걸리던 부분이다. 얼리 테스터인 보안 회사 XBOW는 자사 시각 정확도 벤치마크가 4.6의 54.5%에서 4.7의 98.5%로 올랐고 "가장 큰 고통 포인트가 사실상 사라졌다"고 표현했다.

단가가 같다고 청구 금액이 같은 것은 아니다

4.7은 토크나이저부터 다르다. 늘어나는 자리는 두 곳이다. 입력 쪽은 4.6에서 세던 것과 같은 텍스트가 4.7에서는 콘텐츠 유형에 따라 1.0~1.35배 사이의 토큰 수로 잡힌다. 출력 쪽은 effort를 올릴수록 답 앞에 붙는 추론이 길어져 따로 불어난다. 토큰당 성능은 모든 effort 레벨에서 개선됐다지만, 단가가 그대로라는 말과 월 사용량이 그대로라는 말은 다르다. 원문이 실제 트래픽으로 측정하라고 권한 이유다.

입력이 1.35배가 되고 기본 effort가 xhigh로 올라 출력까지 늘면, 단가표는 그대로인데 다음 달 청구 금액은 오른다. 이것을 "모델이 비싸졌다"로 읽으면 진단이 틀린다. 바뀐 것은 단가가 아니라 토큰의 개수다.

프롬프트는 4.6에 맞춰 느슨하게 쓴 만큼 다시 조여야 한다

4.7의 지시 해석은 4.6보다 엄격하다. 4.6이 느슨하게 해석하거나 일부를 건너뛰던 지시를 4.7은 적힌 대로 실행하므로, 원문의 표현으로는 "대충 이 정도면 알아듣겠지" 하던 프롬프트가 통하지 않을 수 있다.

프롬프트에 빠진 조건을 모델이 채워 주지 않는다는 뜻이다. "알아서 판단해" 류의 문장이 어디에 있는지가 재조정의 출발점이며, claude.ai 시스템 프롬프트의 4.6→4.7 변경점은 Claude Opus 4.7 시스템 프롬프트 diff는 우리 프롬프트에서 먼저 지울 문장을 알려준다에 따로 정리했다.

보안 조건도 하나 붙는다. 고위험 사이버보안 요청은 모델과 함께 배포되는 세이프가드가 자동으로 막고, 사이버 역량 자체도 Mythos Preview 수준에 이르지 않도록 두었다. 침투 테스트나 취약점 연구처럼 차단 대상과 겹치는 업무를 하는 팀을 위해서는 Cyber Verification Program이라는 별도 창구가 있다.

가져갈 것

  • 실제 트래픽 요청 샘플로 4.6과 4.7의 토큰 수를 콘텐츠 유형별로 비교해 배수(1.0~1.35배)를 기록했는가
  • Claude Code 기본 effort xhigh에서 늘어나는 출력 토큰까지 넣어 월 비용을 다시 냈는가
  • "알아서 판단해" 류의 느슨한 지시가 든 프롬프트를 4.7에서 돌려 같은 결과가 나오는지 대조했는가
  • 스크린샷·차트를 읽는 파이프라인이 있다면 긴 변 2,576픽셀까지 원본 해상도로 넣도록 바꿨는가
  • 취약점 연구·침투 테스트 업무가 있다면 Cyber Verification Program 가입을 보안팀과 확인했는가

안 되는 경우

  • 토큰 배수 1.0~1.35배의 콘텐츠 유형별 기준과 측정 조건은 원문이 밝히지 않았다. 자기 트래픽으로 잰 값만 유효하다.
  • XBOW의 54.5%→98.5%는 얼리 테스터 한 곳의 자사 벤치마크이고, 구성과 표본 크기는 원문에 없다.
  • "자리를 비워도 된다"는 테스터 반응이며, 어떤 길이·유형의 작업에서 확인됐는지 원문은 적지 않았다.
  • /ultrareview 3회 무료와 auto mode 확장은 Pro·Max 기준으로만 적혀 있고, Team·Enterprise 조건은 원문에 없다.

이번 주에 바꿀 것은 업그레이드 순서다. 모델 ID를 먼저 바꾸고 청구서를 기다리는 대신, 요청 샘플 하나로 토큰 수를 재고 느슨한 프롬프트 하나를 4.7에서 돌려 본 뒤에 ID를 바꾼다. 모델이 바뀔 때마다 이 순서를 반복한다. 사업영역 →

출처

ClaudeOpus 4.7모델 마이그레이션

Contact

이런 교육이 필요하다면

AI·데이터 교육 도입을 검토 중이라면 카카오 오픈채팅으로 편하게 문의하세요.

Newsletter

조녁컴퍼니 뉴스레터

AI 전환과 교육 현장의 기록을 메일로 받아보세요.