7 min read

Claude Opus 5 마이그레이션 가이드: 기본 Thinking, Effort, Copilot 적용

Claude Opus 4.8에서 Opus 5로 옮길 때 바뀌는 기본 thinking, max_tokens, effort, 프롬프트와 GitHub Copilot 활성화 절차를 운영 관점에서 정리합니다.

Claude Opus 5는 모델 이름만 바꾸면 호출할 수 있지만, 기존 Opus 4.8 설정을 그대로 두면 비용과 출력 길이가 예상과 달라질 수 있습니다. 가장 큰 이유는 thinking이 기본으로 켜지고 max_tokens가 thinking과 최종 응답을 함께 제한하기 때문입니다.

이 글은 출시 기능을 나열하지 않습니다. API 요청, 에이전트 프롬프트, 평가와 GitHub Copilot 정책을 어떤 순서로 바꿔야 하는지 설명합니다.

이 글은 2026년 7월 25일 Anthropic의 모델·마이그레이션·프롬프트·가격 문서와 GitHub의 7월 24일 Copilot 발표를 기준으로 검증했습니다.

먼저 확인할 결론

상황권장 선택
Opus 4.8 API를 사용 중모델 ID를 바꾸기 전에 thinking과 max_tokens를 함께 재평가
긴 코딩 에이전트thinking을 유지하고 effort를 낮추거나 높여 비용·품질 조정
thinking을 꺼야 하는 기존 서비스effort: high 이하에서만 사용하고 도구 호출 누출 테스트 추가
Claude Code단순 작업보다 장기 분석·대규모 변경·복합 검증에 우선 배치
GitHub Copilot Business·Enterprise관리자가 먼저 Opus 5 정책을 활성화한 뒤 모델 선택기에서 사용
웹 fetch 도구에 의존Opus 5에는 해당 도구가 없으므로 다른 검색 경로를 준비

Opus 5의 API 모델 ID는 claude-opus-5입니다. 기본 컨텍스트는 100만 토큰이고 최대 출력은 128,000토큰입니다. 표준 가격은 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러로 Opus 4.8과 같습니다.

다만 같은 단가라고 같은 비용은 아닙니다. thinking 사용량과 effort가 달라지면 한 요청에서 소비하는 출력 토큰이 달라질 수 있습니다.

1. 모델 ID보다 thinking 동작을 먼저 바꾸기

Opus 4.8은 thinking 필드를 생략하면 thinking 없이 실행됐습니다. Opus 5는 같은 요청에서 adaptive thinking이 기본으로 동작합니다.

기본 요청은 다음처럼 작성할 수 있습니다.

import Anthropic from '@anthropic-ai/sdk';

const anthropic = new Anthropic({
  apiKey: process.env.ANTHROPIC_API_KEY,
});

const message = await anthropic.messages.create({
  model: 'claude-opus-5',
  max_tokens: 12_000,
  thinking: { type: 'adaptive' },
  output_config: {
    effort: 'high',
  },
  messages: [
    {
      role: 'user',
      content: '이 저장소의 인증 흐름을 분석하고 변경 계획만 작성해 주세요.',
    },
  ],
});

여기서 max_tokens는 화면에 보이는 답변만의 제한이 아닙니다. thinking과 최종 응답을 합친 전체 출력의 상한입니다. 기존 값이 최종 답변 길이에 맞춰 빡빡하게 설정돼 있었다면 Opus 5에서 응답이 일찍 잘릴 수 있습니다.

마이그레이션 전후에는 최소한 다음 값을 기록하세요.

const result = {
  stopReason: message.stop_reason,
  inputTokens: message.usage.input_tokens,
  outputTokens: message.usage.output_tokens,
};

console.log(result);

stop_reason이 토큰 한도 때문에 끝나는지, 평균 출력 토큰이 얼마나 변하는지부터 확인해야 합니다.

2. thinking을 끄기보다 effort를 먼저 낮추기

Opus 5에서는 thinking을 끌 수 있지만 efforthigh 이하일 때만 허용됩니다. xhighmax와 thinking 비활성화를 함께 보내면 400 오류가 발생합니다.

기존 동작을 보존해야 하는 요청은 다음처럼 명시할 수 있습니다.

const message = await anthropic.messages.create({
  model: 'claude-opus-5',
  max_tokens: 8_000,
  thinking: { type: 'disabled' },
  output_config: {
    effort: 'high',
  },
  messages,
});

하지만 도구를 많이 쓰는 에이전트에서는 이 구성을 기본값으로 삼지 않는 편이 좋습니다. Anthropic은 thinking을 끈 상태에서 도구 호출이 구조화된 tool_use가 아니라 일반 텍스트로 노출되거나 내부 XML 태그가 보이는 사례를 문서화했습니다.

안전한 조정 순서는 다음과 같습니다.

  1. thinking을 켠 상태로 시작합니다.
  2. low, medium, high, 필요하면 xhighmax를 자체 평가셋에서 비교합니다.
  3. 정확도, 완료율, 출력 토큰, 지연을 함께 기록합니다.
  4. 정말 필요한 경로에서만 thinking을 끕니다.
  5. thinking 비활성화 경로에는 도구 호출 형식과 XML 누출 회귀 테스트를 둡니다.

비용을 줄이기 위해 reasoning 자체를 없애기보다 effort로 계산량을 조절하는 방식이 먼저입니다.

3. 프롬프트에서 과도한 자기 검증 지시 제거하기

Opus 5는 장기 작업과 자기 수정 능력이 강화됐습니다. 이전 모델에서 품질을 높이기 위해 넣었던 다음 문구는 오히려 작업을 늘릴 수 있습니다.

반드시 모든 내용을 다시 확인하세요.
완료 후 처음부터 한 번 더 검증하세요.
확신할 때까지 반복하세요.

Anthropic은 이전 모델용 verification·self-check 지시를 제거하고 자체 평가를 다시 수행하라고 권장합니다.

대신 완료 조건을 구체적으로 제한하세요.

수정 범위는 src/auth와 관련 테스트로 제한합니다.
기존 공개 API를 변경하지 않습니다.
완료 조건은 다음과 같습니다.
- 타입 검사 통과
- 인증 단위 테스트 통과
- 변경 파일과 남은 위험 요약
요구 조건을 충족하면 추가 리팩터링을 하지 않습니다.

이 방식은 검증을 없애는 것이 아닙니다. 검증의 범위와 종료 조건을 명시하는 것입니다.

진행 설명도 필요한 만큼만 요청하기

Opus 5는 작업 중 수정 과정과 생각의 변화를 이전보다 길게 설명할 수 있습니다. 사용자 화면에 진행 상황을 보여주는 제품이라면 다음처럼 제약을 둡니다.

진행 보고는 단계가 바뀔 때만 한 문장으로 작성합니다.
사용자의 코드나 결정에 영향을 주는 오류만 짧게 정정합니다.
영향이 없는 표현상의 수정은 알리지 않습니다.

서브에이전트 남용 막기

장기 작업에서 서브에이전트가 유용하지만 작은 작업까지 위임하면 컨텍스트와 비용만 늘어납니다.

서브에이전트는 서로 독립적인 조사나 병렬 검증에만 사용합니다.
한 파일 안의 작은 변경은 직접 처리합니다.
동시에 실행하는 서브에이전트는 3개를 넘지 않습니다.

에이전트 하네스의 종료 조건과 승인 경계는 Claude Code 하네스 엔지니어링 가이드와 함께 보면 좋습니다.

4. Opus 4.7 이하에서 바로 옮길 때 추가 점검

Opus 4.8에서 옮기는 경우 핵심 변경은 thinking 기본값과 비활성화 시 effort 상한입니다. Opus 4.7 이하에서 바로 이동하면 누적된 변경도 함께 적용해야 합니다.

  • temperature, top_p, top_k의 비기본값 제거
  • assistant prefill 제거
  • 수동 extended thinking 설정을 adaptive thinking으로 전환
  • tool argument를 문자열로 직접 해석하지 말고 표준 JSON parser 사용
  • stop_reason: "refusal" 처리
  • web fetch 도구 대체
  • Priority Tier 의존성 제거

특히 보안 관련 제품은 HTTP 오류만 검사하면 안 됩니다. 강화된 사이버 안전장치에 따른 거절은 모델 응답의 stop reason으로 나타날 수 있으므로 정상 응답 파싱 단계에서 별도로 분기해야 합니다.

5. 자체 평가셋으로 effort를 다시 고르기

모델 교체 평가를 벤치마크 점수 하나로 끝내면 안 됩니다. 실제 작업 20~50개를 모아 다음 지표를 비교하세요.

지표확인 방법
기능 완료율요구 조건을 모두 충족한 작업 비율
회귀율기존 테스트를 깨뜨린 작업 비율
불필요한 수정요청 범위 밖 파일 변경 수
도구 효율동일 결과까지 tool call 수
토큰 비용입력·출력·캐시 토큰을 실제 가격으로 계산
지연첫 토큰과 전체 작업 완료 시간
사람 개입승인·수정·재시도가 필요했던 횟수

평가 코드는 모델과 effort만 바꿔 같은 작업을 반복할 수 있어야 합니다.

const variants = [
  { model: 'claude-opus-4-8', effort: 'high' },
  { model: 'claude-opus-5', effort: 'medium' },
  { model: 'claude-opus-5', effort: 'high' },
  { model: 'claude-opus-5', effort: 'max' },
] as const;

for (const variant of variants) {
  await runEvaluation({
    ...variant,
    tasks: migrationTasks,
  });
}

runEvaluation은 애플리케이션별 함수입니다. 중요한 것은 같은 입력, 같은 도구 권한, 같은 완료 조건으로 비교하는 것입니다.

6. GitHub Copilot에서 활성화하기

GitHub는 2026년 7월 24일부터 Claude Opus 5를 Copilot에 점진적으로 배포하고 있습니다. Pro+, Max, Business, Enterprise에서 사용할 수 있고 VS Code, Visual Studio, Copilot CLI, cloud agent, github.com, 모바일, JetBrains, Xcode, Eclipse 등의 모델 선택기에 제공됩니다.

Business와 Enterprise 조직은 관리자가 Copilot 설정에서 Opus 5 정책을 먼저 허용해야 합니다. 모델이 보이지 않는다면 다음 순서로 확인하세요.

  1. 조직의 Copilot 모델 정책에서 Opus 5가 활성화됐는지 확인합니다.
  2. 사용 중인 IDE와 Copilot 확장을 최신 버전으로 올립니다.
  3. 점진적 배포 대상인지 확인합니다.
  4. 모델 선택기에서 Opus 5를 고릅니다.
  5. 장기 작업용 custom agent나 repository instruction과 함께 작은 저장소에서 먼저 평가합니다.

Copilot에서는 사용량 기반 과금이 제공자 API 정가를 기준으로 적용됩니다. 기존 premium request 수만 보고 비용을 추정하지 말고 조직의 AI credit 사용량을 함께 확인해야 합니다.

Copilot 코드 리뷰에 저장소 지침과 전용 실행 환경을 연결하는 방법은 GitHub Copilot 코드 리뷰 커스터마이징 가이드를 참고하세요.

단계별 배포 체크리스트

준비

  • 현재 모델 ID와 thinking 설정을 검색했습니다.
  • max_tokens가 최종 텍스트만을 기준으로 잡혀 있지 않은지 확인했습니다.
  • sampling parameter와 assistant prefill 사용 여부를 확인했습니다.
  • web fetch와 Priority Tier 의존성을 확인했습니다.
  • 실제 작업 평가셋을 준비했습니다.

평가

  • Opus 4.8과 Opus 5를 같은 도구 권한으로 비교했습니다.
  • effort별 완료율·토큰·지연을 기록했습니다.
  • 범위 밖 수정과 과도한 검증 여부를 확인했습니다.
  • thinking 비활성화 경로의 도구 호출·XML 누출을 검사했습니다.
  • refusal과 일반 API 오류를 분리했습니다.

배포

  • 낮은 트래픽이나 내부 사용자부터 전환했습니다.
  • 모델·effort·thinking 상태를 trace에 기록합니다.
  • 토큰 상한으로 잘린 응답을 알림으로 연결합니다.
  • 이전 모델로 되돌릴 수 있는 라우팅 플래그를 유지합니다.
  • Copilot 조직 정책과 AI credit 소비를 확인합니다.

핵심 판단

Claude Opus 5는 Opus 4.8의 단순한 이름 변경이 아닙니다. thinking이 기본으로 켜지면서 모델 선택보다 계산량과 종료 조건을 운영하는 일이 중요해졌습니다.

가장 안전한 전환은 모델 ID를 바꾸고 바로 전체 트래픽을 넘기는 방식이 아닙니다. thinking을 유지한 채 effort를 평가하고, 과도한 자기 검증 프롬프트를 제거하며, max_tokens와 도구 형식을 다시 측정한 뒤 점진적으로 배포하세요.

공식 자료