Claude Opus 5 마이그레이션: Thinking, Effort, 프롬프트, Copilot
Claude Opus 4.8 이하에서 옮길 때 thinking 예산, effort, 프롬프트와 도구 가정, 회귀 평가, Copilot 정책을 순서대로 바꾸는 방법을 설명합니다.
Claude Opus 5는 Opus 4.8과 같은 Messages API 형태를 사용하지만, 같은 요청이 다른 출력 예산을 소비할 수 있습니다. Thinking이 기본으로 켜지고 max_tokens는 thinking과 최종 응답을 함께 제한합니다. 모델 ID를 바꾸기 전에 thinking 예산부터 다시 잡아야 합니다.
안전한 마이그레이션 순서는 동작 중심입니다. 출력 예산을 다시 잡고, effort를 sweep하고, 프롬프트와 지원하지 않는 도구 가정을 갱신하며, 도구·거절 회귀를 실행한 다음 모델을 배포합니다. GitHub Copilot 접근은 별도의 호스팅 제품 정책이지 API 마이그레이션 완료 증거가 아닙니다.
아래의 현재 사실은 2026년 8월 5일 Anthropic의 모델, 마이그레이션, effort, prompting, 가격, TypeScript API 문서와 GitHub의 Copilot 출시 공지를 기준으로 다시 확인했습니다.
문서화된 경계부터 확인하기
| 항목 | Claude Opus 5 경계 |
|---|---|
| API 모델 ID | claude-opus-5 |
| 컨텍스트 | 100만 토큰, 기본값이자 최댓값 |
| 동기 Messages 최대 출력 | 128,000토큰. Message Batches는 output-300k-2026-03-24 beta header로 최대 300,000토큰 지원 |
| 표준 토큰 가격 | 100만 토큰당 입력 $5 / 출력 $25 |
| 기본 thinking | Adaptive thinking 켜짐 |
| Effort 수준 | low, medium, high, xhigh, max |
| 기본 effort | Claude API와 Claude Code에서 high |
| 지원하지 않음 | Web fetch와 Priority Tier |
목록 가격은 Opus 4.8과 같지만, 토큰당 요금이 같다고 요청당 비용까지 같지는 않습니다. Thinking 양, 도구 호출, 재시도, 출력 길이, 캐시 동작이 합격 결과 한 건의 비용을 결정합니다.
Thinking과 max_tokens부터 다시 계산하기
thinking을 생략한 Opus 4.8 요청은 thinking 없이 실행됩니다. Opus 5에서 같은 필드를 생략하면 adaptive thinking을 사용합니다. Anthropic은 max_tokens를 thinking과 최종 답변을 포함한 전체 출력의 절대 상한으로 문서화합니다.
두 선택을 명시적으로 검토할 수 있는 TypeScript 요청은 다음과 같습니다.
import Anthropic from "@anthropic-ai/sdk";
const anthropic = new Anthropic();
const message = await anthropic.messages.create({
model: "claude-opus-5",
max_tokens: 12_000,
thinking: { type: "adaptive" },
output_config: {
effort: "high",
},
messages: [
{
role: "user",
content: "이 저장소의 인증 흐름을 분석하고 변경 계획만 반환하세요.",
},
],
});
이 예시는 Anthropic의 현재 TypeScript API와 adaptive-thinking 문서에 맞춰 검토했지만 유료 API 자격 증명으로 실행하지는 않았습니다.
배포 전에 SDK가 제공하는 stop_reason, 전체 입력 토큰, 전체 출력 토큰, 문서화된 thinking-token breakdown을 기록합니다. max_tokens를 늘리면 잘림을 막을 수 있지만 한 요청이 소비할 수 있는 양도 늘어납니다. 최대화할 기본값이 아니라 측정된 상한으로 다루세요.
Thinking을 끄기 전에 effort 사용하기
Opus 5는 다섯 effort 수준을 지원하며 기본값은 high입니다. Anthropic은 Opus 4.8 설정을 그대로 가져오지 말고 새로 sweep할 것을 권장합니다. 합격 평가셋을 유지하는 범위에서 low나 medium을 사용하고, 추가 작업이 중요한 개선을 만드는 경우에만 xhigh나 max를 평가하세요.
호환성을 위해 thinking을 끌 수 있지만 high effort 이하에서만 가능합니다.
const message = await anthropic.messages.create({
model: "claude-opus-5",
max_tokens: 8_000,
thinking: { type: "disabled" },
output_config: {
effort: "high",
},
messages,
});
Thinking 비활성화와 xhigh 또는 max를 함께 보내면 HTTP 400이 발생합니다. 더 중요한 것은 Anthropic이 thinking 비활성화 요청에서 도구 호출이 일반 텍스트로 나오거나 내부 XML tag가 보이는 사례를 문서화했다는 점입니다. 평가가 허용한다면 낮은 effort와 adaptive thinking을 우선하세요. 호환성 때문에 thinking을 꺼야 한다면 tool block 형태, XML 노출, 출력 parsing 회귀 검사를 추가해야 합니다.
작업을 증폭하는 프롬프트 바꾸기
Anthropic의 Opus 5 prompting 가이드는 모델이 이전 버전보다 더 자주 자체 검증하고 위임할 수 있다고 설명합니다. 다음과 같은 일반 지시는 작업을 늘릴 수 있습니다.
완료 후 모든 내용을 다시 검증하세요.
완전히 확신할 때까지 검토를 반복하세요.
가능하면 항상 subagent를 사용하세요.
범위, 근거, 종료 조건으로 바꾸세요.
수정 범위를 src/auth와 관련 테스트로 제한합니다.
공개 API는 변경하지 않습니다.
완료 조건은 다음과 같습니다.
- 인증 단위 테스트 통과
- 타입 검사 통과
- 변경 파일과 남은 위험 목록
조건을 충족하면 중지합니다.
검증을 없애는 것이 아닙니다. 검증을 유한하고 외부에서 확인 가능하게 만드는 방식입니다.
진행 설명 범위 제한하기
제품이 agent 진행 상황을 표시한다면 단계나 사용자 영향 위험이 바뀔 때만 짧게 보고하도록 요청하세요. 최종 결정만 사용자에게 영향을 주는데 모든 수정 과정을 기록할 필요는 없습니다.
작업 단계가 바뀔 때만 한 문장으로 보고합니다.
코드, 근거, 권고를 바꾸는 수정만 보고합니다.
Subagent 위임 범위 제한하기
병렬 작업은 서로 독립적일 때만 도움이 됩니다. 유용한 harness 규칙은 다음과 같습니다.
서로 독립적인 조사나 검증 작업만 위임합니다.
한 파일 안의 작은 변경은 직접 수행합니다.
동시에 실행하는 subagent는 세 개를 넘지 않습니다.
정확한 제한 수는 Anthropic API 한도가 아니라 엔지니어링 선택입니다. 작은 모델용으로 조정된 프롬프트가 모든 로컬 수정을 조정 문제로 만드는 것을 막습니다. 지속적인 프로젝트 규칙과 도구 권한은 Claude Code 하네스 엔지니어링 가이드를 참고하세요.
누적 호환성 변경 감사하기
Opus 4.7 이하에서 바로 옮긴다면 Opus 4.8→5 차이만 적용해서는 안 됩니다. Anthropic 마이그레이션 가이드에서 정확한 출발 모델 section을 사용하고 다음을 포함한 누적 변경을 감사합니다.
- 기본값이 아닌 sampling parameter
- assistant prefill과 수동 thinking 설정
- 도구 argument parsing과 thought-signature 연속성
stop_reason과 구조화 세부 정보를 통한 거절 처리- 사용할 수 없는 web fetch 도구
- Priority Tier 가정
- Opus 5에서 불필요한 context-window beta header
이 목록을 맹목적인 수정 지시로 사용하지 마세요. 일부 제한은 이후 Opus 4.x에도 이미 적용됐고, 더 오래된 출발 모델에는 추가 변경이 있습니다. 정확한 출발 모델이 필요한 순서를 결정합니다.
두 가지 명시적인 Opus 5 호환성 예외는 중요합니다. Web fetch와 Priority Tier는 사용할 수 없습니다. Web fetch는 승인된 다른 검색 경로로 교체하고, service_tier가 기존 Priority Tier 운영 방식을 보존한다고 가정하지 마세요.
합격 결과 평가 다시 실행하기
프로덕션 트래픽을 바꾸기 전에 사용 권한이 확인된 대표 작업 20~50개를 사용하세요. 최소한 다음을 측정합니다.
| 지표 | 확인 내용 |
|---|---|
| 기능 완료 | 명시된 합격 조건을 모두 통과 |
| 회귀율 | 기존 테스트나 동작이 깨짐 |
| 범위 통제 | 허용 범위 밖 파일 변경 |
| 도구 신뢰성 | 유효한 tool block, 도구 오류, 재시도 |
| 거절 동작 | stop_reason과 fallback 경로 처리 |
| 출력 예산 | Thinking, 화면 출력, 잘림 |
| 지연 | 첫 유용한 출력과 전체 작업 완료 시간 |
| 합격 결과당 비용 | 토큰, 캐시, 도구, 재시도, 사람 수정 |
모델과 effort를 sweep할 때 작업, 프롬프트, 도구, grader를 고정합니다.
const variants = [
{ model: "claude-opus-4-8", effort: "high" },
{ model: "claude-opus-5", effort: "medium" },
{ model: "claude-opus-5", effort: "high" },
{ model: "claude-opus-5", effort: "max" },
] as const;
이 코드는 harness pseudocode이지 벤치마크 결과가 아닙니다. 평가기는 선택한 effort를 적용하고, 허용된 근거만 저장하며, 실제 애플리케이션 결과를 점수화해야 합니다.
GitHub Copilot 별도로 활성화하기
GitHub는 7월 24일 Copilot Pro+, Max, Business, Enterprise에 Claude Opus 5를 발표했습니다. 지원 클라이언트에는 VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, github.com, mobile, JetBrains, Xcode, Eclipse가 포함됩니다. 배포는 점진적으로 진행됐습니다.
Business와 Enterprise는 관리자가 Claude Opus 5 정책을 활성화해야 합니다. 완전한 호스팅 제품 확인 절차는 다음과 같습니다.
- 사용자 플랜이 대상인지 확인합니다.
- 조직 또는 엔터프라이즈 정책이 Opus 5를 허용하는지 확인합니다.
- 실제 클라이언트와 계정에서 모델이 보이는지 확인합니다.
- 팀의 대표 읽기, 수정, agent 작업을 실행합니다.
- usage-based 가격, 출력 합격 여부, 지연, 거절 동작을 기록합니다.
Copilot 제공이 direct Anthropic API 모델 ID, 프롬프트, 도구 계약, fallback을 갱신하지는 않습니다. 별도 설정으로 운영하세요.
명시적인 중지 조건으로 배포하기
- 현재 모델, thinking, effort,
max_tokens, 도구, 프롬프트, 캐시, fallback을 목록화합니다. - 요청 호환성을 갱신하고 가장 작은 호출을 증명합니다.
- 고정된 합격 평가셋에서 effort sweep을 실행합니다.
- Tool block, XML 노출, 거절, 잘림, 범위 밖 수정 회귀를 추가합니다.
- 저장소나 외부 쓰기를 허용하기 전에 읽기 전용 작업을 shadow 평가합니다.
- 작은 트래픽 비율부터 배포합니다.
- 합격 결과당 비용, 오류율, 지연, 거절률, 범위 위반이 기록된 임계값을 넘으면 되돌립니다.
같은 목록 가격은 Opus 4.8과 Opus 5를 비교하기 쉽게 만들 뿐, 자동으로 교체 가능하게 만들지는 않습니다. 새 설정이 프로덕션 형태의 근거 gate를 통과할 때까지 이전 모델을 유지하세요.
권고
Opus 4.8 마이그레이션이라면 adaptive thinking을 켜고 high에서 시작하세요. 일반 작업에는 medium, 어려운 꼬리 작업에는 필요한 경우에만 xhigh나 max를 평가합니다. max_tokens를 다시 잡고 무제한 자기 검증이나 위임을 만드는 프롬프트를 제거하며, 문서화된 thinking 비활성화 실패 모드에 회귀 검사를 추가하세요.
더 오래된 Opus 버전은 정확한 출발 모델의 누적 마이그레이션 경로를 따릅니다. 그런 다음 GitHub Copilot 정책을 별도 단계로 활성화하고 실제 클라이언트에서 모델을 확인하세요. 요청, 프롬프트, 도구, 평가기, 정책, rollback 근거가 일치할 때만 마이그레이션이 완료됩니다.