[Claude Opus 5] 공개, 가격 그대로 context window 1M
![[Claude Opus 5] 공개, 가격 그대로 context window 1M](https://blog.kakaocdn.net/dna/E0Fmw/dJMcajprhKC/AAAAAAAAAAAAAAAAAAAAAGWeJevrAYWlVyFuNDsGHv0eixHVlsJJaE8ta5Dvua4h/img.png?credential=yqXZFxpELC7KVnFOS48ylbz2pIh7yKj8&expires=1785509999&allow_ip=&allow_referer=&signature=GbvpmLJxHNtjEA%2BXUtWXyP6ZJv8%3D)
[Claude Opus 5] 공개, 가격 그대로 context window 1M
Anthropic이 7월 24일 Claude Opus 5를 공개했어요. 값은 Opus 4.8과 같은데 context window는 1M으로 올라갔어요. Max 요금제에서는 기본 모델 자리를 가져갔고 API 쪽에는 thinking 기본값이 바뀌는 변경이 붙어 있어요.
01. 값은 Opus 4.8과 같고 Fable 5의 절반이에요
Anthropic 발표 기준으로 100만 토큰당 입력 $5, 출력 $25예요. Opus 4.8과 동일한 값이에요. 6월에 나온 Fable 5($10 / $50)로 보면 절반이에요.
모델 ID는 claude-opus-5이고 Claude API와 Amazon Bedrock, Google Cloud, Microsoft Foundry에 같은 날 올라왔어요. Opus 4.8도 네 곳 모두에 그대로 남아 있어서 급하게 갈아탈 필요는 없어요.
fast mode는 research preview 단계예요. 값은 입력 $10 / 출력 $50으로 두 배이고 Claude API와 Claude Code(사용량 크레딧)에서만 돼요. Bedrock이나 Google Cloud, Microsoft Foundry 쪽은 아직 빠져 있어요.
02. Max는 기본 모델이 바뀌고 Pro는 최상위가 Opus 5가 돼요
Opus 5는 Max에서 새 기본 모델이 되고 Pro에서는 고를 수 있는 최상위 모델이 된다고 발표에 나와 있어요. Fable 5가 Pro 요금제 사용량 한도에서 빠지고 별도 크레딧 과금으로 바뀐 뒤라, Pro 구독자 입장에서는 한도 안에서 쓰는 상단이 Opus 5로 채워지는 셈이에요.
claude.ai와 Claude Code, Claude Cowork에서 바로 선택할 수 있어요. GitHub Copilot에도 같은 날 추가됐는데 Pro+·Max·Business·Enterprise 등급에서 사용량 과금으로 열린다고 해요.
03. context window는 1M이 기본이자 최대예요
1M 토큰이 기본값이면서 동시에 최대값이에요. 200k 같은 작은 변형이 따로 없고 최대 출력은 128k 토큰이에요.
지식 기준일은 2026년 5월이에요. Fable 5(2026년 1월)보다 넉 달 뒤라 최근 라이브러리 버전을 물어볼 일이 많다면 차이가 날 수 있어요.
prompt caching 최소 길이도 1,024 토큰에서 512 토큰으로 내려갔어요. Opus 4.8에서 너무 짧아 캐시가 안 잡히던 시스템 프롬프트는 코드 수정 없이 캐시 대상이 돼요.
04. thinking이 기본으로 켜져 있어서 max_tokens를 다시 봐야 해요
Opus 4.8은 thinking을 adaptive로 명시해야 켜졌어요. Opus 5는 켜진 상태가 기본이고 깊이는 effort 값(low, medium, high, xhigh, max)으로 조절해요.
max_tokens가 thinking과 응답 텍스트를 합친 상한이라 4.8에서 thinking 없이 돌리던 요청은 값을 다시 잡으라고 공식 문서에 적혀 있어요. 기존 설정 그대로 두면 응답이 중간에 잘릴 수 있어요.
05. thinking을 끄려면 effort를 high 이하로 내려야 해요
Opus 5에서는 thinking을 disabled로 두면서 effort를 xhigh나 max로 잡으면 400 에러가 나요. effort와 무관하게 끌 수 있던 Opus 4.8과 달라진 breaking change라고 릴리스 노트에 명시돼 있어요.
model = "claude-opus-4-8" # 이전
model = "claude-opus-5" # 변경 후
# thinking을 끌 거라면 effort는 high 이하로
output_config = {"effort": "high"}
thinking = {"type": "disabled"}
프롬프트 쪽 권고도 하나 있어요. "마지막에 검증 단계를 넣어라" 같은 지시를 예전 모델 기준으로 박아뒀다면 빼라는 안내예요. Opus 5는 시키지 않아도 자기 작업을 검증하는 쪽이라 과하게 반복된다고 해요.
여기 적은 성능·동작 서술은 모두 Anthropic 발표와 공식 문서 기준이에요. 실제 체감은 직접 써보고 판단할 부분이에요.
출처: Anthropic — Introducing Claude Opus 5, What's new in Claude Opus 5
이 글은 공식 발표 내용을 정리한 것이고, Anthropic으로부터 어떤 형식의 협찬도 받지 않았습니다.
'AI > 정보' 카테고리의 다른 글
| [Claude API] 대화 중간에 툴 바꿔도 프롬프트 캐시가 안 깨져요 (0) | 2026.07.27 |
|---|---|
| [Claude Code] 2.1.219, 중첩 서브에이전트가 3단계로 풀렸어요 (0) | 2026.07.26 |
| [Claude Code] 2.1.218, 코드 리뷰가 대화창을 안 채워요 (0) | 2026.07.24 |
| [Claude Code] 2.1.217, 서브에이전트 폭주에 상한이 걸렸어요 (0) | 2026.07.23 |
| [Claude Code] 2.1.216, 긴 세션이 느려지던 문제가 잡혔어요 (0) | 2026.07.22 |
📚 같이 보면 좋은
"이 포스팅은 쿠팡 파트너스 활동의 일환으로, 일정액의 수수료를 제공받습니다."