에디블로그
Engineer's Field Notes

AI 자동화로 매일
한 편씩 쓰는
엔지니어 운영 노트

Claude Code · 자동화 파이프라인 · 사고 회고까지. 잘 굴러간 기록 + 깨진 흔적도 같이 남깁니다.

사람이 할 수 있는 일은,
AI도 할 수 있어야 합니다.
매일 한 편 쓰면서 검증 중.
— 이번 주 가장 많이 읽힌 글 TOP 3
AI/정보

[Grok] 4.5 공개 — 코딩 특화, Opus보다 60% 싸다고 해요

반응형
[Grok] 4.5 공개 — 코딩 특화, Opus보다 60% 싸다고 해요

[Grok] 4.5 공개 — 코딩 특화, Opus보다 60% 싸다고 해요

SpaceXAI(구 xAI)가 현지시간 7월 8일 Grok 4.5를 공개했어요. Grok 라인에서 처음부터 코딩과 에이전트 작업에 맞춰 만든 첫 모델이에요. 가격을 Claude Opus 4.8의 절반 아래로 잡은 게 핵심이에요.

01. 코딩과 에이전트 작업에 맞춘 첫 모델이에요

공식 릴리즈 노트에는 코딩, 에이전트 작업, 지식 노동용 모델로 소개돼 있어요. reasoning effort는 low·medium·high 세 단계로 조절돼요. 기본값은 high예요.

발표에서 눈에 띄는 대목은 Cursor와 함께 학습됐다(trained alongside Cursor)는 부분이에요. 실제 개발 세션 데이터를 학습에 반영했다는 게 SpaceXAI 설명인데, 어떤 데이터가 얼마나 들어갔는지는 공개하지 않았어요.

context window는 500,000토큰이에요. 이전 세대 Grok 4.3의 100만 토큰보다 오히려 줄었는데, 코딩 세션 품질에 집중하면서 조정한 것으로 보여요.

02. 가격이 Opus 4.8의 절반 이하예요

API 가격은 입력 100만 토큰당 $2, 출력 $6이에요. 캐시된 입력은 $0.50까지 내려가요. Claude Opus 4.8($5/$25)이나 GPT-5.5(약 $5/$30)와 비교하면 60% 이상 싼 가격대예요.

단, 요청이 200,000토큰 context를 넘어가면 더 높은 요율이 적용된다고 해요. 큰 코드베이스를 통째로 넣는 작업이라면 이 구간을 확인할 필요가 있어요.

참고로 회사 이름이 낯설 수 있는데, xAI는 올해 2월 SpaceX에 인수됐고 7월 6일부터 SpaceXAI라는 이름을 쓰고 있어요. 소유 구조가 바뀐 건 2월, 7월은 이름과 로고만 바뀐 거예요.

03. 벤치마크는 측정 방식에 따라 엇갈려요

SpaceXAI는 Opus급 성능을 내세우지만, 외부 측정치는 갈려요. 외부 집계 기준으로 Terminal Bench 2.1에서는 83.3%로 Opus 4.8(78.9%)보다 높았고 DeepSWE 1.1에서는 53%로 Opus 4.8(59%)에 못 미쳤어요.

Artificial Analysis의 Intelligence Index에서는 54점으로 전체 4위예요. Fable 5(60), Opus 4.8(56), GPT-5.5(55) 다음이에요. 수치가 하니스마다 다르게 나오는 만큼, 실제 코딩 체감은 직접 써보고 판단할 부분이에요.

04. 한국에서는 바로 쓸 수 있고, EU만 늦어요

출시 당일부터 xAI API, Cursor, OpenRouter, Vercel 등에서 쓸 수 있어요. EU는 출시 시점에 빠졌고 7월 중순 제공 예정이라고 해요. 한국은 별도 제한이 언급되지 않아 바로 접근되는 상태예요.

API는 OpenAI 호환 형식(Responses API·Chat Completions)을 지원해요. 이미 OpenAI API 기준으로 짜둔 코드라면 모델명과 엔드포인트만 바꿔서 시험해볼 수 있는 구조예요. 가격이 낮은 만큼, 에이전트를 오래 돌리는 작업에서 비용 비교를 해볼 만해요.

출처: SpaceXAI — Grok 4.5 발표, xAI API Release Notes

이 글은 공식 발표 내용을 정리한 것이고, SpaceXAI로부터 어떤 형식의 협찬도 받지 않았습니다.

반응형

📚 같이 보면 좋은

"이 포스팅은 쿠팡 파트너스 활동의 일환으로, 일정액의 수수료를 제공받습니다."