새소식

300x250
AI/Grok

Grok 4.5 출시 요약 - 코딩 벤치마크와 토큰 가격 한눈에 보기( Grok Build CLI 사용전 Grok 4.5 가볍게 살펴보기 )

  • -
728x90

안녕하세요! 갓대희입니다.

Grok 4.5 발표에서 먼저 눈에 띈 것은 가격과 속도였다.

입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러에 코딩과 에이전트 작업을 겨냥했다.

 

그렇다고 모든 코딩 벤치마크에서 1위인 모델은 아니다. 평가마다 선두가 달랐고, 출시 직후 커뮤니티 반응도 “빠르고 좋다”와 “내 작업에서는 더 확인해야 한다”로 나뉘었다.

 

이번 글에서는 공식 문서와 독립 평가(2026년 7월 14일 기준), 초기 사용기를 함께 살펴보려고 한다.

확인 기준: 2026-07-14 KST · 모델 ID grok-4.5 · 가격과 제공 지역, 플랜, 사용량 제한은 바뀔 수 있다. 최신 값은 공식 모델 페이지공식 가격표에서 다시 확인하자.

1. Grok 4.5는 어떤 모델인가

SpaceXAI는 2026년 7월 8일 Grok 4.5를 공개하며 이 모델을 코딩, 여러 도구를 이어서 쓰는 에이전트 작업, 기술 지식 업무에 맞춘 모델로 소개했다.

 

공식 모델 ID는 grok-4.5다. grok-4.5-latestgrok-build-latest라는 별칭도 있다.

이름이 비슷하지만 별도 Heavy·Standard·Basic 등급이 공식 문서에 공개된 것은 아니다.

 

추론 강도는 low·medium·high로 고를 수 있고 기본값은 high다.

 

2. 공식 사양과 가격 한눈에 보기

항목 2026-07-14 공식 문서 기준 주의할 점
모델 ID grok-4.5 별칭은 grok-4.5-latest, grok-build-latest
컨텍스트 500,000토큰 20만 토큰 초과 요청은 별도 요율
입력·출력 텍스트·이미지 입력 → 텍스트 출력 이미지 생성 기능과는 다름
입력 가격 100만 토큰당 $2 기본 요율 구간 기준
캐시 입력 100만 토큰당 $0.50 반복되는 앞부분이 실제로 캐시돼야 적용
출력 가격 100만 토큰당 $6 추론 강도와 출력 길이를 함께 기록
도구 호출 웹·X 검색·코드 실행 각각 1,000회당 $5 토큰 비용에 추가됨

기본 가격은 단순하지만 50만 토큰 전체에 같은 요율을 적용한다고 보면 안 된다.

공식 모델 페이지는 한 요청의 컨텍스트가 20만 토큰을 넘으면 별도 요율이 붙는다고 안내하고 있다.

 

3. 사용 경로 차이점 (API·Grok Build 등)

Grok 4.5는 모델 이름이다. xAI API, Grok Build, Cursor, Office 추가 기능은 이 모델을 사용하는 서로 다른 경로다. 같은 이름이 보여도 가격과 컨텍스트, 사용량 제한은 경로마다 달라질 수 있다.

 

사용 경로 처음 해볼 작업 따로 확인할 것
xAI API 기존 앱이나 모델 평가 도구에 연결 토큰·도구 가격, 지역, 팀 사용량 제한
Grok Build 저장소 탐색과 여러 파일 수정 파일·터미널 권한, 제품별 사용량
Cursor 에디터 안에서 같은 이슈를 다른 모델과 비교 Cursor의 컨텍스트와 모드, 플랜
Office 추가 기능 문서·표·슬라이드 초안 수식, 출처, 원자료 검토

공식 발표에 따르면 기간 한정으로 Grok Build와 Cursor에서 Grok 4.5 무료 사용을 제공한다.
API 키 없이 곧바로 코딩 작업을 시작해볼 수 있는 경로다.
무료 기간과 사용량 한도는 언제든 변경될 수 있으므로 x.ai/cli에서 현재 조건을 확인하자.

 

4. 코딩 벤치마크

평가 주로 보는 것 Grok 4.5 GPT-5.5
(xhigh)
Opus 4.8
(max)
공식 차트 1위
DeepSWE 1.0 실제 저장소 이슈 해결 62.0%
GPT-5.5보다 낮음
64.31% 55.75%
Grok 승 ↑
Fable max 66.1%
DeepSWE 1.1 별도 에이전트 환경의 저장소 해결 53%
두 모델보다 낮음
67% 59% Fable max 70%
SWE Marathon 장시간 이어지는 소프트웨어 작업 29.0% ★
1위
미공개 26.0%
Grok 승 ↑
Grok 4.5 1위
Terminal Bench 2.1 터미널 명령·도구로 작업 완료 83.3%
GPT-5.5와 0.1%p 차
83.4% 78.9%
Grok 승 ↑
Fable max 84.3%
SWE Bench Pro 다중 언어 실제 저장소 이슈 해결 64.7%
GPT-5.5 상회 ↑
58.6%
Grok 승 ↑
69.2% Fable max 80.4%

 

 

평가별 강약이 다르므로 내 작업 유형과 가장 가까운 벤치마크 결과를 우선 보자.

 

SpaceXAI는 SWE Bench Pro의 특정 비교에서 Grok 4.5가 평균 15,954 출력 토큰을, Opus 4.8 max가 약 70,000토큰을 썼다고 발표했다. 약 4.2배 차이는 이 조건에만 해당한다.

 

공식 벤치마크 차트에는 위 비교표에 포함되지 않은 두 모델도 등장한다.

Opus 4.7 max는 DeepSWE 1.0에서 40.12%, SWE Marathon에서 16.0%, Terminal Bench 2.1에서 78.9%, SWE Bench Pro에서 64.3%를 기록했다.

GLM 5.2는 DeepSWE 1.1에서 44.0%, SWE Bench Pro에서 62.1%였다.

 

5. 경쟁 모델과 가격 비교

벤치마크 수치가 비슷할 때 실제 도입 결정에서 가장 크게 갈리는 것은 가격이다.

아래 표는 2026년 7월 기준 공개된 API 토큰 가격과 개인 구독 플랜 가격을 정리했다.

모든 가격은 게시 시점 공개 자료 기준이며 변경될 수 있다.

 

API 토큰 가격 비교 (2026년 7월 기준, 1M 토큰 기준)

모델 제공사 입력(1M) 출력(1M) Grok 4.5대비
출력 단가
비고
Grok 4.5 SpaceXAI $2.00 $6.00 기준 200k 토큰 초과 시 입력 $4 / 출력 $12
o3 OpenAI $2.00 $8.00 1.3× 추론 모델
Claude Sonnet 5 Anthropic $2.00* $10.00* 1.7× *2026-08-31까지 프로모션
Claude Opus 4.8 Anthropic $5.00 $25.00 4.2× SWE Bench Pro에서 Grok 4.5보다 높음
GPT-5.6 Sol OpenAI $5.00 $30.00 5.0× 플래그십 모델 (최고 성능)
GPT-5.6 Terra OpenAI $2.50 $15.00 2.5× 가성비 훌륭한 기본 모델
GPT-5.6 Luna OpenAI $1.00 $6.00 1.0× 가장 빠르고 저렴한 모델
Claude Fable 5 Anthropic $10.00 $50.00 8.3× 모든 벤치마크에서 최상위권

출처: xAI Pricing · Anthropic Pricing · OpenAI Pricing (2026-07-15 기준 공개 자료, 변동 가능)

 

토큰 효율과 가격을 함께 보면 차이는 더 크다.

Grok 4.5는 SWE Bench Pro 작업에서 Opus 4.8보다 약 4.2배 적은 출력 토큰을 사용했다.

 

단가뿐 아니라 소비 토큰까지 고려하면 작업 한 건당 실질 비용 차이는 표면적인 가격 배수와 다를 수 있다.

특히 Grok 4.5와 GPT-5.6 모델들(Sol, Terra, Luna)은 각자의 작업 특성에 맞춰 사용하면 훨씬 경제적으로 활용할 수 있다.

 

개인 구독 플랜 비교 (2026년 7월 기준)

API가 아닌 개인 구독으로 사용할 때의 가격이다. ChatGPT, Claude, SuperGrok 모두 월정액 플랜을 운영하며 상위 플랜은 더 많은 사용량을 제공한다.

서비스 플랜 월 요금 주요 특징 및 Grok 4.5 사용 범위
SuperGrok
(SpaceXAI)
Lite $10 기본 유료 접근. Grok 4.5를 제한적으로 사용할 수 있음
Standard
(추천)
$30
(연간 결제 시 $25)
Grok 4.5를 가장 자유롭게 쓸 수 있는 플랜
• 높은 사용량 한도
• 우선 처리 (빠른 응답)
• 일상 코딩·글쓰기 작업에 충분한 수준
• 연간 결제 시 약 17% 할인
Heavy $300 Grok Heavy 멀티에이전트 모델 포함 (고급 사용자向け)
ChatGPT
(OpenAI)
Plus $20 GPT-5.6 계층 모델 포함
Pro $100 / $200 사용량 대폭 증가
Claude
(Anthropic)
Pro $20 Sonnet 5 포함
Max 5× $100 Pro 대비 5배 사용량
Max 20× $200 Pro 대비 20배 사용량

 

SuperGrok Standard 추천 이유

  • Grok 4.5를 일상적으로 자유롭게 쓰고 싶을 때 가장 균형이 좋은 플랜
  • 연간 결제하면 월 $25로 내려가서 실질 부담이 적음
  • ChatGPT Plus나 Claude Pro보다 저렴하면서 Grok 4.5 풀 기능을 제공

출처: SpaceXAI 공식 Pricing (2026-07-16 기준)
ex) 월간 구독

ex) 연간 구독

 

6. 커뮤니티 반응

출시 직후 반응은 다소 엇갈렸다. 모델의 객관적 성능을 확정하는 것은 아니지만 가볍게 참고할 만 하다.

  • 긍정적 평가: PRD·이슈 작성이 빠르고 군더더기가 적다, 복잡한 C 코드 이해나 Kubernetes 장애 대응에 유용했다.
  • 부정적/아쉬운 평가: 일부 환경에서 도구 호출이 실패하거나, 사용량이 예상보다 빨리 줄어드는 현상이 관찰되었다.

법률 초안이나 프로토타입처럼 초안과 프로토타입을 빨리 만들 때 쓸 만했다는 경험이 많았다.

법률·재무·의료처럼 오류 비용이 큰 문서는 전문가 검토가 필요하고, 코드도 테스트를 통과해야 완료로 볼 수 있다.

 

7. 초보자가 바로 써보는 방법

가장 쉬운 방법부터 추천한다.

 

1. Grok Build 또는 Cursor
기간 한정 무료로 바로 코딩 작업을 해볼 수 있다. API 키가 필요 없다.

 

2. API로 짧게 테스트 (키가 있는 경우)
공식 문서는 https://api.x.ai/v1/responses에 모델 ID와 입력을 보내는 예시를 제공한다.

 

보안 주의
일반 API 요청과 응답은 오남용 감사를 위해 서버에 일정 기간 임시 저장될 수 있다.

고객 정보, 비공개 소스, 비밀값은 보내지 말고 샘플·익명화 데이터나 공개 연습 저장소부터 사용한다.

 

8. 어떤 사람에게 맞을까

지금 써볼 만한 경우 조금 더 확인할 경우
코딩·터미널·검색 작업을 한 모델에서 비교하고 싶다. EU 제공이나 데이터 지역 조건이 먼저 해결돼야 한다.
출력 토큰과 재시도 비용이 큰 작업을 줄이고 싶다. 50만 토큰 전체를 기본 단가로 쓸 수 있다고 기대한다.
Cursor나 Grok Build에서 작은 실험부터 할 수 있다. 도구 실행을 사람 승인 없이 바로 운영에 넣으려 한다.
같은 저장소와 프롬프트로 비교할 평가 목록이 있다. 공식 차트 한 장만으로 기존 모델을 교체하려 한다.

Grok 4.5를 처음 시험한다면 계획 작성이나 실패 원인 분석처럼 결과를 검토하기 쉬운 작업 하나를 고르는 편이 좋다.

 

자주 묻는 질문

Q1. Grok 앱에서도 Grok 4.5를 고를 수 있나?

이번에 확인한 Grok 4.5 공식 페이지는 xAI API, Grok Build, Cursor, Office 추가 기능과 모델 게이트웨이를 안내한다. grok.com 소비자 채팅 앱에서 누구나 Grok 4.5를 직접 선택할 수 있다고 명시하지는 않는다. 앱의 실제 모델 선택 화면과 플랜 안내를 따로 확인해야 한다.

Q2. 500k 컨텍스트면 50만 토큰까지 모두 기본 가격인가?

아니다. 최대 컨텍스트는 50만 토큰이지만 공식 모델 페이지는 20만 토큰을 넘는 요청에 별도 요율이 적용된다고 안내한다.

Q3. Grok 4.5와 Grok Build는 같은 것인가?

Grok 4.5는 모델이고 Grok Build는 저장소와 터미널에서 코딩 작업을 실행하는 제품이다. API 가격표의 grok-4.5grok-build-0.1도 별도 항목이다.

Q4. Grok 4.5는 코딩 모델 전체 1위인가?

공식 차트에서도 평가별 선두가 다르다. SWE Marathon에서는 가장 높았지만 DeepSWE, Terminal Bench 2.1, SWE Bench Pro에는 더 높은 모델이 있었다.

 

함께 보면 좋은 글

Grok 4.5를 터미널에서 직접 쓰고 싶다면?
Grok 4.5 + 공식 Grok Build CLI 초보자 설치 가이드

참고자료

공식 자료

독립 평가

커뮤니티 원문

300x250
Contents

포스팅 주소를 복사했습니다

이 글이 도움이 되었다면 공감 부탁드립니다.

💡 AI 관련 질문이 있나요? 눌러보세요!