SpaceXAI 브랜드로 운영되는 xAI는 2026년 7월 8일에 Grok 4.5를 출시했습니다. 이 회사는 이를 "코딩, 에이전트 작업 및 지식 작업을 위해 구축된 SpaceXAI의 가장 스마트한 모델"이라고 부르며, 일론 머스크는 이를 "Opus급 모델이지만 더 빠르고, 토큰 효율적이며, 비용이 저렴하다"고 평가했습니다.
주요 특징: 입력 토큰 백만 개당 2달러, 출력 백만 개당 6달러, 50만 개의 컨텍스트 윈도우, 초당 80개 토큰 처리 속도, 그리고 SpaceX가 6월에 인수하기로 합의한 AI 코드 편집기 Cursor의 실제 개발자 세션이 포함된 훈련 과정을 거쳤습니다. 오늘부터 Grok Build, Cursor의 모든 플랜, 그리고 xAI API를 통해 사용할 수 있습니다.
이 가이드는 Grok 4.5가 무엇인지, 공개된 수치(xAI 마케팅에서 강조하지 않는 수치 포함)가 무엇을 의미하는지, 그리고 이를 호출하는 방법을 다룹니다. 앱에 연결하기 전에 엔드포인트를 테스트하고 싶다면, Apidog를 사용하여 grok-4.5로 요청을 보내고, 스트리밍 응답을 검사하며, 클라이언트 코드를 한 줄도 작성하지 않고 팀을 위한 API를 모의(mock)할 수 있습니다.
Grok 4.5 한눈에 보기
| 사양 | 값 |
|---|---|
| 모델 ID | grok-4.5 (점 유의) |
| 출시일 | 2026년 7월 8일 |
| 컨텍스트 윈도우 | 50만 토큰 |
| 입력 가격 | 1백만 토큰당 $2.00 |
| 출력 가격 | 1백만 토큰당 $6.00 |
| 속도 | 초당 약 80 토큰 |
| 가용성 | Grok Build (기본), Cursor (모든 플랜), xAI API |
| EU 가용성 | 아직 아님; 2026년 7월 중순 예상 |
| 엔드포인트 | https://api.x.ai/v1/responses |
이 표의 두 가지 세부 사항은 다시 살펴볼 가치가 있습니다.
첫째, 컨텍스트 윈도우입니다. Grok 4.5는 50만 토큰의 컨텍스트를 제공하는 반면, 더 오래되고 저렴한 grok-4.3은 1백만 토큰을 제공합니다. 작업량이 긴 문서 RAG 또는 전체 저장소 분석이라면 이전 모델이 더 많은 컨텍스트를 유지합니다. xAI는 사용자가 컨텍스트를 기능과 맞바꿀 것이라고 예상하고 있습니다.

둘째, EU 관련 사항입니다. 출시 페이지에는 Grok 4.5가 "아직 EU의 어떤 SpaceXAI 제품이나 API 콘솔에서도 사용할 수 없다"고 명시되어 있으며, 7월 중순에 출시될 예정입니다. 유럽 사용자를 위해 개발 중이라면 이 공백을 고려하여 계획을 세우세요.
Grok 4.5의 새로운 기능
Cursor와 함께 훈련됨
이 릴리스의 결정적인 사실은 Grok 4.5가 "Cursor와 함께 훈련되었다"는 것입니다. Cursor의 자체 발표에 따르면, 이 편집기는 "코드베이스 및 소프트웨어 도구와의 사용자 상호 작용"을 포착하는 수조 개의 토큰을 기여했습니다. 이는 모델이 정적 코드뿐만 아니라 디버깅 추적, 다중 파일 편집, 그리고 에이전트가 잘못된 것을 수행했을 때 개발자가 수정한 내용을 통해 학습했음을 의미합니다.
이는 대부분의 연구소에서 사용하는 것과는 다른 데이터 전략이며, 동의 및 개인 정보 보호에 대한 정당한 의문을 제기합니다. Cursor 세션 훈련이 개발자에게 의미하는 것에 대한 당사의 동반 문서에서 이에 대해 자세히 설명합니다.
대규모 강화 학습
xAI에 따르면 이 모델은 수만 개의 NVIDIA GB300 GPU에서 훈련되었으며, "다단계 소프트웨어 엔지니어링에 중점을 둔 수십만 개의 작업"을 다루는 강화 학습이 포함되었습니다. 스택은 훈련이 계속되는 동안 몇 시간 동안 에이전트 롤아웃을 비동기적으로 실행합니다. xAI의 말에 따르면 목표는 "토큰당 지능"입니다. 즉, 길게 늘어지는 추론 체인 대신 더 적고 더 스마트한 토큰을 사용하는 것입니다.
코드뿐만 아니라 사무 작업도 가능
Grok 4.5는 이제 Grok Build의 기본 모델이며, xAI는 발표에서 스프레드시트에 놀라울 정도로 많은 부분을 할애합니다. 이 모델은 웹 조사를 통해 다중 시트 Excel 모델을 구축하고, 기본 도형으로 PowerPoint 다이어그램을 구성하며, xAI의 Office 플러그인을 통해 Word로 산문을 작성합니다. Cursor는 이를 "소프트웨어 엔지니어링 이상을 위해 구축한 첫 번째 모델"이라고 표현합니다.
벤치마크, 솔직하게 읽기
xAI는 네 가지 코딩 벤치마크를 공개했습니다. 다음은 xAI 자체 차트에서 Grok 4.5보다 높은 점수를 받은 모델을 포함한 전체 그림입니다.
| 벤치마크 | Grok 4.5 | Opus 4.8 (최대) | GPT 5.5 (최고) | Fable (최대) |
|---|---|---|---|---|
| DeepSWE 1.0 (pass@1) | 62.0% | 55.75% | 64.31% | 66.1% |
| DeepSWE 1.1 | 53% | 59% | 67% | 70% |
| Terminal Bench 2.1 | 83.3% | 78.9% | 83.4% | 84.3% |
| SWE Bench Pro (resolve) | 64.7% | 69.2% | 58.6% | 80.4% |
세 가지 사항이 눈에 뜁니다.
머스크가 비교 대상으로 지목한 모델인 Claude Opus 4.8과 비교했을 때, Grok 4.5는 4개 중 2개에서 승리했습니다. DeepSWE 1.0에서는 약 6점, Terminal Bench에서는 4.4점 앞섰지만, DeepSWE 1.1에서는 6점, SWE Bench Pro에서는 4.5점 뒤처졌습니다. "Opus급"은 적절한 표현이지만, "Opus를 능가한다"는 것은 아닙니다. Grok 4.5 대 Claude Opus 4.8에서 전체 대결을 다룹니다.
xAI 자체 페이지에서 Anthropic의 Claude Fable 5 (최대)는 네 가지 차트 모두에서 최고를 기록했습니다. xAI는 누구도 선두 우위를 주장하지 않았으며, 차트는 이에 대해 솔직하게 보여줍니다. Grok 4.5는 최고 성능이 아닌 비용과 속도에서 경쟁합니다.
출처는 중요합니다. xAI는 경쟁사 수치가 "각 개발자의 공개된 시스템 카드 또는 벤치마크 리더보드"에서 가져왔으며, DeepSWE 평가는 Datacurve에 의해 외부 당사자가 실행하여 생성되었다고 언급합니다. 이는 순수한 자체 보고보다 투명하지만, 이 글을 쓰는 시점까지 Grok 4.5에 대한 완전히 독립적인 제3자 평가는 아직 없습니다. 벤치마크 심층 분석에서 검증된 것과 그렇지 않은 것을 추적합니다.
토큰 효율성이 진짜 이야기
이번 릴리스에서 가장 흥미로운 수치는 벤치마크 점수가 아닙니다. 바로 출력량입니다. SWE Bench Pro에서 Grok 4.5는 평균 15,954개의 출력 토큰을 사용하여 작업을 해결합니다. Opus 4.8 (최대)는 동일한 벤치마크에서 67,020개를 사용하여 약 4.2배 더 많이 사용합니다.
출력 토큰은 백만 개당 6달러를 지불하는 대상이며, 초당 80개 토큰으로 기다리는 대상입니다. 4분의 1 토큰으로 작업을 해결하는 모델은 리더보드 점수로는 나타나지 않는 방식으로 더 저렴하고 빠릅니다. xAI는 전반적으로 "비슷한 선도 모델보다 약 2배의 토큰 효율성"을 가지며, 작업을 "절반 미만의 단계로" 해결한다고 주장합니다.
단일 세션에서 도구 호출을 통해 수십만 개의 토큰을 소모할 수 있는 에이전트 작업의 경우, 이는 정가보다 비용 계산을 더 많이 변경합니다. Grok 4.5 가격 설명에서 수치를 자세히 설명합니다.
Grok 4.5 사용 시작 방법
네 가지 방법이 있으며, 그중 세 가지는 현재 무료입니다.
- Grok Build. Grok 4.5가 기본 모델이며, xAI는 "제한된 시간 동안 Grok 4.5 무료 사용"을 제공하고 있습니다.
- Cursor. 데스크톱, 웹, iOS, CLI, SDK의 모든 플랜에서 사용할 수 있으며, 첫 주에는 사용량이 두 배로 제공됩니다. 설정 단계는 Cursor 가이드를 참조하세요.
- Grok CLI.
curl -fsSL https://x.ai/cli/install.sh | bash를 사용하여 설치합니다. - API. xAI 콘솔에서 키를 받아 Responses 엔드포인트를 호출합니다.
curl -s https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.5",
"input": "Summarize the breaking changes in this OpenAPI diff."
}'
스트리밍 및 Apidog 기반 테스트를 포함한 전체 가이드는 Grok 4.5 API 사용 방법에 있습니다. 탐색하는 동안 API 크레딧을 사용하고 싶지 않다면, 무료 경로는 Grok 4.5 무료 사용 방법에서 다룹니다.
엔드포인트를 호출하면 Apidog가 통합을 쉽게 유지하도록 돕습니다. 키에 대한 환경 변수로 요청을 저장하고, 응답 필드를 단언하며, 실제 프롬프트에서 grok-4.5와 grok-4.3을 A/B 테스트하고, 응답 형태의 모의(mock)를 생성하여 프롬프트를 조정하는 동안 프런트엔드 팀이 막히지 않도록 합니다. Apidog를 무료로 다운로드하여 따라해보세요.
2026년 모델 환경에 Grok 4.5가 어떻게 적합한가
Grok 4.5는 경쟁이 치열한 중급 프론티어 계층에 진입했습니다. Claude Opus 4.8(백만 개당 $5 입력 / $25 출력)보다 저렴하고 Claude Fable 5보다 훨씬 저렴하며, 코딩 벤치마크에서는 Opus와 몇 점 차이 내에 있습니다. GLM 5.2와 같은 오픈 웨이트 경쟁 모델과 비교했을 때, 공개된 코딩 평가에서는 승리하지만 토큰당 비용은 더 높습니다.
핵심은 왕관이 아닌, 달러당 초당 지능입니다. 병목 현상이 에이전트 처리량과 API 지출이라면, 이 제안은 테스트해 볼 가치가 있습니다. 가장 어려운 문제에 대한 최고의 추론이 필요하다면, xAI가 공개한 동일한 차트가 다른 모델을 가리킬 것입니다.
이 모델이 추구하는 모델에 대한 배경 지식은 Claude Opus 4.8은 무엇인가와 xAI가 여기까지 오게 된 과정을 추적하는 Grok 4.1에 대한 이전 보도를 참조하세요.
자주 묻는 질문 (FAQ)
Grok 4.5는 무료로 사용할 수 있나요? Grok Build 및 Cursor에서는 제한된 시간 동안 무료입니다. API 사용은 백만 토큰당 $2/$6로 유료입니다. 현재 모든 무료 경로는 저희 무료 액세스 가이드에 나와 있습니다.
Grok 4.5 모델 ID는 무엇인가요? 점이 있는 grok-4.5입니다. API 호출에서 grok-4-5를 사용하면 모델을 찾을 수 없다는 오류가 반환됩니다.
Grok 4.5 컨텍스트 윈도우는 얼마인가요? 50만 토큰입니다. 이전 모델인 grok-4.3은 1백만 토큰을 제공하므로, 최신 여부가 아닌 작업량에 따라 선택하세요.
Grok 4.5가 Claude Opus 4.8보다 우수한가요? xAI가 공개한 네 가지 벤치마크 중 두 가지에서 승리하고 다른 두 가지에서는 패배했으며, Opus 입력 가격의 약 40% 수준입니다. 더 빠르고 저렴하지만, 전반적으로 더 강력하다고는 할 수 없습니다.
EU에서 Grok 4.5를 사용할 수 있나요? 아직 아닙니다. xAI는 제품 및 API 콘솔 전반에 걸친 EU 가용성은 2026년 7월 중순에 예상된다고 밝혔습니다.
