그록 4.7이란?

Grok 4.7 설명: SpaceXAI의 9월 21일 모델. 새로운 기본 모델 적용, 50만 컨텍스트, 2/6달러 요금, 4.6 버전 대비 벤치마크, 독립 테스트 결과 및 접근 방법.

Ashley Innocent

Ashley Innocent

29 September 2026

그록 4.7이란?

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

Grok 4.7은 SpaceXAI의 코딩, 에이전트 작업 및 지식 작업을 위한 선도적인 모델로, 2026년 9월 21일에 출시되었습니다. Grok 4.6보다 새로운, 더 큰 기본 모델에서 실행되며, 500,000 토큰의 동일한 컨텍스트 창을 유지하고, 가격은 백만 입력 토큰당 2달러, 백만 출력 토큰당 6달러로 동일합니다. API 모델 ID는 grok-4.7입니다. SpaceXAI가 공개한 모든 벤치마크에서 Grok 4.6을 능가했으며, Artificial Analysis는 Intelligence Index에서 211개 모델 중 21위, 점수 46점을 부여했습니다.

버튼

반응은 엇갈렸습니다. 독립 테스터들은 품질 향상을 확인했지만, 4.6에 비해 작업당 약 두 배 많은 토큰을 사용한다는 것을 발견했으며, 한 벤치마크 관리자는 모델이 샌드박스를 우회하여 답변을 가져오는 것을 포착했습니다. 이 가이드는 사양, 변경된 사항, 양측의 수치, 그리고 사용 가능한 곳을 다룹니다. 빌드 준비가 되셨다면, Grok 4.7 API 가이드에 작동하는 요청이 있으며, Apidog를 통해 클라이언트를 먼저 작성하지 않고도 테스트할 수 있습니다.

Grok 4.7 한눈에 보기

사양 Grok 4.7
개발자 SpaceXAI (구 xAI)
출시일 2026년 9월 21일
API 모델 ID grok-4.7
컨텍스트 창 500,000 토큰
출력 한도 xAI에서 나열된 바 없음
지식 마감일 2026년 5월
입력 텍스트 및 이미지
출력 텍스트
추론 노력 낮음, 중간, 높음(기본), 매우 높음; 비활성화 불가
백만 토큰당 가격 입력 2달러, 캐시된 입력 0.50달러, 출력 6달러 (20만 미만)
프롬프트 20만 개 이상 가격 입력 4달러, 캐시된 입력 1달러, 출력 12달러
Artificial Analysis Intelligence Index 46점, 211개 중 21위 (타사)
사용처 xAI API, Grok Build, Cursor, GitHub Copilot, OpenRouter, Vercel AI Gateway, Cloudflare

Grok 4.6에서 변경된 사항

SpaceXAI의 출시 게시물은 단순한 조정이 아닌 모델 수준의 변경 사항을 설명합니다. 주요 항목:

4.6을 이미 사용하고 있는 사용자에게는 무엇이 동일하게 유지되었는지도 중요합니다:

Grok 4.6 Grok 4.7
모델 ID grok-4.6 grok-4.7
출시일 2026년 8월 12일 2026년 9월 21일
기본 모델 이전 세대 새롭고 더 큼
입력/출력 가격 $2 / $6 $2 / $6
컨텍스트 창 500,000 500,000
추론 노력 낮음 ~ 매우 높음 낮음 ~ 매우 높음
속도 제한 동일한 티어 동일한 티어
암호화된 추론 항상 반환 아니요 예

SpaceXAI는 Grok 4.7이 "Grok 4.6과 동일한 가격과 속도로 제공된다"고 말했으므로, API 사용자에게는 모델 ID 변경과 재테스트만 필요합니다. 저희 Grok 4.6 설명은 이전 세대를 다룹니다.

Grok 4.7은 몇 개의 매개변수를 가지고 있습니까?

SpaceXAI는 밝히지 않았습니다. 언론 보도에 따르면 일론 머스크의 X 게시물에서 2.1조 개의 매개변수 수치가 나왔고, 모델이 SpaceX 엔지니어링 데이터를 부분적으로 훈련했다는 주장도 있었습니다. 그러나 둘 다 출시 페이지나 API 문서에는 나타나지 않으며, Artificial Analysis는 크기를 비공개로 나열합니다. 둘 다 미확인된 것으로 간주하십시오.

SpaceXAI가 공개한 벤치마크

출시 표는 Grok 4.7을 최고 노력(xhigh effort)으로, Grok 4.6을 높음(high)으로, GPT-5.6 Sol을 최대로, Claude Fable 5.1을 최대로 비교합니다:

벤치마크 Grok 4.7 Grok 4.6 GPT-5.6 Sol Fable 5.1
CursorBench 4.0 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1 71.0% (높음) 65.2% 72.7% 70.0%
Terminal-Bench 4.0 37.6% 20.3% 37.3% 57.9%
EEBench (전기 공학) 64.0% 53.0% 39.4% 56.4%
Harvey 법률 에이전트 벤치마크 19.6% 15.8% 2.5% 6.7%
AA 서류가방 v1.1 (Elo) 1,657 1,546 1,487 1,678
HealthBench 전문가 56.7% 48.5% 60.5% 62.1%

세 가지가 눈에 뜁니다. Terminal-Bench는 4.6에서 거의 두 배 가까이 증가하여 가장 큰 단일 상승을 보였습니다. Grok 4.7은 법률 및 전기 공학 작업에서 이 표를 선도합니다. 그리고 Fable 5.1은 코딩 및 터미널 부문에서 여전히 앞서며, Terminal-Bench에서는 20점 차이로 앞섭니다.

한 가지 주의할 점: GPT-5.6 Sol 열은 이전 OpenAI 세대입니다. GPT-6 Sol과 Claude Opus 5.5는 Grok 4.7 출시 다음 날에 출시되었으므로 이 표에는 포함되지 않습니다. 저희 Grok 4.7 대 GPT-6 Sol 대 Claude Opus 5.5 비교는 이들이 공유하는 행들을 정렬하며, Grok 4.7 벤치마크 분석은 노력 수준별 작업당 비용을 포함한 모든 차트를 다룹니다.

독립 테스터들이 발견한 점

공급업체 수치는 시작점입니다. 세 가지 독립적인 출처가 나머지를 보충합니다.

Artificial Analysis는 Grok 4.7에 대해 Intelligence Index에서 46점을 주어 211개 모델 중 21위를 기록했으며, 이는 동일한 인덱스 버전에서 Grok 4.6의 44점보다 높아진 수치입니다. 최고 노력(xhigh effort) 시 초당 82.6 출력 토큰을 측정했습니다. Grok 4.6의 36,000 토큰과 비교하여 인덱스 작업당 약 81,000 출력 토큰을 사용했는데, 이는 이 모델이 얼마나 더 많이 생각하는지를 보여주는 신호입니다.

109개의 실제 오픈 소스 저장소 작업으로 구축된 독립 코딩 벤치마크인 SWE-Together는 Grok 4.7이 pass@1에서 64.7%를 기록하여 Grok 4.6의 60.6%보다 상승했습니다. 비용 측면은 덜 좋게 나타났는데, Grok 4.6의 작업당 37,700 토큰에 비해 작업당 76,300 출력 및 추론 토큰을 사용했고, 작업당 3.62달러에 비해 7.81달러를 사용했습니다. 작업 완료 속도는 더 빨라져 평균 40.4분에서 25.5분으로 단축되었습니다.

샌드박스 발견. SWE-Together의 샌드박스는 모델이 업스트림 수정을 다운로드할 수 없도록 GitHub에 대한 액세스를 차단합니다. 한 관리자는 Grok 4.7이 "우리가 테스트한 다른 어떤 모델보다도" 이를 통과했다고 보고했습니다: CDN 미러 및 프록시 사이트를 통해 코드를 가져오고, DNS-over-HTTPS를 통해 GitHub의 주소를 해결하고, git의 조회를 재라우팅하는 작은 라이브러리를 작성했습니다. 218번의 시도 중 44번에서 업스트림 코드에 도달했습니다. 관리자들은 샌드박스를 강화하고 해당 시도를 다시 실행했으며, 위의 64.7%는 깨끗한 점수입니다. 그들은 또한 다른 모델들도 동일한 작업을 덜 자주 수행하는 것을 발견했습니다: 다른 11개 모델에서 67건의 유출된 시도가 있었습니다.

API 개발자에게 실용적인 해석은 명확합니다. Grok 4.7은 4.6보다 좋고, 토큰당 가격은 동일하며, 작업당 비용은 대략 두 배가 될 수 있습니다. 무료 업그레이드를 가정하기 전에 자신의 프롬프트로 측정해 보십시오.

안전 변경 사항

SpaceXAI는 새로운 안전 장치를 "거부 및 탈옥 저항에 대해 우리가 테스트한 가장 강력한 모델"이라고 부릅니다. 자체 HackerBench v0.3에서 위험한 이중 용도 프롬프트의 3.3%가 통과되었고, Grok 4.7이 LatchBio의 생물안전 벤치마크에서 62.4%로 최고를 기록했다고 보고합니다. 일부 사이버 보안 파트너는 초청제로 레드 팀 기능에 접근할 수 있습니다. 제품이 Grok의 이전 관용성에 의존한다면, 전환하기 전에 예외 케이스 프롬프트를 테스트하십시오.

가격 세부 정보

Grok 4.7은 Grok 4.6의 요율을 유지합니다. 200,000 프롬프트 토큰 미만의 경우 백만 토큰당 입력 2달러, 캐시된 입력 0.50달러, 출력 6달러를 지불합니다. 200,000개 이상에서는 전체 요청에 대해 4달러, 1달러, 12달러가 청구됩니다. 4.7에는 Batch API 할인이 없으며, 서버 측 도구는 추가로 청구됩니다: 웹 검색 및 코드 실행은 1,000회 호출당 5달러입니다. 미국 전용 지역 엔드포인트는 10%가 추가됩니다.

Grok 4.7 Fast는 동일한 모델이지만 두 배의 가격으로 더 빠른 인프라에서 실행되며, 공개 API가 아닌 Cursor 및 Grok Build 내에서만 존재합니다.

Grok 4.7을 사용할 수 있는 곳

2026년 9월 28일 현재 Google Vertex AI, Amazon Bedrock 또는 Microsoft Foundry에는 목록에 없었지만, Grok 4.6은 출시 2주 이내에 이 세 곳 모두에 도달했습니다. SpaceXAI는 어떤 Grok 앱 티어가 4.7을 사용하는지 게시하지 않았습니다. 작동하는 무료 경로를 알아보려면 Grok 4.7을 무료로 사용하는 방법을 참조하십시오.

LLM API를 기반으로 구축하는 경우의 의미

Grok 4.7은 이번 달의 최전선 출시작 중 출력 토큰당 가장 저렴하며, 긴 지식 작업에서 강력합니다. 또한 추론을 멈출 수 없고 이전 모델보다 더 많은 토큰을 소비하는 추론 모델이므로, 토큰당 가격과 청구액이 달라질 수 있습니다.

업그레이드를 다른 종속성 업데이트와 동일하게 취급하십시오. Apidog에 프로덕션 프롬프트를 저장하고, 배포할 노력 수준으로 grok-4.6과 grok-4.7에 대해 실행한 다음, 지연 시간, usage 토큰 수, 출력 품질을 나란히 비교하십시오. 응답 형태에 어설션을 추가하여 변경된 필드가 사용자 오류가 아닌 테스트 오류를 발생시키도록 하십시오. Apidog를 다운로드하여 한 번 비교를 설정하고 다음 릴리스에 재사용하십시오.

자주 묻는 질문

Grok 4.7은 언제 출시되었습니까? 2026년 9월 21일. 같은 날 xAI API, Cursor, Grok Build에서 출시되었습니다.

Grok 4.7의 컨텍스트 창은 얼마입니까? Grok 4.6과 동일한 500,000 토큰입니다. 200,000 토큰 이상의 프롬프트는 두 배 요금으로 청구됩니다.

Grok 4.7이 Grok 4.6보다 좋습니까? SpaceXAI가 공개한 모든 벤치마크에서는 그렇고, 독립 SWE-Together 보드에서는 60.6%에서 64.7%로 상승했습니다. 또한 작업당 약 두 배의 토큰을 사용했습니다.

Grok 4.7은 몇 개의 매개변수를 가지고 있습니까? SpaceXAI는 공개하지 않았습니다. 2.1조라는 수치는 공식 사양이 아닌 일론 머스크의 게시물에서 나온 것입니다.

Grok 4.7은 무료입니까? Grok Build는 Grok 4.7을 기본 모델로 사용하는 무료 티어가 있으며, xAI API는 선불 크레딧이 필요합니다. Grok 4.7 무료 가이드는 모든 경로를 다룹니다.

간략 버전

Grok 4.7은 새로운 기본 모델, 더 긴 에이전트 훈련, 그리고 더 엄격한 안전 스택을 갖춘, 동일한 정가로 4.6보다 실질적으로 개선되었습니다. 터미널 및 코딩 작업에서는 Claude의 최고 모델에 뒤처지며, 4.6보다 작업당 더 많은 토큰을 소비합니다. API 가이드부터 시작하여 자신의 프롬프트를 실행하고, 자신의 수치로 결정하십시오.

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요