본 사이트는 파트너스 활동으로 수수료를 받으며, 서버 운영과 무료 앱 개발에 사용됩니다. 본 사이트는 파트너스 활동으로 수수료를 받으며
서버 운영과 무료 앱 개발에 사용됩니다.
목록으로
테크·IT

Grok 4.5 | Cursor·SpaceXAI 코딩 AI 성능·가격·벤치마크 (2026)

최초 발행: 2026년 7월 9일 오전 11:35 | 최종 수정: 2026년 7월 9일 오후 12:01

Cursor를 처음 붙잡은 건 대략 두 달짜리 시험이었다. 그 기간에 이 웹사이트 골격을 잡고, 이후 약 1년 동안 앱 60여 개와 유튜브 채널 분석기까지 Cursor로 이어 갔다. 초반이 맞아 연간 결제했고, Godfather(갓파더) 요금제의 Auto 모드 무제한 구간을 쓰며 지금도 위키·앱·영상 편집 등 사이트 작업의 대략 90% 이상을 Cursor에 맡긴다. SpaceX·일론 머스크 측이 Cursor(Anysphere)를 인수했다는 소식도, 이미 도구를 쓰고 있는 상태에서 들었다.

2026년 7월 8일 SpaceXAI(구 xAI)가 Grok 4.5를 공개했다. Cursor와 공동 학습한 MoE 모델로, 코딩·에이전트·지식 업무를 한곳에 담았다. 벤치마크 전 항목 1위는 아니다. 여러 표에서 1위를 차지하는 쪽은 Anthropic 계열 Fable 5(Claude Code 쪽에서 쓰는 최고 성능 엔진으로 자주 묶여 언급됨)이고, Opus 4.8이 앞서는 축도 있다. Cursor·Grok 쪽 움직임은 「벤치 1위 탈환」으로 보이지 않는다. 최고 성능 엔진 경쟁은 경쟁사에 두고, 자신들은 싸고 빠른 엔진을 키우는 전략에 가깝다. 공식 발표(x.ai/news/grok-4-5)와 Cursor 블로그(cursor.com/blog/grok-4-5)를 교차 확인한 결과, 출시일·가격·벤치 수치·Cursor 통합 사실은 일치한다.

아래에서는 출시 배경, 학습 방식, 기술 사양, 벤치마크 해석, 가격·토큰 효율, Cursor·Grok Build 이용 경로, 그리고 이 사이트에서 Cursor를 계속 쓰는 이유까지 한 번에 정리한다. 벤치 1위 주장은 공식 자료 기준으로 항목마다 다르다는 점을 먼저 짚고 읽으면 혼동이 줄어든다.

1. Grok 4.5 한눈에 보기

항목공식 확인 내용
출시일2026년 7월 8일 (SpaceXAI 뉴스·Cursor 블로그)
개발 주체SpaceXAI + Cursor(Anysphere) 공동 학습
구조Mixture-of-Experts(MoE)
학습 인프라수만 대 NVIDIA GB300 GPU (SpaceXAI 발표)
추론 속도초당 80토큰(TPS) — flash급 속도로 서빙
API 가격입력 $2/100만 토큰 · 출력 $6/100만 토큰
Cursor fast 변형입력 $4 · 출력 $18 (Cursor 블로그)
이용 채널Grok Build · Cursor 전 요금제 · SpaceXAI API 콘솔
EU 제공7월 중순 예정 (아직 미제공)
Cursor 프로모션출시 후 1주간 사용량 2배(7월 14일까지 50% 할인 배너)

SpaceXAI는 Grok 4.5를 「지금까지 가장 지능적인 모델」이자 코딩·에이전트·지식 업무용으로 소개한다. Cursor는 「소프트웨어 엔지니어링만이 아닌 범용 모델」이라는 점을 강조한다.

SpaceXAI Cursor 데이터 플라이휠 — GPU·모델·도구·재학습 순환 그림 1. 컴퓨팅·파운데이션·Cursor·재학습이 한 루프로 이어지는 구조

2. SpaceXAI와 Cursor가 만난 배경

2.1. 사명·조직 재편

2026년 초 SpaceX와 xAI 통합 이후 브랜드가 SpaceXAI로 정리됐다. Grok 4.5는 이 재편 이후 대표 모델로 포지셔닝된다.

2.2. Anysphere(Cursor) 인수

2026년 6월 Cursor 개발사 Anysphere를 약 600억 달러 전액 주식 교환으로 인수하기로 발표됐다(3분기 마무리 예정). Grok 4.5는 이 협력 루프의 첫 공동 모델이다.

단계의미
컴퓨팅(Colossus 등)대규모 GPU 학습
파운데이션(V9/Grok)MoE 기반 모델
코딩 도구(Cursor)개발자·에이전트 상호작용 데이터
재학습실사용 궤적이 다음 모델로 순환

Cursor 블로그는 학습에 수조 개 토큰 규모의 Cursor 데이터가 들어갔다고 밝힌다. 완성 코드뿐 아니라 개발자가 코드베이스·도구와 주고받는 에이전트 상호작용까지 포함된다.

3. 학습 방식 — 데이터와 강화학습

3.1. MoE와 데이터 믹스

Grok 4.5는 MoE 구조다. Composer 2.5가 코딩 전용이었다면, Grok 4.5는 STEM 과제·연구 논문·지식 노동 데이터를 섞어 금융·법률·데이터 과학 등으로 폭을 넓혔다.

3.2. 에이전트가 만든 RL 환경

SpaceXAI·Cursor는 어려운 문제를 풀도록 강화학습(RL) 환경을 대규모로 구축했다. 엔지니어가 문제와 검증 방법만 정하면, 다수의 에이전트가 환경을 만들고 테스트·다듬는다. Cursor 블로그에 따르면 일부 환경은 수백 명의 엔지니어가 수개월 걸릴 규모였다.

특징설명
비동기 학습에이전트 롤아웃이 수 시간 돌아가도 GPU 클러스터에서 학습 지속
난이도 설계프런티어 모델도 실패하는 과제를 의도적으로 포함
이전 모델 활용Composer 등 이전 모델로 다음 모델 학습 가속

3.3. 보충 학습 한계(커뮤니티 분석)

V9 사전학습은 Cursor 인수 발표(6월 16일) 이전에 끝났다는 분석이 있다. Cursor 데이터는 사후 보충 단계에서 들어갔고, 처음부터 넣는 것만큼 효과가 크지 않을 수 있다는 지적도 있다. Grok 4.5는 이 데이터 플라이휠 초기 버전으로 보는 시각이 있다.

4. 기술 사양과 추론 특성

사양수치·출처
추론 속도80 TPS (SpaceXAI 뉴스)
토큰 효율SWE-Bench Pro 과제당 평균 출력 15,954토큰
비교 기준Opus 4.8(max) 67,020토큰 → 약 4.2배 적음
Cursor UI 표기Cursor Grok 4.5 High — 256k 컨텍스트 (모델 선택 툴팁)

SpaceXAI는 「동일 과제를 절반 이하 스텝으로 해결」한다고 설명한다. Cursor IDE에서 보이는 256k와 API·Grok Build의 컨텍스트 한도는 채널마다 다를 수 있으므로, 배포 전 SpaceXAI API 문서에서 최신 한도를 확인하는 것이 안전하다.

Grok 4.5 벤치마크 항목별 순위 — SWE Marathon 1위·SWE-Bench Pro 3위 그림 2. 벤치마크마다 1위 모델이 다르다 — 절대 1위 주장 주의

5. 벤치마크 — 항목마다 순위가 다르다

SpaceXAI·Cursor가 공개한 표 기준(2026년 7월 8일 발표)이다. 경쟁 모델 점수는 타사 자체 보고(self-reported) 임을 각주에서 명시한다. 동일 하네스·동일 조건 비교로 단정하지 않는다.

Grok 4.5 벤치마크 종합 — DeepSWE·Terminal-Bench·SWE-Bench Pro 비교 표 그림 3. SpaceXAI 공개 벤치마크 종합 표 — 항목마다 순위가 다름

5.1. 종합 비교표

벤치마크1위Grok 4.5Grok 4.5 순위
DeepSWE 1.0Fable max 66.1%62.0%3위 (Opus 4.8 max 55.75% 앞섬)
DeepSWE 1.1Fable max 70.0%53.0%4위
SWE MarathonGrok 4.5 29.0%29.0%1위
Terminal-Bench 2.1Fable max 84.3%83.3%3위 (GPT 5.5 xhigh 83.4%와 0.1%p 차)
SWE-Bench ProFable max 80.4%64.7%3위 (Opus 4.8 max 69.2%보다 낮음)
SWE-Bench MultilingualOpus 4.8 84.4%78.0%Opus보다 낮음

전 항목 1위는 Anthropic 계열 Fable 5(max) 가 차지하는 경우가 많다. Cursor 자사 모델이 아니라 경쟁사(Claude Code 쪽) 최고 성능 엔진으로 읽는 편이 맞다. Grok 4.5는 DeepSWE 1.0·Terminal-Bench·SWE Marathon에서 상위권이지만, SWE-Bench Pro·Multilingual에서는 Opus 4.8이 더 높다. 즉 Cursor·SpaceXAI는 지금 「1위 탈환」보다 상위권 성능을 훨씬 싼 엔진으로 공급하는 쪽에 가깝다.

5.2. 벤치마크별 해석

DeepSWE 1.0 벤치마크 — Grok 4.5 62.0%
그림 4. DeepSWE 1.0 — Grok 4.5 62.0% (Fable max 66.1%·GPT 5.5 64.31%)
DeepSWE 1.1 벤치마크 — Grok 4.5 53.0%
그림 5. DeepSWE 1.1 — Grok 4.5 53.0% (Opus 4.8 max 59.0%보다 낮음)

DeepSWE — Datacurve가 만든 소프트웨어 엔지니어링 에이전트 평가. Grok 4.5는 1.0에서 62.0%로 Opus 4.8을 앞서지만, 1.1(53.0%)에서는 Opus 4.8 max(59.0%)에 뒤진다.

SWE Marathon 벤치마크 — Grok 4.5 29.0% 1위
그림 6. SWE Marathon — Grok 4.5 29.0%로 1위
Terminal-Bench 2.1 — Grok 4.5 83.3%
그림 7. Terminal-Bench 2.1 — Grok 4.5 83.3% (GPT 5.5와 0.1%p 차)

SWE Marathon — 장시간 해결률(pass@1). Grok 4.5가 29.0%로 1위, Opus 4.8 max 26.0%, Fable max 24.0%다. 장기 에이전트 작업에서 강점을 보여 주는 지표다.

Terminal-Bench 2.1 — 터미널·CLI 기반 코딩. Grok 4.5 83.3%로 GPT 5.5 xhigh(83.4%)와 거의 동률, Opus 4.8 max(78.9%)보다 높다.

SWE-Bench Pro — Grok 4.5 64.7% 그림 8. SWE-Bench Pro — Grok 4.5 64.7% (Opus 4.8 max 69.2%보다 낮음)

SWE-Bench Pro — 여러 파일·평균 107줄 수정 등 실전형 과제. Grok 4.5 64.7%, Opus 4.8 max 69.2%로 Anthropic 측이 앞선다.

5.3. CursorBench는 공식 표에서 제외

Cursor 블로그 각주에 따르면, Grok 4.5 학습 데이터에 Cursor 코드베이스 과거 스냅샷이 실수로 포함돼 CursorBench에서 유리했을 수 있다. 그래서 공식 비교표에서 CursorBench가 빠졌다. 「10분의 1 비용에 비슷한 점수」 같은 CursorBench 기반 주장은 근거가 약하다고 보는 것이 맞다.

Grok 4.5 가격·토큰 효율 — $2/$6·4.2배 적은 출력 토큰 그림 9. 출력 단가·SWE-Bench Pro 토큰 효율에서 Grok 4.5가 두드러짐

6. 가격과 가성비 — 이번 출시의 핵심 무기

6.1. API·Cursor 토큰 단가

모델입력(/100만)출력(/100만)
Grok 4.5$2$6
Grok 4.5 fast (Cursor)$4$18
Opus 4.8 (참고)$5$25
GPT 5.5 (참고)$5$30
Fable 5 (참고)$10$50

출력 기준으로 Grok 4.5는 Opus 4.8의 약 4분의 1, Fable 5의 8분의 1 수준이다. SpaceXAI는 「시간·비용 단위당 지능(intelligence per unit of time and cost)」을 강조한다. Cursor·Grok의 전략 축은 「최고 성능」이 아니다. 싸고 빠른 엔진을 키워 실사용 점유를 노리는 쪽에 가깝고, 벤치 절대 1위 엔진은 여전히 경쟁사 Anthropic의 Fable 5(Claude Code 계열)로 보는 것이 자연스럽다.

6.2. 토큰 효율이 비용을 더 낮춘다

같은 SWE-Bench Pro 과제에서 Grok 4.5는 평균 15,954 출력 토큰, Opus 4.8(max)은 67,020 토큰을 쓴다(공식 그래프). 단가가 낮을 뿐 아니라 쓰는 토큰 자체가 적어 체감 비용 차이가 커진다.

일론 머스크는 X에 「Opus급이지만 더 빠르고 토큰 효율이 높으며 비용이 낮다」고 밝혔다. 벤치마크 절대 1위가 아니라 값 대비 성능을 내세우는 포지셔닝과 맞닿아 있다.

7. 코딩·사무 업무 능력

7.1. 코딩

SpaceXAI는 Rust·C/C++ 난이도 과제부터 프롬프트 한 번으로 프로덕션 앱까지 가능하다고 소개한다. 공개 예시로 Three.js 태양계 시뮬레이션 등이 있다.

7.2. Grok Build·오피스

Grok 4.5는 Grok Build 기본 모델이다.

영역공식 소개 능력
Excel웹 리서치·멀티시트 수식·메모(sticky) 남기기
PowerPoint네이티브 도형·다이어그램·슬라이드 구성
Word명확한 산문 작성

Word·PowerPoint·Excel용 플러그인도 함께 안내된다.

Cursor Grok 4.5 신규 모델 출시 팝업 — SpaceXAI 공동 학습·7월 14일까지 50% 할인
그림 10. Cursor 출시 팝업 — SpaceXAI 공동 학습·1주간 사용량 2배 안내
Cursor 모델 선택 — Cursor Grok 4.5 High 256k 컨텍스트 툴팁
그림 11. Cursor Grok 4.5 High — 256k 컨텍스트·장시간 에이전트 코딩용

8. Cursor에서 Grok 4.5 쓰는 방법

▶ Cursor 시작하기 — 바이브 코딩·에이전트 체험
데스크톱·웹·CLI · Grok 4.5 포함 모델 풀 · 이 사이트 제작에 사용한 도구 (제휴 링크)

8.1. 모델 선택

Cursor 데스크톱·웹·iOS·CLI·SDK에서 Cursor Grok 4.5 High 등 티어를 선택한다. 툴팁에는 「SpaceXAI 최신 모델, 복잡한 장시간 에이전트 코딩용」이라고 표기된다.

8.2. 요금·프로모션

  • 개인·팀 플랜에 1st-party 모델 풀로 포함
  • 출시 후 1주간 사용량 2배(UI 배너: 7월 14일까지 50% 할인)
  • Grok Build·Cursor에서 한시 무료 이용 안내(x.ai/cli)

8.3. API 예시

SpaceXAI 콘솔에서 API 키를 발급한 뒤 model 이름 grok-4.5로 호출한다. 공식 뉴스에 curl 예시가 제공된다.

9. 경쟁 모델과 어떻게 비교할까

관점Grok 4.5 (Cursor·SpaceXAI)Fable 5 max (Anthropic·Claude Code 계열)Opus 4.8 maxGPT 5.5 xhigh
벤치 절대 점수상위권·항목별 엇갈림다수 1위SWE-Bench Pro·Multilingual 강함Terminal-Bench·DeepSWE 1.0 상위
비용최저 수준최고가중~고가중~고가
토큰 효율4.2배 우위(공식 SWE-Bench Pro)상대적으로 많음67k 토큰/과제중간
장시간 에이전트SWE Marathon 1위24.0%26.0%(표에 미포함)

성능 1등이 목표면 Cursor 밖·경쟁사 쪽 Fable 5 max(Claude Code 계열) 나 항목별 최고 모델을 본다. 예산·속도·토큰 효율이 우선이면 Cursor 안의 Grok 4.5가 후보에 오른다. Composer 2.5는 다른 가중치 클래스로 Cursor가 계속 제공한다(Cursor 블로그). Cursor·Grok이 Fable을 「자사 1위 엔진」으로 대체하려는 그림으로 읽히면 오해다.

10. 이 사이트에서 Cursor를 쓰는 이유

앞 절까지는 공식 벤치와 가격표를 봤다. 여기서는 그 숫자가 실제 사이트 운영에서 어떻게 읽히는지를 짧게 연결한다. min-inter는 Cursor로 만든 사이트이고, 지금도 Cursor로 유지·확장한다. Grok 4.5 출시를 「남의 뉴스」가 아니라 이미 쓰는 도구 안의 모델 교체로 보는 이유다.

10.1. 왜 「최고 모델」만 고르지 않는가

코딩 에이전트를 고를 때 흔히 하는 실수는 벤치 1위 = 내 작업에 최선이라고 단정하는 것이다. Anthropic Fable 5(Claude Code 쪽에서 쓰는 최고 성능 엔진)처럼 점수가 높은 모델은 어려운 한 방·정밀 패치에서 유리할 수 있다. 다만 이 사이트처럼 하루에도 위키 초안, 앱 수정, 영상 편집 스크립트, FAQ 보강을 여러 번·길게 돌리면 이야기가 달라진다.

선택 기준경쟁사 최고 성능 (Fable 5 · Claude Code 계열)Cursor + Grok 쪽
목표한 과제에서 최고 점수같은 날 여러 과제를 버틸 단가·속도
전략벤치·추론 절대 우위싸고 빠른 엔진으로 실사용 점유
비용 체감과제당·토큰당 비쌈$2/$6·토큰 효율로 부담이 작음
도구 통합Claude Code 등 별도 루프Cursor IDE·에이전트·요금제가 한 루프
실패 비용비싼 시도싸게 다시 시도 가능

머스크·Cursor 쪽 메시지와 공식 가격표를 겹치면 전략이 보인다. Cursor와 Grok은 1위를 탈환하려는 그림이 아니라, 최고 성능은 경쟁사(Claude Code의 Fable 5)에 두고 싸고 빠른 엔진 개발에 목적을 둔 쪽에 가깝다. 「최고는 아니나 싼데 빠르다」는 그 한 줄 요약이다. Grok 4.5가 SWE Marathon·Terminal-Bench에서 상위권이면서도 SWE-Bench Pro에서는 Opus에 뒤지는 점도, 「전 항목 1위」가 아니라 쓸 만한 지능을 싸게 공급하는 포지션과 잘 맞는다.

10.2. min-inter에서 Cursor가 하는 일

이 사이트에서 Cursor는 「코드 한 줄 자동완성」 수준이 아니다. 대략 아래를 한 워크플로로 돌린다.

영역실제로 하는 일
웹앱초기 60여 개 앱·유틸·페이지 구현·수정
유튜브채널 분석기 등 수집·분석 도구
콘텐츠위키·칼럼 조사·작성·이미지·OG 반영
영상컷편집·자막·자동화 스크립트
운영문의 처리·배포 스크립트·스킬 기반 반복 작업

작업량의 대략 90% 이상이 Cursor 에이전트 경로를 탄다. 그래서 모델 선택은 「오늘 한 번 쓸 최고 점수」보다 한 달 내내 돌려도 버틸 요금·속도·도구 통합이 우선이다. Godfather(갓파더) 요금제의 Auto 모드 무제한 구간도, 그 반복 작업을 전제로 잡은 선택이다.

10.3. 시기별로 보면

시기무슨 일이 있었나지금 읽으면
초기 약 2개월Cursor를 시험하며 사이트 골격·초기 앱을 만듦「도구가 맞는지」를 짧게 검증한 구간
이후 약 1년앱 60여 개·채널 분석기·포스팅 파이프라인 확장시험이 본업 도구로 굳어진 구간
요금제초반이 맞아 연간 결제, 갓파더 Auto 무제한 활용단발 구독이 아니라 상시 에이전트 비용으로 봄
인수 소식SpaceX·머스크 측 Cursor 인수·협력을 접함이미 쓰는 도구의 소유 구조가 바뀐 뉴스
Grok 4.5Cursor 전 요금제·Grok Build·API에 동시 배포같은 IDE 안에서 가성비 모델이 기본 후보로 들어옴

인수 소식 이후에도 Cursor를 바꾼 것은 아니다. 이미 사이트·스킬·배포 루프가 Cursor에 맞춰져 있고, Grok 4.5는 그 루프에 가격이 낮은 공동 학습 모델을 추가한 이벤트에 가깝다.

10.4. Grok 4.5를 이 사이트 관점에서 보면

  1. 벤치 — 전 항목 1위가 아니어도, 장시간 에이전트(SWE Marathon)·터미널 작업에서 상위권이면 「하루 종일 돌리는 작업」 후보가 된다.
  2. 가격 — 입력 $2·출력 $6과 토큰 효율은, 위키·앱·영상 스크립트를 자주 돌릴 때 체감 비용을 낮춘다.
  3. 통합 — 별도 콘솔만 쓰는 모델이 아니라 Cursor 모델 풀에 들어와, 기존 스킬·에이전트 흐름을 그대로 탄다.
  4. 역할 분담 — 정말 어려운 한 방은 경쟁사 쪽 Fable 5(Claude Code)·Opus를 쓰고, 반복·장시간·비용 민감 작업은 Cursor 안의 Grok 4.5·Composer로 나누는 식이 이 사이트 운영과 잘 맞는다.

정리하면, 이 사이트가 Cursor를 쓰는 이유는 「Grok이 세계 1위라서」가 아니다. 최고 성능 엔진은 여전히 경쟁사 Claude Code 계열 Fable 5에 가깝고, Cursor·Grok은 그 자리를 뺏기보다 싸고 빠른 엔진으로 실사용을 채우는 전략이다. 이미 검증된 Cursor 루프 위에 그 가성비 모델이 올라왔기 때문에 계속 쓰는 쪽에 가깝다. 다음 절의 주의점(self-reported 점수·CursorBench 제외 등)을 본 뒤, 상황별 선택표에서 자기 작업에 맞게 고르면 된다.

11. 읽을 때 꼭 알아둘 주의점

앞 절의 운영 경험과 별개로, 벤치 숫자를 읽을 때 빠지기 쉬운 함정만 다시 짚는다.

  1. 경쟁사 점수는 self-reported — SWE-Bench Pro·Terminal-Bench 등(Cursor 각주).
  2. CursorBench는 오염 가능성으로 공식 표 제외 — CursorBench 수치만으로 우위 주장 금지.
  3. 항목마다 1위가 다름 — 「모든 벤치 1위」는 사실이 아니다.
  4. EU는 7월 중순 이후 — 현재 EU에서는 SpaceXAI 제품·API 미제공.
  5. 가격·모델명·리더보드는 변동 — 결정 전 공식 페이지 재확인.

독립 제3자 평가(예: Artificial Analysis)와 자신의 코드베이스 실측을 함께 보는 것이 안전하다.

12. 상황별 선택 가이드

위 경험과 벤치·가격을 겹치면, 모델은 「하나만」이 아니라 역할별로 고르는 편이 낫다.

상황추천 방향
Cursor에서 장시간 멀티파일 에이전트Cursor에서 Grok 4.5 High 시험 · SWE Marathon 강점 참고
API 대량 배치·비용 민감Grok 4.5 기본($2/$6) · 토큰 효율 확인
최고 점수·예산 여유Anthropic Fable 5 max(Claude Code 계열) 등 벤치 1위 엔진
멀티파일 패치 정확도 최우선SWE-Bench Pro에서 높은 Opus 4.8 max 비교
가벼운 일상 코딩·가성비Composer 2.5 유지(Cursor 블로그)
엑셀·PPT·워드 자동화Grok Build 기본 모델
Cursor를 이미 쓰고 비용·속도가 중요Grok 4.5·Composer 유지 · 최고 성능이 필요하면 Claude Code·Fable 5를 별도로

Cursor를 아직 안 써 봤다면 Cursor 바이브 코딩 시작하기에서 데스크톱·웹·CLI를 먼저 열어 보면 된다.

13. 마무리

앞에서 다룬 Grok 4.5의 핵심만 짧게 정리한다.

  • 7월 8일 SpaceXAI·Cursor 공동 학습 MoE 모델로 출시됐고 Grok Build·Cursor·API에서 이용 가능하다.
  • 벤치마크는 항목마다 순위가 갈린다. SWE Marathon·Terminal-Bench·DeepSWE 1.0에서 강하지만 SWE-Bench Pro·Multilingual에서는 Opus 4.8이 더 높다.
  • Anthropic Fable 5 max(Claude Code 계열) 가 여러 표에서 1위인 경우가 많아, Grok 4.5를 「절대 최고 성능」으로 읽으면 안 된다.
  • 가격($2/$6)·80 TPS·4.2배 토큰 효율이 이번 출시의 실질 무기다. Cursor·Grok은 1위 탈환보다 싸고 빠른 엔진 전략에 가깝다.
  • CursorBench는 학습 오염 단서로 공식 비교에서 빠졌다 — 해당 수치만으로 결론 내리지 않는다.
  • 경쟁 모델 점수는 타사 self-reported일 수 있어, 동일 조건 비교로 받지 않는다.
  • EU·컨텍스트 한도·요금제 포함량은 채널·시점마다 다를 수 있으니 공식 문서로 재확인한다.
  • 이 사이트처럼 Cursor로 앱·위키·영상 편집을 돌리는 경우, 벤치 1위보다 하루 종일 돌릴 수 있는 단가·속도가 선택 기준이 되기 쉽다.

「최고 성능 엔진은 Claude Code의 Fable 5, Cursor·Grok은 싸고 빠른 엔진」 — Grok 4.5는 그 역할 분담을 가격표와 벤치 표에 동시에 보여 주는 사례다. 이 사이트도 Cursor를 초기부터 약 1년 넘게 쓰며 앱·포스팅·영상 편집의 대부분을 그 루프에 올려 둔 상태다. 자신의 저장소에서 짧은 파일럿을 돌려 본 뒤, Cursor 모델 풀에 넣을지·최고 성능이 필요하면 경쟁사 엔진을 따로 쓸지 정하면 된다.

자주 묻는 질문

  • Grok 4.5는 언제 출시됐나요?

    SpaceXAI 공식 뉴스와 Cursor 블로그 기준 2026년 7월 8일입니다. 당일 Grok Build, Cursor 전 요금제, SpaceXAI API 콘솔에 배포됐습니다. EU 지역은 7월 중순 예정으로 아직 미제공입니다.

  • SpaceXAI와 xAI는 같은 회사인가요?

    2026년 SpaceX-xAI 통합 이후 브랜드가 SpaceXAI로 정리됐습니다. Grok 4.5 발표 페이지·Cursor 블로그 모두 SpaceXAI 명칭을 씁니다. 법적 합병 구조는 매체마다 표현이 조금 다를 수 있습니다.

  • Cursor와 어떤 관계로 만들어졌나요?

    MoE 모델을 SpaceXAI와 Cursor가 공동 학습했습니다. 수조 토큰 규모 Cursor 데이터(코드베이스·도구 상호작용·에이전트 궤적)가 들어갔고, 6월 Anysphere 600억 달러 규모 인수 발표와 맞물린 첫 공동 모델입니다.

  • Grok 4.5 API 가격은 얼마인가요?

    입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러입니다. Cursor의 fast 변형은 입력 4달러·출력 18달러로 별도 안내됩니다. Opus 4.8·GPT 5.5·Fable 5보다 출력 단가가 훨씬 낮습니다.

  • 벤치마크에서 Grok 4.5가 1위인 항목은?

    SpaceXAI 공개 표 기준 SWE Marathon(29.0%)에서 1위입니다. DeepSWE 1.0·Terminal-Bench 2.1에서는 3위, SWE-Bench Pro·DeepSWE 1.1에서는 더 낮습니다. Fable 5 max가 여러 항목 1위입니다.

  • Terminal-Bench 2.1에서 Grok 4.5 점수는?

    83.3%입니다. GPT 5.5 xhigh 83.4%와 0.1%p 차이로 거의 동률이고, Opus 4.8 max 78.9%보다 높습니다. Fable max 84.3%가 1위입니다. 경쟁 모델 점수는 타사 self-reported일 수 있습니다.

  • 토큰 효율이란 무엇이며 Grok 4.5는 얼마나 좋나요?

    SWE-Bench Pro 과제 하나를 푸는 데 쓰는 평균 출력 토큰을 말합니다. Grok 4.5는 15,954토큰, Opus 4.8 max는 67,020토큰으로 공식 자료 기준 약 4.2배 적게 씁니다. 단가 절감과 함께 체감 비용을 더 낮춥니다.

  • CursorBench 결과는 왜 공식 표에 없나요?

    Cursor 블로그 각주에 따르면 Grok 4.5 학습 데이터에 Cursor 코드베이스 과거 스냅샷이 실수로 포함돼 CursorBench에서 유리했을 수 있습니다. 그래서 공식 비교표에서 제외됐고, 향후 CursorBench 대규모 업데이트가 예정됩니다.

  • Cursor에서 Grok 4.5는 어떻게 선택하나요?

    Cursor 데스크톱·웹·iOS·CLI·SDK의 모델 선택 메뉴에서 Cursor Grok 4.5 High 등을 고릅니다. 출시 후 1주간 사용량이 2배로 제공되며 UI에는 7월 14일까지 50% 할인 프로모션이 표시됩니다.

  • Composer 2.5는 Grok 4.5에 대체되나요?

    아닙니다. Cursor 블로그는 Grok 4.5와 Composer 2.5가 서로 다른 가중치 클래스이며 Composer 2.5를 계속 제공하고 같은 크기의 새 모델도 낼 것이라고 밝혔습니다.

  • Grok 4.5 컨텍스트 윈도우는 몇 토큰인가요?

    Cursor IDE 모델 툴팁에는 Cursor Grok 4.5 High fast 변형 기준 256k 컨텍스트가 표기됩니다. API·Grok Build의 최대 컨텍스트는 채널별로 다를 수 있으므로 docs.x.ai에서 최신 한도를 확인하는 것이 좋습니다.

  • EU에서 지금 쓸 수 있나요?

    SpaceXAI 공식 뉴스에 따르면 2026년 7월 8일 기준 EU에서는 SpaceXAI 제품·API 콘솔 모두 Grok 4.5를 아직 제공하지 않으며, 7월 중순(mid-July) 제공이 예정됩니다.

  • Grok 4.5는 벤치 1위가 아닌데 왜 Cursor에 넣었나요?

    공식 표에서도 항목마다 Anthropic Fable 5·Opus 4.8이 앞서는 경우가 있습니다. Fable 5는 Cursor 자사 모델이 아니라 Claude Code 쪽에서 쓰는 최고 성능 엔진으로 읽는 편이 맞습니다. Cursor·SpaceXAI는 벤치 1위 탈환보다 가격·토큰 효율·속도(싸고 빠른 엔진)로 실사용 점유를 노리는 전략에 가깝습니다.

  • 이 사이트는 Cursor를 실제로 얼마나 쓰나요?

    운영 기준으로 초기 약 2개월 시험 뒤 연간 결제했고, 앱 60여 개·유튜브 채널 분석기·위키·영상 편집 등 사이트 작업의 대략 90% 이상을 Cursor로 진행합니다. Godfather 요금제의 Auto 모드 무제한 구간도 활용합니다. 벤치 1위 모델만 고르는 방식이 아니라, 하루 종일 돌리는 에이전트 작업에서 비용·속도·도구 통합이 맞아서 유지하는 사례입니다. Grok 4.5는 그 루프에 들어온 가성비 모델로 읽습니다.

  • Cursor는 어디서 시작할 수 있나요?

    이 사이트 제작·운영에 쓰는 도구와 같은 Cursor는 제휴 링크(https://min-inter.co.kr/link/cursor-easy-vibecoding)에서 시작할 수 있습니다. 데스크톱·웹·iOS·CLI·SDK를 지원하며, Grok 4.5는 Cursor 전 요금제 모델 풀에 포함됩니다.

  • Fable 5는 Cursor 모델인가요?

    아닙니다. 벤치 표의 Fable 5(max)는 Anthropic 계열·Claude Code 쪽에서 쓰는 최고 성능 엔진으로 자주 묶여 언급됩니다. Cursor·Grok 4.5와는 경쟁 관계에 가깝고, Cursor가 Fable을 자사 1위 엔진으로 내세우는 구조가 아닙니다. Cursor·Grok은 가성비·속도 쪽, Fable 5는 최고 성능 쪽에 가깝습니다.