/ 블로그 / Grok 4.6
ENGINEERING_BLOG · 2026.07.30

Grok 4.6 출시일:
8월 7일·1.5조 파라미터, SpaceXAI 일정이 현실적인가?

일론 머스크는 Grok 4.68월 7일경 출시되고, 몇 주 뒤 더 큰 Grok 4.7이 이어진다고 밝혔습니다. 그는 2026년 7월 28일 X에서 Vercel CEO Guillermo Rauch에게 답글을 달며 이 일정을 공유했으며, SpaceXAI 공식 발표는 아닙니다. 아직 benchmark, 요금, 모델 카드는 공개되지 않았습니다. 본문은 프론티어 모델 출시, Agent 라우팅, Token 경제를 추적하는 개발자·기술 리더를 위해 타임라인, 사양, 경쟁 구도, 미검증 항목을 정리합니다.

SECTION 01 Grok 4.6 출시 전 흔히 하는 오해

  • 트윗을 공식 출시로 간주: 기록상 유일한 출처는 7월 28일 머스크의 X 답글입니다. SpaceXAI 블로그와 제품 페이지는 날짜·사양을 확인하지 않았습니다;
  • 파라미터 수를 성능과 동일시: 머스크는 원시 스케일보다 SFT·RL 사후 훈련 강화를 강조했으며, 이는 Grok 4.5의 코딩 중심 포지셔닝과 일치합니다;
  • 「머스크 타임」 무시: SpaceXAI, Tesla, SpaceX의 머스크 일정은 역사적으로 며칠~수주 밀린 적이 있습니다. 「8월 7일경」은 목표일 뿐 보장은 아닙니다;
  • 루머 경쟁 모델과 출시 모델 혼동: Claude Fable 5.1은 Anthropic이 공식 확인하지 않았습니다. Kimi K3·Grok 4.5 같은 출시 모델과 출처를 구분해 비교해야 합니다;
  • 벤더 리스크 맥락 생략: 2026년 7월 SpaceXAI는 Grok을 통해 CSAM 생성 혐의 사용자를 상대로 소송을 제기했습니다. Grok 4.6 기술 점수를 예측하진 않지만, 엔터프라이즈 벤더 검토에는 영향을 줍니다.

요약하면 Grok 4.6/4.7 로드맵은 그럴듯하지만 제3자 검증은 없습니다. 2026년 8월은 역대 가장 밀집된 출시 달이 될 수 있으므로, 파라미터 헤드라인만이 아니라 Token 효율과 실제 작업 비용으로 모델을 선택하는 것이 좋습니다.

SECTION 02 타임라인과 사양: Grok 4.5부터 4.7까지

2026년 7~9월 주요 이벤트
날짜 이벤트
2026년 7월 8일 SpaceXAI, 코딩·Agentic 작업용 Grok 4.5 출시. Cursor와 실제 개발자 세션 공동 훈련. 50만 Token 컨텍스트, 입력/출력 $2/$6 per 1M tokens, 15개 benchmark 점수 모델 카드 공개
2026년 7월 16~26일 Moonshot AI Kimi K3, 호스팅 프리뷰에서 완전 오픈웨이트 출시로 전환(2.8조 파라미터, 100만 Token 컨텍스트)
2026년 7월 28일 머스크, Rauch 답글로 Grok 4.6/4.7 로드맵 게시. 같은 날 OpenAI·Anthropic·Google DeepMind·Meta 1,200명 이상 직원이 「Pacing the Frontier」 서명 공개
~2026년 8월 7일 Grok 4.6 목표: 1.5조 파라미터, SFT/RL 업그레이드(트윗 발표, 미출시)
2026년 8월 말~9월 초 Grok 4.7 목표: 2.1조 파라미터. 머스크는 서빙 속도를 제외하면 4.6을 전면 능가하며 Token 효율이 더 낫다고 밝혔습니다
Grok 4.3~4.7 한눈에 보기
모델 날짜 파라미터 초점 상태
Grok 4.3 Beta 2026년 4월 17일 비공개 이전 기준선 출시됨
Grok 4.5 2026년 7월 8일 비공개(단일 SKU, MoE 아님) 코딩/Agentic, Cursor 공동 훈련 출시·benchmark 공개
Grok 4.6 ~2026년 8월 7일 1.5조 SFT/RL 업그레이드 트윗 발표, 미출시
Grok 4.7 ~2026년 8월 말~9월 초 2.1조 4.6 대비 전반 업그레이드, Token 효율 개선 트윗 발표, 미출시

Grok 4.6/4.7 수치는 단일 SNS 게시물의 미검증 벤더 주장입니다. 방향성 참고용으로만 취급하십시오.

SECTION 03 SpaceXAI가 스케일뿐 아니라 사후 훈련을 강조하는 이유

지도 학습 미세조정(SFT)은 선별된 예시 출력으로 모델 행동을 형성합니다. 강화 학습(RL)은 보상 신호로 어떤 행동 시퀀스가 효과적인지 가르치며, 다단계 Agentic 작업에 핵심입니다. 머스크의 「SFT·RL 대폭 개선」 프레이밍은 Grok 4.5가 Agentic benchmark에서 경쟁력을 갖게 한 전략을 강화한다는 신호입니다. SWE-Bench Pro 작업당 Grok 4.5는 약 15,954 출력 Token, Opus 4.8은 67,020 Token으로 4.2배 효율 격차가 있으며, 실제 Cursor 개발자 세션 사후 훈련 덕분이라는 평가가 있습니다.

Grok 4.6의 1.5조 파라미터는 실질적 스케일 증가이지만, Grok 4.7(2.1조, 「서빙은 약간 느리지만 모든 면에서 더 낫다」) 프레이밍은 SpaceXAI가 만능 단일 모델이 아니라 트레이드오프가 다른 두 SKU를 의도적으로 구축하고 있음을 시사합니다.

Grok 4.6 목표일은 Kimi K3 완전 오픈웨이트 출시로 업계가 흔들린 지 약 10일 뒤입니다. Kimi K3는 Frontend Code Arena 1,679점으로 오픈웨이트 최초 1위를 기록했고 Artificial Analysis Intelligence Index 3위입니다. 머스크는 Kimi K3 benchmark 게시물에 「impressive」라고 댓글을 달았습니다. 이 경쟁 압력이 약 2개월 만에 세 프론티어 모델을 출시하는 cadence를 압축한 가장 그럴듯한 설명입니다.

Grok과 경쟁 모델 비교
모델 벤더 파라미터 컨텍스트 요금(입력/출력 per 1M tokens)
Grok 4.5 SpaceXAI 비공개 500K $2 / $6
Grok 4.6(발표) SpaceXAI 1.5조 비공개 비공개
Kimi K3 Moonshot AI 2.8조(MoE, 활성 전문가 ~16/896) 1M $0.30(캐시 히트) / $3(캐시 미스) 입력, $15 출력
Claude Fable 5.1(루머) Anthropic 비공개 비공개 Fable 5($10 in / $50 out)와 동일하다는 루머
GPT-5.6 Sol OpenAI 비공개 비공개 비공개

Grok 4.6·Claude Fable 5.1 행은 출시 전 주장이며 검증된 benchmark가 아닙니다. 출시 시점·포지셔닝 참고용이며, 성능 대결 근거로는 부적합합니다.

SECTION 04 이 일정을 신뢰하기 전에 확인할 점

  • 유일한 출처는 트윗입니다. SpaceXAI 블로그, 모델 카드, 제품 페이지는 Grok 4.6 사양·날짜를 확인하지 않았습니다;
  • benchmark와 요금이 공백입니다. Grok 4.5의 상세 출시 자료와 달리 Grok 4.6에는 독립 평가·공식 모델 카드가 없습니다;
  • SpaceXAI는 별도 축에서 안전 논란을 겪고 있습니다. 2026년 7월 SpaceXAI는 Grok으로 CSAM 생성 혐의 사용자를 상대로 회사 최초의 유형 소송을 제기했습니다. 2026년 1월 Common Sense Media 보고서는 Grok을 아동 안전 리스크가 큰 AI 챗봇 중 하나로 평가했습니다;
  • 일정이 AI 속도 산업 분열과 겹칩니다. 머스크가 Grok 4.6/4.7을 발표한 같은 날 1,200명 이상 직원이 「Pacing the Frontier」에 서명해 미국 정부의 자동화 AI 개발 속도 조절을 요청했습니다. OpenAI·Anthropic은 기업으로 동의했으나 SpaceXAI는 목록에 없습니다.

머스크 일정이 지켜진다면 Grok 4.6·4.7은 루머 Claude Fable 5.1(36kr·WinCentral 유출)과 같은 달, Kimi K3 오픈웨이트 충격 몇 주 뒤에 출시됩니다. 모델을 평가하는 팀에게 단일 플래그십의 유효 기간은 수주로 압축되므로, Token 효율과 실제 작업 비용이 더 지속 가능한 선택 기준이 됩니다.

SECTION 05 인용 가능한 사양과 출시 전 6단계 체크리스트

  • Grok 4.5 benchmark(출시): Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%(SpaceXAI 공식 모델 카드);
  • Grok 4.5 Token 효율: SWE-Bench Pro 작업당 ~15,954 출력 Token vs Opus 4.8 ~67,020(제3자 요약);
  • Grok 4.6 발표: 1.5조 파라미터, SFT/RL 초점(머스크 X 게시, 미검증);
  • Grok 4.7 발표: 2.1조 파라미터, 4.6 대비 전반 우위·서빙은 다소 느림(머스크 X 게시);
  • Kimi K3 참고: Frontend Code Arena 1,679점, 2.8조 MoE, 100만 Token 컨텍스트(Moonshot 공식);
  • Grok 4.5 요금 참고: 입력 $2 / 출력 $6 per 1M tokens(SpaceXAI 공식).
  1. 진실 공급원 고정: SpaceXAI 블로그와 X @xai를 팔로우하십시오. 2차 보도만으로 프로덕션 라우팅을 바꾸지 마십시오;
  2. 기준선 매트릭스 구축: Grok 4.6 모델 카드 출시 전 자체 저장소에서 Grok 4.5·Kimi K3를 benchmark하고 Token 소비·통과율을 기록하십시오;
  3. A/B 기간 확보: 8월 첫 주 연간 API 계약 체결을 피하십시오. Grok 4.6·루머 Fable 5.1 대비 여유를 두십시오;
  4. 「강함」vs「빠름」 SKU 분리: 머스크에 따르면 4.6은 균형, 4.7은 품질 중심입니다. 지연 민감·품질 민감 워크로드별 라우트를 계획하십시오;
  5. 안전·컴플라이언스 재확인: SpaceXAI CSAM 소송·아동 안전 평가를 벤더 정책 검토에 반영하십시오;
  6. 출시일 요금 재확인: SpaceXAI 콘솔·API 문서를 기준으로 하십시오. 재무 모델에 Grok 4.5 요금을 가정하지 마십시오.

공식·제3자 출처 — 날짜·사양·가격 의존 전에 라이브 페이지로 재확인하십시오:

SpaceXAI: Grok 4.5 소개

Elon Musk on X(2026년 7월 28일 @rauchg 답글)

Moonshot AI: Kimi K3 GitHub

Grok·Kimi 등 프론티어 모델로 Agent와 iOS/macOS CI 파이프라인을 구축할 때 가상화 Mac 환경은 Xcode 빌드·Metal 워크로드에 오버헤드를 더합니다. 무손실 네이티브 연산, 안정적 iOS CI/CD, 7×24 Agent 자동화가 필요한 프로덕션 환경에서는 MACNOX 전용 클라우드 Mac 하드웨어가 보통 더 적합합니다. 100% Apple 정품 하드웨어, 완전 Root, Hypervisor 세금 없음, 일/주/월 유연 과금. Grok 4.5 리뷰Kimi K3 오픈웨이트 보도도 참고하십시오.

SECTION 06 자주 묻는 질문 FAQ

Grok 4.6은 정확히 언제 출시되나요?

머스크는 X 게시물에서 「2026년 8월 7일경」이라고 했으나 SpaceXAI는 공식 날짜를 확인하지 않았습니다. 밀릴 수 있는 목표로 취급하십시오.

Grok 4.6과 Grok 4.7의 차이는 무엇인가요?

Grok 4.6은 1.5조 파라미터 모델로 SFT·RL 사후 훈련 개선에 초점을 둡니다. Grok 4.7은 몇 주 뒤 예상되는 2.1조 모델로, 머스크에 따르면 서빙 속도를 제외하면 4.6을 전면 능가하며 일부 지연을 Token 효율과 교환합니다.

Grok 4.6이 Kimi K3나 Claude Fable 5.1을 이길 수 있나요?

아직 판단하기 이릅니다. Grok 4.6 benchmark는 없고 Kimi K3는 검증된 제3자 점수가 있으며 Claude Fable 5.1은 Anthropic 공식 확인이 없습니다. Grok 4.6이 모델 카드와 함께 출시될 때까지 실질 비교는 불가능합니다.

Grok 4.6 요금은 얼마인가요?

미공개입니다. Grok 4.5는 입력 $2·출력 $6 per 1M tokens로 출시되어 합리적 참고점이지만, Grok 4.6 요금은 SpaceXAI가 밝히지 않았습니다.

Grok 4.6은 어디에서 사용할 수 있나요?

Grok 4.5 출시 패턴상 Grok Build, SpaceXAI API, SpaceXAI 콘솔이 우선 접근을 받고 서드파티 연동이 뒤따를 것으로 예상되지만, 4.6에 대해서는 아직 확인되지 않았습니다.