xAI 8월 7일 전후 Grok 4.7 예고 2026-07-30

Grok 4.6 출시 일정: 8월 7일 전후 1.5조 파라미터 — xAI가 SFT·RL에 베팅하는 이유

누가 읽어야 하나요? Grok 4.5 이후 차기 모델 일정을 추적하는 Mac·Cursor 개발자와, Kimi K3·Claude Fable 5.1과의 포지셔닝을 정리해야 하는 AI 엔지니어링 팀입니다.얻는 것: 머스크 7/28 X 답글 기반 타임라인, 1.5T/2.1T 스펙 표, SFT·RL 업그레이드 해설, 경쟁 모델 비교, 미검증 정보 구분, Mac 격리 5단계.구성: 의사결정 함정×3, 타임라인·스펙·벤치마크 표, FAQ×5, 대여 Mac CTA.

Grok 4.6 출시 일정 1.5조 파라미터 SFT RL Grok 4.7 2.1조 xAI 2026

관련 글: Grok 4.5 심층 평가 (7/11) · Kimi K3 오픈 웨이트 개방 (7/28) · OpenRouter API 가이드.

Featured Snippet 직답

2026년 7월 28일, 일론 머스크는 Vercel CEO Guillermo Rauch(@rauchg) X 게시물 답글에서 Grok 4.6약 8월 7일 전후 출시한다고 밝혔습니다. 총 파라미터 1.5조(1.5T), 핵심은 단순 스케일업이 아니라 SFT·RL 후학습 대폭 강화입니다. 이어 Grok 4.7(2.1T)은 수 주 내 예상되며, 머스크는 「4.6보다 전반적으로 우수하나 서빙 속도는 약간 느리고 토큰 효율은 더 높다」고 설명했습니다. xAI 공식 블로그·모델 카드·벤치마크·요금은 아직 미공개이며, 본문의 4.6/4.7 수치는 단일 SNS 발언 기반입니다.

Grok 4.5 출시(7월 8일)로부터 불과 3주 만에, xAI는 여름 안에 연속 3개의 프론티어 모델을 내놓겠다는 로드맵을 공개했습니다. Grok 4.6·4.7의 유일한 1차 출처는 머스크의 X 답글이며, Grok 4.5 당시처럼 15개 이상의 벤치마크가 담긴 모델 카드는 아직 없습니다. Mac 개발자 입장에서는 「출시 전에 워크플로를 미리 설계할지, 4.5를 유지할지」를 판단하려면 공식 발표와 루머를 구분하는 프레임이 필요합니다.

01 · 3대 의사결정 함정

  1. 「공식 발표」와 「머스크 타임」 혼동: Grok 4.6 일정의 유일한 1차 출처는 7/28 X 답글입니다. xAI 제품 페이지·블로그·API 문서에는 동일 로드맵이 아직 없습니다. Tesla·SpaceX·xAI 역사상 「약 N일」은 며칠~2주 밀리는 Musk time이 흔하므로, 내부 마일스톤에 하드 데드라인으로 박아 두면 위험합니다.
  2. 파라미터 숫자만 보고 선정: 1.5T·2.1T는 규모 점프이지만, 머스크 본인이 4.6의 핵심을 「SFT & RL」로 규정했습니다. Grok 4.5가 SWE-Bench Pro에서 Opus 4.8(67,020 출력 토큰) 대비 약 15,954 토큰으로 경쟁한 것처럼, 4.6 이후에도 작업당 토큰·달러가 리더보드 순위보다 실무에 더 중요할 수 있습니다.
  3. 미출시 모델에 아키텍처 베팅: Kimi K3는 7/27 오픈 웨이트·독립 벤치마크가 이미 존재합니다. Grok 4.6은 벤치마크·요금·컨텍스트 윈도우가 전부 공백입니다. 프로덕션 라우팅을 4.6 출시 전에 고정하거나, Cursor 기본 모델을 미리 바꾸는 것은 검증 불가 상태에서의 과잉 투자입니다.

02 · 출시 타임라인: Grok 4.5 → 4.6 → 4.7

날짜 이벤트
2026-04-17Grok 4.3 Beta 출시 — 4.x 세대 기준선
2026-07-08Grok 4.5 공식 출시 — Cursor 공동 학습, 50만 토큰 컨텍스트, API $2/$6 per 1M, 모델 카드·15개 벤치마크 공개
2026-07-16–26Moonshot AI Kimi K3 호스팅 → 7/27 오픈 웨이트 전환(2.8T MoE, 100만 토큰). HF 트렌딩 1위, Frontend Code Arena 1,679점 1위
2026-07-28머스크, @rauchg 답글로 Grok 4.6·4.7 로드맵 최초 공개. 동일 날 OpenAI·Anthropic 등 1,200+명 「Pacing the Frontier」 연명 공개 — xAI는 서명 목록에 없음
~2026-08-07Grok 4.6 목표 — 1.5T, SFT·RL 업그레이드 (공식 미확인)
~2026-08 말–09 초Grok 4.7 예상 — 2.1T, 4.6 대비 전반적 성능↑·서빙 속도↓·토큰 효율↑ (공식 미확인)

핵심 데이터 #1: 7/8 Grok 4.5 → 7/28 4.6 예고 = 20일. K3 오픈 웨이트(7/27) 직후 4.6 목표(8/7) = 약 10일 — 경쟁 압박과 출시 밀도가 동시에 높아진 시점입니다.

03 · Grok 라인업 핵심 스펙 표

모델 출시/목표 파라미터 포지셔닝 상태
Grok 4.3 Beta2026-04-17비공개4.x 기준선출시 완료
Grok 4.52026-07-08비공개(단일 SKU, 비 MoE 공개)코딩·Agent, Cursor 공동 학습출시·벤치마크 공개
Grok 4.6~2026-08-071.5TSFT·RL 후학습 강화SNS 예고, 미출시
Grok 4.7~8월 말–9월 초2.1T4.6 전방위 우위, 서빙 느림·토큰 효율↑SNS 예고, 미출시

* Grok 4.6·4.7 파라미터·일정은 머스크 7/28 X 답글 기반. 제3자 독립 검증·공식 모델 카드 없음.

04 · SFT·RL 후학습 심층 분석: 「더 크게」가 아니라 「더 잘 배우기」

머스크가 Grok 4.6에서 강조한 「significantly improved SFT & RL」은 단순 파라미터 증가와 다른 축의 업그레이드를 뜻합니다.

4.1 SFT(지도 미세조정)가 바꾸는 것

지도 미세조정(SFT)은 인간이 선별·라벨링한 고품질 입출력 쌍으로 모델의 출력 습관을 교정합니다. 코딩 Agent에서는 「올바른 diff 형식」「도구 호출 순서」「에러 메시지 해석」 같은 패턴이 SFT로 고정됩니다. Grok 4.5가 Cursor 실제 개발자 세션 데이터로 학습해 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 기록한 것이 같은 전략의 연장선입니다.

4.2 RL(강화학습)이 Agent에 특히 중요한 이유

강화학습(RL)은 다단계 작업에서 「어떤 행동 시퀀스가 보상을 받는지」를 학습합니다. 파일 탐색 → 테스트 실행 → 패치 → 재실행 같은 멀티스텝 Agent 루프는 SFT만으로는 일반화가 어렵고, RL 보상 신호가 품질을 끌어올립니다. 4.6에서 RL을 「대폭」 강화한다는 것은 코딩·자율 워크플로 벤치마크 개선을 노린다는 해석이 타당합니다 — 다만 수치는 출시 전까지 미검증입니다.

4.3 「스케일 + 후학습」 이원 전략: 4.6 vs 4.7

4.6(1.5T)은 4.5 대비 명확한 규모 점프이지만, 머스크는 4.7(2.1T)을 「4.6보다 전반적으로 우수하나 서빙은 약간 느리다」고 구분했습니다. 이는 Anthropic Sonnet/Opus, OpenAI mini/플래그십처럼 지연 민감 vs 품질 민감 워크로드를 SKU로 나누려는 신호로 읽힙니다. Mac 개발자는 Cursor 인터랙티브 코딩(저지연)과 백그라운드 Agent(고품질)를 서로 다른 Grok 세대에 매핑할 여지가 생깁니다.

4.4 Kimi K3와의 동시대 경쟁 압력

Grok 4.6 목표일은 K3 오픈 웨이트 직후 약 10일입니다. K3는 Frontend Code Arena 1,679점으로 역사상 첫 「오픈 웨이트가 모든 클로즈드 모델을 앞선」 사례가 되었고, Artificial Analysis 지능 지수 글로벌 3위입니다. 머스크는 K3 벤치마크 관련 스레드에 「인상적」이라 댓글을 남긴 바 있습니다. xAI가 4.6·4.7 출시 간격을 압축한 배경으로 업계는 중국·미국 프론티어 경쟁 격화를 가장 유력한 설명으로 봅니다.

핵심 데이터 #2: Grok 4.5 SWE-Bench Pro 작업당 출력 토큰 ~15,954 vs Opus 4.8 ~67,020 — 약 4.2배 효율 격차. 4.6의 SFT·RL 강화가 이 축을 유지·확대할지가 실무 핵심 관전 포인트입니다.

05 · 경쟁 모델 횡단 비교

모델 제조사 파라미터 컨텍스트 요금(입력/출력 per 1M) 출처
Grok 4.5xAI비공개50만 토큰$2 / $6xAI 공식
Grok 4.6 (예고)xAI1.5T미공개미공개머스크 X (미검증)
Kimi K3Moonshot AI2.8T MoE (16/896 활성)100만 토큰$0.30(캐시)/$3 입력, $15 출력Moonshot + HF
Claude Fable 5.1 (루머)Anthropic미공개미공개Fable 5 동일 $10/$50 추정36kr·WinCentral, Anthropic 미확인
GPT-5.6 SolOpenAI비공개비공개비공개OpenAI 공식

* Grok 4.6·Fable 5.1 행은 출시 전 주장·루머 — 헤드투헤드 성능 비교용이 아니라 출시 리듬·포지셔닝 참고용입니다.

06 · Grok 4.5 벤치마크 기준선 (4.6 출시 전 참고)

Grok 4.6에는 공개 벤치마크가 없습니다. 선정 회의에서는 전작 4.5의 검증된 수치를 기준선으로 두고, 4.6 출시 후 동일 harness로 재측정하는 것이 안전합니다.

6.1 코딩·Agent 핵심 지표 (Grok 4.5 공식·독립 정리)

벤치마크 Grok 4.5 비교 참고
SWE-Bench Pro64.7%Claude Opus 4.8: 69.2%
Terminal-Bench 2.183.3%터미널·도구 호출 Agent
작업당 출력 토큰 (SWE-Bench Pro)~15,954Opus 4.8: ~67,020 (약 4.2× 차이)
Kimi K3 (독립, 7월)SWE-bench Verified 93.4%, AA Index 글로벌 3위
Grok 4.6데이터 없음출시·모델 카드 대기

4.6이 「1.5T이므로 K3를 이긴다」고 결론 내리기 이릅니다. K3는 이미 독립 harness에서 높은 점수를 보였고, 4.6은 아직 harness 자체가 없습니다.

07 · 미검증 정보·안전 논란·업계 분열

  • 유일한 1차 출처 = X 답글 1건: xAI 블로그·제품 페이지·API 카탈로그에 Grok 4.6이 아직 없습니다. 내부 로드맵·고객 커뮤니케이션은 공식 채널 재확인 전까지 보류가 안전합니다.
  • 벤치마크·요금·컨텍스트 전부 공백: Grok 4.5는 출시 당일 모델 카드와 $2/$6 요금이 함께 나왔습니다. 4.6은 파라미터·SFT·RL 문구만 있고 검증 가능한 수치가 없습니다.
  • xAI 콘텐츠 안전 논란: 2026년 7월 xAI는 Grok 안전장치 우회로 CSAM 생성 혐의 사용자를 기소했습니다(해당 유형 최초 소송). 2026년 1월 Common Sense Media는 Grok를 미성년자 보호 측면 최악 AI 제품 중 하나로 평가했습니다. 기술 성능 평가와 별개로 엔터프라이즈 벤더 리스크 체크리스트에 넣을 항목입니다.
  • 「Pacing the Frontier」와의 시차: 7/28 — 머스크가 4.6·4.7을 예고한 날 — OpenAI·Anthropic·Google DeepMind·Meta 등 1,200+명이 미국 정부에 프론티어 AI 속도 조절 도구 구축을 촉구하는 연명을 공개했고, OpenAI·Anthropic은 회사 명의로 지지했습니다. xAI는 서명자에 없습니다. 「감속 호출」과 「2개월 3모델」이 동시에 진행되는 업계 분열이 8월 선정 환경의 배경입니다.

08 · 2026년 8월: 「대량 출시월」이 될 가능성

머스크 일정이 맞다면 Grok 4.6(~8/7)과 Grok 4.7(~8월 말)은 루머상 Claude Fable 5.1(36kr·WinCentral 등, 8월·GPT-6 선행 목적 추정, Anthropic 미확인)과 같은 달에 겹칩니다. 7월 K3 오픈 웨이트 충격까지 더하면, 2026년 8월은 대형 모델 출시 밀도가 역대급일 수 있습니다.

Mac·Agent 팀에게 시사점은 명확합니다: 플래그십 유효 기간이 수주 단위로 줄어들고, 리더보드 1위보다 작업당 토큰·달러·검증 파이프라인이 더 지속 가능한 선정 기준이 됩니다. 4.6 출시 전에는 Grok 4.5 + K3 API를 병행 벤치마크해 내부 baseline을 확보해 두는 편이 낫습니다.

09 · Mac 개발자 5단계 격리 시험 (4.6 출시 대비)

  1. Grok 4.5 baseline 확보: xAI API 또는 Cursor에서 동일 저장소 서브셋으로 버그 수정·리팩터·Agent 루프 3종을 실행하고 작업당 토큰·$ 비용을 기록합니다. (4.5 심층 평가 참고)
  2. Kimi K3 교차 검증: Moonshot API 또는 OpenRouter로 동일 태스크를 돌려 토큰 효율·diff 품질을 비교합니다. (K3 오픈 웨이트 개방)
  3. 격리 Mac에 API Key 분리: XAI_API_KEY를 주력기 Keychain·.zshrc가 아닌 임대 노드 환경 변수에만 저장합니다.
  4. 4.6 출시 알림·모델 카드 체크리스트 준비: xAI 공식 X·블로그·docs.x.ai·Cursor 릴리스 노트를 구독하고, SWE-Bench·Terminal-Bench·작업당 토큰 3항목을 4.5 수치와 나란히 기록할 스프레드시트를 만듭니다.
  5. 출시 48시간 내 동일 harness 재실행: 4.6이 Cursor·API에 올라오면 격리 Mac에서만 1~3단계 태스크를 재현하고, 품질·비용이 임계값을 넘을 때만 주력 워크플로에 반영합니다.
curl -s https://api.x.ai/v1/chat/completions \ -H "Authorization: Bearer $XAI_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model": "grok-4.5", "messages": [{"role": "user", "content": "Grok 4.6 is rumored for Aug 7 with 1.5T params. Summarize what is confirmed vs unverified."}]}'

10 · 자주 묻는 질문 FAQ

Q: Grok 4.6은 정확히 언제 출시되나요?
A: 머스크는 「약 8월 7일」이라고 했으나 xAI 공식 확인은 없습니다. Musk time 특성상 며칠~2주 지연 가능 — xAI 공식 채널을 기준으로 하세요.

Q: Grok 4.6과 Grok 4.7의 차이는?
A: 4.6은 1.5T·SFT·RL 강화, 4.7은 2.1T·4.6 대비 전반적 성능↑·서빙 속도↓·토큰 효율↑(머스크 발언). 둘 다 미출시·미검증입니다.

Q: Grok 4.6이 Kimi K3나 Fable 5.1보다 강할까요?
A: 현재 불가. 4.6 벤치마크 없음, K3는 독립 검증 다수, Fable 5.1은 루머 단계입니다.

Q: Grok 4.6 요금은?
A: 미공개. 4.5($2/$6 per 1M)가 참고 구간이나 신규 플래그십은 조정 가능 — 공식 발표 전 추정만 하세요.

Q: 어디서 쓸 수 있을까요?
A: 4.5 패턴상 Grok Build·xAI API·콘솔 1차, Cursor 등 서드파티 후속 가능성 — 4.6 전용 입구는 미확인입니다.

11 · 격리 Mac 임대: Grok 4.6 출시 전·후 API 워크플로 검증

Grok 4.6은 아직 없지만, 4.5 baseline과 K3 교차 벤치마크는 지금 격리 환경에서 돌려야 출시 직후 48시간 내 의사결정이 가능합니다. 주력 MacBook에 xAI Key를 넣고 Cursor 기본 모델을 바꾸면 Keychain·shell 프로필·Agent 캐시가 오염되고, 4.6 출시 후 「되돌리기」가 번거롭습니다.

격리 Apple Silicon 노드에서는 프로덕션 저장소 서브셋 복제 → XAI_API_KEY 환경 변수 주입 → Cursor에서 Grok 4.5 vs Kimi K3 동일 태스크 청구 비교 → 4.6 출시 시 모델 ID만 교체 재실행까지 한 사이클로 끝낼 수 있습니다. Windows/Linux는 Cursor Web으로 부분 체험 가능하나, macOS Keychain·Xcode 공존 시나리오는 검증 불가입니다.

일 단위 M 시리즈 Mac mini 임대는 시험 후 노드 폐기로 설정 잔존을 없앱니다. 요금은 M 시리즈 Mac 연산 임대 요금을 참고하세요.

12 · 참고 자료

  • xAI 공식: Introducing Grok 4.5, Grok 4.5 모델 카드 (media.x.ai)
  • 일론 머스크 2026-07-28 X 답글 (@rauchg)
  • 보도: Chain Tech Daily, Tron Weekly, American Bazaar, Qazinform (4.6 예고 취재)
  • Grok 4.5 벤치마크 정리: eesel.ai, felloai.com, aireleasetracker.com
  • Kimi K3: Moonshot AI 공식, GitHub moonshotai/Kimi-K3, Futu News, 21财经, Unwire.pro
  • Claude Fable 5.1 루머: Emergent.sh, WinCentral, 36kr (Anthropic 미확인)
  • 「Pacing the Frontier」: The Verge, TechTimes
  • xAI 안전 논란: Ars Technica, TechCrunch, The Guardian

데이터 기준일: 2026년 7월 30일. Grok 4.6·4.7 세부는 공식 예고·업계 보도 수준이며, 출시 전 xAI 공식 채널로 최신 일정·스펙·요금을 반드시 재확인하세요.