Grok 4.6 출시일은 언제? 머스크 8월 7일 예고, 1.5조 파라미터

1.5T 파라미터 · SFT/RL 업그레이드 · Grok 4.7 로드맵 · Kimi K3 경쟁 압력 · Musk time 변동성

Grok 4.6 출시 예고와 xAI 로드맵 분석

2026년 7월 28일, 일론 머스크는 X에서 Vercel CEO Guillermo Rauch에게 답글을 달며 xAI가 8월 7일경 1.5조 파라미터 규모의 Grok 4.6을 출시할 계획이라고 밝혔습니다. 이어 수주 내 2.1조 파라미터 Grok 4.7도 공개 예정입니다. Grok 4.5 출시 후 불과 한 달 만에 세 개의 프론티어 모델을 연속으로 내놓겠다는 뜻으로, xAI의 여름 출시 속도가 전례 없이 빨라지고 있습니다. Agent 프로그래밍 스택을 검토 중이거나 차세대 API 요금을 기다리는 분이라면, 본문에서 전체 타임라인, Grok 시리즈 핵심 데이터표, 경쟁사 가로 비교, SFT/RL 업그레이드 해석, 논쟁점 구분, 6단계 출시 전 Runbook을 제공합니다. 공식 벤치마크와 요금은 아직 없으며, 아래 정보는 모두 출처 등급을 표기했습니다. 데이터 기준: 2026-07-30

01

Grok 4.5에서 4.6·4.7까지: 출시 속도는 얼마나 빠른가?

Grok 4.6 예고는 고립된 사건이 아닙니다. 2026년 7월 집중된 대규모 모델 출시 물결 속에 자리 잡고 있으며, 머스크 로드맵을 이해하려면 아래 타임라인이 핵심 맥락입니다.

날짜사건
2026년 7월 8일xAI, Grok 4.5 정식 출시. 「프로그래밍·에이전트 작업 전용」 플래그십으로 Cursor와 공동 훈련, 실제 개발자 세션 데이터 활용. 50만 토큰 컨텍스트, 백만 토큰당 입력 $2 / 출력 $6
2026년 7월 16일경쟁사 Moonshot AI(월지암면) Kimi K3 호스팅 서비스 형태로 출시
2026년 7월 26일Kimi K3, 하루 앞당겨 전체 오픈웨이트 공개. 2.8조 파라미터, 100만 토큰 컨텍스트로 오픈소스 모델 규모·성능 기준을 한 단계 끌어올림
2026년 7월 28일머스크, Rauch 게시물 답글에서 Grok 4.6·4.7 로드맵과 대략적 일정 최초 공개 — 본문 주요 정보 출처
약 2026년 8월 7일(목표)Grok 4.6 출시 예정. 1.5조 파라미터, 단순 스케일업이 아닌 SFT·RL 레벨 업그레이드에 초점
약 2026년 8월 말~9월 초(추정)Grok 4.7 후속 출시 예정. 2.1조 파라미터, 머스크는 「추론 속도는 다소 느리지만 4.6보다 전반적으로 우수하고 토큰 효율은 더 높다」고 언급

머스크가 제시한 일정은 역사적으로 변동성이 큽니다. 업계에서는 이를 「Musk time」이라 부르며, 실제 출시가 예고보다 며칠에서 2주 늦어지는 경우가 흔합니다. 출시 전에는 xAI 공식 계정이나 웹사이트 공지를 기준으로 확인하시기 바랍니다.

Grok 4.6 예고를 둘러싼 다섯 가지 흔한 인식 오류는 다음과 같습니다.

  1. 01

    X 게시물을 공식 발표와 동일시: 현재 유일한 정보원은 머스크의 X 답글 하나뿐이며, xAI 공식 블로그·제품 페이지에는 아직 동기화된 공지가 없습니다. 사양과 날짜 모두 변경될 수 있습니다.

  2. 02

    「Musk time」 변동성 간과: xAI, Tesla, SpaceX 일정은 수일~수주 지연 전례가 있습니다. 「약 8월 7일」은 약속이 아닌 목표로 봐야 합니다.

  3. 03

    파라미터 규모를 곧바로 능력 향상으로 해석: 머스크는 4.6 업그레이드 핵심이 SFT·RL 후훈련에 있다고 강조했습니다. 4.7은 더 크지만 「추론이 다소 느리다」고도 밝혔습니다.

  4. 04

    Kimi K3 경쟁 배경 무시: Grok 4.6 목표일은 K3 전면 오픈소스화 약 10일 후로, xAI가 출시 속도를 압축한 배경과 업계 경쟁 심화가 맞물려 있습니다.

  5. 05

    업계 「감속」 호출과 xAI 가속 혼동: 7월 28일 같은 날 OpenAI·Anthropic 등 1,200명 이상이 「Pacing the Frontier」 연서를 발표했으나, xAI는 서명 목록에 없습니다.

02

핵심 데이터: Grok 시리즈와 동시기 경쟁 모델 비교

Grok 시리즈 로드맵

모델출시/목표 시점파라미터포지셔닝상태
Grok 4.3 Beta2026년 4월 17일미공개이전 세대 기준선출시 완료
Grok 4.52026년 7월 8일미공개(MoE 아닌 단일 SKU)코딩·에이전트, Cursor 공동 훈련출시 완료
Grok 4.6약 2026년 8월 7일1.5조SFT/RL 대폭 업그레이드공식 예고, 미출시
Grok 4.7약 8월 말~9월 초2.1조4.6 전반적 우위, 토큰 효율 향상공식 예고, 미출시

파라미터, 요금, 벤치마크는 제조사·머스크 진술 기준이며, Grok 4.6·4.7은 아직 제3자 독립 평가가 없습니다. 「공식 예고」 정보는 정식 출시 공지를 기준으로 확인하시기 바랍니다.

가로 비교: Grok vs 동시기 경쟁 모델

모델제조사파라미터컨텍스트요금(입력/출력, 백만 토큰)주요 출처
Grok 4.5xAI미공개50만 토큰$2 / $6xAI 공식
Grok 4.6(예고)xAI1.5조미공개미공개머스크 X 게시물(제3자 미검증)
Kimi K3월지암면2.8조(MoE, 활성 약 16/896 전문가)100만 토큰입력 $0.30(캐시 히트)/$3(미스), 출력 $15Moonshot 공식 + Hugging Face
Claude Fable 5.1(루머)Anthropic미공개미공개Fable 5와 동일($10/$50) 루머36kr·WinCentral, Anthropic 미확인
GPT-5.6 SolOpenAI미공개미공개미공개OpenAI 공식

Grok 4.6·Claude Fable 5.1 관련 수치는 예고·루머 수준이며 공식 벤치마크 비교가 아닙니다. 출시 리듬과 대략적 포지셔닝 참고용입니다. 자세한 내용은 Grok 4.5 심층 리뷰Kimi K3 오픈웨이트 완전 해부를 참고하세요.

머스크는 Grok 4.6 업그레이드 핵심이 파라미터 규모가 아닌 「SFT & RL」에 있다고 강조했습니다. Grok 4.5가 Cursor와의 협력으로 실제 개발자 세션 데이터를 확보하고, 상대적으로 적은 출력 토큰으로 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 기록한 전략과 일맥상통합니다.

03

6단계 Runbook: Grok 4.6 출시 전 어떻게 판단·준비할까?

AI 개발자, 기술 의사결정자, Agent 엔지니어 모두 Grok 4.6 정식 출시 전 아래 6단계로 독립적 판단 프레임을 세우면, 헤드라인에 휘둘리지 않을 수 있습니다.

  1. 01

    정보원 등급 구분: 「머스크 X 게시물」과 「xAI 공식 블로그·모델 카드」를 분리합니다. 4.6은 현재 전자만 존재하므로, 공식 공지 전까지 모든 사양은 「예고/미검증」으로 표기해야 합니다.

  2. 02

    Musk time 여유 확보: 「약 8월 7일」을 하드 데드라인이 아닌 목표 구간으로 두고, 벤더 선정·예산 계획에 1~2주 지연 버퍼를 반영합니다.

  3. 03

    Grok 4.5를 능력 기준점으로: 4.5는 완전한 모델 카드, 15개 벤치마크(Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%), $2/$6 요금이 있습니다. 파라미터 숫자가 아닌 이 기준으로 4.6 전환 가치를 판단합니다.

  4. 04

    Kimi K3·Fable 5.1 루머와 가로 비교: K3는 Frontend Code Arena 1679점 1위, Artificial Analysis 지능 지수 글로벌 3위입니다. Fable 5.1은 8월 출시 루머 — 세 모델 포지셔닝이 달라 아직 head-to-head 비교는 불가합니다.

  5. 05

    SFT/RL 업그레이드의 실제 의미: SFT는 고품질 샘플로 출력 습관을 교정하고, RL은 보상 신호로 다단계 Agent 작업에서 올바른 행동을 학습시킵니다. 출시 후 4.5의 토큰 효율(SWE-Bench Pro 출력 약 1.9만 vs Opus 4.8 약 6.7만)이 유지되는지 주목합니다.

  6. 06

    출시 창구 내 하이브리드 라우팅: Grok 4.5 배포 경로를 기준으로 4.6은 Grok Build·xAI API·Cursor에 우선 제공될 가능성이 큽니다. 정식 요금 공개 전까지 「일반 서브태스크는 Grok, 고난도 아키텍처는 Claude」 혼합 전략을 유지하고, 미검증 모델에 조기 All-in하지 않습니다.

04

심층 분석: SFT/RL 업그레이드, 경쟁 압력, 논쟁점

SFT와 RL은 무엇을 해결하나?

지도 미세조정(SFT)은 사람이 라벨링하거나 엄선한 고품질 샘플로 모델 출력 습관을 교정합니다. 강화학습(RL)은 보상 신호로 실제 작업 경로에서 「어떻게 해야 맞는지」를 가르치며, 특히 다단계 Agent 작업에 중요합니다. 머스크가 Grok 4.6 업그레이드 핵심을 「SFT & RL」로 강조한 것은 Grok 4.5 전략의 연장입니다. Grok 4.5는 Cursor 협력으로 확보한 실제 개발자 세션 데이터 덕분에 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 기록했고, 동급 작업 출력 토큰은 Claude Opus 4.8(약 6.7만) 대비 약 1.9만으로 4.2배 효율적이었습니다.

xAI가 「파라미터 확대 + 후훈련 정밀화」 두 축을 택한 이유

Grok 4.6의 1.5조 파라미터는 Grok 4.5 대비 분명한 규모 도약이지만, 머스크는 「파라미터만이 변수가 아니다」는 점을 분명히 했습니다. Grok 4.7은 2.1조로 더 크지만 「추론이 다소 느리다」고 보완했으며, xAI 내부적으로 규모와 추론 속도 간 트레이드오프를 인지하고 「더 강한」 모델과 「더 빠른」 모델을 분리해 제공하려는 의도로 읽힙니다.

Kimi K3와의 동시기 경쟁이 주는 현실적 압력

Grok 4.6 목표일은 Kimi K3 전면 오픈소스화로 업계가 흔들린 약 10일 후입니다. Kimi K3는 Frontend Code Arena 1679점으로 1위, 모든 폐쇄 모델을 넘긴 최초의 오픈웨이트 모델이며, Artificial Analysis 지능 지수 종합 3위입니다. 머스크 본인도 Kimi K3 벤치마크 관련 댓글에서 「인상적」이라고 남겼습니다. 업계는 xAI가 Grok 4.6/4.7 출시 속도를 압축한 배경에 OpenAI·Anthropic·중국 벤더와의 경쟁 심화가 직접 연관되어 있다고 해석합니다.

!

논쟁점 1: 일정은 제3자 검증 없음. 유일한 정보원은 머스크 X 답글 하나이며, xAI 공식 블로그·제품 페이지에는 동기화 공지가 없습니다. 실제 날짜는 앞당겨지거나 지연될 수 있습니다.

!

논쟁점 2: 벤치마크·요금 전면 공백. Grok 4.5 출시 때와 달리 4.6에는 독립 평가나 공식 모델 카드가 없습니다. 「1.5조 파라미터」「SFT/RL 대폭 업그레이드」는 현재 제조사 일방 주장입니다.

배경: xAI 콘텐츠 안전 논란. Grok 4.6 예고 직전 7월, xAI는 Grok 안전 제한을 우회해 아동 성착취물(CSAM)을 생성했다는 혐의로 한 사용자를 기소했습니다. xAI가 AI 생성 딥페이크 콘텐츠와 관련해 사용자를 상대로 소송을 제기한 것은 이번이 처음입니다. 1월 Common Sense Media 보고서는 Grok을 「미성년자 보호 최하위 AI」 중 하나로 평가했습니다. 기술 능력 평가와는 별개이나, 빠른 반복 속도에서 안전·컴플라이언스 투자 여부는 기업 사용자가 주목할 포인트입니다.

배경: 업계 「감속」과 「가속」의 분열. 7월 28일 — 머스크가 Grok 4.6/4.7 로드맵을 공개한 같은 날 — OpenAI·Anthropic 등 1,200명 이상이 「Pacing the Frontier」 연서를 발표해 미국 정부에 프론티어 AI 개발 속도 조절 거버넌스를 촉구했습니다. OpenAI와 Anthropic은 회사 명의로 공식 지지했으나, xAI는 서명 목록에 없습니다.

05

인용 가능한 핵심 수치와 2026년 8월 「집중 출시월」 전망

  • Grok 4.6 파라미터: 머스크, 1.5조 예고. Grok 4.5(미공개) 대비 분명한 규모 상승이나 독립 벤치마크는 없음.
  • Grok 4.7 후속: 2.1조, 4.6 출시 「수주」 내 예상. 머스크는 「4.6보다 전반적으로 우수하나 추론 속도는 다소 느리고 토큰 효율은 더 높다」고 언급.
  • Grok 4.5 토큰 효율 기준: SWE-Bench Pro 평균 출력 약 15,954(Grok 4.5) vs 67,020(Opus 4.8), 4.2배 차 — 4.6이 이 효율을 이어갈지 판단의 핵심 지표.
  • Kimi K3 경쟁 좌표: 2.8T MoE(활성 약 16/896), 100만 토큰, Frontend Code Arena 1679점 1위, Artificial Analysis 지능 지수 글로벌 3위.
  • Claude Fable 5.1 루머 창: 36kr·WinCentral 등 8월 출시 루머, OpenAI GPT-6 선행 목적 — Anthropic 미확인.
  • 3연속 출시 리듬: 일정대로라면 xAI는 약 2개월 내 Grok 4.5·4.6·4.7 세 프론티어 모델을 연속 출시, 이전 플래그십 유효 기간을 압축.

머스크 일정이 성사되면 Grok 4.6·4.7은 루머의 Claude Fable 5.1과 같은 달에 등장하고, 7월 Kimi K3 오픈소스 충격과 맞물려 2026년 8월은 대규모 모델 출시 밀도가 가장 높은 달 중 하나가 될 가능성이 큽니다. 개발자·기업 사용자에게 선형 기간은 극도로 짧아져, 이전 플래그십이 출시 한 달 만에 차세대 경쟁에 직면할 수 있습니다. 파라미터나 단일 리더보드보다 비용 대비 토큰 효율과 실전 작업당 비용이 더 현실적인 의사결정 기준이 됩니다.

로컬에서 다중 모델 API 전환, Agent 오케스트레이션 파이프라인, Grok/Cursor 공동 개발 워크플로를 추적하면 프로세스 불안정, 24×7 상시 가동 불가, 컴파일 부하 병목이 흔합니다. 자체 VPS는 Apple Silicon 생태계·Metal 컴파일 체인 부재 문제도 있습니다. 안정적 격리 환경, iOS CI/CD, AI Agent 자동화가 필요한 프로덕션 시나리오에서는 VpsMesh Mac Mini M4 클라우드 임대가 일반적으로 더 나은 선택입니다. 통합 메모리는 대용량 컨텍스트 Agent 오케스트레이션에 적합하고, 원격 노드가 24×7 다중 모델 라우팅 테스트를 로컬 환경 오염 없이 수행할 수 있습니다. 자세한 요금은 Mac Mini M4 대여 가격을 참고하세요.

FAQ

Grok 4.6 출시 FAQ

머스크는 「약 8월 7일」이라고 밝혔으나, xAI 공식 확정 날짜는 아닙니다. 실제 출시는 앞당겨지거나 지연될 수 있습니다. xAI 공식 X 계정과 x.ai 공지를 확인하시기 바랍니다.

Grok 4.6은 1.5조 파라미터로 SFT·RL 후훈련 업그레이드에 초점을 맞춘 모델입니다. Grok 4.7은 2.1조 파라미터로 4.6 출시 「수주」 내 공개 예정이며, 머스크에 따르면 전반적 성능은 4.6보다 우수하나 추론 속도는 다소 느리고 토큰 효율은 더 높습니다. xAI는 「더 빠른」과 「더 강한」 SKU를 분리하는 전략으로 보입니다.

아직 판단하기 이릅니다. Grok 4.6은 공개 벤치마크가 없고, Kimi K3는 실측 데이터가 있으며 프로그래밍 리더보드에서 두각을 나타냅니다. Claude Fable 5.1은 Anthropic 공식 발표조차 없어 세 모델을 직접 비교할 수 없습니다. Kimi K3 오픈웨이트 완전 해부에서 경쟁 현황을 확인하세요.

공식 발표가 없습니다. Grok 4.5 기준(입력 $2 / 출력 $6, 백만 토큰당)을 대략적 참고로 삼을 수 있으나, 신규 모델은 요금이 조정될 수 있으므로 정식 공지를 확인하시기 바랍니다. Agent 테스트 환경 비용을 검토하려면 고객 센터를 참고하세요.

Grok 4.5 배포 경로를 기준으로 Grok Build, xAI API, 콘솔에 우선 제공될 가능성이 높으며, 이후 Cursor 등 서드파티 플랫폼으로 확대될 것으로 예상됩니다. 다만 4.6에 대한 확정 정보는 아니므로 정식 공지를 기준으로 확인하시기 바랍니다.