AI Agent xAI 2026.07.30

Grok 4.6 출시일: 머스크 8월 7일 예고, 1.5T 파라미터로 확대

7월 28일, 머스크는 X에서 Vercel CEO Guillermo Rauch에게 답글로 xAI가 8월 7일 전후1.5조(1.5T) 파라미터의 Grok 4.6을 출시하고, 수주 내 2.1T 파라미터의 Grok 4.7도 공개할 계획이라고 밝혔습니다. 이는 Grok 4.5 출시 후 불과 한 달 만의 일로, xAI가 올여름 세 개의 프론티어 모델을 연속 투입하는 계획을 시사합니다. 공식 벤치마크와 가격은 아직 없으며, 아래 내용은 머스크의 공개 발언과 업계 보도를 바탕으로 정리했습니다.

모델 선정 담당자와 AI 개발자를 위해 본문은 다음 세 가지를 다룹니다: ① Grok 4.5에서 4.6/4.7로의 일정과 「Musk time」 리스크; ② SFT/RL 후학습 강화와 Kimi K3와의 동시 경쟁 압력; ③ 가로 스펙 비교, 논점 배경, 6단계 출시 전 준비와 FAQ. 데이터는 2026-07-30 기준, 미확인 정보는 명시했습니다.

01 Grok 4.5에서 4.6·4.7: 출시 속도와 핵심 과제

머스크의 일정이 맞다면 xAI는 약 2개월 안에 세 개의 프론티어 모델을 출시합니다. 주요 타임라인은 다음과 같습니다.

  • 2026년 7월 8일: xAI가 Grok 4.5를 정식 출시. Cursor 공동 훈련, 실제 개발자 세션 데이터 사용, 50만 토큰 컨텍스트, 입력 $2/출력 $6(100만 토큰).
  • 2026년 7월 16–26일: 경쟁사 Moonshot AI의 Kimi K3가 호스팅에서 전면 오픈웨이트(2.8T, 100만 토큰)로 전환.
  • 2026년 7월 28일: 머스크가 Rauch 답글에서 Grok 4.6/4.7 로드맵을 최초 공개——본문의 주요 정보원.
  • 약 2026년 8월 7일(목표): Grok 4.6, 1.5T, SFT/RL 강화가 핵심.
  • 2026년 8월 말–9월 초(추정): Grok 4.7, 2.1T, 4.6보다 전반적으로 우수하지만 추론 속도는 약간 느림.

개발자와 기업 사용자가 직면한 핵심 과제:

  • 정보원 단일성: 현재 확인된 유일한 1차 정보는 머스크의 X 게시물입니다. xAI 공식 블로그와 제품 페이지는 아직 동기화되지 않았습니다.
  • 벤치마크·가격 공백: Grok 4.5 출시 시의 상세 모델 카드와 달리 4.6에는 독립 평가가 없습니다.
  • 선정 윈도우 극소화: flagship 모델의 유효 기간이 수주로 줄어, 리더보드보다 토큰 효율이 실무에서 더 중요해집니다.
  • 안전·컴플라이언스 리스크: xAI는 7월 CSAM 관련으로 사용자를 고소했습니다. 기업 법무는 벤더 리스크 평가에 포함해야 합니다.

머스크의 일정은 역사적으로 유연합니다——업계에서는 「Musk time」이라 부르며, 며칠에서 2주 지연은 흔합니다. 정식 발표 전에는 xAI 공식 계정과 웹사이트를 기준으로 하세요.

02 Grok 시리즈 핵심 파라미터 일람

Grok 시리즈 모델 파라미터 대조(2026-07-30 기준)
모델 출시/목표일 파라미터 규모 定位 상태
Grok 4.3 Beta2026년 4월 17일비공개이전 세대 기준출시 완료
Grok 4.52026년 7월 8일비공개(단일 SKU, 비 MoE)코딩/Agent, Cursor 공동출시 완료
Grok 4.6약 2026년 8월 7일1.5TSFT/RL 대폭 강화공식 예고, 미출시
Grok 4.7약 8월 말–9월 초2.1T4.6 전반 우위, 토큰 효율 향상공식 예고, 미출시

파라미터 규모, 가격, 벤치마크는 벤더/머스크 발언에 기반합니다. Grok 4.6/4.7은 제3자 독립 평가가 없으며, 표의 「공식 예고」는 정식 발표에서 반드시 재확인하세요.

03 심층 분석: 업그레이드의 핵심은 「더 크게」가 아니라 「더 잘 학습」

SFT와 RL이 해결하는 문제

지도 미세조정(SFT)은 고품질 샘플로 출력 습관을 교정합니다. 강화학습(RL)은 보상 신호로 다단계 Agent 작업의 올바른 행동 시퀀스를 학습합니다. 머스크는 Grok 4.6의 강화점을 파라미터 규모가 아닌 「SFT & RL」로 강조하여 Grok 4.5 노선을 계승합니다. 4.5는 Cursor 공동 훈련으로 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 달성하고, 동종 작업 출력 토큰은 Claude Opus 4.8의 약 6.7만 대비 약 1.9만이었습니다.

파라미터 확대와 후학습 정밀화의 이중 전략

Grok 4.6의 1.5T는 4.5 대비 명확한 규모 점프이지만, 머스크는 Grok 4.7(2.1T)이 「추론이 약간 느리다」고 보완하여 xAI가 규모와 속도의 트레이드오프를 인식하고, 서로 다른定位의 2개 SKU로 「더 강함」과 「더 빠름」을 분리하는 방침을 보여줍니다.

Kimi K3와의 동시 경쟁 압력

Grok 4.6 목표일은 Kimi K3 전면 오픈웨이트 약 10일 후입니다. Kimi K3는 Frontend Code Arena에서 1679점으로 모든 클로즈드 모델을 넘은 최초의 오픈웨이트 모델이 되었고, Artificial Analysis 지능 지수에서 세계 3위입니다. 머스크도 Kimi K3 벤치마크 게시물에 「인상적」이라고 댓글을 달았습니다. xAI가 4.6/4.7을 가속하는 배경으로 OpenAI, Anthropic, 중국 벤더와의 경쟁 격화가 가장 설득력 있는 설명입니다.

04 가로 비교: Grok 시리즈 vs 동기 경쟁 모델

Grok과 동기 flagship 모델 스펙 비교
모델 벤더 파라미터 컨텍스트 가격(입력/출력, 100만 토큰) 출처
Grok 4.5xAI비공개50만 토큰$2 / $6xAI 공식
Grok 4.6(예고)xAI1.5T비공개비공개머스크 X 게시(미검증)
Kimi K3Moonshot AI2.8T(MoE, 16/896 전문가 활성)100만 토큰$0.30(캐시 히트)/$3 입력, $15 출력Moonshot 공식
Claude Fable 5.1(루머)Anthropic비공개비공개루머: Fable 5 유지($10/$50)36kr, WinCentral, Anthropic 미확인
GPT-5.6 SolOpenAI비공개비공개비공개OpenAI 공식

Grok 4.6과 Claude Fable 5.1 행은 예고·루머 정보이며, 정식 벤치마크 비교에 사용할 수 없습니다. 출시 타이밍과 대략적定位 참고용입니다.

05 논점, 6단계 출시 전 준비와 인용 가능 데이터

출시 전 유의할 논점:

  • 일정 미검증: 유일한 정보원은 머스크의 X 게시물입니다.
  • 벤치마크·가격 전면 공백: 「1.5T」와 「SFT/RL 대폭 강화」는 현재 벤더 일방 주장입니다.
  • xAI 콘텐츠 안전 논란: 7월 CSAM 생성 관련 사용자 고소. Common Sense Media는 1월 Grok을 아동 보호 최악급 AI로 평가했습니다.
  • 업계 「감속」 호소와의 괴리: 7월 28일 OpenAI, Anthropic 등 1200명 이상이 「Pacing the Frontier」 공개서에 서명. xAI는 서명자에 없습니다.

Grok 4.6 출시 전 6단계 준비:

  1. xAI 공식 채널 구독: xAI 공식 X와 x.ai를 팔로우하여 2차 정보만 의존하지 않습니다.
  2. Grok 4.5 벤치마크 복습: 본사 Grok 4.5 심층 리뷰로 4.6 대표 기준선을 확립합니다.
  3. xAI API 계정 개설: 콘솔에서 API Key를 생성하고 Grok 4.5로 연결성과 지연을 검증합니다.
  4. OpenAI 호환 클라이언트 설정: Cursor 또는 자체 Agent에서 Grok 4.5 엔드포인트를 연결하고 토큰 소비 기준선을 기록합니다.
  5. Kimi K3 대조 벤치마크 구축: Kimi K3 오픈웨이트 해설을 참고하여 동일 Agent 워크플로로 비교 테스트합니다.
  6. 듀얼 SKU 라우팅 계획: Grok 4.6(고속)과 4.7(고품질)의 계층 라우팅을 사전 설계합니다.
grok_api_baseline.py
from openai import OpenAI

client = OpenAI(
    api_key="your_xai_api_key",
    base_url="https://api.x.ai/v1"
)

response = client.chat.completions.create(
    model="grok-4.5",
    messages=[{"role": "user", "content": "Analyze this agent workflow..."}]
)

인용 가능한 하드 데이터(xAI 공식, 머스크 X, Moonshot 공식, 2026-07-30):

  • Grok 4.6 파라미터: 1.5T(공식 예고, 제3자 미검증)
  • Grok 4.7 파라미터: 2.1T, 8월 말–9월 초 예상(공식 예고)
  • Grok 4.5 가격: 입력 $2/M token, 출력 $6/M token, 50만 토큰 컨텍스트
  • Grok 4.5 SWE-Bench Pro: 64.7%; Terminal-Bench 2.1: 83.3%
  • 토큰 효율: Grok 4.5 약 1.9만 출력 token/작업 vs Opus 4.8 약 6.7만
  • Kimi K3 규모: 2.8T 파라미터, 100만 토큰 컨텍스트, Frontend Code Arena 1679점
  • 출시 속도: 4.5에서 4.6까지 약 1개월, 3개 프론티어 모델이 약 2개월 내 연속 출시

06 FAQ, 8월 출시 러시와 프로덕션 마무리

Q: Grok 4.6은 구체적으로 언제 출시됩니까?
A: 머스크는 「8월 7일 전후」라고 했지만 xAI 공식 확인은 아닙니다. 전후 조정 가능합니다.

Q: Grok 4.6과 Grok 4.7의 차이는?
A: Grok 4.6은 1.5T, SFT/RL 후학습 강화가 핵심입니다. Grok 4.7은 2.1T, 4.6 수주 후 예상이며 머스크는 전반적으로 우수하지만 추론이 약간 느리고 토큰 효율이 더 높다고 했습니다.

Q: Grok 4.6이 Kimi K3나 Claude Fable 5.1보다 강할까요?
A: 현재 판단 불가합니다. Grok 4.6에 공개 벤치마크가 없고, Kimi K3는 실측 데이터가 있으며 Fable 5.1은 Anthropic 미확인입니다.

Q: Grok 4.6 가격은?
A: 미발표. Grok 4.5의 $2/$6을 참고할 수 있지만 정식 정보로 반드시 확인하세요.

Q: 일반 사용자는 어디서 Grok 4.6을 쓸 수 있을까요?
A: Grok 4.5 배포 경로로 Grok Build, xAI API, 콘솔이 선행하고 제3자 플랫폼이 뒤따를 것으로 예상되지만 4.6은 미확인입니다.

머스크의 일정이 맞다면 Grok 4.6/4.7은 루머의 Claude Fable 5.1과 같은 달에 등장하고, 7월 오픈웨이트화된 Kimi K3 충격과 겹쳐 2026년 8월은 LLM 출시 밀도가 가장 높은 달 중 하나가 될 수 있습니다.

API로 Grok을 쓰는 것은 빠르지만, 프로덕션 팀은 여전히 공유 VPS에서 멀티모델 라우팅 시 메모리 부족, Agent 파이프라인의 7×24 안정 호스트 부족, flagship 모델 잦은 교체로 인한 통합 반복 재구축의 세 가지 숨은 비용에 직면합니다. Grok Agent, 전체 리포 분석, MCP Server를 프로덕션에서 지속 운영하려면 JEXCLOUD 멀티리전 베어메탈 Mac 노드가 더 안정적인 선택입니다: 전용 Apple Silicon 통합 메모리, 오버서브스크립션 없음, launchd 상주 Agent 게이트웨이, 120초 프로비저닝. 노드와 요금은 JEXCLOUD 요금 페이지를 참고하세요.