8월 7일 목표 전에 짚어야 할 다섯 가지 마찰

Musk의 답글은 로드맵 힌트이지 프로덕션 커밋이 아닙니다. 실무에서는 다음 층위가 겹칩니다.

  • 미검증 일정: Musk는 미검증 벤더 릴리스 주장에 대해 시간축에 신중하다고 밝힌 바 있습니다. 8월 7일은 목표일이지 확약이 아닙니다.
  • 4.5 대비 변화 폭: Grok 4.6의 핵심은 SFT/RL 업그레이드와 1.5T 규모입니다. coding 파이프라인은 7월 8일 4.5에서 이미 강화되었으므로 4.6은 미세 조정이나 serving 비용 재배분일 수 있습니다.
  • 4.7 serving 트레이드오프: 2.1T Grok 4.7은 성능은 올라가지만 serving이 느리다고 했습니다. latency에 민감한 에이전트는 4.6을 더 오래 쓸 수 있습니다.
  • 동시 진행 경쟁:Kimi K3의 1M open weight와 8월 루머 Claude Fable 5.1(미확인)이 같은 창에 겹쳐 단일 벤더 고정은 리스크입니다.
  • 규제·소송 노이즈: 7월 xAI CSAM 관련 소송과 7월 28일 Pacing the Frontier 서한(1100명 이상 서명)이 프론티어 모델 채택 심사를 복잡하게 합니다.

Grok 4.5·4.6·Kimi K3 — 스펙과 가격 비교

7월 8일 Grok 4.5가 실운영 기준점입니다. 4.6은 그 위에 쌓이는 층으로 읽으면 평가 계획이 명확해집니다.

항목 Grok 4.5 (7월 8일) Grok 4.6 (Musk 7월 28일) Kimi K3 (7월 16~26일)
파라미터 규모공개 제한적약 1.5T2.8T MoE open weight
핵심 강화coding/agentic, Cursor 공동학습SFT/RL 업그레이드1M 컨텍스트, MoonEP 등 Infra
컨텍스트500,000 tokens미공개1,000,000 tokens
API 가격 (per M tokens)$2 입력 / $6 출력미공개API 티어별
Frontend Code Arena1679
가중치 다운로드불가불가 (예상)가능 (7월 27일)
출시2026년 7월 8일 (완료)약 2026년 8월 7일API 7월 16일, 가중치 7월 27일

Grok 4.6과 4.7 — 로드맵 위치

버전 시기 (Musk 발언) 규모 트레이드오프
Grok 4.6약 8월 7일약 1.5TSFT/RL 강화, serving 비교적 현실적
Grok 4.74.6 수주 후약 2.1T성능 상승, serving 지연
Claude Fable 5.18월 루머 (미확인)비공개Anthropic 미발표

latency와 품질 축으로 모델 ID를 나누고 OpenRouter 폴백 체인에 등록하는 설계가 현실적입니다.

Grok 4.6 도입 전 개발자 6단계

일정 포스트는 배포 계획이 아닙니다. 격리 환경에서 같은 체크리스트를 돌리십시오.

  1. 4.5 베이스라인 고정: 프로덕션급 coding/agentic 태스크를 Grok 4.5로 실행하고 토큰·latency·통과율을 로그에 남깁니다. 4.6 비교 기준이 없으면 차이를 측정할 수 없습니다.
  2. 모델 ID·가격 티어 모니터링: xAI 콘솔과 docs.x.ai changelog를 구독하고 4.6 전환 시 $2/$6 per M tokens가 바뀌는지 확인합니다.
grok_smoke.py
from openai import OpenAI
client = OpenAI(
    api_key="...",
    base_url="https://api.x.ai/v1",
)
resp = client.chat.completions.create(
    model="grok-4-5",
    messages=[{"role": "user", "content": "Refactor this handler for testability."}],
)
print(resp.usage)
  1. 컨텍스트 한도 재검증: 4.5의 500K로 장문 리포를 통과한 뒤 4.6에서 동일 프롬프트를 재실행하여 truncation·비용 급등을 비교합니다.
  2. Kimi K3 side-by-side: 동일 태스크를 Kimi K3(Frontend Code Arena 1679 맥락)로 실행하여 open weight 폴백 가치를 수치화합니다.
  3. 규제·소송 리스크 법무 동기화: xAI CSAM 소송과 Pacing the Frontier 서한을 반영해 xAI 경유 데이터 워크플로에 추가 심사가 필요한지 판단합니다.
  4. 4.7 latency 예산 선결정: 2.1T·serving 지연이 허용되지 않는 경로는 4.6에 고정하고 배치 평가만 4.7로 돌리는 이중 구조를 설계합니다.

Musk의 시간축은 과거에도 전후로 움직였고 미검증 주장에는 신중합니다. 8월 7일을 하드 데드라인으로 두지 말고 API에서 모델이 실제 전환된 시점에 프로덕션을 업데이트하십시오.

인용할 수 있는 수치와 사건

  • Grok 4.6: 약 8월 7일, 약 1.5T, SFT/RL 업그레이드 (Musk, 2026년 7월 28일, @rauchg 답글).
  • Grok 4.7: 4.6 수주 후, 약 2.1T, 성능 상승·serving 지연 (동일).
  • Grok 4.5: 2026년 7월 8일, coding/agentic, Cursor 공동학습, 500K, $2/$6 per M tokens.
  • Kimi K3: 7월 16~26일, 2.8T MoE open weight, 1M, Frontend Code Arena 1679.
  • 규제: 7월 28일 Pacing the Frontier (1100명 이상); 2026년 7월 xAI CSAM 소송.
  • 경쟁 루머: Claude Fable 5.1 8월 루머, 미확인.

출시일·가격·소송 상황은 변경될 수 있습니다. 아래 1차 출처를 우선하십시오.

xAI 공식 API 문서:

xAI — Models and API reference

Elon Musk @rauchg 답글 관련 제3자 보도:

Tron Weekly — Elon Musk Targets August 7 For Grok 4.6

Guillermo Rauch (@rauchg) 스레드:

X — Guillermo Rauch profile

FAQ

Grok 4.6은 언제 출시됩니까?

2026년 7월 28일 Musk는 @rauchg에게 약 8월 7일이라고 답했습니다. 미검증 벤더 주장에 대한 신중한 입장도 있었으므로 공식 롤아웃 확인 후 전환하십시오.

4.6과 4.5의 차이는?

4.5는 7월 8일 coding/agentic·Cursor 공동학습·500K·$2/$6로 출시했습니다. 4.6은 약 1.5T와 SFT/RL 강화가 핵심입니다.

4.7을 기다려야 합니까?

4.7은 약 2.1T로 성능은 높지만 serving이 느립니다. 실시간 에이전트는 4.6, 배치 평가는 4.7로 역할 분담이 현실적입니다.

Kimi K3와 어떤 것을 선택해야 합니까?

K3는 2.8T open weight·1M·Frontend Code Arena 1679입니다. Grok은 폐쇄 API에 Cursor 공동학습 실적이 있습니다. 동일 태스크 side-by-side가 필요합니다.

규제 뉴스가 도입에 영향을 줍니까?

CSAM 소송과 Pacing the Frontier 서한은 컴플라이언스 심사를 강화합니다. 데이터 경로와 폴백을 문서화하십시오.

실무 한계는 Grok에서도 같습니다. 8월 7일을 믿고 먼저 프로덕션을 바꾸기보다 4.5 베이스라인·K3 비교 로그·OpenRouter 폴백을 맞춘 뒤 4.6을 시험하는 편이 안전합니다. 그 평가는 공유 샌드박스보다 root 있는 전용 머신에 적합합니다. KVMFLUX Mac mini M4는 SSH 수 분 내 구동되고 API 키·모델 ID가 밤에 바뀌어도 wipe 후 재시도할 수 있습니다.

깨끗한 Mac에서 Grok 4.6 시험

xAI API와 Cursor 연동을 Apple Silicon 한 대에서 — VM 오버헤드 없음.

Mac Mini M4 · 16GB / 256GB
일간$19.3 /일
주간$52.2 /주
월간$96.7 /월
분기$263 /분기