Grok 4.6 출시: API 가격, 500K 컨텍스트와 개발자 가이드
공식 자료로 확인한 Grok 4.6의 정확한 모델 ID, 500K 컨텍스트, 토큰 가격, 추론 수준, API 예제, 출시 벤치마크와 운영 마이그레이션 점검표입니다.
xAI는 2026년 8월 12일 Grok 4.6을 출시했습니다. 공식 개발자 가이드에 표시된 API 모델 ID는 grok-4.6이며, 500,000토큰 컨텍스트 창, 텍스트와 이미지 입력, 텍스트 출력, low·medium·high(기본값)·xhigh의 네 가지 추론 수준을 제공합니다.
개발자에게 중요한 내용은 출시 벤치마크뿐이 아닙니다. Grok 4.6은 Responses API와 Chat Completions를 모두 지원하고, 프롬프트가 200,000토큰에 도달하면 긴 컨텍스트 요금이 적용되며, 장기 실행 에이전트에는 의도적인 캐시 선호도와 컨텍스트 관리가 필요합니다.
이 가이드는 xAI의 공식 사양, 공급자가 공개한 벤치마크 주장, 현재 Modelflare 제공 여부를 구분합니다. 가격과 제공 상태는 바뀔 수 있으며 아래의 변동 가능 정보는 2026년 8월 13일 확인했습니다.
Grok 4.6 핵심 정보
| 항목 | 공식 값 |
|---|---|
| 출시일 | 2026년 8월 12일 |
| API 모델 ID | grok-4.6 |
| 컨텍스트 창 | 500,000토큰 |
| 지식 기준일 | 2026년 2월 1일 |
| 모달리티 | 텍스트와 이미지 입력, 텍스트 출력 |
| 텍스트 출력 한도 | xAI는 고정 텍스트 출력 한도가 없다고 표기 |
| 추론 수준 | low, medium, high(기본값), xhigh |
| API 형식 | Responses API와 Chat Completions |
| 문서화된 기능 | 함수 호출, 구조화 출력, 웹 검색, X 검색, 코드 실행 |
“고정 텍스트 출력 한도 없음”은 모델 페이지의 설명일 뿐, 모든 SDK·게이트웨이·계정·요청이 무제한 텍스트를 반환한다는 보장이 아닙니다. 클라이언트 시간 제한, 계정 제한, 경로 정책과 사용 가능한 컨텍스트는 계속 적용됩니다.
Grok 4.5에서 달라진 점
xAI는 Grok 4.6을 장기 실행 에이전트와 더 복잡한 상호작용·시각 작업에 초점을 둔 점진적 frontier 모델 업데이트로 설명합니다. 공식 발표에는 더 긴 추가 학습, 재생성된 지도 미세 조정 궤적, 지식 작업·코딩·웹 개발·커널 최적화·CAD 환경의 에이전트 강화 학습이 소개되었습니다.
실제 전환에서 평가할 변화는 다음과 같습니다.
- low, medium, high에
xhigh추론 수준이 추가되었습니다. - xAI는 다단계 조사, 코드베이스 전반의 작업, 반복적 애플리케이션 구축에서 연속성이 향상됐다고 보고했습니다.
- 모델은 텍스트와 이미지를 입력받아 텍스트를 출력합니다.
- 500K 컨텍스트 등급과 표준 입력 $2 / 출력 $6 시작 가격은 같지만, Grok 4.6의 캐시 입력은 백만 토큰당 $0.50으로 현재 Grok 4.5의 $0.30과 다릅니다.
- xAI는 긴 에이전트 루프에 대화 단위 캐시 선호도와 컨텍스트 압축을 권장합니다.
이러한 변화는 통제된 마이그레이션을 수행할 이유이지 Grok 4.5를 무조건 대체할 이유가 아닙니다. 실제 워크로드에서 성공한 작업, 지연, 전체 토큰, 도구 호출과 비용을 비교하세요.
Grok 4.6 API 가격
xAI 가격 페이지에 게시된 표준 가격은 백만 토큰당 미국 달러 기준으로 다음과 같습니다.
| 프롬프트 크기 | 입력 | 캐시 입력 | 출력 |
|---|---|---|---|
| 프롬프트 200K토큰 미만 | $2.00 | $0.50 | $6.00 |
| 프롬프트 200K토큰 이상 | $4.00 | $1.00 | $12.00 |
프롬프트가 200K토큰에 도달하면 해당 요청의 모든 토큰에 긴 컨텍스트 요금이 적용된다고 xAI는 설명합니다. 세 가지 계산으로 경계를 확인할 수 있습니다.
- 입력 100K와 출력 5K는 표준 짧은 컨텍스트 요금으로 약 $0.23입니다.
- 입력 100K가 모두 캐시에서 제공되면 같은 출력은 약 $0.08입니다.
- 입력 220K와 출력 10K는 경계를 넘어 게시된 긴 컨텍스트 요금으로 약 $1.00입니다.
이 계산에는 서버 측 도구가 포함되지 않습니다. xAI는 현재 웹 검색, X 검색, 코드 실행에 토큰 비용과 별도로 1,000회당 $5를 게시하고 있습니다. 발표문은 표준의 두 배 가격인 빠른 변형도 언급합니다. 예산을 정하기 전에 xAI 콘솔에서 정확한 모델, 서비스 등급, 지역 제공 여부와 현재 가격을 확인하세요.
더 일반적인 비용 계산은 LLM 토큰 비용 계산과 AI API 비용 추적을 참고하세요.
Responses 또는 Chat Completions로 Grok 4.6 호출하기
다음 요청은 xAI 공식 API 엔드포인트를 사용합니다. 이 글은 출시 가이드이며 모든 게이트웨이에 이미 모델이 활성화됐다는 주장이 아니기 때문입니다.
Responses API:
export XAI_API_KEY="<YOUR_XAI_API_KEY>"
curl -sS https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.6",
"input": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps.",
"prompt_cache_key": "grok-46-migration-review"
}'
Chat Completions:
curl -sS https://api.x.ai/v1/chat/completions \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-H "x-grok-conv-id: grok-46-migration-review" \
-d '{
"model": "grok-4.6",
"messages": [
{
"role": "user",
"content": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps."
}
]
}'
Responses에서는 prompt_cache_key를, Chat Completions에서는 x-grok-conv-id 헤더를 사용해 대화의 캐시 선호도를 높이세요. 이 값은 운영 메타데이터로 다루어 한 대화에서 안정적으로 유지하고, 비밀이나 개인정보를 넣지 않으며, 관련 없는 사용자 사이에서 재사용하지 마세요.
두 전송 형식 중 하나를 선택한다면 Responses API와 Chat Completions 비교를 참고하세요.
프롬프트 캐시와 긴 에이전트 루프
500K 컨텍스트 창은 용량이지 목표가 아닙니다. 매 단계 전체 기록을 보내면 지연이 늘고 요청 전체가 긴 컨텍스트 가격 구간으로 들어갈 수 있습니다.
지속 실행 워크플로에서는:
- 안정적인 지시와 재사용 컨텍스트를 프롬프트 앞부분에 배치합니다.
- 대화마다 안정적인 캐시 선호도 키를 사용합니다.
- 캐시 입력과 비캐시 입력을 따로 측정합니다.
- 프롬프트가 200K토큰에 가까워지기 전에 오래된 턴을 압축하거나 요약합니다.
- 여전히 유효한 도구 결과는 보존하고 중복 전송 잡음은 제거합니다.
- 추론 수준을 명시하고 xhigh가 항상 더 좋다고 가정하지 말고 작업 성공률을 비교합니다.
- 성공한 작업마다 상태, 지연, 입력, 캐시 입력, 출력, 도구 호출과 전체 비용을 기록합니다.
컨텍스트 압축은 모델이 보는 정보를 바꿉니다. 요약을 원본 상태와 대조하고 권위 있는 ID, 제약, 결정과 해결되지 않은 오류를 보존하세요.
출시 벤치마크를 올바르게 읽는 방법
xAI는 출시 발표에서 다음 Grok 4.6 High 결과를 공개했습니다.
| 평가 | xAI가 공개한 Grok 4.6 점수 |
|---|---|
| Artificial Analysis Intelligence Index | 61 |
| GDPVal-AA v2 | 1753 |
| CursorBench v3.2 | 69.9% |
| DeepSWE v1.1 | 65.9% |
| FrontierCode v1.1 Extended | 61.3% |
| APEX-Agents | 57.5% |
이는 공급자가 게시한 출시 결과이며 Modelflare의 독립 테스트가 아닙니다. 벤치마크 하네스, 추론 설정, 도구 접근, 시간 제한과 채점 버전은 비교 가능성에 영향을 줍니다. 표를 테스트할 워크로드를 고르는 자료로 사용하되 보편적 품질 순위나 운영 결과 보장으로 해석하지 마세요.
운영 마이그레이션 점검표
운영 트래픽을 Grok 4.6으로 전환하기 전에:
- 정확한
grok-4.6모델 ID를 사용하고 조용한 별칭 대체를 거부합니다. - 대상 계정, 지역, API 형식과 서비스 등급에서 모델이 활성화됐는지 확인합니다.
- 개인정보가 없는 고정 평가 세트를 Grok 4.5와 Grok 4.6에서 재생합니다.
- 애플리케이션 사용 범위에 따라 텍스트, 이미지, 함수 호출, 구조화 출력, 스트리밍, 거부 경로와 취소를 각각 시험합니다.
- low, medium, high, xhigh를 성공 작업당 비용과 지연으로 비교합니다.
- 200K 프롬프트 경계 바로 아래와 위의 요청을 시험합니다.
- 캐시 적중, 컨텍스트 압축, 도구 호출 수, 재시도와 중복 부작용 방지를 확인합니다.
- 롤백 경로를 유지하고 각 요청의 최종 모델, 경로, 사용량, 지연과 비용을 기록합니다.
HTTP 200은 한 요청이 완료됐다는 것만 증명합니다. 기능 동등성, 안정적 지연, 올바른 도구 동작이나 허용 가능한 비용을 증명하지는 않습니다. 경로 단위 검증에는 OpenAI 호환 API 적합성 테스트와 안정적인 AI API 라우팅을 이용하세요.
Modelflare에서 Grok 4.6을 사용할 수 있나요?
사용할 수 있습니다. 2026년 8월 13일 운영 확인에서 Modelflare 공개 모델과 가격 카탈로그에 정확한 grok-4.6 ID가 grok-award와 grok-stable 그룹으로 표시되었습니다. 카탈로그는 OpenAI 호환 Chat Completions와 Responses API 경로를 지원한다고 명시합니다.
확인 당시 표시된 그룹 배율은 grok-award 0.03x, grok-stable 0.06x였습니다. 그룹 권한, 경로, 가격과 제공 상태는 바뀔 수 있습니다. xAI에는 별도의 긴 컨텍스트 가격 구간도 있으므로 하나의 홍보 배율이나 짧은 컨텍스트 예를 모든 요청에 적용하지 마세요. 실시간 가격 페이지와 완료된 요청의 비용 기록을 현재 기준으로 삼으세요.
사용 가능한 그룹으로 API Key를 만들거나 갱신하고 정확한 grok-4.6 ID를 사용해 민감하지 않은 실제 요청을 한 번 완료한 뒤 운영 트래픽을 이동하세요. 카탈로그 표시는 공개 구성을 확인하지만 Modelflare의 독립 품질 벤치마크나 모든 API Key의 접근 보장은 아닙니다.
공식 출처와 업데이트 기록
1차 출처:
업데이트 기록:
- 2026년 8월 13일: 최초 게시. 공식 사양, 가격, API 형식, 출시 벤치마크와 Modelflare 카탈로그 제공 여부를 확인했습니다.