← Back to all pricing

Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding

Comprehensive Grok 4.6 API pricing analysis ($2.00/M input, $6.00/M output), real-time search synthesis, 2M context window scaling, and streaming benchmarks.

Full specs, context window and API limits →

How much does Grok 4.6 cost per million tokens?

Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.

Verified 2026-09-07 — source
Input
$2.00/M
Output
$6.00/M
Blended
$3.00/M
Provider
Verified 2026-08-14 — source

How much does Grok 4.6 cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.5000
Medium1,000500$5.0000
Long4,0002,000$20.0000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Exact-model pricing guide · verified 2026-09-07

Exact model boundary: xAI Grok 4.6 (grok-4.6). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.

1M context scale and token cost envelope

Frozen scenario board. Formula / deterministic rule: request_bill = (tokens_in * 3.00 + tokens_out * 15.00) / 1M; no undocumented tiering assumed Boundary: Owns long-context cost scaling for Grok 4.6.

Frozen scenarioExact identity and evidence fieldsResultState
32K interactive promptmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K interactive prompt; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 32K interactive prompt is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
128K document reviewmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=128K document review; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 128K document review is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
250K multi-file codebasemodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=250K multi-file codebase; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 250K multi-file codebase is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
500K massive document QAmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=500K massive document QA; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 500K massive document QA is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
1M maximum context windowmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=1M maximum context window; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1M maximum context window is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
context limit overflowmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=context limit overflow; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — context limit overflow has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

64K output expansion and truncation risk planner

Frozen scenario board. Formula / deterministic rule: max_output_cost = 64000 * (15.00 / 1M) = $0.96; truncation avoided when request <= 64K Boundary: Owns maximum output generation economics.

Frozen scenarioExact identity and evidence fieldsResultState
standard 2K responsemodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=standard 2K response; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — standard 2K response is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
8K deep code generationmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=8K deep code generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 8K deep code generation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
16K long document draftingmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=16K long document drafting; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 16K long document drafting is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
32K extensive analysismodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K extensive analysis; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 32K extensive analysis is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
64K maximum generationmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=64K maximum generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 64K maximum generation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unsupported output requestmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=unsupported output request; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported output request has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok model specifications; verification date 2026-09-07. Missing or conflicting joins fail closed.

Enterprise coding agent multi-step budget

Frozen scenario board. Formula / deterministic rule: agent_spend = sum(turn_input * 3.00 + turn_output * 15.00) / 1M; retry costs modeled explicitly Boundary: Owns multi-turn agent loops with Grok 4.6.

Frozen scenarioExact identity and evidence fieldsResultState
3-step bug repairmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=3-step bug repair; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 3-step bug repair is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
5-step feature developmentmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=5-step feature development; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 5-step feature development is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
10-step full workflow loopmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=10-step full workflow loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10-step full workflow loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
single tool retry turnmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=single tool retry turn; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — single tool retry turn is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
multiple tool failure loopmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=multiple tool failure loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — multiple tool failure loop has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required
exhausted agent budgetmodel=grok-4.6; provider=xAI; slug=grok-4-6; scenario=exhausted agent budget; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — exhausted agent budget is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run this scenario →

Evidence audit · 2026-09-08

Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding

Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.

Module 1 · Grok 4.6 Frontier Flagship Token Rate Card
Blended Cost = (Input Tokens × $2.00 + Output Tokens × $6.00) / 1,000,000

Grok 4.6 pairs elite frontier intelligence with accessible $3.00/M blended token pricing.

Boundary: Standard pay-as-you-go rate card on xAI platform; live data grounding calls priced per request.
ScenarioRendered Evidence & Bounds
Scenario 1Live financial market sentiment analysis (8K in, 1K out): $0.022000 per search pass
Scenario 2Breaking geopolitical news synthesis (16K in, 2K out): $0.044000 per dossier
Scenario 3Complex software engineering refactor (24K in, 3K out): $0.066000 per code PR
Scenario 4Scientific paper critique and validation (32K in, 4K out): $0.088000 per review pass
Scenario 5Autonomous live research loop (48K in, 5K out): $0.126000 per full cycle
Scenario 6Monthly 50M token frontier research tier: $150.00 infrastructure budget
Module 2 · Grok 4.6 2M Context Scaling & Information Retrieval ROI
Context Spend = (Large Context Input × $2.00 + Output × $6.00) / 1,000,000

A 2M context window at $2.00/M input enables exhaustive document analysis without RAG chunking loss.

Boundary: Evaluates cost scaling across deep repository analysis and massive multi-document search.
ScenarioRendered Evidence & Bounds
Scenario 1250K token corporate compliance corpus audit: $0.50000 input cost per run
Scenario 2500K token multi-year litigation archive scan: $1.00000 input cost per document set
Scenario 31M token full repository context ingestion: $2.00000 input cost per analysis pass
Scenario 42M token maximum context saturation: $4.00000 single-request ingestion price
Scenario 5Near-perfect recall across 2M tokens eliminates need for complex lossy RAG chunking
Scenario 6Massive time and compute savings by directly processing complete document corpora
Module 3 · Grok 4.6 Real-Time Live Grounding Value vs Static Models
Real-Time Intelligence Value = (Eliminated Hallucination Risk + Up-to-the-Minute Data) - API Cost

Native live data grounding eliminates external web scraping pipelines while guaranteeing current facts.

Boundary: Quantifies the business advantage of native real-time knowledge synthesis over static models.
ScenarioRendered Evidence & Bounds
Scenario 1Zero knowledge cutoff limitations on rapidly evolving financial and tech developments
Scenario 2Direct citations to primary sources and public disclosures eliminate verification delays
Scenario 3Real-time social sentiment tracking provides instant consumer perception insights
Scenario 4Eliminates maintenance costs of building and hosting complex external web scraper pipelines
Scenario 5Single API endpoint serves both deep deductive reasoning and live web research
Scenario 6Superior ROI for algorithmic trading, PR crisis response, and dynamic market intelligence
Explore Related Analyses:xAI provider profile →Compare vs Grok 4.5 →Compare vs GPT-5.6 Sol →Fastest AI models comparison →
Exact-Model Pricing Evidence•Verified 2026-08-14; revalidation required before current claims.

Grok 4.6 pricing evidence

Source-backed dated rate shape: input=$2.000000/M; output=$6.000000/M. Grok 4.6 rate and fixed coding-agent workload economics only; xAI policy, live-web guarantees, and broad comparisons retain their owners. Missing evidence, failed revalidation, and unsupported mechanics render Unavailable.

Module 1 of 3: Coding-agent bill ladder

Novel contribution boundary: Owns dated 4.6 arithmetic for fixed repository and tool-loop shapes; coding quality and live grounding are not asserted. Formula / deterministic rule: spend = requests × (inputTokens × inputRate + outputTokens × outputRate) / 1,000

ScenarioExact model, provider, and fixed inputsResultState
10K compact code patchesmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=10,000; inputTokens=2,000; outputTokens=800; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
25K repository tool loopsmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=25,000; inputTokens=6,000; outputTokens=2,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
50K multi-file agent turnsmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=50,000; inputTokens=12,000; outputTokens=5,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party registry provenance: https://docs.x.ai/docs/models; registry provider xai; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 2 of 3: 4.6→4.5 accepted-result cost boundary

Novel contribution boundary: Owns dated version arithmetic with explicit retry input; accepted-result uplift and coding quality are not sourced. Formula / deterministic rule: requiredAcceptedRate = 4.5 attempt-plus-retry cost / 4.6 attempt cost; observed acceptance = Unavailable

ScenarioExact model, provider, and fixed inputsResultState
Short code patch; 10% retry share; 400 retry-input tokensmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=1; inputTokens=2,000; outputTokens=800; retryInputTokens=400; retryShare=10%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Medium repository turn; 20% retry share; 1,000 retry-input tokensmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=1; inputTokens=6,000; outputTokens=2,000; retryInputTokens=1,000; retryShare=20%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Long agent turn; 30% retry share; 2,000 retry-input tokensmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=1; inputTokens=12,000; outputTokens=5,000; retryInputTokens=2,000; retryShare=30%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party registry provenance: https://docs.x.ai/docs/models; registry provider xai; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 3 of 3: Context and live-grounding evidence matrix

Novel contribution boundary: Owns exact-model registry evidence only; context and live-grounding costs are not inferred from xAI-wide material. Formula / deterministic rule: evidence = exact-model registry field when present; undocumented cost = Unavailable

ScenarioExact model, provider, and fixed inputsResultState
Context-window pricing treatmentmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=evidenceField=context; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Live-grounding fee or eligibilitymodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=evidenceField=live-search; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Tool-loop or stream billing fieldmodel=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=evidenceField=stream; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party registry provenance: https://docs.x.ai/docs/models; registry provider xai; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.

Try Grok 4.6 pricing analysis →

How fast is Grok 4.6?

Not yet measured — see the speed benchmark leaderboard for models we do track.

How much does Grok 4.6 cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.30
1,000,000$3.00
10,000,000$30.00
100,000,000$300.00

How does Grok 4.6 compare with other models?

Grok-3 Mini — $0.26/MGrok 4.3 — $1.56/MGrok-3 — $2.50/MGrok-4.20 Reasoning — $3.00/MGrok-4.20 — $3.00/MGrok-4.20 Reasoning — $3.00/MGrok-4.20 — $3.00/MGrok 4.5 — $3.00/M
See all xAI models →

What is Grok 4.6 best for?

#12 for Agents & Tool Use#16 for Math & Reasoning#21 for Chatbots & Support
Looking for a cheaper option?
Gemini 3.5 Flash Lite is 71.7% cheaper — a code-change migration. See all 8 alternatives to Grok 4.6 →

Which Grok 4.6 head-to-head comparisons are available?

Grok 4.6 vs Claude Opus 4.8Grok 4.6 vs DeepSeek V4 ProGrok 4.6 vs Gemini 3.1 Pro

What are common questions about Grok 4.6?

Is Grok 4.6 cheaper than Grok-4.20 Reasoning?

Grok 4.6 costs $3.00/M blended tokens, Grok-4.20 Reasoning costs $3.00/M — Grok-4.20 Reasoning is cheaper.

How much does 1 million tokens cost with Grok 4.6?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $3.00. Pure input costs $2.00/M; pure output costs $6.00/M.

What does Grok 4.6 cost at high volume?

At 100 million blended tokens a month, Grok 4.6 costs approximately $300.00. See the cost-at-scale table below for other volumes.

Try Grok 4.6 for free

Run real prompts against Grok 4.6 and every other model on this page in one workspace.

Try Grok 4.6 Free