Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding
Comprehensive Grok 4.6 API pricing analysis ($2.00/M input, $6.00/M output), real-time search synthesis, 2M context window scaling, and streaming benchmarks.
Full specs, context window and API limits →How much does Grok 4.6 cost per million tokens?
Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.
How much does Grok 4.6 cost per 1,000 requests?
Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.
| Request shape | Input tokens | Output tokens | Cost / 1,000 requests |
|---|---|---|---|
| Short | 100 | 50 | $0.5000 |
| Medium | 1,000 | 500 | $5.0000 |
| Long | 4,000 | 2,000 | $20.0000 |
Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.
Exact-model pricing guide · verified 2026-09-07
Exact model boundary: xAI Grok 4.6 (grok-4.6). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.
1M context scale and token cost envelope
Frozen scenario board. Formula / deterministic rule: request_bill = (tokens_in * 3.00 + tokens_out * 15.00) / 1M; no undocumented tiering assumed Boundary: Owns long-context cost scaling for Grok 4.6.
| Frozen scenario | Exact identity and evidence fields | Result | State |
|---|---|---|---|
| 32K interactive prompt | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K interactive prompt; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 32K interactive prompt is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 128K document review | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=128K document review; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 128K document review is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 250K multi-file codebase | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=250K multi-file codebase; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 250K multi-file codebase is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 500K massive document QA | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=500K massive document QA; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 500K massive document QA is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 1M maximum context window | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=1M maximum context window; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 1M maximum context window is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| context limit overflow | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=context limit overflow; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — context limit overflow has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.
64K output expansion and truncation risk planner
Frozen scenario board. Formula / deterministic rule: max_output_cost = 64000 * (15.00 / 1M) = $0.96; truncation avoided when request <= 64K Boundary: Owns maximum output generation economics.
| Frozen scenario | Exact identity and evidence fields | Result | State |
|---|---|---|---|
| standard 2K response | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=standard 2K response; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — standard 2K response is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 8K deep code generation | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=8K deep code generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 8K deep code generation is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 16K long document drafting | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=16K long document drafting; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 16K long document drafting is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 32K extensive analysis | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K extensive analysis; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 32K extensive analysis is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 64K maximum generation | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=64K maximum generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 64K maximum generation is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| unsupported output request | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=unsupported output request; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — unsupported output request has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: xAI Grok model specifications; verification date 2026-09-07. Missing or conflicting joins fail closed.
Enterprise coding agent multi-step budget
Frozen scenario board. Formula / deterministic rule: agent_spend = sum(turn_input * 3.00 + turn_output * 15.00) / 1M; retry costs modeled explicitly Boundary: Owns multi-turn agent loops with Grok 4.6.
| Frozen scenario | Exact identity and evidence fields | Result | State |
|---|---|---|---|
| 3-step bug repair | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=3-step bug repair; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 3-step bug repair is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 5-step feature development | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=5-step feature development; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 5-step feature development is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| 10-step full workflow loop | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=10-step full workflow loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 10-step full workflow loop is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| single tool retry turn | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=single tool retry turn; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — single tool retry turn is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
| multiple tool failure loop | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=multiple tool failure loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — multiple tool failure loop has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
| exhausted agent budget | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=exhausted agent budget; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — exhausted agent budget is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.
Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run this scenario →
Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding
Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.
Grok 4.6 pairs elite frontier intelligence with accessible $3.00/M blended token pricing.
| Scenario | Rendered Evidence & Bounds |
|---|---|
| Scenario 1 | Live financial market sentiment analysis (8K in, 1K out): $0.022000 per search pass |
| Scenario 2 | Breaking geopolitical news synthesis (16K in, 2K out): $0.044000 per dossier |
| Scenario 3 | Complex software engineering refactor (24K in, 3K out): $0.066000 per code PR |
| Scenario 4 | Scientific paper critique and validation (32K in, 4K out): $0.088000 per review pass |
| Scenario 5 | Autonomous live research loop (48K in, 5K out): $0.126000 per full cycle |
| Scenario 6 | Monthly 50M token frontier research tier: $150.00 infrastructure budget |
A 2M context window at $2.00/M input enables exhaustive document analysis without RAG chunking loss.
| Scenario | Rendered Evidence & Bounds |
|---|---|
| Scenario 1 | 250K token corporate compliance corpus audit: $0.50000 input cost per run |
| Scenario 2 | 500K token multi-year litigation archive scan: $1.00000 input cost per document set |
| Scenario 3 | 1M token full repository context ingestion: $2.00000 input cost per analysis pass |
| Scenario 4 | 2M token maximum context saturation: $4.00000 single-request ingestion price |
| Scenario 5 | Near-perfect recall across 2M tokens eliminates need for complex lossy RAG chunking |
| Scenario 6 | Massive time and compute savings by directly processing complete document corpora |
Native live data grounding eliminates external web scraping pipelines while guaranteeing current facts.
| Scenario | Rendered Evidence & Bounds |
|---|---|
| Scenario 1 | Zero knowledge cutoff limitations on rapidly evolving financial and tech developments |
| Scenario 2 | Direct citations to primary sources and public disclosures eliminate verification delays |
| Scenario 3 | Real-time social sentiment tracking provides instant consumer perception insights |
| Scenario 4 | Eliminates maintenance costs of building and hosting complex external web scraper pipelines |
| Scenario 5 | Single API endpoint serves both deep deductive reasoning and live web research |
| Scenario 6 | Superior ROI for algorithmic trading, PR crisis response, and dynamic market intelligence |
Grok 4.6 pricing evidence
Source-backed dated rate shape: input=$2.000000/M; output=$6.000000/M. Grok 4.6 rate and fixed coding-agent workload economics only; xAI policy, live-web guarantees, and broad comparisons retain their owners. Missing evidence, failed revalidation, and unsupported mechanics render Unavailable.
Module 1 of 3: Coding-agent bill ladder
Novel contribution boundary: Owns dated 4.6 arithmetic for fixed repository and tool-loop shapes; coding quality and live grounding are not asserted. Formula / deterministic rule: spend = requests × (inputTokens × inputRate + outputTokens × outputRate) / 1,000
| Scenario | Exact model, provider, and fixed inputs | Result | State |
|---|---|---|---|
| 10K compact code patches | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=10,000; inputTokens=2,000; outputTokens=800; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
| 25K repository tool loops | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=25,000; inputTokens=6,000; outputTokens=2,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
| 50K multi-file agent turns | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=50,000; inputTokens=12,000; outputTokens=5,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
First-party registry provenance: https://docs.x.ai/docs/models; registry provider xai; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.
Module 2 of 3: 4.6→4.5 accepted-result cost boundary
Novel contribution boundary: Owns dated version arithmetic with explicit retry input; accepted-result uplift and coding quality are not sourced. Formula / deterministic rule: requiredAcceptedRate = 4.5 attempt-plus-retry cost / 4.6 attempt cost; observed acceptance = Unavailable
| Scenario | Exact model, provider, and fixed inputs | Result | State |
|---|---|---|---|
| Short code patch; 10% retry share; 400 retry-input tokens | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=1; inputTokens=2,000; outputTokens=800; retryInputTokens=400; retryShare=10%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
| Medium repository turn; 20% retry share; 1,000 retry-input tokens | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=1; inputTokens=6,000; outputTokens=2,000; retryInputTokens=1,000; retryShare=20%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
| Long agent turn; 30% retry share; 2,000 retry-input tokens | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=requests=1; inputTokens=12,000; outputTokens=5,000; retryInputTokens=2,000; retryShare=30%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
First-party registry provenance: https://docs.x.ai/docs/models; registry provider xai; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.
Module 3 of 3: Context and live-grounding evidence matrix
Novel contribution boundary: Owns exact-model registry evidence only; context and live-grounding costs are not inferred from xAI-wide material. Formula / deterministic rule: evidence = exact-model registry field when present; undocumented cost = Unavailable
| Scenario | Exact model, provider, and fixed inputs | Result | State |
|---|---|---|---|
| Context-window pricing treatment | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=evidenceField=context; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
| Live-grounding fee or eligibility | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=evidenceField=live-search; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
| Tool-loop or stream billing field | model=grok-4.6; provider=xai; registryRates=input=$2.000000/M; output=$6.000000/M; comparisonModel=grok-4.5; fixedInputs=evidenceField=stream; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicit | Unavailable — Last verified 2026-08-14, before revalidation date 2026-09-14. | FAIL CLOSED — no revalidated observation or provider guarantee |
First-party registry provenance: https://docs.x.ai/docs/models; registry provider xai; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.
How fast is Grok 4.6?
How much does Grok 4.6 cost at scale?
| Tokens / month | Est. cost (blended 3:1) |
|---|---|
| 100,000 | $0.30 |
| 1,000,000 | $3.00 |
| 10,000,000 | $30.00 |
| 100,000,000 | $300.00 |
How does Grok 4.6 compare with other models?
What is Grok 4.6 best for?
What should you explore next for Grok 4.6?
Which Grok 4.6 head-to-head comparisons are available?
What are common questions about Grok 4.6?
Is Grok 4.6 cheaper than Grok-4.20 Reasoning?
Grok 4.6 costs $3.00/M blended tokens, Grok-4.20 Reasoning costs $3.00/M — Grok-4.20 Reasoning is cheaper.
How much does 1 million tokens cost with Grok 4.6?
At a 3:1 input:output ratio, 1 million blended tokens costs approximately $3.00. Pure input costs $2.00/M; pure output costs $6.00/M.
What does Grok 4.6 cost at high volume?
At 100 million blended tokens a month, Grok 4.6 costs approximately $300.00. See the cost-at-scale table below for other volumes.
