All LLM Models Compared

Raw dataset: data.json. Cite this: All AI Ask LLM Model Roster Dataset, retrieved 2026-08-08.

63 models across every provider we route to, one row each. 32 current models have a full spec sheet and link to a canonical model page; the rest are legacy catalog entries and link to their pricing or deprecation page.

Largest context
Gemini 3.1 Pro
2M tokens
Cheapest current model
Amazon Nova Micro
$0.06/M blended
Fastest measured
GPT-OSS 120B (Cerebras)
2450 tok/s
Sort by:ContextPriceSpeedName
ModelProviderContextMax outputModalitiesReasoning$/M blendedtok/sStatus
Gemini 3.1 ProGoogle2M64Ktext, vision, audioYes$4.5055current
Gemini 3.5 Flash LiteGoogle1M32Ktext, visionNo$0.56162current
Grok 4.3xAI1M64Ktext, visionYes$1.5698current
GLM-5.2Z.ai1M64KtextYes$2.15current
Grok-4.20 ReasoningxAI1M64Ktext, visionYes$3.0052current
Grok-4.20xAI1M32Ktext, visionNo$3.00104current
Gemini 3.6 FlashGoogle1M64Ktext, vision, audioYes$3.38114current
Claude Fable 5Anthropic1M128Ktext, visionYes$20.0041current
Claude Opus 4.8Anthropic500K64Ktext, visionYes$10.0058current
GPT-5.6 LunaOpenAI400K64Ktext, visionNo$0.45126current
GPT-5.6 TerraOpenAI400K128Ktext, visionYes$4.5078current
GPT-5.6 SolOpenAI400K128Ktext, visionYes$11.2544current
Amazon Nova LiteAmazon300K16Ktext, vision, audioNo$0.11108current
Amazon Nova ProAmazon300K33Ktext, vision, audioNo$1.4064current
Claude Sonnet 4.6Anthropic300K64Ktext, visionYes$6.0076current
CodestralMistral256K33KtextNo$0.45118current
Qwen 3.7 PlusQwen256K33Ktext, visionNo$1.1084current
Qwen 3.8 MaxQwen256K33Ktext, visionYes$2.8047current
Qwen 3.7 MaxQwen256K33Ktext, visionYes$2.8049current
Claude Haiku 4.5Anthropic200K32Ktext, visionNo$2.00148current
GLM 4.7 (Cerebras)Cerebras200K33KtextYes$2.381980current
GPT-OSS 20BGroq131K33KtextYes$0.131120current
Ministral 8BMistral131K16KtextNo$0.15158current
GPT-OSS 120BGroq131K33KtextYes$0.26780current
Mistral Small 3.1Mistral131K33Ktext, visionNo$0.26121current
GPT-OSS 120B (Cerebras)Cerebras131K33KtextYes$0.452450current
Mistral Medium 3Mistral131K33Ktext, visionNo$0.8092current
Qwen 3.8 30BGroq131K33Ktext, visionYes$1.20690current
Mistral Large 3Mistral131K33Ktext, visionNo$3.0061current
Amazon Nova MicroAmazon128K8KtextNo$0.06168current
DeepSeek V4 FlashDeepSeek128K32KtextNo$0.17132current
DeepSeek V4 ProDeepSeek128K64KtextYes$0.5468current
Llama 3.1 8BGroq$0.06deprecated
GPT-5 NanoOpenAI$0.14legacy
Gemini 2.5 Flash LiteGoogle$0.18legacy
GPT-4o MiniOpenAI$0.26legacy
Grok-3 MinixAI$0.26legacy
Llama 4 MaverickGroq$0.30legacy
GPT-5.4 NanoOpenAI$0.46legacy
Gemini 3.1 Flash LiteGoogle$0.56legacy
Llama 3.3 70BGroq$0.64deprecated
GPT-5 MiniOpenAI$0.69legacy
Gemini 2.5 FlashGoogle$0.85legacy
GLM-5.1Z.ai$1.00legacy
Qwen 3.6 27BGroq$1.20legacy
GPT-5.4 MiniOpenAI$1.69legacy
Gemini 3.1 FlashGoogle$1.69legacy
o3-MiniOpenAI$1.93legacy
Grok-3xAI$2.50legacy
Gemini 3.5 FlashGoogle$3.38legacy
GPT-5OpenAI$3.44legacy
GPT-4.1OpenAI$3.50legacy
GPT-4oOpenAI$4.38legacy
GPT-5.4OpenAI$5.63legacy
Claude Sonnet 4.5Anthropic$6.00legacy
Claude Sonnet 4Anthropic$6.00legacy
Claude Opus 4.7Anthropic$10.00legacy
Claude Opus 4.6Anthropic$10.00legacy
Claude Opus 4.5Anthropic$10.00legacy
GPT-4 TurboOpenAI$15.00legacy
Claude Opus 4.1Anthropic$30.00legacy
Claude Opus 4Anthropic$30.00legacy
GPT-5.4 ProOpenAI$67.50legacy

32 of 63 models have full specs (legacy catalog entries deliberately have none); 31 have measured speed. Data verified 2026-08-08.

Try any model for free

Every model in this table, one workspace, one API key.

Try It Free