Skip to main content
TokenCost logoTokenCost

Cheapest LLM Models in 2026

All 142+ LLM API models ranked from cheapest to most expensive by average token price. Find the most budget-friendly AI model for your project.

RankModelProviderInput/1MOutput/1MAvg/1MContext
#1Gemma 4 12BGoogle$0$0$0.00262K
#2DiffusionGemma 26BGoogle$0$0$0.00262K
#3Ling-3.0-tinyAnt Group$0$0$0.00262K
#4Qwen3.7 FlashAlibaba$0.03$0.13$0.081.0M
#5GPT-OSS 120BOpenAI$0.039$0.19$0.11131K
#6Ling-3.0-flashAnt Group$0.06$0.18$0.12262K
#7Qwen3.5-9BAlibaba$0.1$0.15$0.13262K
#8Ministral 3 8BMistral$0.15$0.15$0.15262K
#9Muse Spark 1.2 ContributorMeta$0.1$0.2$0.151.0M
#10Laguna S 2.1Poolside$0.1$0.2$0.151.0M
#11Gemma 4 26B A4BGoogle$0.06$0.3$0.18262K
#12Llama 3.3 70BMeta$0.18$0.18$0.18131K
#13GPT-OSS 20B (Bedrock)OpenAI$0.07$0.3$0.1816K
#14GPT-OSS 20BOpenAI$0.075$0.3$0.19131K
#15Llama 4 ScoutMeta$0.08$0.3$0.191.0M
#16Ministral 3 14BMistral$0.2$0.2$0.20262K
#17GPT-5 NanoOpenAI$0.05$0.4$0.23400K
#18GLM-4.7-FlashXZhipu$0.07$0.4$0.24200K
#19Gemma 4 31BGoogle$0.12$0.36$0.24262K
#20GPT-4.1 NanoOpenAI$0.1$0.4$0.251.0M
#21Gemini 2.5 Flash-LiteGoogle$0.1$0.4$0.251.0M
#22Qwen3.8 FlashAlibaba$0.15$0.47$0.311.0M
#23GLM-5.3-FlashZhipu$0.15$0.5$0.331.0M
#24Hy3Tencent$0.132$0.528$0.33262K
#25GPT-OSS 120B (Bedrock)OpenAI$0.15$0.6$0.3816K
#26GPT-4o MiniOpenAI$0.15$0.6$0.38128K
#27Mistral Small 4Mistral$0.15$0.6$0.38256K
#28DeepSeek V4.1 FlashDeepSeek$0.15$0.6$0.381.0M
#29KAT-Coder-Air v2.5Kwaipilot$0.15$0.6$0.38262K
#30Hunyuan HY3 PreviewTencent$0.178$0.595$0.39262K
#31Qwen3 Coder NextAlibaba$0.12$0.8$0.46262K
#32Mercury 2.5 (Preview)Inception Labs$0.2$0.75$0.47260K
#33Mercury 2Inception Labs$0.25$0.75$0.50128K
#34Nemotron 3 Super 120BNVIDIA$0.3$0.8$0.551.0M
#35Llama 4 MaverickMeta$0.27$0.85$0.561.0M
#36CodestralMistral$0.3$0.9$0.60256K
#37MiMo-V2.5-ProXiaomi$0.435$0.87$0.651.0M
#38Qwen3-Next-80B-A3B-ThinkingAlibaba$0.15$1.2$0.67262K
#39Step 3.7 FlashStepFun$0.2$1.15$0.67262K
#40GPT-5.6 LunaOpenAI$0.2$1.2$0.701.1M
#41GPT-5.4 NanoOpenAI$0.2$1.25$0.72400K
#42MiniMax M2.7MiniMax$0.3$1.2$0.75205K
#43MiniMax M2.5MiniMax$0.3$1.2$0.75128K
#44Gemini 3.1 Flash-LiteGoogle$0.25$1.5$0.881.0M
#45Muse Glimmer 30BMeta$0.35$1.5$0.93131K
#46GPT-4.1 MiniOpenAI$0.4$1.6$1.001.0M
#47Mistral Large 3Mistral$0.5$1.5$1.00262K
#48Qwen3.7 PlusAlibaba$0.4$1.6$1.001.0M
#49GPT-5 MiniOpenAI$0.25$2$1.13400K
#50Qwen3.5-Omni FlashAlibaba$0.4$2.2$1.30262K
#51DeepSeek V4-ProDeepSeek$0.66$1.98$1.321.0M
#52Doubao Seed 2.1 TurboByteDance$0.44$2.21$1.32262K
#53Qwen3.5-27BAlibaba$0.3$2.4$1.35262K
#54Gemini 3.5 Flash-LiteGoogle$0.3$2.5$1.401.0M
#55Gemini 2.5 FlashGoogle$0.3$2.5$1.401.0M
#56Nova 2.0 LiteAmazon$0.3$2.5$1.401.0M
#57GLM-4.7Zhipu$0.6$2.2$1.40200K
#58Grok Build 0.1xAI$1$2$1.50256K
#59Nemotron 3 Ultra 550BNVIDIA$0.5$2.5$1.501.0M
#60MiniMax M3MiniMax$0.6$2.4$1.501.0M
#61Nex-N2-ProNex AGI$0.5$2.5$1.50262K
#62QwQ-PlusAlibaba$0.8$2.4$1.60131K
#63Hy4 previewTencent$0.834$2.501$1.671.0M
#64Gemini 3 FlashGoogle$0.5$3$1.751.0M
#65Qwen3.6-PlusAlibaba$0.5$3$1.751.0M
#66Kimi K2.5Moonshot$0.6$3$1.80262K
#67LongCat-2.0Meituan$0.75$2.95$1.851.0M
#68KAT-Coder-Pro v2.5Kwaipilot$0.74$2.96$1.85262K
#69Grok 4.3xAI$1.25$2.5$1.881.0M
#70Grok 4.20xAI$1.25$2.5$1.881.0M
#71MiMo-V2-ProXiaomi$1$3$2.001.0M
#72Qwen3.5-397B-A17BAlibaba$0.6$3.6$2.10262K
#73GLM-5Zhipu$1$3.2$2.10200K
#74Gemini 3.8 FlashGoogle$0.75$3.75$2.251.0M
#75Gemini 3.6 FlashGoogle$0.75$3.75$2.251.0M
#76Gemini 3.7 FlashGoogle$0.75$3.75$2.251.0M
#77Kimi K2.7 CodeMoonshot$0.95$4$2.48262K
#78Kimi K2.6Moonshot$0.95$4$2.48262K
#79Qwen3.5-Omni PlusAlibaba$0.4$4.8$2.60262K
#80GLM-5 TurboZhipu$1.2$4$2.60200K
#81GPT-5.4 MiniOpenAI$0.75$4.5$2.63400K
#82Gemini 3.1 Flash LiveGoogle$0.75$4.5$2.631.0M
#83Doubao Seed 2.1 ProByteDance$0.88$4.41$2.65262K
#84o4 MiniOpenAI$1.1$4.4$2.75200K
#85o3 MiniOpenAI$1.1$4.4$2.75200K
#86Muse Spark 1.1Meta$1.25$4.25$2.751.0M
#87Muse Spark 1.2Meta$1.25$4.25$2.751.0M
#88GLM-5.3Zhipu$1.4$4.4$2.901.0M
#89GLM-5.2Zhipu$1.4$4.4$2.901.0M
#90GLM-5.1Zhipu$1.4$4.4$2.90200K
#91Claude Haiku 4.5Anthropic$1$5$3.00200K
#92Grok 4.6xAI$2$6$4.00500K
#93Grok 4.5xAI$2$6$4.00500K
#94Qwen3.8 MaxAlibaba$2$6$4.001.0M
#95Mistral Medium 3.5Mistral$1.5$7.5$4.50256K
#96Qwen3.6-Max-PreviewAlibaba$1.3$7.8$4.55262K
#97GPT-4.1OpenAI$2$8$5.001.0M
#98o3OpenAI$2$8$5.00200K
#99o4 Mini Deep ResearchOpenAI$2$8$5.00200K
#100Qwen3.7 MaxAlibaba$2.5$7.5$5.001.0M
#101Gemini Omni Flash (Preview)Google$1.5$9$5.251.0M
#102Gemini 3.5 FlashGoogle$1.5$9$5.251.0M
#103GPT-5.1OpenAI$1.25$10$5.63400K
#104GPT-5OpenAI$1.25$10$5.63400K
#105Gemini 2.5 ProGoogle$1.25$10$5.631.0M
#106Nova 2.0 Pro ReasoningAmazon$1.25$10$5.63128K
#107Claude Sonnet 5Anthropic$2$10$6.001.0M
#108GPT-4oOpenAI$2.5$10$6.25128K
#109Command A+Cohere$2.5$10$6.25128K
#110Command ACohere$2.5$10$6.25128K
#111GPT-5.6 TerraOpenAI$2$12$7.001.1M
#112Gemini 3.1 ProGoogle$2$12$7.001.0M
#113GPT-5.2OpenAI$1.75$14$7.88400K
#114GPT-5.3 CodexOpenAI$1.75$14$7.88400K
#115Voxtral TTSMistral$16$0$8.00128K
#116GPT-5.4OpenAI$2.5$15$8.751.1M
#117Claude Sonnet 4.6Anthropic$3$15$9.001.0M
#118Claude Sonnet 4.5Anthropic$3$15$9.00200K
#119Sonar ProPerplexity$3$15$9.00128K
#120Kimi K3Moonshot$3$15$9.001.0M
#121Gemini 3.1 Flash TTSGoogle$1$20$10.5032K
#122GPT-5.6 SolOpenAI$4$20$12.001.1M
#123Claude Opus 5Anthropic$5$25$15.001.0M
#124Claude Opus 4.8Anthropic$5$25$15.001.0M
#125Claude Opus 4.7Anthropic$5$25$15.001.0M
#126Claude Opus 4.6Anthropic$5$25$15.001.0M
#127Claude Opus 4.5Anthropic$5$25$15.00200K
#128Gemini 3.1 Flash Lite ImageGoogle$0.25$30$15.13131K
#129GPT-5.5OpenAI$5$30$17.501.1M
#130GPT Image 2.5OpenAI$5$30$17.5032K
#131GPT Image 2OpenAI$5$30$17.5032K
#132MAI-Image-2Microsoft$5$33$19.0032K
#133o3 Deep ResearchOpenAI$10$40$25.00200K
#134Claude Fable 5.1Anthropic$10$50$30.001.0M
#135Claude Fable 5Anthropic$10$50$30.001.0M
#136Gemini 3.1 Flash ImageGoogle$0.5$60$30.25131K
#137o1OpenAI$15$60$37.50200K
#138GPT-5.6 CyberOpenAI$12.5$75$43.75400K
#139o3-proOpenAI$20$80$50.00200K
#140GPT-5.5 ProOpenAI$30$180$105.001.1M
#141GPT-5.4 ProOpenAI$30$180$105.001.1M
#142o1 ProOpenAI$150$600$375.00200K

How We Rank the Cheapest LLMs

Models are ranked by their average price per 1 million tokens, calculated as (input price + output price) / 2. This gives a balanced view of overall cost since most workloads use both input and output tokens.

Keep in mind that the cheapest model isn't always the best choice. Consider quality benchmarks, context window size, and output speed when making your decision. Use our leaderboard to compare quality alongside cost.