LLM Cost Calculator

Agentic AI Workflow LLM Cost Estimator

AI agents call LLMs multiple times per task — plan, execute, reflect, retry. Estimate monthly costs for multi-step agentic pipelines with tool use and long context.

Recommended Setup

Model
Claude Sonnet 4.6
Anthropic
Monthly tokens
520M
400M in / 120M out
Estimated monthly cost
$3,000

Cost Comparison: All Cloud Models

Based on 400M input + 120M output tokens/month

ModelProviderMonthly cost
gpt-oss-20bOpenAI$27.60
Qwen3.7 FlashQwen (Alibaba)$27.60
Llama 3.1 8B (Groq)Groq$29.60
Gemma 3 4BGoogle$32.00
gpt-oss-120bOpenAI$36.40
Gemma 3 12BGoogle$38.00
Gemma 3n 4BGoogle$38.40
Qwen3 30B A3B Instruct 2507Qwen (Alibaba)$42.80
Doubao Seed 2.0 MiniDoubao (ByteDance)$46.80
DeepSeek V4 FlashDeepSeek$56.40
Qwen3.5-9BQwen (Alibaba)$58.00
Qwen3.5-FlashQwen (Alibaba)$59.20
Qwen3 Coder 30B A3B InstructQwen (Alibaba)$61.60
Qwen2.5 7B InstructQwen (Alibaba)$64.00
GPT-5 NanoOpenAI$68.00
gpt-oss-safeguard-20bOpenAI$68.00
Gemma 4 26B A4B Google$68.80
GLM-4.7 FlashZhipu AI (GLM)$72.00
Qwen3 14BQwen (Alibaba)$76.80
Doubao Pro 32KDoubao (ByteDance)$77.60
Hunyuan TurboSHunyuan (Tencent)$77.60
Gemma 4 31BGoogle$80.80
Llama 4 Scout (Groq)Groq$84.80
Gemma 3 27BGoogle$86.00
GPT-4.1 NanoOpenAI$88.00
Gemini 2.5 Flash-LiteGoogle$88.00
DeepSeek V4 Flash 0731DeepSeek$89.60
Qwen3 VL 32B InstructQwen (Alibaba)$90.40
Qwen3.5-FlashQwen (Alibaba)$102
Qwen3 VL 8B InstructQwen (Alibaba)$102
Qwen3 235B A22B Instruct 2507Qwen (Alibaba)$102
Qwen3 30B A3BQwen (Alibaba)$108
Qwen3 VL 30B A3B InstructQwen (Alibaba)$114
Hunyuan T1Hunyuan (Tencent)$123
GPT-4o-miniOpenAI$132
GPT-OSS 120B (Groq)Groq$132
Qwen3 Coder NextQwen (Alibaba)$144
DeepSeek V3.2DeepSeek$150
GLM 4.5 AirZhipu AI (GLM)$154
Qwen3 Next 80B A3B InstructQwen (Alibaba)$172
Qwen3.6 35B A3BQwen (Alibaba)$176
Qwen3 32B (Groq)Groq$187
Qwen2.5 72B InstructQwen (Alibaba)$192
Qwen3 Coder FlashQwen (Alibaba)$198
Qwen3.5-PlusQwen (Alibaba)$198
Qwen3 Next 80B A3B ThinkingQwen (Alibaba)$204
Qwen3.6 FlashQwen (Alibaba)$212
DeepSeek V3 0324DeepSeek$220
GPT-5.6 LunaOpenAI$224
GPT-5.6 Luna ProOpenAI$224
DeepSeek V3DeepSeek$228
DeepSeek V3.1 TerminusDeepSeek$228
GLM 4.6VZhipu AI (GLM)$228
GPT-5.4 NanoOpenAI$230
DeepSeek V3 (Mar 2025)DeepSeek$240
Qwen3 Coder 480B A35BQwen (Alibaba)$240
Qwen3.5-35B-A3BQwen (Alibaba)$250
Qwen3.5-27BQwen (Alibaba)$267
Gemini 3.1 Flash-LiteGoogle$280
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$280
Qwen3.7 PlusQwen (Alibaba)$282
Qwen3.5 Plus 2026-02-15Qwen (Alibaba)$291
Qwen3 VL 235B A22B InstructQwen (Alibaba)$312
Qwen3 VL 8B ThinkingQwen (Alibaba)$324
Llama 3.3 70B (Groq)Groq$331
GPT-5 MiniOpenAI$340
GPT-5.1-Codex-MiniOpenAI$340
GPT-4.1 MiniOpenAI$352
Qwen3.5-122B-A10BQwen (Alibaba)$354
Qwen3.6 PlusQwen (Alibaba)$366
Qwen3 VL 30B A3B ThinkingQwen (Alibaba)$368
Qwen3 30B A3B Thinking 2507Qwen (Alibaba)$368
Qwen3 235B A22B Thinking 2507Qwen (Alibaba)$368
GLM 4.7Zhipu AI (GLM)$370
DeepSeek V4 ProDeepSeek$371
Gemini 3.7 FlashGoogle$378
Qwen2.5 Coder 32B InstructQwen (Alibaba)$384
Qwen3-MaxQwen (Alibaba)$398
R1 Distill Llama 70BDeepSeek$416
DeepSeek V3.1DeepSeek$418
Gemini 2.5 FlashGoogle$420
Gemini 3.5 Flash LiteGoogle$420
Nano Banana (Gemini 2.5 Flash Image)Google$420
Qwen2.5 VL 72B InstructQwen (Alibaba)$440
GLM 4.6Zhipu AI (GLM)$440
GLM 4.5VZhipu AI (GLM)$456
Llama 3.3 70B (Together)Together AI$458
R1 0528DeepSeek$458
Doubao Seed 2.0 ProDoubao (ByteDance)$472
Qwen3.8 27BQwen (Alibaba)$478
Kimi K2Kimi (Moonshot AI)$504
GLM 4.5Zhipu AI (GLM)$504
Qwen3.6 27BQwen (Alibaba)$512
GPT Audio MiniOpenAI$528
Kimi K2.5 (Together)Together AI$536
Kimi K2 ThinkingKimi (Moonshot AI)$540
Kimi K2 0905Kimi (Moonshot AI)$540
Nano Banana 2 (Gemini 3.1 Flash Image)Google$560
DeepSeek R1DeepSeek$580
Kimi K2.5Kimi (Moonshot AI)$600
Qwen3.5 397B A17BQwen (Alibaba)$632
Qwen3 VL 235B A22B ThinkingQwen (Alibaba)$640
Qwen3 Coder PlusQwen (Alibaba)$650
Qwen3.5 397B (Together)Together AI$672
Gemini 3.6 FlashGoogle$750
Qwen3 Max ThinkingQwen (Alibaba)$780
GLM-5Zhipu AI (GLM)$784
Claude 3.5 HaikuAnthropic$800
GPT-5.4 MiniOpenAI$840
DeepSeek V4 Pro 0813DeepSeek$852
Kimi K2.7 CodeKimi (Moonshot AI)$860
Kimi K2.6Kimi (Moonshot AI)$860
GLM-5-TurboZhipu AI (GLM)$960
GLM 5V TurboZhipu AI (GLM)$960
o4-miniOpenAI$968
o3 MiniOpenAI$968
o4 Mini HighOpenAI$968
o3 Mini HighOpenAI$968
Claude Haiku 4.5Anthropic$1,000
GLM-5.1Zhipu AI (GLM)$1,088
GLM 5.3Zhipu AI (GLM)$1,088
Qwen3.7 MaxQwen (Alibaba)$1,124
GPT-5 Image MiniOpenAI$1,240
DeepSeek V4 Pro (Together)Together AI$1,368
Moonshot V1 (128K)Kimi (Moonshot AI)$1,400
Qwen3.8 2.4T A95BQwen (Alibaba)$1,520
Qwen3.8 MaxQwen (Alibaba)$1,520
Gemini 3.5 FlashGoogle$1,680
GPT-5OpenAI$1,700
GPT-5 CodexOpenAI$1,700
GPT-5.1-Codex-MaxOpenAI$1,700
GPT-5.1OpenAI$1,700
GPT-5.1-CodexOpenAI$1,700
Gemini 2.5 ProGoogle$1,700
Gemini 2.5 Pro Preview 05-06Google$1,700
Kimi K2.7 Code HighSpeedKimi (Moonshot AI)$1,720
GPT-4.1OpenAI$1,760
o3OpenAI$1,760
o4 Mini Deep ResearchOpenAI$1,760
GPT-5.6 Sol ProOpenAI$2,000
Claude Sonnet 5Anthropic$2,000
GPT-4oOpenAI$2,200
GPT AudioOpenAI$2,200
GPT-5.6 TerraOpenAI$2,240
GPT-5.6 Terra ProOpenAI$2,240
Gemini 3.1 Pro PreviewGoogle$2,240
Nano Banana Pro (Gemini 3 Pro Image)Google$2,240
Gemini 3.1 Pro Preview Custom ToolsGoogle$2,240
GPT-5.3 ChatOpenAI$2,380
GPT-5.3-CodexOpenAI$2,380
GPT-5.2-CodexOpenAI$2,380
GPT-5.2 ChatOpenAI$2,380
GPT-5.2OpenAI$2,380
GPT-5.4OpenAI$2,800
Claude Sonnet 4.6★ recommendedAnthropic$3,000
Claude Sonnet 4.5Anthropic$3,000
Claude Sonnet 4Anthropic$3,000
Kimi K3Kimi (Moonshot AI)$3,000
GPT-5.4 Image 2OpenAI$5,000
Claude Opus 4.7Anthropic$5,000
Claude Opus 4.6Anthropic$5,000
Claude Opus 4.8Anthropic$5,000
Claude Opus 4.5Anthropic$5,000
Claude Opus 5Anthropic$5,000
GPT-5 ImageOpenAI$5,200
GPT-5.6 SolOpenAI$5,600
GPT-5.5OpenAI$5,600
GLM-5.2Zhipu AI (GLM)$6,560
o3 Deep ResearchOpenAI$8,800
Claude Opus 4.8 (Fast)Anthropic$10,000
Claude Opus 5 (Fast)Anthropic$10,000
Claude Fable 5Anthropic$10,000
o1OpenAI$13,200
Claude Opus 4.1Anthropic$15,000
Claude Opus 4Anthropic$15,000
o3 ProOpenAI$17,600
GPT-5 ProOpenAI$20,400
GPT-5.2 ProOpenAI$28,560
Claude Opus 4.7 (Fast)Anthropic$30,000
Claude Opus 4.6 (Fast)Anthropic$30,000
GPT-5.5 ProOpenAI$33,600
GPT-5.4 ProOpenAI$33,600
o1-proOpenAI$132,000

Frequently Asked Questions

Why are agentic workflows so much more expensive than single-shot LLM calls?

Each agent step re-sends the full conversation history plus tool outputs. A 5-step agent task with a 10k-token context uses 50k input tokens total — 5× more than a direct request. Multi-agent pipelines multiply this further. Budget 3–10× the tokens you'd expect from a single-turn interaction.

Which model is best for running AI agents?

Claude Sonnet 4.6 ($3/1M input) is the leading choice for agentic tasks — it reliably follows tool-use schemas and handles complex multi-step reasoning. Claude Opus 4.8 ($5/1M) is better for high-stakes agents where accuracy matters most. For cost-optimized agents with simpler tasks, GPT-5.4 Mini ($0.75/1M) is a strong mid-tier option.

How can I reduce costs for agentic AI workflows?

Key strategies: (1) limit context accumulation — prune tool outputs after each step; (2) use a small model for planning/routing and a large model only for execution; (3) cap retry loops with max_iterations; (4) cache repeated tool results with a key-value store. These cuts can reduce token use by 40–70%.