Skip to content
Cost Analysis

LLM Cost Per Query 2026:
What Does One AI Request Actually Cost?

The true cost of a single AI API request across all major production models in 2026. See how per-query costs scale from 1 request to 1 million, and find the break-even point for your product. Last verified: 2026-10-01.

10 min read·Updated October 2026
Cost Per Single Query (500 input + 500 output tokens)
$0.00025
Gemini 2.5 Flash-Lite
$0.00030
GPT-6 Luna
$0.0060
GPT-6.1 Sol
$0.012
Claude Opus 5.5

Cost Per Query: Full Table — Production Models Only

Assuming a typical conversational query: 500 input tokens (your message + system prompt) and 500 output tokens (the AI's response). This equals ~375 words in + 375 words out.

ModelCost / Query1K queries/day10K queries/day100K queries/day
Mistral Small 4$0.000375$11.25/mo$112.50/mo$1,125/mo
Gemini 2.5 Flash-Lite$0.000250$7.50/mo$75/mo$750/mo
GPT-6 Luna$0.000300$9/mo$90/mo$900/mo
Gemini 2.5 Flash$0.00140$42/mo$420/mo$4,200/mo
Claude Haiku 4.5$0.00300$90/mo$900/mo$9,000/mo
GPT-6 Astra$0.03000$900/mo$9,000/mo$90,000/mo
Claude Sonnet 5.5$0.00600$180/mo$1,800/mo$18,000/mo
Claude Opus 5.5$0.01200$360/mo$3,600/mo$36,000/mo

1K queries/day = ~30K/month. Assumes 500 input + 500 output tokens per query.

How Query Size Affects Cost

The 500+500 token example is for a simple chat message. Real-world query costs vary dramatically based on use case:

Use CaseTypical TokensFlash-Lite costSonnet 5.5 cost
Simple FAQ answer200 in / 150 out$0.000080$0.00190
Customer support chat turn800 in / 300 out$0.000200$0.00460
Code explanation (1 file)3,000 in / 800 out$0.000620$0.01400
Document summarization (10 pages)8,000 in / 500 out$0.001000$0.02100
Long document analysis (50 pages)40,000 in / 2,000 out$0.004800$0.10000
Full codebase review (1K files)100,000 in / 5,000 out$0.012000$0.25000

The AI Cost Ceiling: When Does AI Become Unsustainable?

AI becomes expensive when your cost-per-query exceeds the revenue or value generated per query. Key benchmarks:

  • SaaS product ($10/month subscription): Can afford ~$0.05–0.10 per query (5–10% of revenue on inference)
  • Free-tier product (ad-supported): Must keep cost below ~$0.001 per query to be viable — use Gemini 2.5 Flash-Lite or GPT-6 Luna
  • Enterprise tool ($500/month): Can afford $2–5 per complex query — Claude Sonnet 5.5 is reasonable

If your cost per query exceeds 10–15% of your revenue per user, you need to optimize model selection or reprice.

How to Get Your Real Per-Query Cost

Log token counts for a representative sample of real requests. Calculate:

avg_input_tokens = sum(input_tokens) / total_requests
avg_output_tokens = sum(output_tokens) / total_requests
cost_per_query =
(avg_input_tokens / 1_000_000) × input_price
+ (avg_output_tokens / 1_000_000) × output_price

Observability tools like LangSmith, Helicone, and Braintrust calculate this automatically from your API logs. Set up monitoring before you scale — surprises at 10M queries/month are expensive.

Calculate Your Exact Per-Query Cost

Enter your model, token counts, and query volume to get your monthly estimate.

Open API Cost Calculator