NEWTickerr MCP is live →
tickerr

Tickerr / Compare

AI Model Speed & Cost Comparison 2026

Live P50/P95 TTFT benchmarks, API pricing, and uptime across Claude, GPT-4, Gemini, Groq, Mistral, and more - updated every 5 minutes from independent inference checks.

Live model performance & pricing

Fastest model right now: Gemini 2.5 Flash Lite · 287ms median TTFT (last 24h)

ModelProviderP50 TTFTP95 TTFTInput /1MOutput /1MStatus
Gemini 2.5 Flash LiteGoogle287ms506ms$0.100$0.400Operational
Gemini 2.5 FlashGoogle432ms610ms$0.300$2.50Operational
Mistral SmallMistral470ms1511ms$0.0600$0.180Operational
Claude Haiku 4.5Anthropic562ms803ms$1.00$5.00Operational
Claude Opus 4.7Anthropic754ms1165ms$5.00$25.00Operational
GPT-4.1 MiniOpenAI806ms2091ms$0.400$1.60Operational
GPT-4o MiniOpenAI879ms1939ms$0.150$0.600Operational
Claude Sonnet 4.6Anthropic1065ms1479ms$3.00$15.00Operational
Claude Opus 4.6Anthropic1901ms5008ms$5.00$25.00Operational
Llama 3.1 8B (Cerebras)CerebrasFreeFreeDown
Llama 3.3 70BGroqFreeFreeDown
Llama 4 Scout (Groq)GroqFreeFreeDown
Grok 3 MinixAI$0.300$0.500Down
Qwen3 235B (Cerebras)CerebrasFreeFreeDown
Command R+Cohere$2.50$10.00Degraded
Mistral LargeMistral$0.500$1.50Down
DeepSeek V3OpenRouterFreeFreeDown
Qwen3 235B (OpenRouter)OpenRouterFreeFreeDown
Grok 3xAI$3.00$15.00Down

P50 = typical speed. P95 = worst case 95% of the time. Measured by Tickerr's independent inference checks every 5 minutes. Pricing from official provider docs. Requires ≥10 checks to compute percentiles. Click any column header to sort.

Tool comparisons

AI assistants

Coding tools

App builders

Automation

Infrastructure

Other