tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 44 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Kimi K2.6tensormesh/moonshotai/Kimi-K2.6
scores
$0.96LiteLLM$4N/A1
Kimi K2.7 Codecloudflare/@cf/moonshotai/kimi-k2.7-code
scores
$0.95LiteLLM$4N/A1
Kimi K2p5accounts/fireworks/models/kimi-k2p5
$0.6LiteLLM$3N/A3
Moonshotai.Kimi K2 Thinkingbedrock/ap-northeast-1/moonshotai.kimi-k2-thinking
scores
$0.6LiteLLM$2.50N/A10
Gemini 2.5 Computer Use Preview 10-2025gemini/gemini-2.5-computer-use-preview-10-2025
$1.25LiteLLM$10N/A1
Gemini 2.5 Flash Preview TTSgemini/gemini-2.5-flash-preview-tts
$0.3LiteLLM$2.50N/A1
Gemini 2.5 Pro Preview TTSgemini/gemini-2.5-pro-preview-tts
$1.25LiteLLM$10N/A1
Gemini 3.1 Flash Live Previewgemini/gemini-3.1-flash-live-preview
$0.75LiteLLM$4.50N/A1
Google: Gemini 2.5 Flash Native Audio Latestgemini/gemini-2.5-flash-native-audio-latest
$0.3LiteLLM$2.50N/A2
Google: Gemini 2.5 Flash Native Audio Preview 09 2025gemini/gemini-2.5-flash-native-audio-preview-09-2025
$0.3LiteLLM$2.50N/A2
Google: Gemini 2.5 Flash Native Audio Preview 12 2025gemini/gemini-2.5-flash-native-audio-preview-12-2025
$0.3LiteLLM$2.50N/A2
Nano Banana 2 (Gemini 3.1 Flash Image Preview)gemini/gemini-3.1-flash-image-preview
$0.25LiteLLM$1.50N/A1
Nano Banana Pro (Gemini 3 Pro Image Preview)gemini/gemini-3-pro-image-preview
$2LiteLLM$12N/A1
xAI: Grok 4 1 Fast Non Reasoning Latestxai/grok-4-1-fast-non-reasoning-latest
$0.2LiteLLM$0.5N/A2
xAI: Grok 4 1 Fast Reasoning Latestxai/grok-4-1-fast-reasoning-latest
$0.2LiteLLM$0.5N/A2
xAI: Grok 4 Latestxai/grok-4-latest
$3LiteLLM$15N/A2
xAI: Grok 4.3 Latestxai/grok-4.3-latest
$1.25LiteLLM$2.50N/A2
Gemini 2.5 Flashdeepinfra/google/gemini-2.5-flash
$0.3LiteLLM$2.50N/A1
Gemini 2.5 Flashgoogle.gemini-2.5-flash
$0.15LiteLLM$0.6N/A1
Gemini 2.5 Flashoci/google.gemini-2.5-flash
$0.15LiteLLM$0.6N/A1
Gemini 2.5 Flashreplicate/google/gemini-2.5-flash
$2.50LiteLLM$2.50N/A1
Gemini 2.5 Flashvercel_ai_gateway/google/gemini-2.5-flash
$0.3LiteLLM$2.50N/A1
Gemini 2.5 Prodeepinfra/google/gemini-2.5-pro
scores
$1.25LiteLLM$10N/A1
Gemini 2.5 Progoogle.gemini-2.5-pro
scores
$1.25LiteLLM$10N/A1
Gemini 2.5 Prooci/google.gemini-2.5-pro
scores
$1.25LiteLLM$10N/A1
Gemini 2.5 Provercel_ai_gateway/google/gemini-2.5-pro
scores
$2.50LiteLLM$10N/A1
Gemini 3.1 Pro Previewvertex_ai/gemini-3.1-pro-preview
scores
$2LiteLLM$12N/A1
Gemini 3.5 Flashvertex_ai/gemini-3.5-flash
scores
$1.50LiteLLM$9N/A1
Nano Banana 2 (Gemini 3.1 Flash Image Preview)vertex_ai/gemini-3.1-flash-image-preview
$0.5LiteLLM$3N/A1
Nano Banana Pro (Gemini 3 Pro Image Preview)vertex_ai/gemini-3-pro-image-preview
$2LiteLLM$12N/A1
Meta: Llama 4 Maverick 17bmeta-llama/llama-4-maverick-17b
$0.35LiteLLM$1.40N/A3
Meta: Llama 4 Maverick 17b 16e Instruct Maasmeta/llama-4-maverick-17b-16e-instruct-maas
$0.35LiteLLM$1.15N/A3
Meta: Llama 4 Scout 17b 128e Instruct Maasmeta/llama-4-scout-17b-128e-instruct-maas
$0.25LiteLLM$0.7N/A3
Meta: Llama 4 Scout 17b 16e Instruct Maasmeta/llama-4-scout-17b-16e-instruct-maas
$0.25LiteLLM$0.7N/A3
Llama 4 Maverick 17B Instructtogether_ai/meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP8
$0.27LiteLLM$0.85N/A1
Llama 4 Scout 17Btogether_ai/meta-llama/Llama-4-Scout-17B-16E-Instruct
scores
$0.18LiteLLM$0.59N/A1
Databricks Llama 4 Maverickdatabricks/databricks-llama-4-maverick
$0.5LiteLLM$1.50N/A2
Llama 4 Maverickvercel_ai_gateway/meta/llama-4-maverick
scores
$0.2LiteLLM$0.6N/A1
Llama 4 Maverick 17B Instructazure_ai/Llama-4-Maverick-17B-128E-Instruct-FP8
$1.41LiteLLM$0.35N/A1
Llama 4 Maverick 17B Instructlambda_ai/llama-4-maverick-17b-128e-instruct-fp8
$0.05LiteLLM$0.1N/A1
Llama 4 Maverick 17B Instructmeta.llama-4-maverick-17b-128e-instruct-fp8
$0.72LiteLLM$0.72N/A1
Llama 4 Maverick 17B Instructnovita/meta-llama/llama-4-maverick-17b-128e-instruct-fp8
$0.27LiteLLM$0.85N/A1
Llama 4 Maverick 17B Instructoci/meta.llama-4-maverick-17b-128e-instruct-fp8
$0.72LiteLLM$0.72N/A1
Llama 4 Scoutvercel_ai_gateway/meta/llama-4-scout
scores
$0.1LiteLLM$0.3N/A1
Llama 4 Scout 17Bazure_ai/Llama-4-Scout-17B-16E-Instruct
scores
$0.2LiteLLM$0.78N/A1
Llama 4 Scout 17Bcloudflare/@cf/meta/llama-4-scout-17b-16e-instruct
scores
$0.27LiteLLM$0.85N/A1
Llama 4 Scout 17Blambda_ai/llama-4-scout-17b-16e-instruct
scores
$0.05LiteLLM$0.1N/A1
Llama 4 Scout 17Bmeta.llama-4-scout-17b-16e-instruct
scores
$0.72LiteLLM$0.72N/A1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash