tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 34 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Sabamistralai/mistral-saba
toolsmistral
$0.1989models.dev$0.59533K3
Qwen-Omni Turbo Realtimealibaba-cn/qwen-omni-turbo-realtime
toolsvisionqwen
$0.23models.dev$0.91833K2
Shisa V2.1 Llama 3.3 70Bshisa-ai/shisa-v2.1-llama3.3-70b
llama
$0.5models.dev$0.533K1
Step 1 (32K)stepfun-ai/step-1-32k
tools
$2.05models.dev$9.5933K2
Google: Gemini Text + Imagegemini/gemini-2.0-flash-exp-image-generation
$0LiteLLM$033K3
Bielik 11B v2.6 Instructspeakleash/Bielik-11B-v2.6-Instruct
toolsopen
$0.67models.dev$0.6732K1
Bielik 11B v3.0 Instructspeakleash/Bielik-11B-v3.0-Instruct
toolsopen
$0.67models.dev$0.6732K1
GLM Z1 Airnano-gpt/glm-z1-air
tools
$0.07models.dev$0.0732K1
GLM Z1 AirXnano-gpt/glm-z1-airx
tools
$0.7models.dev$0.732K1
Qwen25 VL 72bnano-gpt/qwen25-vl-72b-instruct
vision
$0.6999models.dev$0.699932K1
Gemini 2.5 Flash Preview TTSgoogle/gemini-2.5-flash-preview-tts
gemini-flash
$0.3LiteLLM$2.508K2
Gemini 2.5 Pro Preview TTSgoogle/gemini-2.5-pro-preview-tts
gemini-flash
$1models.dev$208K2
Google: Gemini 2.0 Pro 1206gemini/gemini-exp-1206
vision
$0LiteLLM$02.1M3
Doubao 1.5 Pro 32knano-gpt/doubao-1.5-pro-32k
$0.1343models.dev$0.334932K1
Doubao 1.5 Vision Pro 32knano-gpt/doubao-1.5-vision-pro-32k
vision
$0.459models.dev$1.3832K1
Mercury Coder Small Betavercel_ai_gateway/inception/mercury-coder-small
toolsmercury
$0.25LiteLLM$132K4
Mistral Nemo 12B Instructmistral/mistral-nemo-12b-instruct
toolsopenmistral-nemo
$0.038models.dev$0.116K1
Llama 3.1 8B Instructmeta/llama-3.1-8b-instruct
scorestoolsopenllama
$0models.dev$016K2
Ernie 4.5 8k Previewnano-gpt/ernie-4.5-8k-preview
$0.66models.dev$2.608K1
UnslopNemo 12Bthedrummer/unslopnemo-12b
toolsopen
$0.4models.dev$0.41.0M2
Aion 1.0aion-labs/aion-1.0
llama
$4models.dev$7.9966K1
Qwen-Omni Turboalibaba-cn/qwen-omni-turbo
toolsvisionqwen
$0.058models.dev$0.2333K3
Aion-RP 1.0 (8B)aion-labs/aion-rp-llama-3.1-8b
llama
$0.2006models.dev$0.200633K3
Alibaba: Qwen Turboalibaba-cn/qwen-turbo
reasoningtoolsqwen
$0.044models.dev$0.0871M5
Mistral Large 3mistral/mistral-large-2512
scorestoolsvisionopenmistral-large
$0.5models.dev$1.50262K2
Mistral Large 3 2512mistralai/mistral-large-2512
scorestoolsvisionopenmistral-large
$0.5models.dev$1.50262K3
Claude 3.5 Haikudigitalocean/anthropic-claude-3.5-haiku
toolsclaude-haiku
$0.8models.dev$4200K3
Gemini 2.0 Flash Thinking 1219nano-gpt/gemini-2.0-flash-thinking-exp-1219
$0.1003models.dev$0.40833K1
Neural Daredevil 8B abliteratedmlabonne/NeuralDaredevil-8B-abliterated
llama
$0.44models.dev$0.448K1
GLM Zero Previewnano-gpt/glm-zero-preview
$1.80models.dev$1.808K1
Green Sgreenpt/green-s
$0.0044models.dev$01
Green S Progreenpt/green-s-pro
$0.0044models.dev$01
GLM-4 Longnano-gpt/glm-4-long
$0.2006models.dev$0.20061M1
Claude 3.5 Sonnet v2helicone/claude-3.5-sonnet-v2
toolsvisionclaude-sonnet
$3models.dev$15200K1
claude-3-5-haiku-latest302ai/claude-3-5-haiku-latest
toolsvisionclaude-haiku
$0.8models.dev$4200K1
Meta: Llama 3.3 70B Turbometa-llama/Llama-3.3-70B-Instruct-Turbo
toolsopenllama
$0.1models.dev$0.32131K6
Llama 3.3 70B Versatileabacus/llama-3.3-70b-versatile
toolsopenllama
$0.59models.dev$0.79131K4
xAI: Grok 3xai/grok-3
reasoningtoolsgrok
$0models.dev$0131K10
xAI: Grok 3 Minixai/grok-3-mini
reasoningtoolsgrok
$0models.dev$0131K10
Llama 3.2 1B Instructmeta/llama-3.2-1b-instruct
toolsopenllama
$0models.dev$0128K2
Deepseek R1 Distill Qwen 32B@cf/deepseek-ai/deepseek-r1-distill-qwen-32b
reasoningopendeepseek-thinking
$0.497models.dev$4.8880K2
DeepSeek R1 Distill Qwen 32Bdeepseek/deepseek-r1-distill-qwen-32b
opendeepseek-thinking
$0.3models.dev$0.364K2
DeepSeek R1 Distill Qwen 32Balibaba-cn/deepseek-r1-distill-qwen-32b
reasoningtoolsqwen
$0.27LiteLLM$0.2733K3
Llama 3.2 3B Instructmeta/llama-3.2-3b-instruct
toolsopenllama
$0models.dev$033K2
Qwen2.5 32B Instructalibaba-cn/qwen2-5-32b-instruct
toolsopenqwen
$0.06LiteLLM$0.2131K3
Qwen2.5 72B Instructalibaba-cn/qwen2-5-72b-instruct
toolsopenqwen
$0.12LiteLLM$0.39131K3
Qwen2.5-Coder 32B Instructalibaba-cn/qwen2-5-coder-32b-instruct
toolsopenqwen
$0.12LiteLLM$0.3131K3
QwQ 32Balibaba-cn/qwq-32b
reasoningtoolsopenqwen
$0.15LiteLLM$0.4131K4

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash