tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 29 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
OpenAI: GPT-4.1openai/gpt-4.1
reasoningtoolsvisiongpt
$0models.dev$01.0M26
OpenAI: GPT-4.1 Miniopenai/gpt-4.1-mini
scoresreasoningtoolsvisiongpt-mini
$0models.dev$01.0M23
OpenAI: GPT-4.1 Nanoopenai/gpt-4.1-nano
scoresreasoningtoolsvisiongpt-nano
$0models.dev$01.0M22
Llama 4 Maverick 17B Instructcortecs/llama-4-maverick
scorestoolsvisionopenllama
$0.124models.dev$0.6031M5
Command Acohere/command-a
scorestoolsopencommand-a
$2.50models.dev$10256K6
Command Acohere/command-a-03-2025
scorestoolsopencommand-a
$2.50models.dev$10256K3
Anthropic: Claude Opus 4anthropic/claude-opus-4
reasoningtoolsvisionclaude-opus
$13models.dev$64200K23
Codex Miniazure-cognitive-services/codex-mini
reasoningtoolsgpt-codex-mini
$1.50models.dev$6200K3
Model Routerazure-cognitive-services/model-router
toolsvisionmodel-router
$0.14models.dev$0200K4
R1 0528deepseek/deepseek-r1-0528
reasoningtoolsopendeepseek-thinking
$0models.dev$0164K7
DeepSeek R1 0528alibaba-cn/deepseek-r1-0528
reasoningtoolsopendeepseek-thinking
$0.5LiteLLM$2.15164K5
DeepSeek-R1-0528deepseek-ai/DeepSeek-R1-0528
reasoningtoolsopendeepseek-thinking
$0.4models.dev$1.70164K7
Claude-Sonnet-3.7anthropic/claude-sonnet-3.7
reasoningtoolsvisionclaude-sonnet
$2.60models.dev$13197K1
Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct
scoresreasoningtoolsopenllama
$0.05models.dev$0.23131K16
Qwen3 14Bqwen/qwen3-14b
scoresreasoningtoolsopenqwen
$0.06LiteLLM$0.24131K6
Qwen3 8Bqwen/qwen3-8b
scoresreasoningtoolsopenqwen
$0.06models.dev$0.06131K6
Mistral Medium 3mistral/mistral-medium-2505
toolsvisionmistral-medium
$0.4models.dev$2131K2
Virtuoso Largearcee-ai/virtuoso-large
tools
$0.75models.dev$1.20131K2
Cogito v1 Preview Qwen 32Baccounts/fireworks/models/cogito-v1-preview-qwen-32b
qwen
$0.9LiteLLM$0.9128K4
Llama 3.1 70B Dracarys 2abacusai/Dracarys-72B-Instruct
llama
$0.493models.dev$0.49316K1
The Drummer Cydonia 24B v4TheDrummer/Cydonia-24B-v4
$0.2006models.dev$0.241416K1
Qwen3-235B-A22B-Thinking-2507-fastQwen/Qwen3-235B-A22B-Thinking-2507-fast
reasoningtoolsopen
$0.5models.dev$28K1
Qwen3-Next-80B-A3B-Thinking-fastQwen/Qwen3-Next-80B-A3B-Thinking-fast
reasoningtoolsopen
$0.15models.dev$1.208K1
Qwen3.5-397B-A17B-fastQwen/Qwen3.5-397B-A17B-fast
reasoningtoolsopen
$0.6models.dev$3.608K1
Qwen Longalibaba-cn/qwen-long
toolsqwen
$0.072models.dev$0.28710M2
DeepSeek R1deepseek-ai/DeepSeek-R1
scoresreasoningtoolsopendeepseek-thinking
$0.5models.dev$2.18164K7
Qwen 2.5 Coder 32B Instructworkers-ai/@cf/qwen/qwen2.5-coder-32b-instruct
qwen
$0.66models.dev$1128K1
QwQ 32Bworkers-ai/@cf/qwen/qwq-32b
qwen
$0.66models.dev$1128K1
Llama Guard 4 12Bmeta/llama-guard-4-12b
visionopenllama
$0models.dev$0128K1
deepseek-ai/DeepSeek-V3Pro/deepseek-ai/DeepSeek-V3
toolsopendeepseek
$0.25models.dev$1164K5
DeepSeek V3 0324deepseek/deepseek-v3
toolsdeepseek
$0.27LiteLLM$1.10164K2
R1deepseek/deepseek-r1
scoresreasoningtoolsopendeepseek-thinking
$0models.dev$0164K7
DeepSeek R1alibaba-cn/deepseek-r1
scoresreasoningtoolsopendeepseek-thinking
$0models.dev$0164K7
DeepSeek R1public/deepseek-r1
scoresreasoningtoolsopendeepseek-thinking
$0.55models.dev$2.20131K1
Qwen3 32BQwen/Qwen3-32B
scoresreasoningtoolsopenqwen
$0.08models.dev$0.28131K15
Qwen3 32Balibaba-cn/qwen3-32b
scoresreasoningtoolsopenqwen
$0models.dev$0131K10
DeepSeek V3public/deepseek-v3
toolsopendeepseek
$0.28models.dev$1.10131K1
Qwen 2.5 VL 32B InstructQwen/Qwen2.5-VL-32B-Instruct
toolsvisionopenqwen
$0.05models.dev$0.22131K6
DeepSeek R1 (Turbo)deepseek/deepseek-r1-turbo
reasoningtoolsopen
$0.7models.dev$2.5064K2
Qwen2.5 Coder 32B Instruct@cf/qwen/qwen2.5-coder-32b-instruct
openqwen
$0.66models.dev$133K2
Qwen3 1.7B BaseQwen/Qwen3-1.7B-Base
reasoningtools
$0.1models.dev$0.133K1
Qwq 32B@cf/qwen/qwq-32b
reasoningopenqwen
$0.66models.dev$124K2
DeepSeek V3302ai/deepseek-chat
toolsopendeepseek
$0.14models.dev$0.281M10
Deepseek-Reasoner302ai/deepseek-reasoner
reasoningtoolsopendeepseek-thinking
$0.14models.dev$0.281M7
Llama 4 Scout 17Bmeta-llama/Llama-4-Scout-17B-16E-Instruct
scorestoolsvisionopenllama
$0.08LiteLLM$0.3328K6
Qwen3 Coder 30B A3B InstructQwen/Qwen3-Coder-30B-A3B-Instruct
toolsopenqwen
$0models.dev$0262K10
Qwen3-Coder 30B-A3B Instructalibaba-cn/qwen3-coder-30b-a3b-instruct
reasoningtoolsopenqwen
$0.053models.dev$0.222262K10
Gemma 3 27Bgoogle/gemma-3-27b-it
scorestoolsvisionopengemma
$0.06LiteLLM$0.2262K7

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash