tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 35 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Meta Llama Guard 4 12Bhelicone/llama-guard-4
visionllama
$0.21models.dev$0.21131K1
Qwen2.5-Coder 7B Instructalibaba-cn/qwen2-5-coder-7b-instruct
toolsopenqwen
$0.01LiteLLM$0.03131K2
DeepSeek V3alibaba-cn/deepseek-v3
toolsopendeepseek
$0models.dev$0128K5
DeepSeek R1 Distill Qwen 1.5Balibaba-cn/deepseek-r1-distill-qwen-1-5b
reasoningtoolsqwen
$0models.dev$033K2
Qwen-MT Plusalibaba-cn/qwen-mt-plus
qwen
$0.25LiteLLM$0.7516K3
Qwen-MT Turboalibaba-cn/qwen-mt-turbo
qwen
$0.101models.dev$0.2816K2
The Drummer Cydonia 24B v2TheDrummer/Cydonia-24B-v2
$0.1003models.dev$0.120716K1
AI21 Jamba 1.5 Largeai21-labs/ai21-jamba-1.5-large
reasoningtoolsjamba
$0models.dev$0256K1
AI21 Jamba 1.5 Miniai21-labs/ai21-jamba-1.5-mini
reasoningtoolsjamba
$0models.dev$0256K1
Claude-Haiku-3.5anthropic/claude-haiku-3.5
toolsvisionclaude-haiku
$0.68models.dev$3.40189K1
Qwen3-235B-A22Biflowcn/qwen3-235b
reasoningtoolsopenqwen
$0models.dev$0128K1
Qwen2.5-VL 72B Instructalibaba-cn/qwen2-5-vl-72b-instruct
toolsvisionopenqwen
$0.13LiteLLM$0.4131K7
Qwen 2.5 Coder 32Babacus/qwen-2.5-coder-32b
toolsopenqwen
$0.79models.dev$0.79128K1
Llama-3.3-8B-Instructllama/llama-3.3-8b-instruct
toolsopenllama
$0models.dev$0128K1
Nova Microamazon/nova-micro
toolsnova-micro
$0.035models.dev$0.14128K4
Nova Micro 1.0amazon/nova-micro-v1
toolsnova-micro
$0.035models.dev$0.14128K5
Llama 3.3 70B Instructamazon-bedrock/meta.llama3-3-70b-instruct-v1:0
scorestoolsopenllama
$0.72models.dev$0.72128K4
Nova 2 Liteamazon-bedrock/amazon.nova-2-lite-v1:0
scoresreasoningtoolsvisionnova
$0.3LiteLLM$2.50128K6
Nova Microamazon-bedrock/amazon.nova-micro-v1:0
toolsnova-micro
$0.035models.dev$0.14128K5
NVIDIA Nemotron Nano 12B v2 VL BF16amazon-bedrock/nvidia.nemotron-nano-12b-v2
toolsvisionnemotron
$0.2LiteLLM$0.2128K5
Phi 4azure-cognitive-services/phi-4
reasoningtoolsopenphi
$0models.dev$0128K10
Phi-4-miniazure-cognitive-services/phi-4-mini
toolsopenphi
$0.075models.dev$0.3128K2
Phi-4-mini-reasoningazure-cognitive-services/phi-4-mini-reasoning
reasoningtoolsopenphi
$0models.dev$0128K5
Phi-4-multimodalazure-cognitive-services/phi-4-multimodal
visionopenphi
$0.08models.dev$0.32128K2
Phi-4-reasoningazure-cognitive-services/phi-4-reasoning
reasoningtoolsopenphi
$0models.dev$0128K5
Ministral 14B 3.0amazon-bedrock/mistral.ministral-3-14b-instruct
toolsministral
$0.2models.dev$0.2128K3
Ministral 3 8Bamazon-bedrock/mistral.ministral-3-8b-instruct
toolsministral
$0.15models.dev$0.15128K3
Voxtral Mini 3B 2507amazon-bedrock/mistral.voxtral-mini-3b-2507
toolsmistral
$0.04models.dev$0.04128K3
LucidNova RF1 100Blucidquery/lucidnova-rf1-100b
reasoningtoolsnova
$2models.dev$5120K1
Qwen QwQ 32B Previewqwen/qwq-32b-preview
$0.2models.dev$0.233K1
QwQ 32BQwen/QwQ-32B
reasoningtoolsopenqwen
$0.15LiteLLM$0.433K2
Qwen 2.5 32B Abliteratedhuihui-ai/Qwen2.5-32B-Instruct-abliterated
qwen
$0.7models.dev$0.733K1
DeepSeek R1 Distill Llama 8Balibaba-cn/deepseek-r1-distill-llama-8b
reasoningtoolsdeepseek-thinking
$0models.dev$033K3
DeepSeek R1 Distill Qwen 14Bdeepseek/deepseek-r1-distill-qwen-14b
opendeepseek-thinking
$0.15models.dev$0.1533K2
DeepSeek R1 Distill Qwen 14Balibaba-cn/deepseek-r1-distill-qwen-14b
reasoningtoolsqwen
$0.07LiteLLM$0.0733K3
DeepSeek R1 Distill Qwen 7Balibaba-cn/deepseek-r1-distill-qwen-7b
reasoningtoolsqwen
$0.072models.dev$0.14433K2
Phi-4-reasoning-plusazure-cognitive-services/phi-4-reasoning-plus
reasoningopenphi
$0.125models.dev$0.532K2
Llama 3.3 70B WayfarerLatitudeGames/Wayfarer-Large-70B-Llama-3.3
llama
$0.7models.dev$0.716K1
DeepSeek R1 Qwen Abliteratedhuihui-ai/DeepSeek-R1-Distill-Qwen-32B-abliterated
reasoningqwen
$1.40models.dev$1.4016K1
DeepSeek R1 Llama 70B Abliteratedhuihui-ai/DeepSeek-R1-Distill-Llama-70B-abliterated
reasoningdeepseek
$0.7models.dev$0.716K1
MiniMax-M2.5-fastMiniMaxAI/MiniMax-M2.5-fast
reasoningtoolsopen
$0.3models.dev$1.208K1
Osmosis Structure 0.6Bosmosis/osmosis-structure-0.6b
toolsopenosmosis
$0.1models.dev$0.54K1
Qwen2.5 72B Instructqwen/qwen-2.5-72b-instruct
toolsopenqwen
$0.062models.dev$0.231131K8
Auto model (Premium)nano-gpt/auto-model-premium
$10models.dev$19.991M1
Auto model (Standard)nano-gpt/auto-model-standard
$10models.dev$19.991M1
Llama 3.1 70B Instructmeta-llama/llama-3.1-70b-instruct
toolsopenllama
$0.4models.dev$0.4131K3
Mistral Nemomistralai/mistral-nemo
reasoningtoolsvisionopenmistral-nemo
$0models.dev$0131K11
Qwen Coder Plusllmgateway/qwen-coder-plus
toolsqwen
$0.502models.dev$1131K1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash