tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 2,670 matches · page 20 of 56 · 561 free/$0 rows hidden (show them)

ModelInputOutputContextOffers
glm-4.5-air302ai/glm-4.5-air
reasoningtoolsopenglm-air
$0.1143models.dev$0.286131K5
GLM-4.5-Airzai-org/GLM-4.5-Air
reasoningtoolsopenglm-air
$0.1models.dev$0.5131K7
GPT OSS 120B High Throughputopenai/chat-completion/models/gpt-oss-120b-high-throughput
reasoningtoolsopengpt-oss
$0.09models.dev$0.36131K1
Mistral Medium 3.1mistralai/mistral-medium-3.1
scorestoolsvisionmistral-medium
$0.4models.dev$2131K3
Nemotron Nano 9Bnvidia/nemotron-nano-9b-v2
reasoningtoolsopennemotron
$0.06models.dev$0.23131K3
Baichuan M2 32bnovita/baichuan/baichuan-m2-32b
openbaichuan
$0.07LiteLLM$0.07131K4
Green Rgreenpt/green-r
reasoningtoolsvisionopengpt-oss
$0.399models.dev$1.08131K1
Green R Rawgreenpt/green-r-raw
reasoningtoolsvisionopengpt-oss
$0.399models.dev$1.08131K1
Hermes 4 405Bllmgateway/hermes-4-405b
reasoningtoolsopenhermes
$0.3models.dev$1.20131K5
Hunyuan A13B Instructtencent/hunyuan-a13b-instruct
reasoningtoolsopenhunyuan
$0.14models.dev$0.57131K4
ERNIE 4.5 300B A47Bbaidu/ERNIE-4.5-300B-A47B
toolsernie
$0.28models.dev$1.10131K2
DeepSeek V3.1 Terminus (Thinking)deepseek-ai/DeepSeek-V3.1-Terminus:thinking
toolsdeepseek-thinking
$0.25models.dev$0.7128K1
DeepSeek V3.1 Thinkingdeepseek-ai/DeepSeek-V3.1:thinking
deepseek-thinking
$0.2models.dev$0.7128K1
Kimi K2 0711moonshotai/kimi-k2-instruct-0711
toolskimi-k2
$0.1models.dev$2128K1
Kimi K2 0711 Instruct FP4baseten/Kimi-K2-Instruct-FP4
kimi-k2
$0.1models.dev$2128K1
Devstral Mediummistral/devstral-medium-2507
toolsopendevstral
$0.4models.dev$2128K3
Devstral Smallmistral/devstral-small-2507
toolsopendevstral
$0.1models.dev$0.3128K3
Glm 4.5 Airxzai/glm-4.5-airx
toolsglm
$0.572models.dev$1.71128K4
Glm 4.5 Xzai/glm-4.5-x
reasoningtoolsglm
$1.14models.dev$2.29128K4
Glm 4.5Vzai/glm-4.5v
reasoningtoolsvisionopenglm
$0.6models.dev$1.80128K3
GLM-4.6Vzai/glm-4.6v
reasoningtoolsvisionopenglm
$0.3models.dev$0.9128K2
GLM-4.5V302ai/glm-4.5v
reasoningtoolsvisionopenglm
$0.29models.dev$0.86128K4
Command A Visioncohere/command-a-vision-07-2025
visionopencommand-a
$2.50models.dev$10128K1
GPT-OSS-120B-CScerebras/gpt-oss-120b-cs
reasoningtools
$0.35models.dev$0.75128K1
GLM 4.5Vz-ai/glm-4.5v
reasoningtoolsvisionopenglm
$0.6models.dev$1.8066K3
GLM-4.5Vzai-org/GLM-4.5V
reasoningtoolsvisionopenglm
$0.6models.dev$1.8066K4
Llama 3.1 70B Dracarys 2abacusai/Dracarys-72B-Instruct
llama
$0.493models.dev$0.49316K1
DeepSeek OCRdeepseek-ai/deepseek-ocr/models/DeepSeek-OCR
visionopendeepseek
$0.2models.dev$0.78K1
DeepSeek-OCRdeepseek/deepseek-ocr
visionopen
$0.03models.dev$0.038K2
Qwen3 235B A22BQwen/Qwen3-235B-A22B
reasoningtoolsopenqwen
$0.18LiteLLM$0.54131K16
Uncensoredcognitivecomputations/dolphin-mistral-24b-venice-edition
openmistral
$0.2models.dev$0.9128K2
Magistral Small 2506nano-gpt/Magistral-Small-2506
$0.4models.dev$1.4033K2
Llama 4 Maverickmeta-llama/llama-4-maverick
scorestoolsvisionopenllama
$0.18models.dev$0.81.0M4
Llama 4 Maverick 17B Instructcortecs/llama-4-maverick
scorestoolsvisionopenllama
$0.124models.dev$0.6031M5
Command Acohere/command-a
scorestoolsopencommand-a
$2.50models.dev$10256K6
Command Acohere/command-a-03-2025
scorestoolsopencommand-a
$2.50models.dev$10256K3
Qwen3 Reranker 0.6BQwen/Qwen3-Reranker-0.6B
openqwen
$0.01models.dev$0.0141K1
The Drummer Cydonia 24B v4TheDrummer/Cydonia-24B-v4
$0.2006models.dev$0.241416K1
Qwen3-235B-A22B-Thinking-2507-fastQwen/Qwen3-235B-A22B-Thinking-2507-fast
reasoningtoolsopen
$0.5models.dev$28K1
Qwen3-Next-80B-A3B-Thinking-fastQwen/Qwen3-Next-80B-A3B-Thinking-fast
reasoningtoolsopen
$0.15models.dev$1.208K1
Qwen3.5-397B-A17B-fastQwen/Qwen3.5-397B-A17B-fast
reasoningtoolsopen
$0.6models.dev$3.608K1
Claude-Sonnet-3.7anthropic/claude-sonnet-3.7
reasoningtoolsvisionclaude-sonnet
$2.60models.dev$13197K1
DeepSeek V3 0324deepseek/deepseek-chat-v3-0324
scorestoolsopendeepseek
$0.14LiteLLM$0.28164K5
DeepSeek Prover v2 671Bdeepseek/deepseek-prover-v2-671b
opendeepseek
$0.7models.dev$2.50160K5
Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct
scoresreasoningtoolsopenllama
$0.05models.dev$0.23131K16
Mistral Medium 3mistral/mistral-medium-2505
toolsvisionmistral-medium
$0.4models.dev$2131K2
Virtuoso Largearcee-ai/virtuoso-large
tools
$0.75models.dev$1.20131K2
Llama 4 Scout 17B 16E Instruct@cf/meta/llama-4-scout-17b-16e-instruct
scorestoolsvisionopenllama
$0.27models.dev$0.85131K2

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash