tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and if it can do tools, vision, or reasoning. Recommended order puts known labs first, then newer releases. Free/$0 rows stay hidden unless you ask. Measure real sessions with the app or the CLI.

2,615 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · AI plans · Benchmarks

Showing 48 of 2,180 matches · page 5 of 46 · 322 free/$0 rows hidden (show them)

ModelInputOutputContextOffers
Mistral: Medium 3.5mistralai/Mistral-Medium-3.5-128B
scoresreasoningtoolsvisionopenmistral-medium
$1.50LiteLLM$7.50262K6
Mistral: Small (latest)mistral/mistral-small
reasoningtoolsvisionopenmistral-small
$0.07models.dev$0.28262K7
Mistral: Small (latest)mistral/mistral-small-latest
reasoningtoolsvisionopenlatestmistral-small
$0.15models.dev$0.6262K4
Mistral: Small 4mistral/mistral-small-2603
scoresreasoningtoolsvisionopenmistral-small
$0.075OpenRouter$0.3262K11
Mistral: Small 4mistralai/Mistral-Small-4-119B-2603
reasoningtoolsvisionopenmistral-small
$0.15models.dev$0.6262K5
NVIDIA: Nemotron 3 Nano Omninvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16
reasoningtoolsopennemotron
$0.13models.dev$0.38262K1
NVIDIA: Nemotron 3 Nano Omni 30B A3B Reasoningnvidia/nemotron-3-nano-omni-30b-a3b-reasoning-20260428
scoresreasoningtoolsvisionopennemotron
$0.2models.dev$0.8262K7
Hy3 Previewtencent/Hy3-preview
scoresreasoningtoolsopenHy
$0.066models.dev$0.26262K9
xAI: Grok Build 0.1xai/grok-build-0-1
scoresreasoningtoolsvisiongrok-build
$1models.dev$2256K20
Mistral: Code Latestmistral/mistral-code-latest
toolslatestmistral
$0.3LiteLLM$0.9256K3
NVIDIA: Nemotron 3 Nano Omni 30B A3B Reasoningnvidia/Nemotron-3-Nano-Omni-Reasoning-30B-A3B
scoresreasoningtoolsvisionopennemotron
$0.3models.dev$1.83256K1
Z.ai: GLM-5.1zai/GLM-5.1
scoresreasoningtoolsopenglm
$0.45models.dev$2.15205K74
Z.ai: GLM-5-Turbozai/glm-5-turbo
reasoningtoolsopenglm
$0.72models.dev$3.20203K21
Z.ai: GLM-5V-Turbozai/glm-5v-turbo
reasoningtoolsvisionglm
$0.7042models.dev$3.10203K21
Z.ai: GLM 5.1zai-org/GLM-5.1-FP8
scoresreasoningtoolsopenglm
$0.98models.dev$3.08203K3
Z.ai: GLM 5.1 TEEzai-org/GLM-5.1-TEE
reasoningtoolsopenglm
$0.98models.dev$3.08203K1
Google: Gemini Robotics-ER 1.6 Previewgemini/gemini-robotics-er-1.6-preview
reasoningtoolsvisiongemini
$1models.dev$5131K3
Google: gemma 4 31B turbo TEEgoogle/gemma-4-31B-turbo-TEE
reasoningtoolsvisionopengemma
$0.12models.dev$0.37131K1
Google: Gemma 4 E4B ITgoogle/gemma-4-E4B-it
reasoningtoolsvisionopengemma
$0.02models.dev$0.1131K4
Cohere: Command A Pluscohere/command-a-plus-05-2026
reasoningtoolsvisionopencommand-a
$2.50models.dev$10128K3
Hy-MT2 Plustencent/hy-mt2-plus
toolsHy
$0.074models.dev$0.2958K3
Tencent Hy-MT2-Protencent/hy-mt2-pro
Hy
$0.074models.dev$0.2958K1
Alibaba: Qwen3.5 397B A17B (Alibaba Cloud)alibaba/qwen35-397b-a17b
scoresreasoningtoolsvisionopenqwen3.5
$0.6models.dev$3.60262K2
OpenAI: gpt-realtime-2openai/gpt-realtime-2
gpt
$4models.dev$24N/A3
xAI: Grok 4.1 Fastxai/grok-4-1-fast
reasoningtoolsvisiongrok
$0.18models.dev$0.452M36
NVIDIA: Nemotron 3 Nano 30B A3B FP8nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-FP8
reasoningtoolsopennemotron
$0.06models.dev$0.251M1
Qwen3 Coder 480B A35B Instruct TurboQwen/Qwen3-Coder-480B-A35B-Instruct-Turbo
toolsopenqwen
$0.3models.dev$1262K4
Qwen3 Coder NextQwen/Qwen3-Coder-Next
scoresreasoningtoolsopenqwen
$0.108models.dev$0.675262K36
Qwen3 Coder Next (EU)qwen/qwen3-coder-next@eu
scorestoolsopenqwen
$0.3models.dev$1.50262K1
Qwen3 Coder Next FP8Qwen/Qwen3-Coder-Next-FP8
toolsopenqwen
$0.5models.dev$1.20262K4
Qwen3 Maxqwen/qwen3-max-2026-01-23
toolsqwen
$1.20models.dev$6262K3
Qwen3.5 122B-A10BQwen/Qwen3.5-122B-A10B
scoresreasoningtoolsvisionopenqwen
$0.1126LiteLLM$0.9008262K28
Qwen3.5 27BQwen/Qwen3.5-27B
reasoningtoolsvisionopenqwen
$0.086models.dev$0.688262K23
Qwen3.5 35B-A3BQwen/Qwen3.5-35B-A3B
scoresreasoningtoolsvisionopenqwen
$0.057models.dev$0.459262K26
Qwen3.5 397B A17B TEEQwen/Qwen3.5-397B-A17B-TEE
reasoningtoolsvisionopenqwen
$0.45models.dev$3262K1
Qwen3.5 397B-A17BQwen/Qwen3.5-397B-A17B
scoresreasoningtoolsvisionopenqwen
$0.1644LiteLLM$0.9864262K39
Qwen3.5 4BQwen/Qwen3.5-4B
reasoningtoolsvisionopenqwen
$0.04models.dev$0.07262K3
Qwen3.5 9BQwen/Qwen3.5-9B
scoresreasoningtoolsvisionopenqwen
$0.04models.dev$0.15262K28
Qwen3.6 27BQwen/Qwen3.6-27B
scoresreasoningtoolsvisionopenqwen
$0.15LiteLLM$0.5262K37
Qwen3.6 27B FP8Qwen/Qwen3.6-27B-FP8
reasoningtoolsvisionopenqwen
$0.32LiteLLM$3.20262K4
Qwen3.6 27B TEEQwen/Qwen3.6-27B-TEE
reasoningtoolsvisionopenqwen
$0.3models.dev$2262K1
Qwen3.6 35B A3B FP8Qwen/Qwen3.6-35B-A3B-FP8
reasoningtoolsvisionopenqwen
$0.17models.dev$1.10262K3
Qwen3.6 35B-A3BQwen/Qwen3.6-35B-A3B
scoresreasoningtoolsvisionopenqwen
$0.07models.dev$0.42262K38
NVIDIA: Nemotron 3 Nano 30B A3Bnvidia/NVIDIA-Nemotron-3-Nano-30B-A3B
scoresreasoningtoolsopennemotron
$0.05models.dev$0.2262K17
MiniMax: M2.7MiniMax/MiniMax-M2.7
scoresreasoningtoolsopenminimax
$0.08models.dev$0.32262K56
NVIDIA: Nemotron 3 Nano 30B A3Bnvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16
scoresreasoningtoolsopennemotron
$0.05models.dev$0.2262K1
NVIDIA: Nemotron 3 Super 120Bnvidia/nemotron-3-120b-a12b
reasoningtoolsopennemotron
$0.5models.dev$1.50256K4
NVIDIA: Nemotron 3 Super 120B A12Bnvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8
scoresreasoningtoolsopennemotron
$0.09models.dev$0.45256K1

Set up a workspace and measure your agents

Download tokenstat to set up local Git-enabled workspaces, bring remote terminals and desktops into one window, and track the tokens from your own sessions.

CLI for macOS, Linux, and Windows