tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and if it can do tools, vision, or reasoning. Recommended order puts known labs first, then newer releases. Free/$0 rows stay hidden unless you ask. Measure real sessions with the app or the CLI.

2,616 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · AI plans · Benchmarks

Showing 48 of 2,405 matches · page 7 of 51 · 97 beta/latest variants hidden (show them) · including free/$0 list rates

ModelInputOutputContextOffers
Mistral: Small 3.2 24Bmistralai/mistral-small-3.2-24b-instruct
toolsvisionopenmistral-small
$0.0938models.dev$0.25256K6
Mistral: Ministral 3 3B 2512mistral/ministral-3b-2512
scorestoolsvisionopenministral
$0.1models.dev$0.1256K9
MiniMax: M2.5minimax/MiniMax-M2.5
reasoningtoolsvisionopenminimax
$0.15models.dev$1.15229K70
MiniMax-M2.5 Lightningminimax/MiniMax-M2.5-lightning
reasoningtoolsopenminimax
$0.3models.dev$2.40205K4
MiniMax-M2.7-highspeedminimax/minimax-m2.7-highspeed
reasoningtoolsopenminimax
$0.3models.dev$1.20205K19
Mistral: Large 3mistral/mistral-large-2512
scorestoolsvisionopenmistral-large
$0.5models.dev$1.50262K10
Mistral: Small (latest)mistral/mistral-small
reasoningtoolsvisionopenmistral-small
$0.07models.dev$0.28262K7
Mistral: Small 4mistral/mistral-small-2603
scoresreasoningtoolsvisionopenmistral-small
$0.075OpenRouter$0.3262K11
Mistral: Large 3mistral/mistral-large-3
toolsvisionopenmistral-large
$0.5models.dev$1.50262K5
MiniMax: M2.1minimax/MiniMax-M2.1
reasoningtoolsopenminimax
$0.27models.dev$1.10205K47
MiniMax: M2.1 Lightning (MiniMax)minimax/MiniMax-M2.1-lightning
reasoningtoolsopenminimax
$0.12models.dev$0.48205K6
MiniMax: M2.5 Highspeed (MiniMax)minimax/MiniMax-M2.5-highspeed
reasoningtoolsopenminimax
$0.6models.dev$2.40205K12
MiniMax: M2.7 Turbominimax/minimax-m2.7-turbo
reasoningtoolsopenminimax-m2.7
$0.38LiteLLM$1.70205K4
Mistral: Ministral 14Bmistral/ministral-14b
toolsvisionopenministral
$0.2models.dev$0.2262K2
Mistral: GLM-5mistral/zai-glm-5
reasoningtoolsopenglm
$1models.dev$3.20203K7
GLM 4.7 Originalz-ai/glm-4.7-original
reasoningtoolsopenglm
$0.6models.dev$2.20200K2
GLM-4.6V-Flashz-ai/glm-4.6v-flash
reasoningtoolsvisionopenglm-flash
$0.0218models.dev$0.2184200K4
Z.ai: GLM-4.6Vzai/glm-4.6v
scoresreasoningtoolsvisionopenglm
$0.145models.dev$0.43200K15
Z.ai: GLM-4.7zai-org/glm-4.7-maas
scoresreasoningtoolsopenglm
$0.6models.dev$2.20200K4
Z.ai: GLM-4.7 FlashX (Z AI)zai/glm-4.7-flashx
reasoningtoolsopenglm-flash
$0.06models.dev$0.4200K8
Perplexity: Sonar Pro Searchperplexity/sonar-pro-search
reasoningvisionsonar-pro
$3models.dev$15200K4
NVIDIA: DeepSeek V3.2nvidia/DeepSeek-V3.2-NVFP4
scoresreasoningtoolsopendeepseek
$0.55models.dev$1.65131K1
NVIDIA: llama-nemotron-embed-vl-1b-v2nvidia/llama-nemotron-embed-vl-1b-v2
visionopennemotron
$0models.dev$0131K2
OpenAI: GPT-5.3 Chatopenai/gpt-5.3-chat
tools
$1.75models.dev$14128K6
OpenAI: GPT-4o (2024-11-20)openai/gpt-4o-2024-11-20
toolsvisiongpt
$2.50models.dev$10128K16
OpenAI: GPT-4o-mini (2024-07-18)openai/gpt-4o-mini-2024-07-18
scorestoolsvisiongpt
$0.15models.dev$0.6128K9
NVIDIA: gliner-piinvidia/gliner-pii
open
$0models.dev$0128K1
NVIDIA: nemotron-3-content-safetynvidia/nemotron-3-content-safety
opennemotron
$0models.dev$0128K1
OpenAI: GPT 5.1 Thinking (Fast)openai/gpt-5.1-thinking-fast
reasoningtoolsvisiongpt
$2.50models.dev$20400K1
OpenAI: GPT 5.2 (Fast)openai/gpt-5.2-fast
reasoningtoolsvisiongpt
$3.50models.dev$28400K1
OpenAI: GPT-5.1 Chatopenai/gpt-5.1-chat
toolsvision
$1.25models.dev$10128K7
NVIDIA: nemotron-content-safety-reasoning-4bnvidia/nemotron-content-safety-reasoning-4b
reasoningopennemotron
$0models.dev$0128K1
NVIDIA: nemotron-voicechatnvidia/nemotron-voicechat
toolsopennemotron
$0models.dev$0128K1
NVIDIA: Llama Nemotron Rerank VL 1B V2 (free)nvidia/llama-nemotron-rerank-vl-1b-v2
visionopennemotron
$0models.dev$0128K2
NVIDIA: Active Speaker Detectionnvidia/active-speaker-detection
open
$0models.dev$0N/A1
NVIDIA: synthetic-video-detectornvidia/synthetic-video-detector
open
$0models.dev$0N/A1
OpenAI: GPT OSS Safeguard 120Bopenai/gpt-oss-safeguard-120b
reasoningtoolsopengpt-oss
$0.15models.dev$0.6131K10
Trinity Minitogether_ai/arcee-ai/trinity-mini
reasoningtoolsopentrinity
$0.045LiteLLM$0.15131K4
NVIDIA: Cosmos Reason2 8Bnvidia/cosmos-reason2-8b
reasoningtoolsvisionopen
$0models.dev$0131K1
GLM 4.6V Originalz-ai/glm-4.6v-original
visionopenglm
$0.6models.dev$0.9128K1
Z.ai: GLM-4.6V FlashX (Z AI)zai/glm-4.6v-flashx
reasoningtoolsvisionglm-flash
$0.04models.dev$0.4128K2
OpenAI: GPT Audioopenai/gpt-audio
toolsgpt
$2.50models.dev$10128K4
OpenAI: GPT Audio Miniopenai/gpt-audio-mini
toolsgpt
$0.6models.dev$2.40128K5
OpenAI: GPT Image 1 Miniopenai/gpt-image-1-mini
visiongpt-image
$2models.dev$8400K2
NVIDIA: riva-translate-4b-instruct-v1_1nvidia/riva-translate-4b-instruct-v1.1
open
$0models.dev$0128K1
NVIDIA: usdcodenvidia/usdcode
$0models.dev$0128K1
Z.ai: AutoGLM-Phone-9B-Multilingualzai-org/autoglm-phone-9b-multilingual
visionopen
$0.035models.dev$0.13866K4
Qwen3 235B A22Bqwen/qwen3-235b-a22b-fp8
scoresreasoningtoolsopenqwen
$0.2models.dev$0.841K7

Set up a workspace and measure your agents

Download tokenstat to set up local Git-enabled workspaces, bring remote terminals and desktops into one window, and track the tokens from your own sessions.

CLI for macOS, Linux, and Windows