tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,229 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,229 matches · page 4 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Coding MiniMax M2.7aihubmix/coding-minimax-m2.7
reasoningtoolsopenminimax
$0.2models.dev$0.2205K1
Coding MiniMax M2.7 (Free)aihubmix/coding-minimax-m2.7-free
reasoningtoolsopenminimax-free
$0models.dev$0205K1
Coding MiniMax M2.7 Highspeedaihubmix/coding-minimax-m2.7-highspeed
reasoningtoolsopenminimax
$0.2models.dev$0.2205K1
Coding GLM 5.1aihubmix/coding-glm-5.1
reasoningtoolsopenglm
$0.06models.dev$0.22200K1
Coding GLM 5.1 (free)aihubmix/coding-glm-5.1-free
reasoningtoolsopenglm-free
$0models.dev$0200K1
GLM-5.1 (Alibaba Cloud)aihubmix/alicloud-glm-5.1
reasoningtoolsopenglm
$0.84models.dev$3.38200K1
Qwen 3.5 9B (MLX 4-bit)atomic-chat/Qwen3_5-9B-MLX-4bit
toolsvisionopenqwen
$0models.dev$033K1
Qwen 3.5 9B (Q4_K_M)atomic-chat/Qwen3_5-9B-Q4_K_M
toolsvisionopenqwen
$0models.dev$033K1
Gemma 4 E4B Instruct (IQ4_XS)atomic-chat/gemma-4-E4B-it-IQ4_XS
opengemma
$0models.dev$033K1
Gemma 4 E4B Instruct (MLX 4-bit)atomic-chat/gemma-4-E4B-it-MLX-4bit
opengemma
$0models.dev$033K1
Wan2.7 Imagealibaba-token-plan-cn/wan2.7-image
$0models.dev$08K2
Wan2.7 Image Proalibaba-token-plan-cn/wan2.7-image-pro
$0models.dev$08K2
HappyHorse 1.1 Image-to-Videoalibaba-token-plan-cn/happyhorse-1.1-i2v
vision
$0models.dev$02
HappyHorse 1.1 Reference-to-Videoalibaba-token-plan-cn/happyhorse-1.1-r2v
vision
$0models.dev$02
HappyHorse 1.1 Text-to-Videoalibaba-token-plan-cn/happyhorse-1.1-t2v
$0models.dev$02
Qwen3.5 Flashqwen/qwen3.5-flash
scorestoolsvision
$0.1models.dev$0.41.0M1
DeepSeek V4 Procline-pass/deepseek-v4-pro
scoresreasoningtoolsopendeepseek-thinking
$1.74models.dev$3.481M1
Claude Fable 5abacus/claude-fable-5
scoresreasoningtoolsvisionclaude-fable
$0models.dev$01M32
Claude Sonnet 5abacus/claude-sonnet-5
scoresreasoningtoolsvisionclaude-sonnet
$0models.dev$01M34
Umans Coderumans-ai-coding-plan/umans-coder
reasoningtoolsvisionopenkimi-k2
$0models.dev$0262K2
Inkling (256K)thinkingmachines/Inkling:peft:262144
reasoningtoolsvisionopenling
$3.74models.dev$9.36262K1
Grok 4.20venice/grok-4-20
reasoningtoolsvisiongrok
$1.25models.dev$2.502M6
DeepSeek V4 Prounorouter/deepseek-v4-pro:free
scoresreasoningtoolsopendeepseek-thinking
$0models.dev$01M1
GPT-5.6 Lunavenice/openai-gpt-56-luna
scoresreasoningtoolsvisiongpt-luna
$1.25models.dev$7.501M1
GPT-5.6 Luna Provenice/openai-gpt-56-luna-pro
reasoningtoolsvisiongpt-luna
$1.25models.dev$7.501M1
GPT-5.6 Solvenice/openai-gpt-56-sol
scoresreasoningtoolsvisiongpt-sol
$6.25models.dev$37.501M1
Grok 4.20 Beta Non-Reasoningxai/grok-4.20-non-reasoning-beta
toolsvisiongrok
$1.25models.dev$2.502M1
Grok 4.20 Beta Reasoningxai/grok-4.20-reasoning-beta
reasoningtoolsvisiongrok
$1.25models.dev$2.502M1
Grok 4.20 Multi Agent Betaxai/grok-4.20-multi-agent-beta
reasoningtoolsvisiongrok
$1.25models.dev$2.502M1
xAI: Grok 4.20 (Non-Reasoning)xai/grok-4.20-non-reasoning
toolsvisiongrok
$1.25models.dev$2.502M6
xAI: Grok 4.20 (Reasoning)xai/grok-4.20-reasoning
reasoningtoolsvisiongrok
$1.25models.dev$2.502M6
xAI: Grok 4.20 Beta 0309 Non Reasoningxai/grok-4.20-beta-0309-non-reasoning
toolsvisiongrok
$2LiteLLM$62M4
xAI: Grok 4.20 Beta 0309 Reasoningxai/grok-4.20-beta-0309-reasoning
reasoningtoolsvisiongrok
$2LiteLLM$62M4
xAI: Grok 4.20 Multi Agent Beta 0309xai/grok-4.20-multi-agent-beta-0309
reasoningtoolsvision
$2LiteLLM$62M3
xAI: Grok 4.20 Multi-Agentxai/grok-4.20-multi-agent
reasoningtoolsvisiongrok
$1.25models.dev$2.502M8
Grok 4.2 Fastx-ai/grok-4.2-fast
reasoningtoolsvision
$3models.dev$92M1
Grok 4.2 Fast Non Reasoningx-ai/grok-4.2-fast-non-reasoning
toolsvision
$3models.dev$92M1
GLM 5.2venice/zai-org-glm-5-2
scoresreasoningtoolsopenglm
$1.40models.dev$4.401M1
GLM-5.2unorouter/glm-5.2:free
scoresreasoningtoolsopenglm
$0models.dev$01M1
GLM 5.2umans-ai-coding-plan/umans-glm-5.2
scoresreasoningtoolsvisionopenglm
$0models.dev$0406K2
Kimi K2.7 Codeumans-ai-coding-plan/umans-kimi-k2.7
scoresreasoningtoolsvisionopenkimi-k2
$0models.dev$0262K2
GPT-5.4unorouter/gpt-5.4:free
scoresreasoningtoolsvisiongpt
$0models.dev$01.1M1
GPT-5.5unorouter/gpt-5.5:free
scoresreasoningtoolsvisiongpt
$0models.dev$01.1M1
MiMo V2.5xiaomi/mimo-v2.5
scoresreasoningtoolsvisionopenmimo
$0models.dev$01.1M23
OpenAI GPT Latest~openai/gpt-latest
reasoningtoolsvisiongpt
$5models.dev$301.1M3
GLM 5.2zai-org/GLM-5.2
scoresreasoningtoolsopenglm
$0models.dev$01.0M64
Google: Gemini 3.1 Flash Lite Previewgemini/gemini-3.1-flash-lite-preview
scoresreasoningtoolsvisiongemini-flash
$0.25LiteLLM$1.501.1M12
OWLnano-gpt/owl
tools
$0.1models.dev$0.31.0M1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash