tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,229 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 2,668 matches · page 6 of 56 · 561 free/$0 rows hidden (show them)

ModelInputOutputContextOffers
Seed 2.1 Turbovenice/seed-2-1-turbo
reasoningtoolsvisionseed
$0.625models.dev$3.13256K1
GPT-5.2venice/openai-gpt-52
reasoningtoolsgpt
$2.19models.dev$17.50256K1
MiniMax M2.5venice/minimax-m25
reasoningtoolsopenminimax
$0.27models.dev$0.95205K2
GLM 4.7 Flash Hereticvenice/olafangensan-glm-4.7-flash-heretic
reasoningtoolsopenglm
$0.07models.dev$0.4200K1
GLM 5 Turbovenice/z-ai-glm-5-turbo
reasoningtoolsopenglm
$1.20models.dev$4200K1
GLM 5.1venice/zai-org-glm-5-1
scoresreasoningtoolsopenglm
$1.54models.dev$4.84200K1
GLM 5V Turbovenice/z-ai-glm-5v-turbo
reasoningtoolsvisionglm
$1.50models.dev$5200K1
Doubao-Seed-1.8volcengine/doubao-seed-1.8
reasoningtoolsvision
$0.11models.dev$0.28256K1
Doubao-Seed-2.0-litevolcengine/doubao-seed-2.0-lite
reasoningtoolsvision
$0.09models.dev$0.51256K1
GLM 4.7venice/zai-org-glm-4.7
scoresreasoningtoolsopenglm
$0.55models.dev$2.65198K1
GLM 5venice/zai-org-glm-5
reasoningtoolsopenglm
$1models.dev$3.20198K1
MiniMax M2.7venice/minimax-m27
scoresreasoningtoolsopenminimax
$0.375models.dev$1.50198K1
solar-pro3upstage/solar-pro3
reasoningtoolssolar-pro
$0.25models.dev$0.25131K1
GLM 4.7 Flashvenice/zai-org-glm-4.7-flash
reasoningtoolsopenglm
$0.06models.dev$0.4128K1
GPT-4ovenice/openai-gpt-4o-2024-11-20
toolsvisiongpt
$3.13models.dev$12.50128K1
GPT-4o Minivenice/openai-gpt-4o-mini-2024-07-18
scorestoolsvisiongpt
$0.1875models.dev$0.75128K1
Solar Pro 3upstage/solar-pro-3
scoresreasoningtoolssolar-pro
$0.15models.dev$0.6128K3
Venice Role Play Uncensoredvenice/venice-uncensored-role-play
toolsvisionopenvenice
$0.5models.dev$2128K1
Venice Uncensored 1.2venice/venice-uncensored-1-2
toolsvisionopenvenice
$0.2models.dev$0.9128K1
TIM-Qwen3.6 27Bsubconscious/tim-qwen3.6-27b
reasoningtools
$0.3models.dev$38K1
anthropic--claude-4.6-opussap-ai-core/anthropic--claude-4.6-opus
reasoningtoolsvisionclaude-opus
$5models.dev$251M1
anthropic--claude-4.7-opussap-ai-core/anthropic--claude-4.7-opus
reasoningtoolsvisionclaude-opus
$5models.dev$251M1
anthropic--claude-4.8-opussap-ai-core/anthropic--claude-4.8-opus
reasoningtoolsvisionclaude-opus
$5models.dev$251M1
Qwen3.5 Plus 2026-02-15qwen/qwen3.5-plus-02-15
reasoningtoolsvisionqwen3.5
$0.26models.dev$1.561M5
Qwen3.5-Flashqwen/qwen3.5-flash-02-23
scoresreasoningtoolsvisionqwen3.5
$0.065models.dev$0.261M5
Xpersona Frieren 1xpersona/xpersona-frieren-coder
reasoningtoolsvision
$1.50models.dev$61M1
Qwen3.5 Plus Thinkingqwen/qwen3.5-plus-thinking
reasoningvision
$0.4models.dev$2.40984K1
GPT-5.5 Instantopenai/gpt-5.5-instant
reasoningtoolsvision
$5models.dev$30400K1
Qwen3.6 35B A3B Thinkingqwen/Qwen3.6-35B-A3B:thinking
reasoningvision
$0.112models.dev$0.8262K1
Qwen3.6 Max Previewqwen/qwen3.6-max-preview
reasoningtoolsqwen
$1.03models.dev$6.16262K10
GPT-Realtime-2.1openai/gpt-realtime-2.1
reasoningtoolsvisiongpt
$4models.dev$24128K3
OpenAI: GPT-5.3 Chat Latestopenai/gpt-5.3-chat-latest
reasoningtoolsvisiongpt
$1.75models.dev$14400K6
OpenAI: GPT-5.3 Codexopenai/gpt-5.3-codex
reasoningtoolsvisiongpt-codex
$1.60models.dev$13400K25
OpenAI: GPT Chat Latestopenai/gpt-chat-latest
reasoningtoolsvisiongpt
$5models.dev$30400K5
OpenAI GPT Mini Latest~openai/gpt-mini-latest
reasoningtoolsvisiongpt-mini
$0.75models.dev$4.50400K2
GPT-5.4 Image 2openai/gpt-5.4-image-2
reasoningvisiongpt
$8models.dev$15272K2
MiMo V2 Omnixiaomi/mimo-v2-omni
reasoningtoolsvisionopenmimo
$0.14models.dev$0.28265K4
Kimi K2.7 Code Flexneuralwatt/kimi-k2.7-code-flex
reasoningtoolsvisionopenkimi-k2
$0.475models.dev$2262K1
Nemotron Nano 3 Omninvidia/Nemotron-3-Nano-Omni
reasoningtoolsvisionopennemotron
$0.06models.dev$0.24262K3
Nemotron Ultranvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B
reasoningtoolsopennemotron
$0.6models.dev$2.40262K3
Google: Gemini 3.1 Pro Preview Custom Toolsgoogle/gemini-3.1-pro
reasoningtoolsvisiongemini-pro
$2models.dev$121.0M4
Qwen3.5 Flash Thinkingnano-gpt/qwen3.5-flash:thinking
reasoningvision
$0.09models.dev$0.36992K1
Gemma 4 26B A4B Thinkinggoogle/gemma-4-26b-a4b-it:thinking
reasoningvision
$0.13models.dev$0.4262K1
Gemma 4 31B Thinkinggoogle/gemma-4-31b-it:thinking
reasoningvision
$0.1models.dev$0.35262K1
Google: Gemma 4 26B A4B ITgoogle/gemma-4-26B-A4B-it
scoresreasoningtoolsvisionopengemma
$0.06models.dev$0.33262K19
NVIDIA Nemotron 3 Nano Omninvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16
reasoningtoolsopennemotron
$0.13models.dev$0.38262K1
Gemma 4 31B Fablednano-gpt/gemma-4-31B-Fabled
reasoningvision
$0.306models.dev$0.306262K1
Gemma 4 31B Garnetnano-gpt/gemma-4-31B-Garnet
reasoningvision
$0.306models.dev$0.306262K1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash