tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,229 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,229 matches · page 5 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Google Gemini Pro Latestgemini/gemini-pro-latest
reasoningtoolsvisiongemini
$1.25LiteLLM$101.0M6
Gemini 3.5 Flash Thinkinggoogle/gemini-3.5-flash-thinking
reasoningvision
$1.50models.dev$91.0M1
Google: Gemini 3.1 Flash Litegemini/gemini-3.1-flash-lite
reasoningtoolsvisiongemini-flash-lite
$0models.dev$01.0M20
Google: Gemini 3.5 Flash Litegemini/gemini-3.5-flash-lite
scoresreasoningtoolsvisiongemini-flash-lite
$0.3models.dev$2.501.0M14
Google: Gemini 3.6 Flashgemini/gemini-3.6-flash
scoresreasoningtoolsvisiongemini-flash
$1.50models.dev$7.501.0M15
Google Gemini Flash Latestgemini/gemini-flash-latest
reasoningtoolsvisiongemini-flash
$0.3LiteLLM$2.501.0M9
Google: Gemini Flash-Lite Latestgemini/gemini-flash-lite-latest
reasoningtoolsvisiongemini-flash-lite
$0.1LiteLLM$0.41.0M7
Kimi K3 (Free)moonshotai/kimi-k3-free
reasoningtoolsvisionopenkimi-k3
$0models.dev$01.0M1
Kimi K3 TEEmoonshotai/Kimi-K3-TEE
reasoningtoolsvisionopenkimi-k3
$3models.dev$151.0M1
Moonshot: Kimi K3 Fastmoonshotai/kimi-k3-fast
scoresreasoningtoolsvisionopenkimi-k3
$4.50models.dev$22.501.0M3
MoonshotAI Kimi Latestmoonshot/kimi-latest
reasoningtoolsvisionkimi
$0.5models.dev$2.601.0M5
Kimi K3kimi-for-coding/k3
scoresreasoningtoolsvisionopenkimi-k3
$0models.dev$01.0M1
Meta: Muse Spark 1.1meta/muse-spark-1.1
scoresreasoningtoolsvisionmuse
$1.25models.dev$4.251.0M9
MiniMax M3minimax/minimax-m3
scoresreasoningtoolsvisionopenminimax
$0models.dev$01.0M34
Claw Lownano-gpt/claw-low
reasoningtoolsvision
$0.25models.dev$1.501.0M1
GLM 5.2 TEEzai-org/GLM-5.2-TEE
reasoningtoolsopenglm
$1.25models.dev$3.951.0M1
GLM5.2-Fastwafer.ai/glm5.2-fast
reasoningtoolsopenglm
$3models.dev$10.251.0M1
Hermes Lownano-gpt/hermes-low
reasoningtoolsvision
$0.25models.dev$1.501.0M1
Inklingvenice/inkling
scoresreasoningtoolsvisionopenling
$0models.dev$01.0M12
Laguna S 2.1poolside/laguna-s-2.1
reasoningtoolsopenlaguna-s
$0models.dev$01.0M4
MiMo-V2.5-Pro-UltraSpeedxiaomi/mimo-v2.5-pro-ultraspeed
reasoningtoolsopenmimo
$1.30models.dev$2.611.0M1
GLM 5.2 Fastneuralwatt/glm-5.2-fast
toolsopenglm
$1.45models.dev$4.501.0M1
GLM 5.2 Flexneuralwatt/glm-5.2-flex
reasoningtoolsopenglm
$0.725models.dev$2.251.0M1
GPT-5.5venice/openai-gpt-55
scoresreasoningtoolsvisiongpt
$6.25models.dev$37.501M1
MiniMax M3 Previewvenice/minimax-m3-preview
reasoningtoolsvisionopenminimax-m3
$0.3models.dev$1.20524K1
GPT-5.4venice/openai-gpt-54
scoresreasoningtoolsvisiongpt
$3.13models.dev$18.801M1
GPT-5.5 Provenice/openai-gpt-55-pro
reasoningtoolsvisiongpt
$37.50models.dev$2251M1
GPT-5.6 Sol Provenice/openai-gpt-56-sol-pro
reasoningtoolsvisiongpt-sol
$6.25models.dev$37.501M1
GPT-5.6 Terravenice/openai-gpt-56-terra
scoresreasoningtoolsvisiongpt-terra
$3.13models.dev$18.751M1
GPT-5.6 Terra Provenice/openai-gpt-56-terra-pro
reasoningtoolsvisiongpt-terra
$3.13models.dev$18.751M1
Qwen3.7 Max Thinkingnano-gpt/qwen3.7-max:thinking
reasoning
$2.50models.dev$7.501M1
Gemini Omni Flash Previewgoogle/gemini-omni-flash-preview
reasoningvisiongemini
$1.50models.dev$91M3
GLM 5.2 Fastzai/glm-5.2-fast
reasoningtoolsglm
$2.10models.dev$6.601M1
Agentic Chat (Claude Opus 5)gitlab/duo-chat-opus-5
reasoningtoolsvisionclaude-opus
$0models.dev$01M1
Laguna S 2.1 (free)poolside/laguna-s-2.1:free
reasoningtoolsopenlaguna-s
$0models.dev$0262K3
Lyria 3 Clip Previewgoogle/lyria-3-clip-preview
visionlyria
$0models.dev$01.0M4
Lyria 3 Pro Previewgoogle/lyria-3-pro-preview
visionlyria
$0models.dev$01.0M4
MiMo V2 Pro Freeopencode/mimo-v2-pro-free
reasoningtoolsopenmimo-pro-free
$0models.dev$01.0M1
Nemotron 3 Ultra 550B A55Bllmgateway/nemotron-3-ultra-550b
scoresreasoningtoolsopennemotron
$0.5models.dev$2.501.0M1
Nemotron 3 Ultra Freeopencode/nemotron-3-ultra-free
reasoningtoolsopennemotron-free
$0models.dev$01M1
Qwen3.5-Flashqwen/qwen3.5-flash-02-23
scoresreasoningtoolsvisionqwen3.5
$0.065models.dev$0.261M5
Qwen3.6 Flashqwen/qwen3.6-flash
reasoningtoolsvisionqwen3.6
$0models.dev$01M17
Qwen3.6 Plusqwen/qwen3.6-plus
scoresreasoningtoolsvisionopenqwen
$0models.dev$01M24
Qwen3.7 Maxqwen/qwen3.7-max
scoresreasoningtoolsqwen
$0models.dev$01M29
Qwen3.7 Plusqwen/qwen3.7-plus
scoresreasoningtoolsvisionqwen
$0models.dev$01M23
Qwen3.8 Maxqwen/qwen3.8-max
scoresreasoningtoolsvisionqwen
$2OpenRouter$61M5
Qwen3.8 Max Previewqwen/qwen3.8-max-preview
reasoningtoolsvisionqwen
$0models.dev$01M3
Step 3.7 Flashstepfun/step-3.7-flash
scoresreasoningtoolsvisionopenstep
$0models.dev$0262K11

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash