tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 31 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Mistral: Magistral Smallmistral/magistral-small
reasoningtoolsopenmagistral-small
$0.5models.dev$1.50128K4
BGE M3digitalocean/bge-m3
openbge
$0models.dev$0128K8
GLM Z1 32B 0414THUDM/GLM-Z1-32B-0414
glm-z
$0.2models.dev$0.2128K1
Llama-xLAM-2 70B fc-rSalesforce/Llama-xLAM-2-70b-fc-r
llama
$2.50models.dev$2.50128K1
Llama 3.1 8B Instructworkers-ai/@cf/meta/llama-3.1-8b-instruct
scoresllama
$0.28models.dev$0.83128K1
Llama-3.1-8B-CScerebras/llama-3.1-8b-cs
tools
$0.1models.dev$0.1128K1
Mistral 7B Instruct v0.1mistralai/Mistral-7B-Instruct-v0.1
mistral
$0LiteLLM$0128K9
Llama 3 8B Instructworkers-ai/@cf/meta/llama-3-8b-instruct
llama
$0.28models.dev$0.83128K1
solar-pro2upstage/solar-pro2
reasoningtoolssolar-pro
$0.25models.dev$0.2566K1
Qwen3 32B TEEQwen/Qwen3-32B-TEE
reasoningtoolsopenqwen
$0.104models.dev$0.41641K1
Qwen3 Reranker 0.6BQwen/Qwen3-Reranker-0.6B
openqwen
$0.01models.dev$0.0141K1
QwenLong L1 32BTongyi-Zhiwen/QwenLong-L1-32B
qwen
$0.14models.dev$0.6128K1
Qwen2.5 VL 72B TEETEE/qwen2.5-vl-72b-instruct
visionqwen
$0.7models.dev$0.766K1
Mistral-7B-Instruct-v0.3mistralai/mistral-7b-instruct-v0.3
reasoningtoolsopen
$0models.dev$066K5
Gemma 3 27Bgreenpt/gemma-3-27b-it
scorestoolsvisionopengemma
$0LiteLLM$040K2
Qwen3 4B BaseQwen/Qwen3-4B-Base
reasoningtools
$0.15models.dev$0.1533K1
Qwen3 Embedding 4BQwen/Qwen3-Embedding-4B
openqwen
$0models.dev$033K7
DMind-1dmind/dmind-1
gpt
$0.3models.dev$0.633K1
DMind-1-Minidmind/dmind-1-mini
gpt
$0.2models.dev$0.433K1
MM Poly 8Bclarifai/main/models/mm-poly-8b
visionmm-poly
$0.658models.dev$1.1133K1
Ernie X1 32knano-gpt/ernie-x1-32k
vision
$0.33models.dev$1.3232K1
Ernie X1 32knano-gpt/ernie-x1-32k-preview
$0.33models.dev$1.3232K1
Ernie X1 Turbo 32knano-gpt/ernie-x1-turbo-32k
vision
$0.165models.dev$0.6632K1
Google: Gemini Embedding 001gemini/gemini-embedding-001
gemini
$0.15LiteLLM$020K7
Exa (Research Pro)nano-gpt/exa-research-pro
$2.50models.dev$2.5016K1
Exa (Research)nano-gpt/exa-research
$2.50models.dev$2.508K1
GLiNER2 Basefastino/gliner2-base-v1
tools
$0.15models.dev$0.158K1
GLiNER2 Largefastino/gliner2-large-v1
tools
$0.15models.dev$0.158K1
Llama 3 70B abliteratedfailspy/Meta-Llama-3-70B-Instruct-abliterated-v3.5
llama
$0.7models.dev$0.78K1
Exa (Answer)nano-gpt/exa-answer
$2.50models.dev$2.504K1
Meta: Llama Prompt Guard 2 22Mmeta-llama/llama-prompt-guard-2-22m
openllama
$0.01models.dev$0.015122
Meta: Prompt Guard 2 86Mmeta-llama/llama-prompt-guard-2-86m
openllama
$0.01models.dev$0.015122
Gemini 2.0 Pro 0205nano-gpt/gemini-2.0-pro-exp-02-05
vision
$1.99models.dev$7.962.1M1
GPT Image 1digitalocean/openai-gpt-image-1
visiongpt-image
$5models.dev$401
Gemini 2.0 Flashgoogle/gemini-2.0-flash
toolsvisiongemini-flash
$0.1models.dev$0.41.0M4
MiniMax-01minimax/minimax-01
visionopenminimax
$0.1394models.dev$1.121.0M3
o3-minidigitalocean/openai-o3-mini
reasoningtoolso-mini
$1.10models.dev$4.40200K3
Qwerky 72Bfeatherless-ai/Qwerky-72B
qwerky
$0.5models.dev$0.532K1
Gemini 2.0 Flashnano-gpt/gemini-2.0-flash-001
toolsvision
$0.1LiteLLM$0.41M2
Gemini 2.0 Flash Thinking 0121nano-gpt/gemini-2.0-flash-thinking-exp-01-21
reasoningvision
$0.306models.dev$11M1
GPT-5.2 Codexvenice/openai-gpt-52-codex
reasoningtoolsvisiongpt
$2.19models.dev$17.50256K1
Azure o3-mininano-gpt/azure-o3-mini
$1.09models.dev$4.40200K1
o1digitalocean/openai-o1
scoresreasoningtoolsvisiono
$15models.dev$60200K1
Claude 3.7 Sonnetdigitalocean/anthropic-claude-3.7-sonnet
reasoningtoolsvisionclaude-sonnet
$3models.dev$15200K4
GLM 4 9B 0414THUDM/GLM-4-9B-0414
glm
$0.2models.dev$0.232K1
GLM Z1 9B 0414THUDM/GLM-Z1-9B-0414
glm-z
$0.2models.dev$0.232K1
Qwen3-VL 235BQwen/Qwen3-VL-235B-A22B-Instruct-FP8
toolsvisionopenqwen
$0.3LiteLLM$1.40218K4
DeepSeek-V3-0324siliconflow/deepseek-v3-0324
toolsdeepseek
$0.25models.dev$1164K1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash