tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and if it can do tools, vision, or reasoning. Recommended order puts known labs first, then newer releases. Free/$0 rows stay hidden unless you ask. Measure real sessions with the app or the CLI.

2,616 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · AI plans · Benchmarks

Showing 48 of 1,040 matches · page 11 of 22 · 322 free/$0 rows hidden (show them) · 93 beta/latest variants hidden (show them)

ModelInputOutputContextOffers
Alibaba: Qwen 3.32Balibaba/qwen-3-32b
reasoningtoolsqwen
$0.1LiteLLM$0.3128K5
Cogito v1 Preview Qwen 32Bfireworks_ai/accounts/fireworks/models/cogito-v1-preview-qwen-32b
openqwen
$0.9LiteLLM$0.9128K4
Mistral: Devstral Small 2505mistral/devstral-small-2505
toolsopendevstral
$0.05models.dev$0.22128K6
Z.ai: GLM-4.5 AirX (Z AI)zai/glm-4.5-airx
toolsglm
$1.10models.dev$4.50128K4
Z.ai: GLM-4.5 X (Z AI)zai/glm-4.5-x
reasoningtoolsglm
$2.20models.dev$8.90128K4
Z.ai: GLM-4.5Vzai/glm-4.5v
reasoningtoolsvisionopenglm
$0.29models.dev$0.86128K20
Qwen3 Omni 30B A3B Instructqwen/qwen3-omni-30b-a3b-instruct
toolsvisionopenqwen
$0.25models.dev$0.9766K4
Qwen3 Omni 30B A3B Thinkingqwen/qwen3-omni-30b-a3b-thinking
reasoningtoolsvisionopen
$0.25models.dev$0.9766K4
OpenAI: o1-proopenai/o1-pro
reasoningtoolsvisiono-pro
$140models.dev$540200K7
xAI: Grok 3xai/grok-3
toolsgrok
$1.25LiteLLM$2.50131K9
xAI: Grok 3 Minixai/grok-3-mini
reasoningtoolsgrok
$0.25LiteLLM$1.27131K9
Qwen: QwQ Plusqwen/qwq-plus
reasoningtoolsqwen
$0.23models.dev$0.574131K7
Google: Gemma 3n E4b Itgoogle/gemma-3n-E4B-it
toolsvisionopengemma
$0.06models.dev$0.12128K4
Amazon: Voxtral Small 24B 2507 (Amazon Bedrock, US)amazon/mistral.voxtral-small-24b-2507@us
openvoxtral
$0.1models.dev$0.3128K1
Amazon: Voxtral Mini 3B 2507 (Amazon Bedrock, US)amazon/mistral.voxtral-mini-3b-2507@us
openvoxtral
$0.04models.dev$0.04128K1
Google: Nano-Bananagoogle/nano-banana
toolsvisionnano-banana
$0.21models.dev$1.8066K1
Google: Gemini Embedding 001gemini/gemini-embedding-001
gemini
$0.15LiteLLM$020K7
Qwen2.5-VL 72B InstructQwen/Qwen2.5-VL-72B-Instruct
reasoningtoolsvisionopenqwen
$0.25LiteLLM$0.75131K19
Qwen3 14BQwen/Qwen3-14B
scoresreasoningtoolsopenqwen
$0.07models.dev$0.28131K14
Qwen3 8BQwen/Qwen3-8B
scoresreasoningtoolsopenqwen
$0.04LiteLLM$0.14131K13
Qwen2.5 7B InstructQwen/Qwen2.5-7B-Instruct
toolsopenqwen
$0.04LiteLLM$0.1131K14
Qwen3 4Bqwen/qwen3-4b-fp8
reasoningopen
$0.03models.dev$0.03128K4
Z.ai: GLM-4 32B (0414-128k) (Z AI)zai/glm-4-32b-0414-128k
toolsglm
$0.1models.dev$0.1128K4
OpenAI: GPT-4o Mini Transcribeopenai/gpt-4o-mini-transcribe
toolsgpt
$1.25models.dev$5128K6
OpenAI: GPT-4o Transcribeopenai/gpt-4o-transcribe
toolsgpt
$2.50models.dev$10128K6
OpenAI: GPT-4o-mini-Searchopenai/gpt-4o-mini-search
toolsgpt-mini
$0.14models.dev$0.54128K1
OpenAI: GPT-4o-Searchopenai/gpt-4o-search
toolsgpt
$2.20models.dev$9128K1
Meta: Llama 3.3 70B Instructmeta/llama-3.3-70b-instruct-maas
scorestoolsopenllama
$0.72models.dev$0.72128K1
Qwen3 8Bqwen/qwen3-8b-fp8
scoresreasoningopen
$0.035models.dev$0.138128K4
Mistral: Voxtral Small 24B 2507mistralai/Voxtral-Small-24B-2507
toolsopenvoxtral
$0.0023models.dev$0.0023128K10
NVIDIA: Phi 4 Multimodalnvidia/phi-4-multimodal-instruct
openphi
$0.07models.dev$0.11128K4
Mistral: Voxtral Mini 3B 2507mistralai/voxtral-mini-3b-2507
toolsopenvoxtral
$0.04models.dev$0.04128K5
OpenAI: GPT-4.1openai/gpt-4.1
toolsvisiongpt
$1OpenRouter$41.0M35
OpenAI: GPT-4.1 (Fast)openai/gpt-4.1-fast
toolsvisiongpt
$3.50models.dev$141.0M1
OpenAI: GPT-4.1 Miniopenai/gpt-4.1-mini
scorestoolsvisiongpt-mini
$0.2OpenRouter$0.81.0M32
OpenAI: GPT-4.1 mini (Fast)openai/gpt-4.1-mini-fast
toolsvisiongpt-mini
$0.7models.dev$2.801.0M1
OpenAI: GPT-4.1 Nanoopenai/gpt-4.1-nano
scorestoolsvisiongpt-nano
$0.05OpenRouter$0.21.0M30
OpenAI: GPT-4.1 nano (Fast)openai/gpt-4.1-nano-fast
toolsvisiongpt-nano
$0.2models.dev$0.81.0M1
MiniMax: Text 01 (MiniMax)minimax/minimax-text-01
reasoningtoolsopenminimax
$0.2models.dev$1.101M2
NVIDIA: Llama 3.1 Nemotron 70B Instructnvidia/Llama-3.1-Nemotron-70B-Instruct
toolsopennemotron
$0.6LiteLLM$0.6131K5
Mistral: Small 3.1 24Bmistralai/mistral-small-3.1-24b-instruct
toolsvisionopenmistral-small
$0.1models.dev$0.3128K8
Meta: Llama-3.3-70B-Instructmeta/llama-3.3-70b
scorestoolsopenllama
$0.7models.dev$2.80128K8
NVIDIA: Llama 3.1 Nemotron Ultra 253Bnvidia/Llama-3.1-Nemotron-Ultra-253B-v1
reasoningtoolsopennemotron
$0.6LiteLLM$1.80128K7
Mistral: Magistral Medium (latest)mistral/magistral-medium
reasoningtoolsmagistral-medium
$2LiteLLM$5128K4
Mistral: Magistral Smallmistral/magistral-small
reasoningtoolsopenmagistral-small
$0.5models.dev$1.50128K3
Mistral: Magistral Small 2506mistral/magistral-small-2506
reasoningtoolsopenmagistral-small
$0.5models.dev$1.50128K5
Mistral: Medium 3mistral/mistral-medium
toolsvisionmistral-medium
$0.4models.dev$2128K3
Mistral: Small 3.2 (Mistral AI)mistral/mistral-small-2506
toolsvisionopenmistral-small
$0.1models.dev$0.3128K3

Set up a workspace and measure your agents

Download tokenstat to set up local Git-enabled workspaces, bring remote terminals and desktops into one window, and track the tokens from your own sessions.

CLI for macOS, Linux, and Windows