tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and if it can do tools, vision, or reasoning. Recommended order puts known labs first, then newer releases. Free/$0 rows stay hidden unless you ask. Measure real sessions with the app or the CLI.

2,616 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · AI plans · Benchmarks

Showing 48 of 2,089 matches · page 12 of 44 · 322 free/$0 rows hidden (show them) · 93 beta/latest variants hidden (show them)

ModelInputOutputContextOffers
Mistral: Medium 3mistral/mistral-medium
toolsvisionmistral-medium
$0.4models.dev$2128K3
OpenAI: o1openai/o1
scoresreasoningtoolsvisiono
$14models.dev$54200K17
Qwen2.5-VL 72B InstructQwen/Qwen2.5-VL-72B-Instruct
reasoningtoolsvisionopenqwen
$0.25LiteLLM$0.75131K19
Qwen3 14BQwen/Qwen3-14B
scoresreasoningtoolsopenqwen
$0.07models.dev$0.28131K14
Qwen3 8BQwen/Qwen3-8B
scoresreasoningtoolsopenqwen
$0.04LiteLLM$0.14131K13
Qwen2.5 7B InstructQwen/Qwen2.5-7B-Instruct
toolsopenqwen
$0.04LiteLLM$0.1131K14
Qwen3 4Bqwen/qwen3-4b-fp8
reasoningopen
$0.03models.dev$0.03128K4
Perplexity: Sonarperplexity/sonar
reasoningtoolsvisionsonar
$0.25models.dev$2.50130K17
OpenAI: O1 Miniopenai/o1-mini
o-mini
$1.10LiteLLM$4.40128K8
Mistral: Small 3.1mistralai/mistral-small-2503
toolsvisionmistral-small
$0.1LiteLLM$0.3128K8
Perplexity: Sonar Deep Researchperplexity/sonar-deep-research
reasoningsonar-deep-research
$2models.dev$8128K8
Perplexity: Sonar Reasoning Properplexity/sonar-reasoning-pro
reasoningvisionsonar-reasoning
$2models.dev$8128K10
Amazon: Gemma 3 12B IT (Amazon Bedrock, US)amazon/google.gemma-3-12b-it@us
scoresvisionopengemma
$0.09models.dev$0.29128K1
Amazon: Gemma 3 27B IT (Amazon Bedrock, US)amazon/google.gemma-3-27b-it@us
scoresvisionopengemma
$0.23models.dev$0.38128K1
Amazon: Gemma 3 4B IT (Amazon Bedrock, US)amazon/google.gemma-3-4b-it@us
scoresvisionopengemma
$0.04models.dev$0.08128K1
Amazon: Nova Micro 1.0amazon/nova-micro-v1
reasoningtoolsvisionnova-micro
$0.035models.dev$0.14128K6
Mistral-7B-Instruct-v0.3mistralai/mistral-7b-instruct-v0.3
reasoningtoolsopen
$0.1LiteLLM$0.1127K8
Alibaba: Qwen3-30B-A3Balibaba/qwen-3-30b
reasoningtoolsqwen
$0.1LiteLLM$0.341K4
Mistral: Large 2402mistral/mistral-large-2402
reasoningtools
$4LiteLLM$1232K4
Mistral: 7b Instruct V0.2mistralai/mistral-7b-instruct-v0.2
$0.05LiteLLM$0.2532K16
DeepSeek: R1 Distill Qwen 32Bdeepseek/deepseek-r1-distill-qwen-32b
reasoningtoolsopendeepseek-thinking
$0.15LiteLLM$0.1580K14
DeepSeek: R1 (Turbo)deepseek/deepseek-r1-turbo
reasoningtoolsopen
$0.7models.dev$2.5064K7
DeepSeek: V3 (Turbo)deepseek/deepseek-v3-turbo
toolsopen
$0.4models.dev$1.3064K4
Qwen3 32B TEEQwen/Qwen3-32B-TEE
reasoningtoolsopenqwen
$0.104models.dev$0.41641K1
Qwen3 Reranker 0.6BQwen/Qwen3-Reranker-0.6B
openqwen
$0.01models.dev$0.0141K4
Qwen3 Embedding 8BQwen/Qwen3-Embedding-8B
opentext-embedding
$0.01models.dev$041K15
Qwen3 4B InstructQwen/Qwen3-4B-Instruct-2507
reasoningtools
$0.2models.dev$0.233K4
Alibaba: Qwen3-14Balibaba/qwen-3-14b
scoresreasoningtoolsqwen
$0.08LiteLLM$0.2441K4
Qwen3 4B BaseQwen/Qwen3-4B-Base
reasoningtools
$0.15models.dev$0.1533K1
Qwen3 Embedding 0.6BQwen/Qwen3-Embedding-0.6B
opentext-embedding
$0.01models.dev$0.0133K10
Qwen3 Embedding 4BQwen/Qwen3-Embedding-4B
openqwen
$0.01models.dev$033K7
Qwen3 1.7B BaseQwen/Qwen3-1.7B-Base
reasoningtools
$0.1models.dev$0.133K1
Google: Gemma 3 4B (Pretrained)google/gemma-3-4b-pt
reasoningtools
$0.15models.dev$0.1533K1
Alibaba: Qwen-Omni Turbo Realtimealibaba/qwen-omni-turbo-realtime
toolsvisionqwen
$0.23models.dev$0.91833K2
Google: Gemini Embedding 001gemini/gemini-embedding-001
gemini
$0.15LiteLLM$020K7
NVIDIA: Nemotron 70bnvidia/Llama-3.1-Nemotron-70B-Instruct-HF
opennemotron
$0.357models.dev$0.40816K4
Google: Gemini 2.5 Flash Preview TTSgemini/gemini-2.5-flash-preview-tts
gemini-flash
$0.5models.dev$108K4
Google: Gemini 2.5 Pro Preview TTSgemini/gemini-2.5-pro-preview-tts
gemini-flash
$1models.dev$208K3
Meta: Llama Prompt Guard 2 22Mmeta-llama/llama-prompt-guard-2-22m
openllama
$0.01models.dev$0.015124
Meta: Prompt Guard 2 86Mmeta-llama/llama-prompt-guard-2-86m
openllama
$0.01models.dev$0.015124
Google: gemini/gemini-exp-1206gemini/gemini-exp-1206
visiongemini
$0.3LiteLLM$2.502.1M3
MiniMax-01minimax/minimax-01
visionopenminimax
$0.1394models.dev$1.121.0M5
Qwen: Turboqwen/qwen-turbo
reasoningtoolsqwen
$0.043models.dev$0.091M9
Google: Gemini-2.0-Flashgemini/gemini-2.0-flash
toolsvisiongemini-flash
$0.1LiteLLM$0.4990K5
Amazon: Nova Liteamazon/amazon.nova-lite-v1:0
toolsvisionnova-lite
$0.06models.dev$0.24300K11
Amazon: Nova Liteamazon/nova-lite
toolsvisionnova-lite
$0.06models.dev$0.24300K4
Amazon: Nova Lite (US)amazon/amazon.nova-lite-v1:0@us
toolsvisionnova-lite
$0.06models.dev$0.24300K1
Amazon: Nova Proamazon/amazon.nova-pro-v1:0
toolsvisionnova-pro
$0.8models.dev$3.20300K12

Set up a workspace and measure your agents

Download tokenstat to set up local Git-enabled workspaces, bring remote terminals and desktops into one window, and track the tokens from your own sessions.

CLI for macOS, Linux, and Windows