tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and if it can do tools, vision, or reasoning. Recommended order puts known labs first, then newer releases. Free/$0 rows stay hidden unless you ask. Measure real sessions with the app or the CLI.

2,616 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · AI plans · Benchmarks

Showing 48 of 2,405 matches · page 13 of 51 · 97 beta/latest variants hidden (show them) · including free/$0 list rates

ModelInputOutputContextOffers
Perplexity: Sonar Properplexity/sonar-pro
visionsonar-pro
$3models.dev$15200K11
xAI: Grok 3xai/grok-3
toolsgrok
$1.25LiteLLM$2.50131K9
xAI: Grok 3 Minixai/grok-3-mini
reasoningtoolsgrok
$0.25LiteLLM$1.27131K9
Z.ai: GLM-4 32B (0414-128k) (Z AI)zai/glm-4-32b-0414-128k
toolsglm
$0.1models.dev$0.1128K4
OpenAI: o1openai/o1
scoresreasoningtoolsvisiono
$14models.dev$54200K17
Qwen: QwQ Plusqwen/qwq-plus
reasoningtoolsqwen
$0.23models.dev$0.574131K7
Anthropic: Claude-Haiku-3.5anthropic/claude-3.5-haiku
toolsvisionclaude-haiku
$0.68models.dev$3.40200K19
Anthropic: Claude-Sonnet-3.5-Juneanthropic/claude-sonnet-3.5-june
toolsvisionclaude-sonnet
$2.60models.dev$13189K1
Cohere: Command R7B (12-2024)cohere/command-r7b-12-2024
toolsopencommand-r
$0.0375models.dev$0.15132K6
Llama 3.3 70B Versatilegroq/llama-3.3-70b-versatile
toolsopenllama
$0.59models.dev$0.79131K4
Qwen2.5-VL 72B InstructQwen/Qwen2.5-VL-72B-Instruct
reasoningtoolsvisionopenqwen
$0.25LiteLLM$0.75131K19
Qwen3 14BQwen/Qwen3-14B
scoresreasoningtoolsopenqwen
$0.07models.dev$0.28131K14
Qwen2.5 7B InstructQwen/Qwen2.5-7B-Instruct
toolsopenqwen
$0.04LiteLLM$0.1131K14
Qwen3 8Bqwen/qwen3-8b-fp8
scoresreasoningopen
$0.035models.dev$0.138128K4
Cohere: Command R7B Arabiccohere/command-r7b-arabic-02-2025
toolsopencommand-r
$0.0375models.dev$0.15128K1
Qwen: Turboqwen/qwen-turbo
reasoningtoolsqwen
$0.043models.dev$0.091M9
Perplexity: Sonarperplexity/sonar
reasoningtoolsvisionsonar
$0.25models.dev$2.50130K17
OpenAI: O1 Miniopenai/o1-mini
o-mini
$1.10LiteLLM$4.40128K8
Mistral: Small 3.1mistralai/mistral-small-2503
toolsvisionmistral-small
$0.1LiteLLM$0.3128K8
Perplexity: Sonar Deep Researchperplexity/sonar-deep-research
reasoningsonar-deep-research
$2models.dev$8128K8
Perplexity: Sonar Reasoning Properplexity/sonar-reasoning-pro
reasoningvisionsonar-reasoning
$2models.dev$8128K10
NVIDIA: bevformernvidia/bevformer
open
$0models.dev$0128K1
NVIDIA: sparsedrivenvidia/sparsedrive
open
$0models.dev$0128K1
Mistral-7B-Instruct-v0.3mistralai/mistral-7b-instruct-v0.3
reasoningtoolsopen
$0.1LiteLLM$0.1127K8
NVIDIA: Llama 3.1 Nemotron Nano VL 8B v1nvidia/llama-3.1-nemotron-nano-vl-8b-v1
reasoningtoolsvisionopennemotron
$0models.dev$033K1
Qwen: 2.5 7B Vision Instructqwen/qwen-2.5-7b-vision-instruct
toolsvisionopenqwen
$0.2models.dev$0.2125K1
NVIDIA: nv-embedcode-7b-v1nvidia/nv-embedcode-7b-v1
open
$0models.dev$033K1
Mistral: Large 2402mistral/mistral-large-2402
reasoningtools
$4LiteLLM$1232K4
Mistral: 7b Instruct V0.2mistralai/mistral-7b-instruct-v0.2
$0.05LiteLLM$0.2532K16
NVIDIA: Nemotron 70bnvidia/Llama-3.1-Nemotron-70B-Instruct-HF
opennemotron
$0.357models.dev$0.40816K4
Meta: Llama Prompt Guard 2 22Mmeta-llama/llama-prompt-guard-2-22m
openllama
$0.01models.dev$0.015124
Meta: Prompt Guard 2 86Mmeta-llama/llama-prompt-guard-2-86m
openllama
$0.01models.dev$0.015124
MiniMax-01minimax/minimax-01
visionopenminimax
$0.1394models.dev$1.121.0M5
MiniMax: Text 01 (MiniMax)minimax/minimax-text-01
reasoningtoolsopenminimax
$0.2models.dev$1.101M2
Mistral: Magistral Medium (latest)mistral/magistral-medium
reasoningtoolsmagistral-medium
$2LiteLLM$5128K4
Mistral: Magistral Smallmistral/magistral-small
reasoningtoolsopenmagistral-small
$0.5models.dev$1.50128K3
DeepSeek: R1 Distill Llama 8Bdeepseek-ai/DeepSeek-R1-Distill-Llama-8B
reasoningtoolsdeepseek-thinking
$0.025LiteLLM$0.02533K7
DeepSeek: R1 Distill Qwen 1.5Bdeepseek-ai/DeepSeek-R1-Distill-Qwen-1.5B
reasoningtoolsqwen
$0.09LiteLLM$0.0933K8
DeepSeek: R1 Distill Qwen 7Bdeepseek-ai/DeepSeek-R1-Distill-Qwen-7B
reasoningtoolsqwen
$0.072models.dev$0.14433K6
NVIDIA: cosmos-predict1-5bnvidia/cosmos-predict1-5b
visionopen
$0models.dev$0N/A1
NVIDIA: magpie-tts-zeroshotnvidia/magpie-tts-zeroshot
open
$0models.dev$0N/A1
NVIDIA: cosmos-transfer1-7bnvidia/cosmos-transfer1-7b
visionopen
$0models.dev$0N/A1
Mistral: Large 2.1mistral/mistral-large-2411
toolsopenmistral-large
$2models.dev$6131K5
Mistral: Large 2407mistral/mistral-large-2407
toolsmistral-large
$2models.dev$6131K7
Meta: Llama 3.3 70B Turbometa-llama/Llama-3.3-70B-Instruct-Turbo
toolsopenllama
$0.1models.dev$0.32131K7
Meta: Llama-3.3-70B-Instructmeta-llama/Meta-Llama-3.3-70B-Instruct
scorestoolsopenllama
$0.5models.dev$1.50131K11
Meta: Llama 3.2 11B Vision Instructmeta/llama-3.2-11b-vision-instruct
toolsvisionopenllama
$0.0485models.dev$0.676131K16
Meta: Llama 3.2 1B Instructmeta/llama-3.2-1b-instruct
reasoningtoolsopenllama
$0.01models.dev$0.01131K17

Set up a workspace and measure your agents

Download tokenstat to set up local Git-enabled workspaces, bring remote terminals and desktops into one window, and track the tokens from your own sessions.

CLI for macOS, Linux, and Windows