tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 38 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Cohere Command R 08-2024cohere/cohere-command-r-08-2024
toolscommand-r
$0models.dev$0128K3
Cohere Command R+ 08-2024cohere/cohere-command-r-plus-08-2024
toolscommand-r
$0models.dev$0128K3
Command R (08-2024)cohere/command-r-08-2024
toolsopencommand-r
$0.15models.dev$0.6128K5
Command R+ (08-2024)cohere/command-r-plus-08-2024
toolsopencommand-r
$2.50models.dev$10128K6
Llama 3.1 70B Instructamazon-bedrock/meta.llama3-1-70b-instruct-v1:0
toolsopenllama
$0.72models.dev$0.72128K4
Phi-3.5-mini instruct (128k)azure_ai/Phi-3.5-mini-instruct
reasoningtoolsopenphi
$0models.dev$0128K3
Phi-3.5-MoE instruct (128k)azure_ai/Phi-3.5-MoE-instruct
reasoningtoolsopenphi
$0models.dev$0128K3
Phi-3.5-vision instruct (128k)azure_ai/Phi-3.5-vision-instruct
reasoningtoolsvisionopenphi
$0models.dev$0128K3
Llama 3.1 8B Instructmeta-llama/Meta-Llama-3.1-8B-Instruct
scorestoolsopenllama
$0.02models.dev$0.05128K2
Meta-Llama-3.1-8B-Instructmeta/meta-llama-3.1-8b-instruct
scoresreasoningtoolsopenllama
$0models.dev$0128K1
Llama 3.1 8B Instructamazon-bedrock/meta.llama3-1-8b-instruct-v1:0
scorestoolsopenllama
$0.22models.dev$0.22128K4
Meta Llama 3.1 8B Instructhelicone/llama-3.1-8b-instruct
scorestoolsllama
$0.02models.dev$0.05120K4
Qwen 2.5 7B Instruct TurboQwen/Qwen2.5-7B-Instruct-Turbo
toolsopenqwen
$0.3models.dev$0.333K1
Qwen2.5 Coder 7B fasthelicone/qwen2.5-coder-7b-fast
qwen
$0.03models.dev$0.0932K1
rerank-qa-mistral-4bnvidia/rerank-qa-mistral-4b
open
$0models.dev$0128K1
nv-embed-v1nvidia/nv-embed-v1
open
$0models.dev$033K1
Qwen 2.5 32b EVAnano-gpt/Qwen2.5-32B-EVA-v0.2
$0.493models.dev$0.49325K1
Llama 3.1 70B Celeste v0.1nothingiisreal/L3.1-70B-Celeste-V0.1-BF16
llama
$0.493models.dev$0.49316K1
Llama 3.1 70B HanamiSao10K/L3.1-70B-Hanami-x1
llama
$0.493models.dev$0.49316K1
FLUX.1-devaccounts/fireworks/models/flux-1-dev
flux
$0models.dev$04K4
KB WhisperKBLab/kb-whisper-large
openwhisper
$0.0023models.dev$0.00234481
FLUX.1-schnellaccounts/fireworks/models/flux-1-schnell
open
$0models.dev$0774
Qwen-Max-Latest302ai/qwen-max-latest
toolsvisionqwen
$0.343models.dev$1.37131K2
Phi-3-mini instruct (128k)accounts/fireworks/models/phi-3-mini-128k-instruct
reasoningtoolsopenphi
$0models.dev$0128K6
Mixtral 8x22B Instructmistralai/mixtral-8x22b-instruct
toolsopenmistral
$0models.dev$066K5
NemoMix 12B UnleashedMarinaraSpaghetti/NemoMix-Unleashed-12B
mistral-nemo
$0.493models.dev$0.49333K1
Llama 3.1 70B Euryaledeepinfra/Sao10K/L3.1-70B-Euryale-v2.2
llama
$0.306models.dev$0.35720K4
Lumimaid v0.2NeverSleep/Lumimaid-v0.2-70B
llama
$1models.dev$1.5016K1
Magnum V2 72Banthracite-org/magnum-v2-72b
llama
$2.01models.dev$2.9916K1
Mistral Nemo Inferor 12BInfermatic/MN-12B-Inferor-v0.0
mistral-nemo
$0.255models.dev$0.49316K1
Mistral Nemo Starcannon 12b v1VongolaChouko/Starcannon-Unleashed-12B-v1.0
mistral-nemo
$0.493models.dev$0.49316K1
MN-LooseCannon-12B-v1GalrionSoftworks/MN-LooseCannon-12B-v1
mistral-nemo
$0.493models.dev$0.49316K1
Llama 3.2 90B Vision Instructmeta-llama/Llama-3.2-90B-Vision-Instruct
toolsvisionopenllama
$0.35models.dev$0.416K2
Yi Lightningnano-gpt/yi-lightning
$0.2006models.dev$0.200612K1
nvidia--llama-3.2-nv-embedqa-1bsap-ai-core/nvidia--llama-3.2-nv-embedqa-1b
$0.07models.dev$08K1
Llama 3 8B Lunarissao10k/l3-lunaris-8b
openllama
$0.04models.dev$0.058K2
Inflection 3 Piinflection/inflection-3-pi
gpt
$2.50models.dev$108K1
Inflection 3 Productivityinflection/inflection-3-productivity
gpt
$2.50models.dev$108K1
OpenAI: Whisper Large V3openai/whisper-large-v3
openwhisper
$0models.dev$04486
Whisper Large V3 Turboopenai/whisper-large-v3-turbo
openwhisper
$0.0023models.dev$0.00234482
Auto modelnano-gpt/auto-model
$0models.dev$01M1
Auto model (Basic)nano-gpt/auto-model-basic
$10models.dev$19.991M1
Mistral: Codestral (latest)mistral/codestral
toolsopencodestral
$0.3models.dev$0.9256K4
Mistral: Codestral (latest)mistral/codestral-latest
toolsopencodestral
$0LiteLLM$0256K7
Yi Medium 200knano-gpt/yi-medium-200k
$2.50models.dev$2.50200K1
anthropic--claude-3-haikusap-ai-core/anthropic--claude-3-haiku
toolsvisionclaude-haiku
$0.25models.dev$1.25200K1
anthropic--claude-3-sonnetsap-ai-core/anthropic--claude-3-sonnet
toolsvisionclaude-sonnet
$3models.dev$15200K1
GLM 4.6venice/zai-org-glm-4.6
scoresreasoningtoolsopenglm
$0.43models.dev$1.75198K1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash