tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 32 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
DeepSeek V3.1alibaba-cn/deepseek-v3-1
toolsdeepseek
$0.27LiteLLM$1131K3
Kimi K2 (07/11)helicone/kimi-k2-0711
toolskimi-k2
$0.57models.dev$2.30131K1
Meta Llama 4 Scout 17B 16Ehelicone/llama-4-scout
scorestoolsvisionllama
$0.08models.dev$0.3131K2
Google: Gemma 3 4B ITgoogle/gemma-3-4b-it
scorestoolsvisionopengemma
$0models.dev$0131K9
Gemma 3 12Bneon/gemma-3-12b
toolsvisionopengemma
$0.15models.dev$0.5131K1
Llama 3.1 Nemotron Nano 8B v1nvidia/llama-3.1-nemotron-nano-8b-v1
reasoningtoolsopennemotron
$0models.dev$0131K1
DeepSeek R1 Distill Llama 70Bdeepseek-ai/deepseek-r1-distill-llama-70b
reasoningopendeepseek-thinking
$0.03models.dev$0.14131K2
Llama 4 Scout 17B 16E Instruct@cf/meta/llama-4-scout-17b-16e-instruct
scorestoolsvisionopenllama
$0.27models.dev$0.85131K2
DeepSeek R1 Fastnano-gpt/deepseek-r1-sambanova
$5models.dev$6.99128K1
Mistral Small 31 24b Instructnano-gpt/mistral-small-31-24b-instruct
vision
$0.1models.dev$0.3128K1
GLM-4 32B (0414-128k)zai/glm-4-32b-0414-128k
toolsglm
$0.1LiteLLM$0.1128K3
Llama 3.1 Nemotron 70B Instructnvidia/llama-3.1-nemotron-70b-instruct
toolsopennemotron
$0models.dev$0128K4
ERNIE 4.5 21B A3Bnovita/baidu/ernie-4.5-21B-a3b
toolsopenernie
$0.07LiteLLM$0.28120K4
ERNIE 4.5 VL 28Bnovita/baidu/ernie-4.5-vl-28b-a3b
reasoningtoolsvisionopenernie
$0.14LiteLLM$0.5633K5
DeepSeek R1 Distill Llama 70Balibaba-cn/deepseek-r1-distill-llama-70b
reasoningtoolsopendeepseek-thinking
$0.03models.dev$0.13131K5
DeepSeek V3 0324cortecs/deepseek-v3-0324
toolsopendeepseek
$0.25models.dev$0.7128K4
GPT-4o-mini-Searchopenai/gpt-4o-mini-search
toolsgpt-mini
$0.14models.dev$0.54128K1
GPT-4o-Searchopenai/gpt-4o-search
toolsgpt
$2.20models.dev$9128K1
OpenAI: GPT-4o Mini Transcribeopenai/gpt-4o-mini-transcribe
toolso-mini
$1.25models.dev$5128K5
OpenAI: GPT-4o Transcribeopenai/gpt-4o-transcribe
toolsgpt
$2.50models.dev$10128K5
Llama 3.3 70B Instruct FP8 Fastworkers-ai/@cf/meta/llama-3.3-70b-instruct-fp8-fast
toolsopenllama
$0.29models.dev$2.25128K5
Llama-3.1-Nemotron-Ultra-253B-v1nvidia/Llama-3_1-Nemotron-Ultra-253B-v1
reasoningtoolsopennemotron
$0models.dev$0128K5
bevformernvidia/bevformer
open
$0models.dev$0128K1
sparsedrivenvidia/sparsedrive
open
$0models.dev$0128K1
ASI1 Mininano-gpt/asi1-mini
$1models.dev$1128K1
BART Large CNNworkers-ai/@cf/facebook/bart-large-cnn
bart
$0models.dev$0128K1
BGE Base EN v1.5workers-ai/@cf/baai/bge-base-en-v1.5
bge
$0.005OpenRouter$0128K5
BGE Large EN v1.5workers-ai/@cf/baai/bge-large-en-v1.5
bge
$0.01OpenRouter$0128K2
BGE Reranker Baseworkers-ai/@cf/baai/bge-reranker-base
bge
$0.0031models.dev$0128K1
BGE Small EN v1.5workers-ai/@cf/baai/bge-small-en-v1.5
bge
$0.02models.dev$0128K1
DeepSeek V3/Chat Cheapernano-gpt/deepseek-chat-cheaper
tools
$0.25models.dev$0.7128K1
Mistral Large (latest)mistral/mistral-large-latest
toolsvisionopenmistral-large
$0.5models.dev$1.50262K7
Azure o1nano-gpt/azure-o1
$14.99models.dev$59.99200K1
Mistral Large 24.11mistral/mistral-large-2411
reasoningtoolsopenmistral-large
$0models.dev$0131K6
Meta: Llama-3.3-70B-Instructmeta-llama/Meta-Llama-3.3-70B-Instruct
scorestoolsopenllama
$0.5models.dev$1.50131K8
Llama 3.3 70Bcortecs/Llama-3.3-70B-Instruct-FP8-Dynamic
toolsopenllama
$0.53models.dev$0.76128K3
Command R7B (12-2024)cohere/command-r7b-12-2024
toolsopencommand-r
$0.0375models.dev$0.15128K5
Command R7B Arabiccohere/command-r7b-arabic-02-2025
toolsopencommand-r
$0.0375models.dev$0.15128K1
DeepClaudenano-gpt/deepclaude
$3models.dev$15128K1
Mistral Large Instruct 2411mistralai/Mistral-Large-Instruct-2411
toolsvisionmistral-large
$2models.dev$6128K1
Deepseek R1 Cheapernano-gpt/deepseek-reasoner-cheaper
$0.4models.dev$1.70128K1
Doubao 1.5 Thinking Pronano-gpt/doubao-1-5-thinking-pro-250415
$0.6models.dev$2.40128K1
Doubao 1.5 Thinking Pro Visionnano-gpt/doubao-1-5-thinking-pro-vision-250415
vision
$0.6models.dev$2.40128K1
Doubao 1.5 Thinking Vision Pronano-gpt/doubao-1-5-thinking-vision-pro-250428
vision
$0.55models.dev$1.43128K1
Ernie 4.5 Turbo 128knano-gpt/ernie-4.5-turbo-128k
vision
$0.132models.dev$0.55128K1
M2M100 1.2Bworkers-ai/@cf/meta/m2m100-1.2b
m2m
$0.34models.dev$0.34128K1
Llama 3.1 8B Instruct FP8workers-ai/@cf/meta/llama-3.1-8b-instruct-fp8
openllama
$0.15models.dev$0.29128K5
DistilBERT SST-2 INT8workers-ai/@cf/huggingface/distilbert-sst-2-int8
distilbert
$0.026models.dev$0128K1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash