tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 2,670 matches · page 29 of 56 · 561 free/$0 rows hidden (show them)

ModelInputOutputContextOffers
Mistral: Pixtral 12Bmistral/pixtral-12b
toolsvisionopenpixtral
$0.15models.dev$0.15128K4
Pixtral Large (latest)mistral/pixtral-large-latest
toolsvisionopenpixtral
$2models.dev$6128K3
GPT-4o-Augopenai/gpt-4o-aug
toolsvisiongpt
$2.20models.dev$9128K1
OpenAI: GPT-4o (2024-11-20)openai/gpt-4o-2024-11-20
toolsvisiongpt
$2.50models.dev$10128K14
OpenAI: GPT-4o Mini Search Previewopenai/gpt-4o-mini-search-preview
visiongpt-mini
$0.088models.dev$0.35128K4
GPT-4-Classic-0314openai/gpt-4-classic-0314
toolsvisiongpt
$27models.dev$548K1
OpenAI: GPT-4o (2024-05-13)openai/gpt-4o-2024-05-13
scorestoolsvisiongpt
$5models.dev$15128K7
OpenAI: GPT-4o (2024-08-06)openai/gpt-4o-2024-08-06
toolsvisiongpt
$2.50models.dev$10128K13
OpenAI: GPT-4o Search Previewopenai/gpt-4o-search-preview
visiongpt
$1.47models.dev$5.88128K3
Llama-3.3-70B-Instructnvidia/Llama-3.3-70B-Instruct-FP8
scorestoolsopenllama
$1.15models.dev$1.15128K1
Qwen2.5 Coder 32B Instructqwen/qwen-2.5-coder-32b-instruct
openqwen
$0.18LiteLLM$0.1833K5
Gemini 2.0 Flash Thinking 1219nano-gpt/gemini-2.0-flash-thinking-exp-1219
$0.1003models.dev$0.40833K1
DeepSeek R1 Qwen Abliteratedhuihui-ai/DeepSeek-R1-Distill-Qwen-32B-abliterated
reasoningqwen
$1.40models.dev$1.4016K1
Step 2 (16K)stepfun-ai/step-2-16k
tools
$5.21models.dev$16.4416K2
DeepSeek R1 Llama 70B Abliteratedhuihui-ai/DeepSeek-R1-Distill-Llama-70B-abliterated
reasoningdeepseek
$0.7models.dev$0.716K1
Sao10K Stheno 8bnovita/Sao10K/L3-8B-Stheno-v3.2
toolsopenllama
$0.05LiteLLM$0.0516K5
Llama 3.1 70B Celeste v0.1nothingiisreal/L3.1-70B-Celeste-V0.1-BF16
llama
$0.493models.dev$0.49316K1
L31 70B Euryale V2.2novita/sao10k/l31-70b-euryale-v2.2
toolsopen
$1.48LiteLLM$1.488K4
Neural Daredevil 8B abliteratedmlabonne/NeuralDaredevil-8B-abliterated
llama
$0.44models.dev$0.448K1
Sao10k L3 8B Lunarisnovita/sao10k/l3-8b-lunaris
open
$0.05LiteLLM$0.058K4
GLM Zero Previewnano-gpt/glm-zero-preview
$1.80models.dev$1.808K1
Green Sgreenpt/green-s
$0.0044models.dev$01
Green S Progreenpt/green-s-pro
$0.0044models.dev$01
Stable Diffusion 3.5 Largedigitalocean/stable-diffusion-3.5-large
openstable-diffusion
$0.08models.dev$02561
Gemini 1.5 Flashgoogle/gemini-flash-1.5
gemini-flash
$0.0748models.dev$0.3062M1
GLM-4 Longnano-gpt/glm-4-long
$0.2006models.dev$0.20061M1
Auto model (Basic)nano-gpt/auto-model-basic
$10models.dev$19.991M1
Auto model (Premium)nano-gpt/auto-model-premium
$10models.dev$19.991M1
Auto model (Standard)nano-gpt/auto-model-standard
$10models.dev$19.991M1
Claude 3.5 Sonnetdigitalocean/anthropic-claude-3.5-sonnet
toolsvisionclaude-sonnet
$3models.dev$15200K4
Mistral Nemo Instructmistralai/Mistral-Nemo-Instruct-2407
reasoningtoolsopenmistral-nemo
$0.02models.dev$0.03131K15
Llama 3.1 Euryale 70B v2.2sao10k/l3.1-euryale-70b
toolsopenllama
$0.85models.dev$0.85131K2
Llama 3.1 8B Instructmeta-llama/llama-3.1-8b-instruct
scoresreasoningtoolsopenllama
$0.02models.dev$0.04131K9
Llama 3.1 8Bgroq/llama-3.1-8b-instant
scorestoolsopenllama
$0.05models.dev$0.08131K3
Llama 3.1 Instruct (8B)digitalocean/llama3-8b-instruct
toolsopenllama
$0.198models.dev$0.198131K3
Hermes 2 Pro Llama 3 8Bhelicone/hermes-2-pro-llama-3-8b
toolsopenllama
$0.14models.dev$0.14131K5
Pixtral 12Bgreenpt/pixtral-12b-2409
toolsvisionopenpixtral
$0.15LiteLLM$0.15128K3
Meta: Llama 3.1 405B Instruct Turbometa-llama/Meta-Llama-3.1-405B-Instruct-Turbo
toolsopenllama
$3.50models.dev$3.50128K4
Llama 3.1 70B Instructllmgateway/llama-3.1-70b-instruct
openllama
$0.72models.dev$0.72128K2
Llama 3.2 11B Instructllmgateway/llama-3.2-11b-instruct
openllama
$0.07models.dev$0.33128K1
Ministral 3B (latest)mistral/ministral-3b-latest
toolsopenministral
$0.04models.dev$0.04128K1
Ministral 8B (latest)mistral/ministral-8b-latest
toolsopenministral
$0.1models.dev$0.1128K3
Mistral: Ministral 8B (latest)mistral/ministral-8b
toolsopenministral
$0.1models.dev$0.1128K4
Mistral: Codestral (latest)mistral/codestral
toolsopencodestral
$0.3models.dev$0.9256K4
GLM-4 Airnano-gpt/glm-4-air
$0.2006models.dev$0.2006128K1
GLM-4 Flashnano-gpt/glm-4-flash
$0.1003models.dev$0.1003128K1
GLM-4 Plusnano-gpt/glm-4-plus
$7.50models.dev$7.50128K1
OpenAI: GPT-4o-mini (2024-07-18)openai/gpt-4o-mini-2024-07-18
scorestoolsvisiongpt
$0.15models.dev$0.6128K6

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash