tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 36 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Qwen2.5 14B Instructalibaba-cn/qwen2-5-14b-instruct
toolsopenqwen
$0.144models.dev$0.431131K2
Qwen2.5 7B Instructalibaba-cn/qwen2-5-7b-instruct
toolsopenqwen
$0.04LiteLLM$0.1131K4
Qwen2.5-VL 7B Instructalibaba-cn/qwen2-5-vl-7b-instruct
toolsvisionopenqwen
$0.287models.dev$0.717131K2
Llama 3.2 1B Instructmeta-llama/llama-3.2-1b-instruct
reasoningopenllama
$0.027models.dev$0.201131K4
Llama 3.2 3B Instructmeta-llama/llama-3.2-3b-instruct
reasoningopenllama
$0.02LiteLLM$0.02131K8
Mistral: Pixtral 12Bmistral/pixtral-12b
toolsvisionopenpixtral
$0.15models.dev$0.15128K4
Pixtral Large (latest)mistral/pixtral-large-latest
toolsvisionopenpixtral
$2models.dev$6128K3
GPT-4o-Augopenai/gpt-4o-aug
toolsvisiongpt
$2.20models.dev$9128K1
OpenAI o1-previewopenai/o1-preview
reasoningo
$0models.dev$0128K4
OpenAI: GPT-4o (2024-11-20)openai/gpt-4o-2024-11-20
toolsvisiongpt
$2.50models.dev$10128K14
OpenAI: GPT-4o Mini Search Previewopenai/gpt-4o-mini-search-preview
visiongpt-mini
$0.088models.dev$0.35128K4
OpenAI: ChatGPT-4o-Latestopenai/chatgpt-4o-latest
toolsvisiongpt
$4.50models.dev$14128K4
GPT-4-Classic-0314openai/gpt-4-classic-0314
toolsvisiongpt
$27models.dev$548K1
OpenAI: GPT-4oopenai/gpt-4o
reasoningtoolsvisiongpt
$0models.dev$0128K22
OpenAI: GPT-4o (2024-05-13)openai/gpt-4o-2024-05-13
scorestoolsvisiongpt
$5models.dev$15128K7
OpenAI: GPT-4o (2024-08-06)openai/gpt-4o-2024-08-06
toolsvisiongpt
$2.50models.dev$10128K13
OpenAI: GPT-4o miniopenai/gpt-4o-mini
scoresreasoningtoolsvisiongpt-mini
$0models.dev$0128K25
OpenAI: GPT-4o Search Previewopenai/gpt-4o-search-preview
visiongpt
$1.47models.dev$5.88128K3
Llama-3.3-70B-Instructnvidia/Llama-3.3-70B-Instruct-FP8
scorestoolsopenllama
$1.15models.dev$1.15128K1
Qwen 2.5 72B InstructQwen/Qwen2.5-72B-Instruct
toolsopenqwen
$0.11models.dev$0.38128K4
Llama-3.2-11B-Vision-Instructmeta/llama-3.2-11b-vision-instruct
reasoningtoolsvisionopenllama
$0models.dev$0128K3
Llama-3.2-90B-Vision-Instructmeta/llama-3.2-90b-vision-instruct
reasoningtoolsvisionopenllama
$0models.dev$0128K2
dracarys-llama-3.1-70b-instructabacusai/dracarys-llama-3.1-70b-instruct
toolsopen
$0models.dev$0128K1
Llama 3.2 11B Vision Instruct@cf/meta/llama-3.2-11b-vision-instruct
visionopenllama
$0.0485models.dev$0.676128K2
Llama 3.2 3B Instruct@cf/meta/llama-3.2-3b-instruct
openllama
$0.0509models.dev$0.33580K2
Llama 3.2 1B Instruct@cf/meta/llama-3.2-1b-instruct
openllama
$0.027models.dev$0.20160K2
Qwen-VL OCRalibaba-cn/qwen-vl-ocr
visionqwen
$0.717models.dev$0.71734K2
Qwen2.5-Omni 7Balibaba-cn/qwen2-5-omni-7b
toolsvisionopenqwen
$0.087models.dev$0.34533K2
Llama 3.2 3B Instructllmgateway/llama-3.2-3b-instruct
openllama
$0.02LiteLLM$0.0233K4
Llama 3.3 70B Euryaledeepinfra/Sao10K/L3.3-70B-Euryale-v2.3
llama
$0.493models.dev$0.49320K4
Evayale 70bSteelskull/L3.3-MS-Evayale-70B
llama
$0.493models.dev$0.49316K1
Llama 3.3 70B Cu MaiSteelskull/L3.3-Cu-Mai-R1-70b
llama
$0.493models.dev$0.49316K1
MS Evalebis 70bSteelskull/L3.3-MS-Evalebis-70b
llama
$0.493models.dev$0.49316K1
Steelskull Electra R1 70bSteelskull/L3.3-Electra-R1-70b
llama
$0.6999models.dev$0.699916K1
Steelskull Nevoria 70bSteelskull/L3.3-MS-Nevoria-70b
llama
$0.493models.dev$0.49316K1
Steelskull Nevoria R1 70bSteelskull/L3.3-Nevoria-R1-70b
llama
$0.493models.dev$0.49316K1
Llama 3.05 Storybreaker Ministral 70bEnvoid/Llama-3.05-NT-Storybreaker-Ministral-70B
llama
$0.493models.dev$0.49316K1
Nemotron Tenyxchat Storybreaker 70bEnvoid/Llama-3.05-Nemotron-Tenyxchat-Storybreaker-70B
nemotron
$0.493models.dev$0.49316K1
Dolphin 72baccounts/fireworks/models/dolphin-2-9-2-qwen2-72b
qwen
$0.306models.dev$0.3068K4
nemotron-mini-4b-instructnvidia/nemotron-mini-4b-instruct
toolsopennemotron
$0models.dev$0128K1
studiovoicenvidia/studiovoice
open
$0models.dev$0128K1
Qwen2.5 Coder 32B Instructqwen/qwen-2.5-coder-32b-instruct
openqwen
$0.18LiteLLM$0.1833K5
R1 Distill Llama 70Bdeepseek/deepseek-r1-distill-llama-70b
reasoningopendeepseek
$0.75LiteLLM$0.998K4
DeepSeek-V3.2-fastdeepseek-ai/DeepSeek-V3.2-fast
reasoningtoolsopen
$0.4models.dev$28K1
Magnum v4 72Banthracite-org/magnum-v4-72b
openllama
$2.01models.dev$2.9916K3
Step 2 (16K)stepfun-ai/step-2-16k
tools
$5.21models.dev$16.4416K2
Sao10K Stheno 8bnovita/Sao10K/L3-8B-Stheno-v3.2
toolsopenllama
$0.05LiteLLM$0.0516K5
Stable Diffusion 3.5 Largedigitalocean/stable-diffusion-3.5-large
openstable-diffusion
$0.08models.dev$02561

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash