tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 3,231 matches · page 37 of 68 · including free/$0 list rates

ModelInputOutputContextOffers
Claude 3.5 Sonnetdigitalocean/anthropic-claude-3.5-sonnet
toolsvisionclaude-sonnet
$3models.dev$15200K4
Claude-Sonnet-3.5anthropic/claude-sonnet-3.5
toolsvisionclaude-sonnet
$2.60models.dev$13189K1
Hermes 3 70B Instructdeepinfra/NousResearch/Hermes-3-Llama-3.1-70B
opennousresearch
$0.12LiteLLM$0.3131K7
L31 70B Euryale V2.2novita/sao10k/l31-70b-euryale-v2.2
toolsopen
$1.48LiteLLM$1.488K4
Sao10k L3 8B Lunarisnovita/sao10k/l3-8b-lunaris
open
$0.05LiteLLM$0.058K4
Gemini 1.5 Flashgoogle/gemini-flash-1.5
gemini-flash
$0.0748models.dev$0.3062M1
Qwen-Plusqwen/qwen-plus
reasoningtoolsqwen
$0.115models.dev$0.2871M10
Mistral Nemo Instructmistralai/Mistral-Nemo-Instruct-2407
reasoningtoolsopenmistral-nemo
$0.02models.dev$0.03131K15
Llama 3.1 Euryale 70B v2.2sao10k/l3.1-euryale-70b
toolsopenllama
$0.85models.dev$0.85131K2
Llama 3.1 8B Instructmeta-llama/llama-3.1-8b-instruct
scoresreasoningtoolsopenllama
$0.02models.dev$0.04131K9
Llama 3.1 8Bgroq/llama-3.1-8b-instant
scorestoolsopenllama
$0.05models.dev$0.08131K3
Hermes 2 Pro Llama 3 8Bhelicone/hermes-2-pro-llama-3-8b
toolsopenllama
$0.14models.dev$0.14131K5
Pixtral 12Bgreenpt/pixtral-12b-2409
toolsvisionopenpixtral
$0.15LiteLLM$0.15128K3
GLM-4 Airnano-gpt/glm-4-air
$0.2006models.dev$0.2006128K1
GLM-4 Flashnano-gpt/glm-4-flash
$0.1003models.dev$0.1003128K1
GLM-4 Plusnano-gpt/glm-4-plus
$7.50models.dev$7.50128K1
OpenAI: GPT-4o-mini (2024-07-18)openai/gpt-4o-mini-2024-07-18
scorestoolsvisiongpt
$0.15models.dev$0.6128K6
Azure gpt-4onano-gpt/azure-gpt-4o
toolsvision
$2.50models.dev$10128K1
Azure gpt-4o-mininano-gpt/azure-gpt-4o-mini
toolsvision
$0.1496models.dev$0.595128K1
Llama 3.1 70b Instructmeta/llama-3.1-70b-instruct
toolsopen
$0models.dev$0128K1
Meta: Llama 3.1 405B Instruct Turbometa-llama/Meta-Llama-3.1-405B-Instruct-Turbo
toolsopenllama
$3.50models.dev$3.50128K4
Meta: Llama 3.1 70B Instructmeta/llama-3.1-70b
toolsllama
$0.72models.dev$0.72128K4
Llama 3.1 70B Instructllmgateway/llama-3.1-70b-instruct
openllama
$0.72models.dev$0.72128K2
Llama 3.2 11B Instructllmgateway/llama-3.2-11b-instruct
openllama
$0.07models.dev$0.33128K1
Gemma 2 2b Itgoogle/gemma-2-2b-it
toolsopen
$0models.dev$0128K1
esm2-650mmeta/esm2-650m
open
$0models.dev$0128K1
Palmyra X4writer/palmyra-x4
toolspalmyra
$2.50models.dev$10128K1
paligemmagoogle/google-paligemma
visionopen
$0models.dev$0128K1
Open Mistral Nemomistral/open-mistral-nemo
toolsopenmistral-nemo
$0.15models.dev$0.15128K3
Meta: Llama 3.1 8B Instructmeta/llama-3.1-8b
scorestoolsllama
$0.03LiteLLM$0.05128K5
Meta: Llama 3.2 3Bmeta/llama-3.2-3b
toolsopenllama
$0.04LiteLLM$0.08128K5
Llama 3.1 8B (decentralized)nano-gpt/Meta-Llama-3-1-8B-Instruct-FP8
$0.02models.dev$0.03128K1
Meta Llama 3.1 8B Instruct Turbohelicone/llama-3.1-8b-instruct-turbo
toolsllama
$0.02models.dev$0.03128K1
Ministral 3B (latest)mistral/ministral-3b-latest
toolsopenministral
$0.04models.dev$0.04128K1
Ministral 8B (latest)mistral/ministral-8b-latest
toolsopenministral
$0.1models.dev$0.1128K3
Mistral: Ministral 3Bmistral/ministral-3b
reasoningtoolsopenministral
$0models.dev$0128K8
Mistral: Ministral 8B (latest)mistral/ministral-8b
toolsopenministral
$0.1models.dev$0.1128K4
Rocinante 12Bthedrummer/rocinante-12b
open
$0.25models.dev$0.566K2
Qwen2.5 7B Instructqwen/qwen-2.5-7b-instruct
toolsopenqwen
$0.1models.dev$0.233K2
Mistral Nemo Instruct 2407 TEEunsloth/Mistral-Nemo-Instruct-2407-TEE
openmistral-nemo
$0.0245models.dev$0.0978131K1
Llama 3.1 8B Instructneon/meta-llama-3-1-8b-instruct
scorestoolsopenllama
$0.1LiteLLM$0.1131K4
Llama 3.1 Instruct (8B)digitalocean/llama3-8b-instruct
toolsopenllama
$0.198models.dev$0.198131K3
Meta Llama 3.1 8B Instruct (GGUF)atomic-chat/Meta-Llama-3_1-8B-Instruct-GGUF
toolsopenllama
$0models.dev$0131K1
GPT-4odigitalocean/openai-gpt-4o
toolsvisiongpt
$2.50models.dev$10128K1
GPT-4o minidigitalocean/openai-gpt-4o-mini
scorestoolsvisiongpt-mini
$0.15models.dev$0.6128K1
Meta-Llama-3.1-405B-Instructmeta/meta-llama-3.1-405b-instruct
reasoningtoolsopenllama
$0models.dev$0128K1
Meta-Llama-3.1-70B-Instructmeta/meta-llama-3.1-70b-instruct
reasoningtoolsopenllama
$0models.dev$0128K1
Llama 3.1 405B Instructcortecs/llama-3.1-405b-instruct
toolsopenllama
$0models.dev$0128K2

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash