tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and if it can do tools, vision, or reasoning. Recommended order puts known labs first, then newer releases. Free/$0 rows stay hidden unless you ask. Measure real sessions with the app or the CLI.

2,616 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · AI plans · Benchmarks

Showing 48 of 2,405 matches · page 10 of 51 · 97 beta/latest variants hidden (show them) · including free/$0 list rates

ModelInputOutputContextOffers
Z.ai: GLM-4.5-Airzai/glm-4.5-air
reasoningtoolsopenglm-air
$0.1models.dev$0.5131K29
NVIDIA: Nemotron Nano 9Bnvidia/NVIDIA-Nemotron-Nano-9B-v2
reasoningtoolsopennemotron
$0.04LiteLLM$0.16131K16
OpenAI: GPT-5.1-Instantopenai/gpt-5.1-instant
reasoningtoolsvisiongpt
$1.10models.dev$9128K1
NVIDIA: streampetrnvidia/streampetr
open
$0models.dev$0128K1
Mistral: Medium 3.1mistral/mistral-medium-2508
scorestoolsvisionmistral-medium
$0.4models.dev$2262K2
Moonshot: Kimi K2 Instructmoonshotai/Kimi-K2-Instruct
toolsopenkimi-k2
$0.4models.dev$1.80256K16
Moonshot: Kimi K2 Turbo Previewmoonshot/kimi-k2-turbo-preview
toolskimi-k2
$0.15models.dev$8256K3
Mistral: Codestral 2508mistral/codestral-2508
toolsopencodestral
$0.15OpenRouter$0.45256K11
Mistral: Small 3.2 24B Instruct 2506mistralai/Mistral-Small-3.2-24B-Instruct-2506
reasoningtoolsvisionopenmistral-small
$0.075LiteLLM$0.2131K12
Mistral: Medium 3mistralai/mistral-medium-3-instruct
visionmistral-medium
$0models.dev$0131K1
Mistral: Mixtral 8x22Bmistralai/Mixtral-8x22B-Instruct-v0.1
openmixtral
$0.6LiteLLM$0.666K9
NVIDIA: Llama 3.3 Nemotron Super 49B v1.5nvidia/Llama-3.3-Nemotron-Super-49B-v1.5
reasoningtoolsopennemotron
$0.1LiteLLM$0.4131K5
NVIDIA: Nemotron Super 49Bnvidia/Llama-3.3-Nemotron-Super-49B-v1
reasoningtoolsopennemotron
$0.1LiteLLM$0.4131K5
OpenAI: GPT OSS 120B High Throughputopenai/chat-completion/models/gpt-oss-120b-high-throughput
reasoningtoolsopengpt-oss
$0.09models.dev$0.36131K1
Mistral: Medium 3.1mistralai/mistral-medium-3.1
scorestoolsvisionmistral-medium
$0.2OpenRouter$1131K7
NVIDIA: Phi 4 Mininvidia/phi-4-mini-instruct
toolsopenphi
$0.075LiteLLM$0.3131K6
Hunyuan A13B Instructtencent/Hunyuan-A13B-Instruct
reasoningtoolsopenhunyuan
$0.14models.dev$0.57131K6
OpenAI: GPT-5-Chatopenai/gpt-5-chat
toolsvisiongpt-codex
$1.10models.dev$9128K5
NVIDIA: llama-3.1-nemotron-safety-guard-8b-v3nvidia/llama-3.1-nemotron-safety-guard-8b-v3
opennemotron
$0models.dev$0128K1
Z.ai: GLM-4.5 AirX (Z AI)zai/glm-4.5-airx
toolsglm
$1.10models.dev$4.50128K4
Z.ai: GLM-4.5 X (Z AI)zai/glm-4.5-x
reasoningtoolsglm
$2.20models.dev$8.90128K4
Z.ai: GLM-4.5Vzai/glm-4.5v
reasoningtoolsvisionopenglm
$0.29models.dev$0.86128K20
NVIDIA: Phi 4 Multimodalnvidia/phi-4-multimodal-instruct
openphi
$0.07models.dev$0.11128K4
Qwen3 Omni 30B A3B Instructqwen/qwen3-omni-30b-a3b-instruct
toolsvisionopenqwen
$0.25models.dev$0.9766K4
Qwen3 Omni 30B A3B Thinkingqwen/qwen3-omni-30b-a3b-thinking
reasoningtoolsvisionopen
$0.25models.dev$0.9766K4
OpenAI: o3 Proopenai/o3-pro
reasoningtoolsvisiono-pro
$18models.dev$72200K10
OpenAI: o3-deep-researchopenai/o3-deep-research
reasoningtoolso
$9models.dev$36200K6
OpenAI: GPT OSS 120Bopenai/gpt-oss-120b-maas
scoresreasoningtoolsopengpt-oss
$0.09models.dev$0.36131K4
OpenAI: GPT OSS 20Bopenai/gpt-oss-20b
scoresreasoningtoolsvisionopengpt-oss
$0.0145LiteLLM$0.07131K62
OpenAI: GPT OSS 20Bopenai/gpt-oss-20b-maas
scoresreasoningtoolsopengpt-oss
$0.07models.dev$0.25131K4
OpenAI: gpt-oss-120bopenai/gpt-oss-120b
scoresreasoningtoolsvisionopengpt-oss
$0.03models.dev$0.17131K93
Cohere: Command A Visioncohere/command-a-vision-07-2025
visionopencommand-a
$1.56LiteLLM$1.56128K3
Amazon: Voxtral Small 24B 2507 (Amazon Bedrock, US)amazon/mistral.voxtral-small-24b-2507@us
openvoxtral
$0.1models.dev$0.3128K1
Amazon: Voxtral Mini 3B 2507 (Amazon Bedrock, US)amazon/mistral.voxtral-mini-3b-2507@us
openvoxtral
$0.04models.dev$0.04128K1
Alibaba: Qwen3-Omni Flashalibaba/qwen3-omni-flash
reasoningtoolsvisionqwen
$0.058models.dev$0.2366K2
Alibaba: Qwen3-Omni Flash Realtimealibaba/qwen3-omni-flash-realtime
toolsvisionqwen
$0.23models.dev$0.91866K2
Alibaba: Qwen3-ASR Flashalibaba/qwen3-asr-flash
qwen
$0.032models.dev$0.03253K2
Alibaba: Qwen3-LiveTranslate Flash Realtimealibaba/qwen3-livetranslate-flash-realtime
visionqwen
$10models.dev$1053K1
NVIDIA: FLUX.1-Kontext-devnvidia/flux_1-kontext-dev
visionopen
$0models.dev$041K1
Google: Gemini 2.5 Flash TTSgoogle-vertex/gemini-2.5-flash-tts
gemini-flash
$0.5models.dev$1033K1
Google: Gemini 2.5 Pro TTSgoogle-vertex/gemini-2.5-pro-tts
gemini-pro
$1models.dev$2033K1
Google: gemini/gemini-2.5-flash-imagegemini/gemini-2.5-flash-image
reasoningvisiongemini-flash
$0.15models.dev$1.2533K13
DeepSeek: OCRdeepseek/deepseek-ocr
visionopendeepseek
$0.03models.dev$0.038K6
Google: Gemini-2.0-Flash-Litegemini/gemini-2.0-flash-lite
toolsvisiongemini-flash-lite
$0.052models.dev$0.212M6
Google: Gemini 2.5 Pro Preview 0506google/gemini-2.5-pro-preview-05-06
reasoningvisiongemini
$1.25LiteLLM$101.0M4
Google: Gemini 2.5 Pro Preview 06-05google/gemini-2.5-pro-preview
reasoningtoolsvisiongemini
$1.25models.dev$101.0M4
NVIDIA: llama-3_2-nemoretriever-300m-embed-v1nvidia/llama-3_2-nemoretriever-300m-embed-v1
open
$0models.dev$033K1
Qwen-MT Plusqwen/qwen-mt-plus
openqwen
$0.25models.dev$0.7516K6

Set up a workspace and measure your agents

Download tokenstat to set up local Git-enabled workspaces, bring remote terminals and desktops into one window, and track the tokens from your own sessions.

CLI for macOS, Linux, and Windows