tokenstat
tokenstat

Model catalog

Models and list rates

Published API list rates (USD per million tokens), who lists each model, and whether it can do tools, vision, or reasoning. Recommended order is newer first; among similarly new models, larger context wins. Free/$0 rows stay hidden unless you ask. Not a bill: measure real sessions with the CLI.

3,231 models in the merged catalog · as of . Sources: LiteLLM, OpenRouter, models.dev. · Providers · Plans · Benchmarks

Showing 48 of 2,670 matches · page 21 of 56 · 561 free/$0 rows hidden (show them)

ModelInputOutputContextOffers
DeepSeek R1 0528 Qwen3 8Bdeepseek/deepseek-r1-0528-qwen3-8b
reasoningopen
$0.06models.dev$0.09128K4
Mistral Small 3.2mistral/mistral-small
toolsvisionopenmistral-small
$0.075models.dev$0.2128K6
Baichuan 4 Turbonano-gpt/Baichuan4-Turbo
$2.42models.dev$2.42128K1
Llama 4 Scout 17B 16E Instructazure-cognitive-services/llama-4-scout-17b-16e-instruct
scorestoolsvisionopenllama
$0.2models.dev$0.78128K4
Llama 4 Scout 17B 16E Instructworkers-ai/@cf/meta/llama-4-scout-17b-16e-instruct
scoresllama
$0.27models.dev$0.85128K1
DeepHermes-3 Mistral 24B (Preview)NousResearch/DeepHermes-3-Mistral-24B-Preview
$0.3models.dev$0.3128K1
K2-ThinkLLM360/K2-Think
kimi-thinking
$0.17models.dev$0.68128K1
Llama 3.3 70Bsnowflake/llama3.3-70b
scorestoolsopenllama
$0.72LiteLLM$0.72128K4
Morph V3 Fastvercel_ai_gateway/morph/morph-v3-fast
morph
$0.8LiteLLM$1.2082K6
Grayline Qwen3 8Bsoob3123/GrayLine-Qwen3-8B
qwen
$0.3models.dev$0.316K1
Hunyuan MT 7Btencent/Hunyuan-MT-7B
hunyuan
$10models.dev$208K1
mistralai--mistral-medium-instructsap-ai-core/mistralai--mistral-medium-instruct
toolsvisionmistral-medium
$0.36models.dev$1.22128K1
Shisa V2 Llama 3.3 70Bshisa-ai/shisa-v2-llama3.3-70b
llama
$0.5models.dev$0.5128K1
IndicTrans2 EN-Indic 1Bworkers-ai/@cf/ai4bharat/indictrans2-en-indic-1B
indictrans
$0.34models.dev$0.34128K1
PLaMo Embedding 1Bworkers-ai/@cf/pfnet/plamo-embedding-1b
plamo
$0.019models.dev$0128K1
Embed v4azure-cognitive-services/cohere-embed-v-4-0
visionopencohere-embed
$0.12models.dev$0128K2
Mistral Medium 3azure-cognitive-services/mistral-medium-2505
toolsvisionmistral-medium
$0.4models.dev$2128K3
Llama 3.2 3B Instructworkers-ai/@cf/meta/llama-3.2-3b-instruct
llama
$0.051models.dev$0.34128K1
Llama-3.1-8B-CScerebras/llama-3.1-8b-cs
tools
$0.1models.dev$0.1128K1
UI-TARS 7Bbytedance/ui-tars-1.5-7b
visionopen
$0.1models.dev$0.2128K4
Qwen3 Omni 30B A3B Instructqwen/qwen3-omni-30b-a3b-instruct
toolsvisionopenqwen
$0.25models.dev$0.9766K4
Qwen3 Omni 30B A3B Thinkingqwen/qwen3-omni-30b-a3b-thinking
reasoningtoolsvisionopen
$0.25models.dev$0.9766K4
Qwen3-Omni Flashalibaba-cn/qwen3-omni-flash
reasoningtoolsvisionqwen
$0.058models.dev$0.2366K2
Qwen3-Omni Flash Realtimealibaba-cn/qwen3-omni-flash-realtime
toolsvisionqwen
$0.23models.dev$0.91866K2
Nano-Bananagoogle/nano-banana
toolsvisionnano-banana
$0.21models.dev$1.8066K1
Step-3nano-gpt/step-3
reasoningtoolsvision
$0.21models.dev$0.5766K2
Gemini 2.5 Flash Previewnano-gpt/gemini-2.5-flash-preview-04-17
reasoningvision
$0.15models.dev$0.61.0M1
GLM 4.1V Thinking Flashnano-gpt/glm-4.1v-thinking-flash
vision
$0.3models.dev$0.364K1
GLM 4.1V Thinking FlashXnano-gpt/glm-4.1v-thinking-flashx
vision
$0.3models.dev$0.364K1
Qwen3-LiveTranslate Flash Realtimealibaba/qwen3-livetranslate-flash-realtime
visionqwen
$10models.dev$1053K1
Qwen3-ASR Flashalibaba-cn/qwen3-asr-flash
qwen
$0.032models.dev$0.03253K2
Qwen3 VL 235B A22B Instruct Originalnano-gpt/qwen3-vl-235b-a22b-instruct-original
vision
$0.5models.dev$1.2033K1
Mistral: Voxtral Small 24B 2507mistralai/Voxtral-Small-24B-2507
toolsopenvoxtral
$0.0023models.dev$0.002333K9
Baichuan 4 Airnano-gpt/Baichuan4-Air
$0.157models.dev$0.15733K1
Baichuan M2 32B Medicalnano-gpt/Baichuan-M2
$15.73models.dev$15.7333K1
MiniCPM-V 4.5llmgateway/minicpm-v-4.5
toolsvision
$0.658models.dev$1.1132K1
Holo2 30B A3Bgreenpt/holo2-30b-a3b
reasoningtoolsvisionopen
$0.3LiteLLM$0.722K4
Qwen MT Plusqwen/qwen-mt-plus
open
$0.25models.dev$0.7516K2
Qwen3 14B InstructOpenPipe/Qwen3-14B-Instruct
toolsopenqwen
$0.05models.dev$0.2233K1
MM Poly 8Bclarifai/main/models/mm-poly-8b
visionmm-poly
$0.658models.dev$1.1133K1
SmolLM3 3B BaseHuggingFaceTB/SmolLM3-3B-Base
reasoningtools
$0.15models.dev$0.1533K1
Google: Gemini Embedding 001gemini/gemini-embedding-001
gemini
$0.15LiteLLM$020K7
EVA Llama 3.33 70BEVA-UNIT-01/EVA-LLaMA-3.33-70B-v0.0
llama
$2.01models.dev$2.0116K1
Llama 3.3 70B Instruct abliteratedhuihui-ai/Llama-3.3-70B-Instruct-abliterated
llama
$0.7models.dev$0.716K1
EVA-Qwen2.5-32B-v0.2EVA-UNIT-01/EVA-Qwen2.5-32B-v0.2
qwen
$0.799models.dev$0.79916K1
EVA-Qwen2.5-72B-v0.2EVA-UNIT-01/EVA-Qwen2.5-72B-v0.2
qwen
$0.799models.dev$0.79916K1
PaddleOCR-VLnovita/paddlepaddle/paddleocr-vl
visionopen
$0.02LiteLLM$0.0216K4
Command A Translatecohere/command-a-translate-08-2025
toolsopencommand-a
$2.50models.dev$108K1

Price this against your own usage

List rates are only half the story. The CLI reads the session logs your coding harnesses already write and shows tokens, cache share, and usage value on your machine.

$ curl -fsSL https://tokenstat.ai/install.sh | bash