tokenstat
tokenstat

OpenAI: GPT OSS 20B

openai/gpt-oss-20b · rates as of · Benchmarks · AI plans · Calculator

Open-weight GPT model for self-hosted reasoning and instruction-following workloads

Cheapest input
$0.0145
$/MTok · LiteLLM
Cheapest output
$0.07
$/MTok
Context
131K
tokens
Sources
3
60 listings

Sources

Same model, different sources. Our first-party rate is listed first, then router and aggregator rows stay separate so you can see the spread instead of a single blended number. Free/$0 listings are hidden by default (4 omitted). Show free/$0 listings.

SourceProviderInputOutputCache readContext
LiteLLMcheapestdarkbloom/gpt-oss-20bN/A$0.0145$0.07$0.0014N/A
models.devopenai/gpt-oss-20bKilo Gateway$0.02$0.1$0131K
OpenRouteropenai/gpt-oss-20bOpenRouter$0.03$0.13$0.03131K
models.devopenai/gpt-oss-20bWeights & Biases$0.03$0.13$0.03131K
models.devflexai/gpt-oss-20bEden AI$0.03$0.13$0131K
models.devopenai/gpt-oss-20bDeepInfra$0.03$0.14$0.003131K
models.devdeepinfra/openai/gpt-oss-20bEden AI$0.03$0.14$0131K
models.devopenai/gpt-oss-20bIO.NET$0.03$0.14$0.01564K
LiteLLMopenai/gpt-oss-20bN/A$0.03$0.14$0.003N/A
models.devopenai/gpt-oss-20bNovita AI$0.04$0.15$0131K
models.devTEE/gpt-oss-20bNanoGPT$0.04$0.15$0.02131K
models.devopenai/gpt-oss-20bSiliconFlow$0.04$0.18$0131K
models.devgpt-oss-20bDevPass (LLM Gateway)$0.04$0.19$0.01131K
models.devconsensusprotocol/gpt-oss-20bLLM Gateway$0.04$0.19$0.0166K
models.devopenai/gpt-oss-20bMerge Gateway$0.04$0.2$0.02131K
LiteLLMovhcloud/gpt-oss-20bN/A$0.04$0.15$0.004N/A
LiteLLMnovita/openai/gpt-oss-20bN/A$0.04$0.15$0.004N/A
models.devgpt-oss-20bCortecs$0.045$0.167$0131K
models.devopenai/chat-completion/models/gpt-oss-20bClarifai$0.045$0.18$0131K
models.devovhcloud/gpt-oss-20bEden AI$0.05$0.18$0131K
models.devgpt-oss-20bOVHcloud AI Endpoints$0.05$0.18$0131K
models.devopenai/gpt-oss-20bFastRouter$0.05$0.2$0131K
models.devopenai/gpt-oss-20bTogether AI$0.05$0.2$0.005131K
models.devopenai/gpt-oss-20bVercel AI Gateway$0.05$0.2$0131K
OpenRouteropenai/gpt-oss-20b:batchOpenRouter$0.05$0.2$0131K
models.devgpt-oss-20bHelicone$0.05$0.2$0131K
models.devdatabricks-gpt-oss-20bDatabricks$0.05$0.2$0131K
models.devtogether_ai/openai/gpt-oss-20bEden AI$0.05$0.2$0131K
models.devtogether-ai/gpt-oss-20bLLM Gateway$0.05$0.2$0131K
models.devopenai-gpt-oss-20bDigitalOcean$0.05$0.45$0128K
models.devgpt-oss-20bFrogBot$0.07$0.2$0131K
models.devopenai/gpt-oss-20bPioneer$0.07$0.3$0.035131K
models.devopenai.gpt-oss-20bAmazon Bedrock$0.07$0.3$0128K
models.devgpt-oss-20bNeon$0.07$0.3$0131K
models.devfireworks/gpt-oss-20bImpossibl$0.07$0.3$0.035131K
models.devdatabricks/databricks-gpt-oss-20bEden AI$0.07$0.3$0.007131K
LiteLLMtensormesh/openai/gpt-oss-20bN/A$0.07$0.28$0N/A
LiteLLMopenai.gpt-oss-20bN/A$0.07$0.3$0.007N/A
LiteLLMaccounts/fireworks/models/gpt-oss-20bN/A$0.07$0.3$0.035N/A
LiteLLMbedrock_mantle/openai.gpt-oss-20bN/A$0.07$0.3$0.007N/A
LiteLLMfireworks_ai/accounts/fireworks/models/gpt-oss-20bN/A$0.07$0.3$0.035N/A
LiteLLMdatabricks-gpt-oss-20bN/A$0.07$0.3$0.07N/A
LiteLLMdatabricks/databricks-gpt-oss-20bN/A$0.07$0.3$0.07N/A
models.devopenai/gpt-oss-20bGroq$0.075$0.3$0.0375131K
models.devgroq/gpt-oss-20bImpossibl$0.075$0.3$0.0375131K
models.devgroq/openai/gpt-oss-20bEden AI$0.075$0.3$0.0375131K
LiteLLMbedrock_mantle/us-gov-east-1/openai.gpt-oss-20bN/A$0.084$0.36$0.0084N/A
LiteLLMus-gov-east-1/openai.gpt-oss-20bN/A$0.084$0.36$0.0084N/A
LiteLLMus-gov-west-1/openai.gpt-oss-20bN/A$0.084$0.36$0.0084N/A
LiteLLMreplicate/openai/gpt-oss-20bN/A$0.09$0.36$0.009N/A
models.devopenai/gpt-oss-20bHugging Face$0.1$0.5$0131K
models.devgroq/gpt-oss-20bLLM Gateway$0.1$0.5$0131K
models.devopenai/gpt-oss-20bSTACKIT$0.18$0.29$0131K
models.devopenai/gpt-oss-20bNanoGPT$0.2$0.3$0128K
models.dev@cf/openai/gpt-oss-20bCloudflare$0.2$0.3$0128K
models.devcloudflare/@cf/openai/gpt-oss-20bEden AI$0.2$0.3$0128K
LiteLLM@cf/openai/gpt-oss-20bN/A$0.2$0.3$0.02N/A
LiteLLMgpt-oss-20bN/A$0.2$0.3$0.02N/A
LiteLLMcloudflare/@cf/openai/gpt-oss-20bN/A$0.2$0.3$0.02N/A
models.devgpt-oss-20bRegolo AI$0.4$1.80$0128K

Capabilities

  • Reasoning
  • Tool calling
  • Structured output
  • Attachments
  • Open weights
  • In: text
  • In: image
  • Out: text
Knowledge cutoff: 2024-10Released: 2025-08-05Family: gpt-oss

Scores

Sparse coverage on purpose. Missing a score means we have not linked one yet, not that the model is unranked. Hover or tap the i next to any score for its source. Full boards on /benchmarks.

Arena rows are community-vote Elo from Arena AI, Artificial Analysis indices arrive via OpenRouter, and launch-eval figures are collected from vendor announcements, analyst writeups, and community benchmarks. Full boards and credits on /benchmarks.

Run this model in a real workspace

Launch agents from the project they work in, use remote management to reach another machine, and see this model's sessions and token usage in your own history. Free to use, runs on your device.

CLI for macOS, Linux, and Windows

Data and list-price estimates may contain mistakes. Not investment advice.