reroute

OpenAI: gpt-oss-120b

openai/gpt-oss-120b

gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose production use cases. It activates 5.1B parameters per forward pass and is optimized...

Modalities
In / Out Price
$0.037 / $0.17 per 1M
Context
131K
Released
Aug 5, 2025
Knowledge Cutoff
Jun 2024

Pricing

What Reroute charges per unit. No markup on inference — you pay the carrier's price, metered from the carrier's own usage numbers.

Input tokens
$0.037 / M
Output tokens
$0.17 / M

By provider

Each carrier sets its own price. The router weighs these against uptime when it picks one.

ProviderInput /MOutput /MCache read /MCache write /MDiscount
CoreWeave$0.03$0.17$0.03——
DekaLLM$0.03$0.18$0.03——
DeepInfra$0.037$0.17———
AkashML$0.037$0.187$0.037——
Crusoe$0.05$0.25$0.05——
Mancer 2$0.05$0.25———
Novita$0.05$0.25———
DigitalOcean$0.06$0.42$0.012——
Google$0.09$0.36———
BaseTen$0.10$0.50$0.10——
BaseTen$0.10$0.50$0.10——
Parasail$0.10$0.75$0.055——
SambaNova$0.14$0.95———
Amazon Bedrock$0.15$0.60———
Nebius$0.15$0.60———
Amazon Bedrock$0.15$0.60———
DeepInfra$0.15$0.60———
SiliconFlow$0.15$0.60$0.075——
Phala$0.15$0.60———
Together$0.15$0.60———
Groq$0.15$0.60$0.075——
Mara$0.15$0.75———
Cerebras$0.35$0.75$0.35——