12 models, list price
Dollars per million tokens, read from each vendor's published page. Sort by what you're optimising for.
Sort: blended · input · output · cache · context · name
ModelProvider
InputOutput
Cache readContext
Llama Prompt Guard 2 22M
meta-llama/llama-prompt-guard-2-22m
Llama Prompt Guard 2 86M
meta-llama/llama-prompt-guard-2-86m
Llama 3.1 8B Instant
llama-3.1-8b-instant
GPT-OSS 20B
openai/gpt-oss-20b
Safety GPT-OSS 20B
openai/gpt-oss-safeguard-20b
GPT-OSS 120B
openai/gpt-oss-120b
Llama 3.3 70B Versatile
llama-3.3-70b-versatile
Qwen3.6 27B
qwen/qwen3.6-27b
Whisper Large V3
whisper-large-v3
Whisper Large V3 Turbo
whisper-large-v3-turbo
Orpheus Arabic Saudi
canopylabs/orpheus-arabic-saudi
Orpheus V1 English
canopylabs/orpheus-v1-english