4 models, list price
Dollars per million tokens, read from each vendor's published page. Sort by what you're optimising for.
Sort: blended · input · output · cache · context · name
ModelProvider
InputOutput
Cache readContext
Llama 3.1 8B Instant
llama-3.1-8b-instant
GPT-OSS 20B
openai/gpt-oss-20b
GPT-OSS 120B
openai/gpt-oss-120b
Llama 3.3 70B Versatile
llama-3.3-70b-versatile