Head to head

text-embedding-3-small vs Llama 3.1 8B Instant

On a blended workload of one million input tokens and three million output tokens, text-embedding-3-small is 14.5× cheaper than Llama 3.1 8B Instant.

text-embedding-3-smallLlama 3.1 8B Instant
Provider OpenAI Groq
Input / MTok $0.02 $0.05
Output / MTok $0.08
Cache read / MTok
Context window 131,072
Blended 1M in + 3M out $0.02 $0.29
Status ga ga

text-embedding-3-small detail   Llama 3.1 8B Instant detail