Head to head

text-embedding-3-large vs Llama 3.1 8B Instant

On a blended workload of one million input tokens and three million output tokens, text-embedding-3-large is 2.2× cheaper than Llama 3.1 8B Instant.

text-embedding-3-largeLlama 3.1 8B Instant
Provider OpenAI Groq
Input / MTok $0.13 $0.05
Output / MTok $0.08
Cache read / MTok
Context window 131,072
Blended 1M in + 3M out $0.13 $0.29
Status ga ga

text-embedding-3-large detail   Llama 3.1 8B Instant detail