Side by side pricing and context for Mixtral 8x7B (Groq) and Llama 3.3 70B (Groq). Rates are curated catalog values with last verified dates on each model page.
Mixtral 8x7B (Groq)
Mixtral 8x7B on Groq for fast open MoE chat. Trial against Llama 70B on Groq when you need speed at mid quality.
Input $0.240 / Output $0.240 per 1M
Context 32.8K · Approx
Llama 3.3 70B (Groq)
Meta Llama 3.3 70B served on Groq for speed-sensitive chat. Price is for Groq hosting. Compare latency needs vs OpenAI/Anthropic quality.
Input $0.590 / Output $0.790 per 1M
Context 128K · Approx
Quick take
- Mixtral 8x7B (Groq) is cheaper on input in this catalog snapshot.
- Mixtral 8x7B (Groq) is cheaper on output in this catalog snapshot.
- Both last verified on their model pages (2026-08-02 / 2026-08-02).
Rate table
| Metric | Mixtral 8x7B (Groq) | Llama 3.3 70B (Groq) |
|---|---|---|
| Input / 1M | $0.240 | $0.590 |
| Output / 1M | $0.240 | $0.790 |
| Cached input / 1M | n/a | n/a |
| Context | 32.8K | 128K |
| Tokenizer | Approx | Approx |