Llama 3.1 8B — Meta
Llama 3.1 8B est le petit modèle rapide de Meta. Idéal quand la latence compte : réponses courtes, reformulations, tâches simples, à une vitesse que les gros modèles ne peuvent pas égaler.
Type : Texte · Paramètres : 8 milliards · Contexte : 128K tokens
Points forts
- Vitesse maximale
- Faible latence
- Tâches courtes efficaces
Idéal pour
- Réponses instantanées
- Reformulation et correction
- Chat rapide
Llama 3.1 8B est servi via Groq, Cerebras, Cloudflare Workers AI, inclus dans votre abonnement avec des dizaines d'autres modèles — un seul prix, tous les modèles.