Llama 3.1 8B — Meta

Llama 3.1 8B est le petit modèle rapide de Meta. Idéal quand la latence compte : réponses courtes, reformulations, tâches simples, à une vitesse que les gros modèles ne peuvent pas égaler.

Type : Texte · Paramètres : 8 milliards · Contexte : 128K tokens

Points forts

Idéal pour

Llama 3.1 8B est servi via Groq, Cerebras, Cloudflare Workers AI, inclus dans votre abonnement avec des dizaines d'autres modèles — un seul prix, tous les modèles.