meta-llama logo
meta-llama

Meta: Llama 3.1 70B Instruct

Meta's latest class of model (Llama 3.1) launched with a variety of sizes & flavors. $0.40 per million input tokens, $0.40 per million output tokens. 131,072 token context window, maximum output of 16,384 tokens. Higher uptime with 3 providers. Includes independent benchmarks from Artificial Analysis.

Présentation

Caractéristiques du modèle

Contexte
131 072 tokens
Sortie maximale
16 384 tokens
Architecture
text->text
Tokenizer
Llama3
Limite des connaissances
2023-12-31
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.4
/M tokens
Sortie
$0.4
/M tokens
API

Démarrage rapide

Appelez ce modèle via l’API compatible OpenAI d’OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"meta-llama/llama-3.1-70b-instruct","messages":[{"role":"user","content":"Hello!"}]}'
Capacités et modalités

EntréeSortie

Entrée
text
Sortie
text
API

Paramètres API pris en charge

frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Fournisseurs disponibles

3 fournisseurs

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

DeepInfra

fp8
Contexte
131K
Sortie maximale
16K
Entrée
$0.400
Sortie
$0.400
Lecture du cache
Non indiqué
Écriture du cache
Non indiqué

Amazon Bedrock

unknown
Contexte
131K
Sortie maximale
8K
Entrée
$0.720
Sortie
$0.720
Lecture du cache
Non indiqué
Écriture du cache
Non indiqué

CoreWeave

bf16
Contexte
131K
Sortie maximale
118K
Entrée
$0.800
Sortie
$0.800
Lecture du cache
$0.800
Écriture du cache
Non indiqué
meta-llama

modèles

Tous les modèles