meta-llama logo
meta-llama

Meta: Llama 3.3 70B Instruct

The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). $0.10 per million input tokens, $0.32 per million output tokens. 131,072 token context window, maximum output of 16,384 tokens. Higher uptime with 12 providers. Includes independent benchmarks from Artificial Analysis.

Przegląd

Specyfikacja modelu

Kontekst
131 072 tokens
Maksymalne wyjście
115 200 tokens
Architektura
text->text
Tokenizer
Llama3
Granica wiedzy
2023-12-31
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.1
/M tokens
Wyjście
$0.32
/M tokens
API

Szybki start

Wywołaj ten model przez zgodne z OpenAI API OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"meta-llama/llama-3.3-70b-instruct","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
text
API

Obsługiwane parametry API

frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

13 dostawców

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

DeepInfra

fp8
Kontekst
131K
Maksymalne wyjście
16K
Wejście
$0.100
Wyjście
$0.320
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Nebius

fp8
Kontekst
131K
Maksymalne wyjście
118K
Wejście
$0.130
Wyjście
$0.400
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Novita

bf16
Kontekst
12K
Maksymalne wyjście
11K
Wejście
$0.135
Wyjście
$0.400
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

AkashML

fp8
Kontekst
131K
Maksymalne wyjście
128K
Wejście
$0.200
Wyjście
$0.520
Odczyt pamięci podręcznej
$0.100
Zapis pamięci podręcznej
Brak danych

Parasail

fp8
Kontekst
131K
Maksymalne wyjście
16K
Wejście
$0.220
Wyjście
$0.500
Odczyt pamięci podręcznej
$0.110
Zapis pamięci podręcznej
Brak danych

Crusoe

bf16
Kontekst
131K
Maksymalne wyjście
118K
Wejście
$0.250
Wyjście
$0.750
Odczyt pamięci podręcznej
$0.130
Zapis pamięci podręcznej
Brak danych

Cloudflare

fp8
Kontekst
24K
Maksymalne wyjście
22K
Wejście
$0.293
Wyjście
$2.25
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

SambaNova

unknown
Kontekst
131K
Maksymalne wyjście
3K
Wejście
$0.450
Wyjście
$0.900
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Groq

unknown
Kontekst
131K
Maksymalne wyjście
33K
Wejście
$0.590
Wyjście
$0.790
Odczyt pamięci podręcznej
$0.295
Zapis pamięci podręcznej
Brak danych

CoreWeave

fp16
Kontekst
128K
Maksymalne wyjście
115K
Wejście
$0.710
Wyjście
$0.710
Odczyt pamięci podręcznej
$0.710
Zapis pamięci podręcznej
Brak danych

Google

unknown
Kontekst
128K
Maksymalne wyjście
8K
Wejście
$0.720
Wyjście
$0.720
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Google

unknown
Kontekst
128K
Maksymalne wyjście
115K
Wejście
$0.720
Wyjście
$0.720
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Together

unknown
Kontekst
131K
Maksymalne wyjście
2K
Wejście
$1.04
Wyjście
$1.04
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
meta-llama

modele

Wszystkie modele
meta-llama logometa-llama

Meta: Llama Guard 4 12B

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Kontekst
164K
Wejście
image · text
Wyjście
text
Wejście: $0.180Wyjście: $0.180za milion tokenów
Zobacz szczegóły modelu
meta-llama logometa-llama

Meta: Llama 4 Maverick

Llama 4 Maverick 17B Instruct (128E) is a high-capacity multimodal language model from Meta, built on a mixture-of-experts (MoE) architecture with 128 experts and 17 billion active parameters per forward...

Kontekst
1.0M
Wejście
text · image
Wyjście
text
Wejście: $0.200Wyjście: $0.696za milion tokenów
Zobacz szczegóły modelu
meta-llama logometa-llama

Meta: Llama 4 Scout

Llama 4 Scout 17B Instruct (16E) is a mixture-of-experts (MoE) language model developed by Meta, activating 17 billion parameters out of a total of 109B. It supports native multimodal input...

Kontekst
1.3M
Wejście
text · image
Wyjście
text
Wejście: $0.110Wyjście: $0.340za milion tokenów
Zobacz szczegóły modelu
meta-llama logometa-llama

Meta: Llama 3.2 1B Instruct

Llama 3.2 1B is a 1-billion-parameter language model focused on efficiently performing natural language tasks, such as summarization, dialogue, and multilingual text analysis. Its smaller size allows it to operate...

Kontekst
60K
Wejście
text
Wyjście
text
Wejście: $0.027Wyjście: $0.201za milion tokenów
Zobacz szczegóły modelu