meta-llama logo
meta-llama

Meta: Llama 3.3 70B Instruct

Opis źródłowy (angielski)

The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). The Llama 3.3 instruction tuned text only model...

Przegląd

Specyfikacja modelu

Kontekst
131 072 tokens
Maksymalne wyjście
16 384 tokens
Architektura
text->text
Tokenizer
Llama3
Granica wiedzy
2023-12-31
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.1
za milion tokenów
Wyjście
$0.32
za milion tokenów
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"meta-llama/llama-3.3-70b-instruct","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
text
API

Obsługiwane parametry API

frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

13 dostawców

Sprawdzono: 7 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

DeepInfra

fp8
Kontekst
131K
Maksymalne wyjście
16K
Wejście
$0.1
Wyjście
$0.32
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Nebius

fp8
Kontekst
131K
Maksymalne wyjście
118K
Wejście
$0.13
Wyjście
$0.4
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Novita

bf16
Kontekst
12K
Maksymalne wyjście
11K
Wejście
$0.135
Wyjście
$0.4
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

AkashML

fp8
Kontekst
131K
Maksymalne wyjście
128K
Wejście
$0.2
Wyjście
$0.52
Odczyt pamięci podręcznej
$0.1
Zapis pamięci podręcznej
Brak danych

Parasail

fp8
Kontekst
131K
Maksymalne wyjście
16K
Wejście
$0.22
Wyjście
$0.5
Odczyt pamięci podręcznej
$0.11
Zapis pamięci podręcznej
Brak danych

Crusoe

bf16
Kontekst
131K
Maksymalne wyjście
118K
Wejście
$0.25
Wyjście
$0.75
Odczyt pamięci podręcznej
$0.13
Zapis pamięci podręcznej
Brak danych

Cloudflare

fp8
Kontekst
24K
Maksymalne wyjście
22K
Wejście
$0.293
Wyjście
$2.253
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

SambaNova

Brak danych
Kontekst
131K
Maksymalne wyjście
3K
Wejście
$0.45
Wyjście
$0.9
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Groq

Brak danych
Kontekst
131K
Maksymalne wyjście
33K
Wejście
$0.59
Wyjście
$0.79
Odczyt pamięci podręcznej
$0.295
Zapis pamięci podręcznej
Brak danych

CoreWeave

fp16
Kontekst
128K
Maksymalne wyjście
115K
Wejście
$0.71
Wyjście
$0.71
Odczyt pamięci podręcznej
$0.71
Zapis pamięci podręcznej
Brak danych

Google

Brak danych
Kontekst
128K
Maksymalne wyjście
8K
Wejście
$0.72
Wyjście
$0.72
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Google

Brak danych
Kontekst
128K
Maksymalne wyjście
115K
Wejście
$0.72
Wyjście
$0.72
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Together

Brak danych
Kontekst
131K
Maksymalne wyjście
2K
Wejście
$1.04
Wyjście
$1.04
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
meta-llama

4 modele

Wszystkie modele
meta-llama logometa-llama

Meta: Llama Guard 4 12B

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Kontekst
164K
Wejście
image · text
Wyjście
text
Wejście: $0.18Wyjście: $0.18za milion tokenów
Zobacz szczegóły modelu
meta-llama logometa-llama

Meta: Llama 4 Maverick

Llama 4 Maverick 17B Instruct (128E) is a high-capacity multimodal language model from Meta, built on a mixture-of-experts (MoE) architecture with 128 experts and 17 billion active parameters per forward...

Kontekst
1.0M
Wejście
text · image
Wyjście
text
Wejście: $0.1875Wyjście: $0.6525za milion tokenów
Zobacz szczegóły modelu
meta-llama logometa-llama

Meta: Llama 4 Scout

Llama 4 Scout 17B Instruct (16E) is a mixture-of-experts (MoE) language model developed by Meta, activating 17 billion parameters out of a total of 109B. It supports native multimodal input...

Kontekst
1.3M
Wejście
text · image
Wyjście
text
Wejście: $0.1Wyjście: $0.3za milion tokenów
Zobacz szczegóły modelu
meta-llama logometa-llama

Meta: Llama 3.2 1B Instruct

Llama 3.2 1B is a 1-billion-parameter language model focused on efficiently performing natural language tasks, such as summarization, dialogue, and multilingual text analysis. Its smaller size allows it to operate...

Kontekst
60K
Wejście
text
Wyjście
text
Wejście: $0.027Wyjście: $0.201za milion tokenów
Zobacz szczegóły modelu