meta-llama logo
meta-llama

Meta: Llama 3.3 70B Instruct

The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). $0.10 per million input tokens, $0.32 per million output tokens. 131,072 token context window, maximum output of 16,384 tokens. Higher uptime with 12 providers. Includes independent benchmarks from Artificial Analysis.

模型概览

模型规格

上下文
131,072 tokens
最大输出
115,200 tokens
架构
text->text
分词器
Llama3
知识截止时间
2023-12-31
内容审核
OPENROUTER

完整价格

同步自 OpenRouter。Token 价格均按每百万 Token 展示。

输入
$0.1
/M tokens
输出
$0.32
/M tokens
API

快速调用

通过 OpenRouter 的 OpenAI 兼容 API 调用这个确切的模型 ID。

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"meta-llama/llama-3.3-70b-instruct","messages":[{"role":"user","content":"Hello!"}]}'
能力与模态

输入输出

输入
text
输出
text
API

支持的 API 参数

frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
可用提供方

13 个提供方

在 OpenRouter 查看实时 Provider

Provider 可用性、延迟、吞吐量和路由会持续变化,请前往来源页面查看实时运行数据。

OpenRouter

DeepInfra

fp8
上下文
131K
最大输出
16K
输入
$0.100
输出
$0.320
缓存读取
暂未提供
缓存写入
暂未提供

Nebius

fp8
上下文
131K
最大输出
118K
输入
$0.130
输出
$0.400
缓存读取
暂未提供
缓存写入
暂未提供

Novita

bf16
上下文
12K
最大输出
11K
输入
$0.135
输出
$0.400
缓存读取
暂未提供
缓存写入
暂未提供

AkashML

fp8
上下文
131K
最大输出
128K
输入
$0.200
输出
$0.520
缓存读取
$0.100
缓存写入
暂未提供

Parasail

fp8
上下文
131K
最大输出
16K
输入
$0.220
输出
$0.500
缓存读取
$0.110
缓存写入
暂未提供

Crusoe

bf16
上下文
131K
最大输出
118K
输入
$0.250
输出
$0.750
缓存读取
$0.130
缓存写入
暂未提供

Cloudflare

fp8
上下文
24K
最大输出
22K
输入
$0.293
输出
$2.25
缓存读取
暂未提供
缓存写入
暂未提供

SambaNova

unknown
上下文
131K
最大输出
3K
输入
$0.450
输出
$0.900
缓存读取
暂未提供
缓存写入
暂未提供

Groq

unknown
上下文
131K
最大输出
33K
输入
$0.590
输出
$0.790
缓存读取
$0.295
缓存写入
暂未提供

CoreWeave

fp16
上下文
128K
最大输出
115K
输入
$0.710
输出
$0.710
缓存读取
$0.710
缓存写入
暂未提供

Google

unknown
上下文
128K
最大输出
8K
输入
$0.720
输出
$0.720
缓存读取
暂未提供
缓存写入
暂未提供

Google

unknown
上下文
128K
最大输出
115K
输入
$0.720
输出
$0.720
缓存读取
暂未提供
缓存写入
暂未提供

Together

unknown
上下文
131K
最大输出
2K
输入
$1.04
输出
$1.04
缓存读取
暂未提供
缓存写入
暂未提供
meta-llama

个模型

全部模型