ZA
z-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

模型概览

模型规格

上下文
1,048,575 tokens
最大输出
943,717 tokens
架构
text+image+video->text
分词器
Other
知识截止时间
暂未提供
内容审核
能力与模态

输入输出

输入
textimagevideo
输出
text
推理能力

· max · high · low

API

支持的 API 参数

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
可用提供方

21 个提供方

Relace

fp4
上下文
1.0M
最大输出
131K
输入
$0.050
输出
$0.167
缓存读取
$0.010
缓存写入
暂未提供

Z.AI

fp8
上下文
1.0M
最大输出
131K
输入
$0.075
输出
$0.250
缓存读取
$0.015
缓存写入
暂未提供

Novita

fp8
上下文
1.0M
最大输出
131K
输入
$0.075
输出
$0.250
缓存读取
$0.015
缓存写入
暂未提供

DeepInfra

fp8
上下文
1.0M
最大输出
944K
输入
$0.075
输出
$0.250
缓存读取
$0.015
缓存写入
暂未提供

GMICloud

fp8
上下文
1.0M
最大输出
944K
输入
$0.075
输出
$0.250
缓存读取
$0.015
缓存写入
暂未提供

Makora

unknown
上下文
1.0M
最大输出
944K
输入
$0.140
输出
$0.470
缓存读取
$0.024
缓存写入
暂未提供

Modal

fp8
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Morph

fp8
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.420
缓存读取
$0.010
缓存写入
暂未提供

Parasail

fp8
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Reka

fp8
上下文
262K
最大输出
236K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Together

unknown
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Wafer

unknown
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

DigitalOcean

unknown
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

SiliconFlow

fp8
上下文
1.0M
最大输出
262K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Friendli

unknown
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Phala

fp8
上下文
1.0M
最大输出
131K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Fireworks

unknown
上下文
1.0M
最大输出
944K
输入
$0.150
输出
$0.500
缓存读取
$0.029
缓存写入
暂未提供

Cloudflare

unknown
上下文
1.3M
最大输出
1.2M
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Io Net

fp8
上下文
262K
最大输出
131K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

BaseTen

fp8
上下文
1.0M
最大输出
131K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供

Venice

unknown
上下文
1.0M
最大输出
131K
输入
$0.150
输出
$0.500
缓存读取
$0.030
缓存写入
暂未提供