N
nvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Overview

Model specifications

Context
Not provided
Maximum output
Not provided
Architecture
audio->transcription
Tokenizer
Other
Knowledge cutoff
Not provided
Moderated
No
Capabilities

InputOutput

Input
audio
Output
transcription
API

Supported API parameters

frequency_penaltymax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstoptemperaturetop_ktop_p
Available providers

1 Provider

DeepInfra

unknown
Context
Not provided
Maximum output
Not provided
Input
$3.33
Output
Free
Cache read
Not provided
Cache write
Not provided
nvidia

models

All models