models/NVIDIA/Nemotron Asr Multilingual
NVIDIA

Nemotron Asr Multilingual

audio-stt
Compare

Nemotron-ASR-Streaming is a multi lingual, streaming Automatic Speech Recognition (ASR) engineered to deliver high-quality multi lingual transcription across both low-latency streaming and high-throughput batch workloads.

MODALITIES
audio

Nemotron Asr Multilingual (nvidia/nemotron-asr-multilingual/asr) is a audio-stt model from NVIDIA. Pricing via AIgateway: $0.0080 per minute. Call it via https://api.aigateway.sh/v1/audio/transcriptions — set model="nvidia/nemotron-asr-multilingual/asr".

model · nvidia/nemotron-asr-multilingual/asr

Use this model

model: nvidia/nemotron-asr-multilingual/asr
curl https://api.aigateway.sh/v1/audio/transcriptions \
  -H "Authorization: Bearer $AIGATEWAY_API_KEY" \
  -F model="nvidia/nemotron-asr-multilingual/asr" \
  -F file="@audio.mp3"
API schema

Call Nemotron Asr Multilingual from any OpenAI SDK

POST https://api.aigateway.sh/v1/audio/transcriptions·Content-Type: multipart/form-data·Auth: Bearer sk-aig-...

Request body

json
# multipart/form-data — use curl -F or SDK file upload
model="nvidia/nemotron-asr-multilingual/asr"
file=@audio.mp3
response_format=json    # or "verbose_json", "text", "srt", "vtt"
language=en             # optional

Response

json
{
  "text": "Hello from AIgateway.",
  "language": "en",
  "duration": 1.82
}

Quickstart

from openai import OpenAI
client = OpenAI(base_url="https://api.aigateway.sh/v1", api_key="sk-aig-...")

with open("audio.mp3", "rb") as f:
    r = client.audio.transcriptions.create(model="nvidia/nemotron-asr-multilingual/asr", file=f)
print(r.text)

Errors

401authentication_errorInvalid or missing API key
402insufficient_creditsWallet empty (PAYG only)
404not_foundUnknown model or endpoint
429rate_limit_errorOver per-minute limit — see Retry-After header
500server_errorUpstream provider failed (retryable)
503service_unavailableUpstream saturated (retryable)
Full docs →API reference →OpenAPI spec →llms.txt →

Frequently asked questions

What is Nemotron Asr Multilingual?
Nemotron-ASR-Streaming is a multi lingual, streaming Automatic Speech Recognition (ASR) engineered to deliver high-quality multi lingual transcription across both low-latency streaming and high-throughput batch workloads. It is a audio-stt model from NVIDIA, accessible via AIgateway's OpenAI-compatible API at slug nvidia/nemotron-asr-multilingual/asr.
How much does Nemotron Asr Multilingual cost via AIgateway?
$0.0080 per minute of audio, billed pass-through.
How do I call Nemotron Asr Multilingual from my code?
Point the OpenAI SDK at https://api.aigateway.sh/v1 with your AIgateway key and set model to "nvidia/nemotron-asr-multilingual/asr". The request and response shapes match OpenAI exactly.
Does Nemotron Asr Multilingual support streaming, tool calling, vision, and JSON mode?
Streaming — no. Tool calling — no. Vision — no. JSON mode — no. Prompt caching — no.
Can I bring my own NVIDIA API key (BYOK)?
Yes. Attach a NVIDIA key in your AIgateway dashboard and this model flips to pass-through — you pay NVIDIA directly and AIgateway adds no platform fee on those calls.