Nemotron-ASR-Streaming is a multi lingual, streaming Automatic Speech Recognition (ASR) engineered to deliver high-quality multi lingual transcription across both low-latency streaming and high-throughput batch workloads.
Nemotron Asr Multilingual (nvidia/nemotron-asr-multilingual/asr) is a audio-stt model from NVIDIA. Pricing via AIgateway: $0.0080 per minute. Call it via https://api.aigateway.sh/v1/audio/transcriptions — set model="nvidia/nemotron-asr-multilingual/asr".
curl https://api.aigateway.sh/v1/audio/transcriptions \
-H "Authorization: Bearer $AIGATEWAY_API_KEY" \
-F model="nvidia/nemotron-asr-multilingual/asr" \
-F file="@audio.mp3"# multipart/form-data — use curl -F or SDK file upload model="nvidia/nemotron-asr-multilingual/asr" file=@audio.mp3 response_format=json # or "verbose_json", "text", "srt", "vtt" language=en # optional
{
"text": "Hello from AIgateway.",
"language": "en",
"duration": 1.82
}from openai import OpenAI
client = OpenAI(base_url="https://api.aigateway.sh/v1", api_key="sk-aig-...")
with open("audio.mp3", "rb") as f:
r = client.audio.transcriptions.create(model="nvidia/nemotron-asr-multilingual/asr", file=f)
print(r.text)