nemotron-3.5-asr-streaming-multilingual-0.6b

Coming soon
NVIDIA

Nemotron 3.5 ASR Streaming Multilingual is an open 0.6B-parameter prompt-conditioned cache-aware FastConformer-RNNT model, engineered for low-latency streaming transcription across 40+ languages. It powers real-time captioning, voice agents, and multilingual transcription pipelines—replacing separate per-language Whisper deployments with a single inference pass.

Modality

Chat

Region

US

Published

Jul 21, 2026

Use it via the API

nemotron-3.5-asr-streaming-multilingual-0.6b works with any OpenAI-compatible SDK — point the base URL at https://preprod-backend.sovereigneg.com/v1 and use your SovereignEG API key.

Run inference

OpenAI-compatible — POST /v1/chat/completions — drop-in for any OpenAI SDK.

from openai import OpenAI

client = OpenAI(
    base_url="https://preprod-backend.sovereigneg.com/v1",
    api_key="YOUR_API_KEY",
)

response = client.chat.completions.create(
    model="nemotron-3.5-asr-streaming-multilingual-0.6b",
    messages=[
        {"role": "user", "content": "What are some fun things to do in Cairo?"}
    ],
)

print(response.choices[0].message.content)

Frequently asked questions

Where is nemotron-3.5-asr-streaming-multilingual-0.6b hosted?

nemotron-3.5-asr-streaming-multilingual-0.6b is served from US (US-hosted inference).

How do I use nemotron-3.5-asr-streaming-multilingual-0.6b via the API?

nemotron-3.5-asr-streaming-multilingual-0.6b is available through the OpenAI-compatible SovereignEG API: point your SDK's base URL at https://preprod-backend.sovereigneg.com/v1 and call /v1/chat/completions with model "nemotron-3.5-asr-streaming-multilingual-0.6b" and your API key.