Run multilingual speech recognition or translation with an open NVIDIA model.
Audio & Voice

Turn English speech into punctuated text with word timestamps using an NVIDIA open ASR model.
Best for: Builders and researchers who want an open transcription model rather than a subscription-only editor.
Run multilingual speech recognition or translation with an open NVIDIA model.
Use text and optional audio to explore unusual sound generation and transformation.
Generate expressive, multilingual speech from a short voice reference with an open local model.