NeMo Speech
NVIDIAs skalierbares generatives KI-Framework für Sprache – ASR, TTS und Sprachmodelle in einem Toolkit.
Überblick
Anforderungen
Empfohlener VPS
Hostinger · KVM 4
4 vCPU · 16384 MB · 200 GB
Hostinger · KVM 4
4 vCPU · 16384 MB · 200 GB
Hostinger · KVM 8
8 vCPU · 32256 MB · 400 GB
Affiliate-Hinweis
Docker Compose
# Generated by Run This Ai — docker-compose.yml
services:
nemo-speech:
image: nvcr.io/nvidia/nemo:latest
restart: unless-stopped
ports:
- 8080:8080
volumes:
- ./data/nemo-speech:/data
Verwandte Tools
ebook2audiobook
Erstelle Hörbücher aus E-Books mit Voice-Cloning und über 1158 Sprachen.
FunASR
End-to-End-Spracherkennungs-Toolkit mit Streaming-ASR, VAD, Interpunktion und Sprecher-Diarisierung
DIA
Ultrarealistische Dialog-TTS in einem Durchgang
Supertonic
Blitzschnelle, mehrsprachige Text-zu-Sprache-Ausgabe direkt auf dem Gerät, nativ via ONNX.
ESPnet
Das End-to-End-Sprachverarbeitungstoolkit für ASR, TTS, Sprachübersetzung und Sprecher-Diarisierung.
Abogen
Erstelle Hörbücher aus EPUBs, PDFs und Texten mit synchronisierten Untertiteln.
Anleitungen & Artikel
How to Deploy NeMo Speech for Speech Recognition with Docker
Step-by-step tutorial: deploy NVIDIA NeMo Speech for ASR in minutes using the official NGC container and docker-compose, then transcribe audio with Parakeet.
NeMo Speech Guide: NVIDIA's Open-Source ASR & TTS Framework
Discover NeMo Speech, NVIDIA's Apache-2.0 framework for ASR and TTS. Explore Parakeet, Canary, FastConformer, and why 17K+ developers deploy it with Docker.