WhisperLiveKit
Echtzeit-Spracherkennung lokal mit Streaming-ASR, Sprecher-Diarisierung, Übersetzung und OpenAI/Deepgram-kompatiblen APIs.
Überblick
Anforderungen
Empfohlener VPS
Hostinger · KVM 4
4 vCPU · 16384 MB · 200 GB
Hostinger · KVM 4
4 vCPU · 16384 MB · 200 GB
Hostinger · KVM 8
8 vCPU · 32256 MB · 400 GB
Affiliate-Hinweis
Docker Compose
# Generated by Run This Ai — docker-compose.yml
services:
whisperlivekit:
image: vcure/whisperlivekit:latest
restart: unless-stopped
ports:
- 8080:8080
volumes:
- ./data/whisperlivekit:/data
Verwandte Tools
ebook2audiobook
Erstelle Hörbücher aus E-Books mit Voice-Cloning und über 1158 Sprachen.
FunASR
End-to-End-Spracherkennungs-Toolkit mit Streaming-ASR, VAD, Interpunktion und Sprecher-Diarisierung
DIA
Ultrarealistische Dialog-TTS in einem Durchgang
NeMo Speech
NVIDIAs skalierbares generatives KI-Framework für Sprache – ASR, TTS und Sprachmodelle in einem Toolkit.
Supertonic
Blitzschnelle, mehrsprachige Text-zu-Sprache-Ausgabe direkt auf dem Gerät, nativ via ONNX.
Piper
Schnelle, lokale neuronale Text-to-Speech-Lösung, die vollständig offline läuft
Anleitungen & Artikel
How to Deploy WhisperLiveKit with Docker: Step-by-Step Tutorial
Deploy WhisperLiveKit in 10 minutes with Docker. Step-by-step tutorial covering hardware requirements, running the container, verifying the health endpoint, and connecting OpenAI/Deepgram-compatible apps.
WhisperLiveKit: Self-Hosted Real-Time Speech-to-Text Guide
A complete guide to WhisperLiveKit, the self-hosted real-time speech-to-text engine with streaming ASR, speaker diarization, live translation, and OpenAI/Deepgram-compatible APIs — 10,900+ GitHub stars and fully private.