Run This Ai
EN DE

WhisperLiveKit

Echtzeit-Spracherkennung lokal mit Streaming-ASR, Sprecher-Diarisierung, Übersetzung und OpenAI/Deepgram-kompatiblen APIs.

★ 10,983 GitHub Apache-2.0 speech-to-textasrwhisperdiarizationstreaminglocalvoicerealtime Sprache & Audio

Überblick

WhisperLiveKit ist eine selbst gehostete Echtzeit-Speech-to-Text-Engine, die vollständig auf Ihrer eigenen Hardware läuft. Sie streamt Audiodaten von Ihrem Mikrofon oder einer beliebigen Quelle, transkribiert diese live mit geringer Latenz, erkennt den jeweiligen Sprecher und kann sogar Sprachen während der Übertragung übersetzen. Sie bietet OpenAI- und Deepgram-kompatible REST-Endpoints, wodurch sie sich ohne Code-Änderungen in bestehende Sprachanwendungen integrieren lässt. Keine Cloud-Abhängigkeit, keine minutenbasierten Gebühren – Ihre Audiodaten verlassen niemals Ihren Rechner.

Anforderungen

Min vCPU
2
Min RAM
4096 MB
Min Disk
10 GB
Rec vCPU
4
Rec RAM
8192 MB
Rec Disk
20 GB

Empfohlener VPS

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 8

8 vCPU · 32256 MB · 400 GB

$20.00
Zum Anbieter

Affiliate-Hinweis

Docker Compose

# Generated by Run This Ai — docker-compose.yml
services:
  whisperlivekit:
    image: vcure/whisperlivekit:latest
    restart: unless-stopped
    ports:
      - 8080:8080
    volumes:
      - ./data/whisperlivekit:/data

Bester VPS für WhisperLiveKit →

Verwandte Tools

Anleitungen & Artikel