Moonshine Voice
Echtzeit-KI für Sprache auf dem Gerät: Spracherkennung, Absichtserkennung und Sprachausgabe für die Entwicklung schneller, privater Sprachassistenten und Schnittstellen.
Überblick
Anforderungen
Empfohlener VPS
Hostinger · KVM 4
4 vCPU · 16384 MB · 200 GB
Hostinger · KVM 4
4 vCPU · 16384 MB · 200 GB
Hostinger · KVM 8
8 vCPU · 32256 MB · 400 GB
Affiliate-Hinweis
Docker Compose
# Generated by Run This Ai — docker-compose.yml
services:
moonshine:
image: spectralmemories/moonshine
restart: unless-stopped
ports:
- 8080:8080
volumes:
- ./data/moonshine:/data
Verwandte Tools
ebook2audiobook
Erstelle Hörbücher aus E-Books mit Voice-Cloning und über 1158 Sprachen.
FunASR
End-to-End-Spracherkennungs-Toolkit mit Streaming-ASR, VAD, Interpunktion und Sprecher-Diarisierung
DIA
Ultrarealistische Dialog-TTS in einem Durchgang
NeMo Speech
NVIDIAs skalierbares generatives KI-Framework für Sprache – ASR, TTS und Sprachmodelle in einem Toolkit.
Supertonic
Blitzschnelle, mehrsprachige Text-zu-Sprache-Ausgabe direkt auf dem Gerät, nativ via ONNX.
Piper
Schnelle, lokale neuronale Text-to-Speech-Lösung, die vollständig offline läuft
Anleitungen & Artikel
How to Build a Voice Agent with Moonshine Voice: Step-by-Step Tutorial
From pip install to a spoken conversational agent: a hands-on tutorial for building real-time, privacy-first voice apps with Moonshine Voice.
Moonshine Voice: A Complete Guide to On-Device Real-Time Voice AI
Moonshine Voice brings fast, private, on-device speech-to-text, intent recognition, and text-to-speech to any platform — with accuracy that rivals Whisper Large V3.