Run This Ai
EN DE

Sprache & Audio

DIA

Ultrarealistische Dialog-TTS in einem Durchgang

★ 19,358

FunASR

End-to-End-Spracherkennungs-Toolkit mit Streaming-ASR, VAD, Interpunktion und Sprecher-Diarisierung

★ 19,532

Supertonic

Blitzschnelle, mehrsprachige Text-zu-Sprache-Ausgabe direkt auf dem Gerät, nativ via ONNX.

★ 13,564

Abogen

Erstelle Hörbücher aus EPUBs, PDFs und Texten mit synchronisierten Untertiteln.

★ 5,461

ebook2audiobook

Erstelle Hörbücher aus E-Books mit Voice-Cloning und über 1158 Sprachen.

★ 19,620

NeMo Speech

NVIDIAs skalierbares generatives KI-Framework für Sprache – ASR, TTS und Sprachmodelle in einem Toolkit.

★ 17,871

ESPnet

Das End-to-End-Sprachverarbeitungstoolkit für ASR, TTS, Sprachübersetzung und Sprecher-Diarisierung.

★ 9,912

Piper

Schnelle, lokale neuronale Text-to-Speech-Lösung, die vollständig offline läuft

★ 11,277

Moonshine Voice

Echtzeit-KI für Sprache auf dem Gerät: Spracherkennung, Absichtserkennung und Sprachausgabe für die Entwicklung schneller, privater Sprachassistenten und Schnittstellen.

★ 10,764

Anarlog

Local-first KI-Meeting-Protokollierung – Transkription auf dem Gerät, Nutzung eigener LLMs möglich

★ 9,069

Ultravox

Open-Source multimodales LLM für Echtzeit-Sprach-KI – Texteingabe, Sprachausgabe mit extrem geringer Latenz.

★ 4,556

Vexa

Open-Source-Meeting-Transkriptions-API für Google Meet, Microsoft Teams und Zoom

★ 2,728

WhisperLiveKit

Echtzeit-Spracherkennung lokal mit Streaming-ASR, Sprecher-Diarisierung, Übersetzung und OpenAI/Deepgram-kompatiblen APIs.

★ 10,983