AI Tools

307 tools available

Stable Audio

Stable Audio

Stable Audio ist Stability AIs Plattform für generative Musik und Soundeffekte aus Textprompts. Die Stable-Audio-3.0-Familie unterstützt experimentelle Audio-Workflows und Open-Weight-Optionen für Forschung und lokale Kreativarbeit.

Stable AudioAI Music GeneratorText to Music
1210
AudioCraft

AudioCraft

Open source library for audio/music generation by Meta, which mainly includes two models, MusicGen: text-to-music model, AudioGen: text-generated sound model. - Intelligentes KI-Tool für mehr Produktivität.

ai-musicfree
1020
Bark

Bark

Bark is a transformer-based text-to-audio model created by Suno. Bark can generate highly realistic, multilingual speech as well as other audio - including music, background noise and simple sound effects. - Intelligentes KI-Tool für mehr Produktivität.

ai-musicfree
1120
ElevenLabs Sound Effects

ElevenLabs Sound Effects

ElevenLabs Sound Effects ist ein Text-to-Sound-Effects-Generator für individuelle SFX, Ambience, Loops und Cinematic Audio. Er unterstützt Dauersteuerung, Prompt Influence, Loops, mehrere Varianten, Downloads und API-Workflows.

ElevenLabs Sound EffectsAI Sound EffectsText to Sound Effects
1380
Mureka

Mureka

Mureka ist eine KI-Musikplattform, die Songs aus Prompts oder Texten erzeugt und Referenzaudio, Vocal IDs, Bereichsedits, Verlängerung, Remix, Stem-Trennung und Export verbindet.

MurekaKI-MusikgeneratorText zu Song
1160
Udio

Udio

Create music from simple text prompts by specifying topics, genres, and other descriptors which are then transformed into professional quality tracks. - Intelligentes KI-Tool für mehr Produktivität.

ai-musicfree
1250
Suno AI

Suno AI

Create stunning original music for free in seconds using AI. Make your own masterpieces, share with friends, and discover music from artists worldwide. - Intelligentes KI-Tool für mehr Produktivität.

ai-musicfree
1190
Lalal.ai

Lalal.ai

Split vocal and instrumental tracks quickly and accurately with LALAL.AI. Upload any audio file and receive high-quality extracted tracks in a few seconds. - Intelligentes KI-Tool für mehr Produktivität.

voice-processingfree
710
Vocal Remover

Vocal Remover

Separate voice from music out of a song free with powerful AI algorithms - Intelligentes KI-Tool für mehr Produktivität.

voice-processingfree
810
So-VITS-SVC

So-VITS-SVC

So-VITS-SVC 4.1 ist ein archiviertes Open-Source-Forschungsframework für die Konvertierung von Gesangsstimmen, nicht für die Umwandlung von Text in Sprache. Dieser unabhängige Leitfaden behandelt Einwilligung, Lizenzierung, saubere Datensätze, F0 und Encoder, Schulung, Schlussfolgerung, Bewertung, Offenlegung, Sicherheit und Alternativen.

so-vits-svcSinging Voice ConversionVoice Conversion
1020
Shazam

Shazam

Shazam ist Apples App zur Musikerkennung für Songs in der Umgebung oder in unterstützten Apps. Sie ist nützlich für schnelle Song-IDs, Lyrics, Videos, Konzertinformationen und den Übergang zu Apple Music.

Shazammusic recognitionsong identifier
1030
ChatTTS

ChatTTS

ChatTTS is a text-to-speech model designed specifically for dialogue scenario such as LLM assistant. It supports both English and Chinese languages. - Intelligentes KI-Tool für mehr Produktivität.

text-to-speechfree
1010
Tetos

Tetos

Tetos ist ein Open-Source-Python- und CLI-Wrapper mit einheitlicher Schnittstelle für mehrere Text-to-Speech-Anbieter. Nützlich für Entwickler, die Edge TTS, OpenAI, Azure, Google, Volcengine, Baidu, Minimax, Xunfei, Fish Audio und andere Engines vergleichen oder wechseln wollen.

Tetostext to speechTTS API
1230
EmotiVoice

EmotiVoice

EmotiVoice ist eine kostenlose Open-Source-TTS-Engine von NetEase Youdao mit mehreren Stimmen und Prompt-Steuerung. Sie unterstützt Englisch und Chinesisch, über 2.000 Stimmen und emotionale Steuerung für Forschung, Prototypen und Voice-Anwendungen.

EmotiVoiceemotional TTSOpen Source TTS
900
ElevenLabs

ElevenLabs

ElevenLabs ist eine AI-Voice-Plattform für Text-to-Speech, Voice Cloning, Dubbing, Speech-to-Text, Voice Agents und generative Audio-APIs.

ElevenLabsAI voice generatortext to speech
1150
Coqui TTS

Coqui TTS

A deep learning toolkit for Text-to-Speech, battle-tested in research and production - Intelligentes KI-Tool für mehr Produktivität.

text-to-speechfree
1070
Hailuo AI TTS

Hailuo AI TTS

Hailuo AI TTS ist ein mit MiniMax Audio verbundenes Tool für mehrsprachige Text-to-Speech-Erzeugung, KI-Stimmen und Voice Cloning.

Hailuo AI TTSMiniMax Audiotext to speech
1090
Azure Text to Speech

Azure Text to Speech

The best and most realistic voice tools currently available - Intelligentes KI-Tool für mehr Produktivität.

text-to-speech
860
Index TTS

Index TTS

IndexTTS ist Bilibili’s Open-Source-System für industrielle, steuerbare und effiziente Zero-Shot-Text-to-Speech-Synthese. Es richtet sich eher an Speech-Forscher und Entwickler als an Nutzer einer fertigen Web-App.

Index TTStext to speechzero-shot TTS
1100
Whisper Web

Whisper Web

Whisper Web ist eine MIT-lizenzierte Browser-Spracherkennungsdemo mit Transformers.js für lokale Transkription, Zeitstempel und TXT/JSON-Export.

Whisper WebSpracherkennung im BrowserTransformers.js
1180
WhisperX

WhisperX

WhisperX ist eine Open-Source-Pipeline für lange Audiodateien, die faster-whisper-Batches um sprachspezifisches Wort-Alignment und optionale pyannote-Sprecherdiarisierung ergänzt.

WhisperXspeech alignmentspeaker diarization
1310
WhisperDesktop

WhisperDesktop

WhisperDesktop ist eine Windows-Desktop-App und DirectCompute-Implementierung zum lokalen Ausführen von OpenAI Whisper auf Audio-, Video- und Mikrofoneingaben. In diesem Handbuch werden Einrichtung, Modelle, GPUs, Untertitel, Datenschutz und Alternativen behandelt.

WhisperDesktopOpenAI Whisperspeech recognition
1110
Buzz

Buzz

Buzz ist eine kostenlose, vom MIT lizenzierte Desktop-App für lokale Whisper-Transkription, Untertitel, Live-Untertitel, Übersetzung und Sprecherkennzeichnung auf macOS, Windows und Linux. In diesem Leitfaden werden Backends, Hardware, Datenschutz, Genauigkeitstests, Untertitel-Qualitätssicherung, CLI-Automatisierung und Cloud-Alternativen verglichen.

BuzzBuzz CaptionsOffline Transkription
1570
Whisper.cpp

Whisper.cpp

Whisper.cpp ist eine abhängigkeitsarme C/C++-Implementierung von OpenAI Whisper für lokale Transkription, Übersetzung, Streaming, Server und eingebettete Apps. Dieser Leitfaden behandelt Modelle, Quantisierung, Backends, Genauigkeit, Datenschutz und Bereitstellung.

speech-recognitionfree
1160
1...678910...13