AI Tools

307 tools available

Stable Audio

Stable Audio

Stable Audio est la plateforme audio générative de Stability AI pour créer musique, loops, stems, ambiances et effets sonores depuis des prompts. Stable Audio 3.0 propose des modèles pour expérimentation artistique et options open-weight.

Stable Audiogénérateur musique IAtexte vers musique
1330
AudioCraft

AudioCraft

Open source library for audio/music generation by Meta, which mainly includes two models, MusicGen: text-to-music model, AudioGen: text-generated sound model. - Outil IA intelligent pour améliorer votre productivité.

ai-musicfree
1250
Bark

Bark

Bark is a transformer-based text-to-audio model created by Suno. Bark can generate highly realistic, multilingual speech as well as other audio - including music, background noise and simple sound effects. - Outil IA intelligent pour améliorer votre productivité.

ai-musicfree
1350
ElevenLabs Sound Effects

ElevenLabs Sound Effects

ElevenLabs Sound Effects est un générateur text-to-sound-effects pour créer SFX, ambiances, loops et audio cinématique depuis des prompts. Il prend en charge durée, prompt influence, loops, variations, téléchargements et workflows API.

ElevenLabs Sound Effectseffets sonores IAtext to sound effects
2310
Mureka

Mureka

Mureka est une plateforme de création musicale par IA qui génère des chansons depuis un prompt ou des paroles, puis propose référence audio, Vocal ID, retouche ciblée, remix, stems et export.

Murekagénérateur de musique IAparoles en chanson
1700
Udio

Udio

Create music from simple text prompts by specifying topics, genres, and other descriptors which are then transformed into professional quality tracks. - Outil IA intelligent pour améliorer votre productivité.

ai-musicfree
1300
Suno AI

Suno AI

Create stunning original music for free in seconds using AI. Make your own masterpieces, share with friends, and discover music from artists worldwide. - Outil IA intelligent pour améliorer votre productivité.

ai-musicfree
1360
Lalal.ai

Lalal.ai

Split vocal and instrumental tracks quickly and accurately with LALAL.AI. Upload any audio file and receive high-quality extracted tracks in a few seconds. - Outil IA intelligent pour améliorer votre productivité.

voice-processingfree
850
Vocal Remover

Vocal Remover

Separate voice from music out of a song free with powerful AI algorithms - Outil IA intelligent pour améliorer votre productivité.

voice-processingfree
940
So-VITS-SVC

So-VITS-SVC

So-VITS-SVC 4.1 est un cadre de recherche open source archivé pour la conversion de la voix chantée, et non la synthèse vocale. Ce guide indépendant couvre le consentement, les licences, les ensembles de données propres, F0 et encodeurs, la formation, l'inférence, l'évaluation, la divulgation, la sécurité et les alternatives.

so-vits-svcconversion voix chantéevoice conversion
1460
Shazam

Shazam

Shazam est l’app Apple de reconnaissance musicale pour identifier les chansons autour de soi ou dans des apps compatibles. Elle aide à trouver vite titre, paroles, vidéos, concerts et liens Apple Music.

Shazammusic recognitionsong identifier
1000
ChatTTS

ChatTTS

ChatTTS is a text-to-speech model designed specifically for dialogue scenario such as LLM assistant. It supports both English and Chinese languages. - Outil IA intelligent pour améliorer votre productivité.

text-to-speechfree
1170
Tetos

Tetos

Tetos est un wrapper open source Python/CLI qui fournit une interface unifiée pour plusieurs fournisseurs text-to-speech. Il aide les développeurs à comparer ou changer Edge TTS, OpenAI, Azure, Google, Volcengine, Baidu, Minimax, Xunfei, Fish Audio et autres moteurs.

Tetostext to speechTTS API
1160
EmotiVoice

EmotiVoice

EmotiVoice est un moteur TTS open source gratuit de NetEase Youdao, multi-voix et contrôlé par prompts. Il prend en charge anglais et chinois, plus de 2 000 voix et le contrôle émotionnel pour recherche, prototypes et applications vocales.

EmotiVoiceTTS émotionnelTTS open source
1130
ElevenLabs

ElevenLabs

ElevenLabs est une plateforme de voix IA pour TTS, clonage vocal, doublage, STT, voice agents et API audio génératives.

ElevenLabsAI voice generatortext to speech
1270
Coqui TTS

Coqui TTS

A deep learning toolkit for Text-to-Speech, battle-tested in research and production - Outil IA intelligent pour améliorer votre productivité.

text-to-speechfree
1190
Hailuo AI TTS

Hailuo AI TTS

Hailuo AI TTS est un outil lié à MiniMax Audio pour la synthèse vocale multilingue, les voix IA et le clonage vocal.

Hailuo AI TTSMiniMax Audiotext to speech
1410
Azure Text to Speech

Azure Text to Speech

The best and most realistic voice tools currently available - Outil IA intelligent pour améliorer votre productivité.

text-to-speech
1160
Index TTS

Index TTS

IndexTTS est le système open source de Bilibili pour synthèse vocale zero-shot, contrôlable et efficace à niveau industriel. Il vise plutôt chercheurs et développeurs speech qu’une app web vocale clé en main.

Index TTStext to speechzero-shot TTS
1540
Whisper Web

Whisper Web

Whisper Web est une démo MIT de reconnaissance vocale dans le navigateur avec Transformers.js, transcription locale, horodatage et export TXT/JSON.

Whisper Webreconnaissance vocale navigateurTransformers.js
1120
WhisperX

WhisperX

WhisperX est une chaîne open source pour l’audio long qui ajoute à faster-whisper le batch, l’alignement forcé par langue et la diarisation optionnelle avec pyannote.

WhisperXspeech alignmentspeaker diarization
1450
WhisperDesktop

WhisperDesktop

WhisperDesktop est une application de bureau Windows et une implémentation de DirectCompute pour exécuter OpenAI Whisper localement sur une entrée audio, vidéo et microphone. Ce guide couvre la configuration, les modèles, les GPU, les sous-titres, la confidentialité et les alternatives.

WhisperDesktopOpenAI Whisperspeech recognition
1340
Buzz

Buzz

Buzz est une application de bureau gratuite sous licence MIT pour la transcription Whisper locale, les sous-titres, les sous-titres en direct, la traduction et l'étiquetage des locuteurs sur macOS, Windows et Linux. Ce guide compare les backends, le matériel, la confidentialité, les tests de précision, l'assurance qualité des sous-titres, l'automatisation CLI et les alternatives cloud.

BuzzBuzz Captionstranscription offline
2130
Whisper.cpp

Whisper.cpp

Whisper.cpp est une implémentation C/C++ légère en dépendances de OpenAI Whisper pour la transcription locale, la traduction, le streaming, les serveurs et les applications intégrées. Ce guide couvre les modèles, la quantification, les backends, la précision, la confidentialité et le déploiement.

speech-recognitionfree
1140
1...678910...13