AI Tools

307 tools available

Stable Audio

Stable Audio

Stable Audio es la plataforma de audio generativo de Stability AI para crear música, loops, stems, ambientes y efectos de sonido desde prompts de texto. La familia Stable Audio 3.0 ofrece modelos para experimentación artística y opciones open-weight para investigación y flujos locales.

Stable AudioStability AI audiogenerador música IA
1710
AudioCraft

AudioCraft

Open source library for audio/music generation by Meta, which mainly includes two models, MusicGen: text-to-music model, AudioGen: text-generated sound model. - Herramienta de IA inteligente para mejorar tu productividad.

ai-musicfree
1290
Bark

Bark

Bark is a transformer-based text-to-audio model created by Suno. Bark can generate highly realistic, multilingual speech as well as other audio - including music, background noise and simple sound effects. - Herramienta de IA inteligente para mejorar tu productividad.

ai-musicfree
1290
ElevenLabs Sound Effects

ElevenLabs Sound Effects

ElevenLabs Sound Effects es un generador text-to-sound-effects para crear SFX, ambientes, loops y audio cinematográfico desde prompts. Permite controlar duración, prompt influence, efectos en loop, variaciones, descargas y workflows API para video, juegos, podcasts y apps.

ElevenLabs Sound Effectsefectos sonido IAtexto a efectos sonido
1460
Mureka

Mureka

Mureka es una plataforma de música con IA que genera canciones desde prompts o letras y reúne audio de referencia, Vocal IDs, edición regional, extensión, remix, stems y exportación.

Murekagenerador de música IAletras a canción
1610
Udio

Udio

Create music from simple text prompts by specifying topics, genres, and other descriptors which are then transformed into professional quality tracks. - Herramienta de IA inteligente para mejorar tu productividad.

ai-musicfree
1370
Suno AI

Suno AI

Create stunning original music for free in seconds using AI. Make your own masterpieces, share with friends, and discover music from artists worldwide. - Herramienta de IA inteligente para mejorar tu productividad.

ai-musicfree
1370
Lalal.ai

Lalal.ai

Split vocal and instrumental tracks quickly and accurately with LALAL.AI. Upload any audio file and receive high-quality extracted tracks in a few seconds. - Herramienta de IA inteligente para mejorar tu productividad.

voice-processingfree
1240
Vocal Remover

Vocal Remover

Separate voice from music out of a song free with powerful AI algorithms - Herramienta de IA inteligente para mejorar tu productividad.

voice-processingfree
1000
So-VITS-SVC

So-VITS-SVC

So-VITS-SVC 4.1 es un marco de investigación archivado de código abierto para la conversión de voz cantada, no de texto a voz. Esta guía independiente cubre consentimiento, licencias, conjuntos de datos limpios, F0 y codificadores, capacitación, inferencia, evaluación, divulgación, seguridad y alternativas.

so-vits-svcconversión de voz cantadavoice conversion
1550
Shazam

Shazam

Shazam es la app de Apple para reconocer música que suena cerca o dentro de apps compatibles. Sirve para encontrar rápido el tema, letra, vídeo, conciertos y enlaces a Apple Music.

Shazammusic recognitionsong identifier
1070
ChatTTS

ChatTTS

ChatTTS is a text-to-speech model designed specifically for dialogue scenario such as LLM assistant. It supports both English and Chinese languages. - Herramienta de IA inteligente para mejorar tu productividad.

text-to-speechfree
1130
Tetos

Tetos

Tetos es un wrapper open source en Python/CLI que ofrece una interfaz unificada para múltiples proveedores de text-to-speech. Sirve a desarrolladores que quieren comparar o cambiar entre Edge TTS, OpenAI, Azure, Google, Volcengine, Baidu, Minimax, Xunfei, Fish Audio y otros motores.

Tetostext to speechTTS API
1310
EmotiVoice

EmotiVoice

EmotiVoice es un motor TTS open source y gratuito de NetEase Youdao, con múltiples voces y control por prompts. Soporta síntesis en inglés y chino, más de 2.000 voces y control emocional para investigación, prototipos, personajes y apps de voz.

EmotiVoiceTTS emocionalTTS open source
1190
ElevenLabs

ElevenLabs

ElevenLabs es una plataforma de voz AI para texto a voz, clonación, doblaje, STT, voice agents y APIs de audio generativo.

ElevenLabsAI voice generatortext to speech
1970
Coqui TTS

Coqui TTS

A deep learning toolkit for Text-to-Speech, battle-tested in research and production - Herramienta de IA inteligente para mejorar tu productividad.

text-to-speechfree
1530
Hailuo AI TTS

Hailuo AI TTS

Hailuo AI TTS es una herramienta vinculada a MiniMax Audio para texto a voz multilingüe, voces IA y clonación de voz.

Hailuo AI TTSMiniMax Audiotext to speech
1330
Azure Text to Speech

Azure Text to Speech

The best and most realistic voice tools currently available - Herramienta de IA inteligente para mejorar tu productividad.

text-to-speech
1450
Index TTS

Index TTS

IndexTTS es el sistema open source de Bilibili para síntesis de voz zero-shot, controlable y eficiente a nivel industrial. Es más útil para investigadores y desarrolladores de voz que para usuarios que buscan una app web pulida.

Index TTStext to speechzero-shot TTS
1670
Whisper Web

Whisper Web

Whisper Web es una demo MIT de reconocimiento de voz en el navegador con Transformers.js, transcripción local, marcas de tiempo y exportación TXT/JSON.

Whisper Webvoz a texto en navegadorTransformers.js
1550
WhisperX

WhisperX

WhisperX es una canalización abierta para audio largo que añade a faster-whisper transcripción por lotes, alineación forzada por idioma y diarización opcional con pyannote.

WhisperXspeech alignmentspeaker diarization
1180
WhisperDesktop

WhisperDesktop

WhisperDesktop es una aplicación de escritorio de Windows y una implementación de DirectCompute para ejecutar OpenAI Whisper localmente en entradas de audio, video y micrófono. Esta guía cubre la configuración, los modelos, las GPU, los subtítulos, la privacidad y las alternativas.

WhisperDesktopOpenAI Whisperspeech recognition
2400
Buzz

Buzz

Buzz es una aplicación de escritorio gratuita con licencia del MIT para transcripción local de Whisper, subtítulos, subtítulos en vivo, traducción y etiquetado de oradores en macOS, Windows y Linux. Esta guía compara backends, hardware, privacidad, pruebas de precisión, control de calidad de subtítulos, automatización CLI y alternativas en la nube.

BuzzBuzz Captionstranscripción offline
1830
Whisper.cpp

Whisper.cpp

Whisper.cpp es una implementación C/C++ sin dependencias de OpenAI Whisper para transcripción, traducción, transmisión, servidores y aplicaciones integradas locales. Esta guía cubre modelos, cuantificación, backends, precisión, privacidad e implementación.

speech-recognitionfree
1410
1...678910...13