Visit LumiMusic
226 AI tools matching Voice & Sound, with pricing, category and a link to each official site. Page 5 of 6.
226 tools · page 5 of 6
Visit LumiMusic
Visit Tunesona AI Music Agent
Visit Sam Audio
Visit EZAudioIO
HuggingFace Space parler-tts/parler_tts.
HuggingFace Space haoheliu/audioldm-text-to-audio-generation.
HuggingFace Space fffiloni/img-to-music.
HuggingFace Space hkchengrex/MMAudio.
HuggingFace Space TTS-AGI/TTS-Arena-V2.
HuggingFace Space innoai/Edge-TTS-Text-to-Speech.
HuggingFace Space k2-fsa/OmniVoice.
HuggingFace Space myshell-ai/OpenVoice.
HuggingFace Space NihalGazi/Text-To-Speech-Unlimited.
HuggingFace Space hf-audio/open_asr_leaderboard.
HuggingFace Space tonyassi/voice-clone.
HuggingFace Space Qwen/Qwen3-TTS.
HuggingFace model Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice (text-to-speech).
HuggingFace Space facebook/MusicGen.
HuggingFace Space hexgrad/Kokoro-TTS.
HuggingFace Space mrfakename/E2-F5-TTS.
HuggingFace model MahmoudAshraf/mms-300m-1130-forced-aligner (automatic-speech-recognition).
HuggingFace model jonatasgrosman/wav2vec2-large-xlsr-53-polish (automatic-speech-recognition).
HuggingFace model openai/whisper-small (automatic-speech-recognition).
HuggingFace model jonatasgrosman/wav2vec2-large-xlsr-53-russian (automatic-speech-recognition).
HuggingFace model pyannote/segmentation (voice-activity-detection).
HuggingFace model openai/whisper-base (automatic-speech-recognition).
HuggingFace model pyannote/segmentation-3.0 (voice-activity-detection).
HuggingFace model jonatasgrosman/wav2vec2-large-xlsr-53-japanese (automatic-speech-recognition).
HuggingFace model pyannote/speaker-diarization-community-1 (automatic-speech-recognition).
HuggingFace model openai/whisper-large-v3 (automatic-speech-recognition).
HuggingFace model jonatasgrosman/wav2vec2-large-xlsr-53-portuguese (automatic-speech-recognition).
HuggingFace model pyannote/voice-activity-detection (automatic-speech-recognition).
HuggingFace model Qwen/Qwen3-ASR-1.7B (automatic-speech-recognition).
HuggingFace model Qwen/Qwen3-ASR-0.6B (automatic-speech-recognition).
HuggingFace model argmaxinc/whisperkit-coreml (automatic-speech-recognition).
HuggingFace model pyannote/speaker-diarization-3.1 (automatic-speech-recognition).
HuggingFace model coqui/XTTS-v2 (text-to-speech).
HuggingFace model openai/whisper-large-v3-turbo (automatic-speech-recognition).
HuggingFace model laion/clap-htsat-fused (audio-classification).
HuggingFace model hexgrad/Kokoro-82M (text-to-speech).
Can’t find a tool? Tell us about it.