text-to-audioElevenlabs Tts Eleven V3
fal-ai/elevenlabs/tts/eleven-v3Generate text-to-speech audio using Eleven-v3 from ElevenLabs.
Browse the public fal model directory. Models become callable through Kaista Cloud only after supply, pricing, and compatibility review.
text-to-audiofal-ai/elevenlabs/tts/eleven-v3Generate text-to-speech audio using Eleven-v3 from ElevenLabs.
text-to-audiofal-ai/elevenlabs/tts/multilingual-v2Generate multilingual text-to-speech audio using ElevenLabs TTS Multilingual v2.
fal-ai/elevenlabs/sound-effects/v2Generate sound effects using ElevenLabs advanced sound effects model.
text-to-audiofal-ai/elevenlabs/musicGenerate high quality, realistic music with fine controls using Elevenlabs Music!
text-to-audiominimax/music-3MiniMax Music 3 is a high-performance music generation model for creating complete songs up to five minutes long
text-to-audiofal-ai/stable-audio-25/text-to-audioGenerate high quality music and sound effects using Stable Audio 2.5 from StabilityAI
text-to-audiofal-ai/minimax-music/v2.6MiniMax Music 2.6 creates complete tracks with singing, backing music, and detailed arrangements from lyrics and a style description.
text-to-audiocassetteai/music-generatorCassetteAI’s model generates a 30-second sample in under 2 seconds and a full 3-minute track in under 10 seconds. At 44.1 kHz stereo audio, expect a level of professional consistency with no breaks, no squeaks, and no random interruptions in your creations.
text-to-audiobytedance/seed-audio-1.0Seed Audio 1.0 is a new audio model from Bytedance that can generate high-quality, natural sounding audio using text, reference audios or an image.
text-to-audio
text-to-audiofal-ai/minimax-music/v2Generate music from text prompts using the MiniMax Music 2.0 model, which leverages advanced AI techniques to create high-quality, diverse musical compositions.
text-to-audiofal-ai/lyria3/proLyria 3 Pro is the latest music model from Google
text-to-audio
text-to-audiofal-ai/lyria2Lyria 2 is Google's latest music generation model, you can generate any type of music with this model.
text-to-audiofal-ai/stable-audio-3/medium/text-to-audioStable Audio 3 Medium is a 1.4 billion parameter latent diffusion model that generates high-quality stereo music up to 6 minutes from text prompts, trained on fully licensed data for safe commercial use.
text-to-audiofal-ai/kokoro/american-englishKokoro is a lightweight text-to-speech model that delivers comparable quality to larger models while being significantly faster and more cost-efficient.
text-to-audiosonilo/v1.1/text-to-musicGenerates licensed, commercial-use-safe music from a single text prompt, with full control over style, mood, instrumentation, and exact duration.
text-to-audiosonilo/v1.1/text-to-sound-effectsGenerates high-quality, commercial-use-safe sound effects from a text prompt, with full control over type, texture, intensity, and exact duration.
text-to-audiofal-ai/elevenlabs/text-to-dialogue/eleven-v3Generate realistic audio dialogues using Eleven-v3 from ElevenLabs.
text-to-audiocassetteai/sound-effects-generatorCreate stunningly realistic sound effects in seconds - CassetteAI's Sound Effects Model generates high-quality SFX up to 30 seconds long in just 1 second of processing time
text-to-audiofal-ai/ace-step/prompt-to-audioGenerate music from a simple prompt using ACE-Step
text-to-audiofal-ai/gemini-ttsUse Gemini TTS Models to convert your prompts to real audio.
text-to-audio
text-to-audio
text-to-audiofal-ai/minimax-musicGenerate music from text prompts using the MiniMax model, which leverages advanced AI techniques to create high-quality, diverse musical compositions.
text-to-audiofal-ai/stable-audio-3/small/music/text-to-audioStable Audio 3 Small Music is a 459 million parameter latent diffusion model that generates full stereo music compositions up to 2 minutes from text prompts, lightweight enough for on-device deployment.
text-to-audiofal-ai/stable-audio-3/small/sfx/text-to-audioStable Audio 3 Small SFX is a 459 million parameter latent diffusion model that generates high-quality sound effects from text prompts, designed for on-device deployment on mobile phones and consumer laptops.
text-to-audiofal-ai/mmaudio-v2/text-to-audioMMAudio generates synchronized audio given text inputs. It can generate sounds described by a prompt.