{"data":{"node":{"slug":"ekwek1-soprano","name":"soprano","tagline":"Instant, Ultra-Realistic Text-to-Speech","github_url":"https://github.com/ekwek1/soprano","owner":"ekwek1","repo":"soprano","owner_avatar_url":"https://avatars.githubusercontent.com/u/101159140?v=4","primary_language":"Python","stars":1384,"forks":118,"topics":["text-to-speech","tts"],"archived":false,"github_pushed_at":"2026-01-15T16:32:56+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/ekwek1-soprano","markdown_url":"https://www.graphcanon.com/tools/ekwek1-soprano.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/ekwek1-soprano","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=ekwek1-soprano"},"categories":[{"slug":"speech-audio","name":"Speech & Audio","url":"https://www.graphcanon.com/categories/speech-audio","markdown_url":"https://www.graphcanon.com/categories/speech-audio.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/speech-audio"}],"tags":[{"slug":"text-to-speech","name":"text-to-speech"},{"slug":"tts","name":"tts"}],"edges":[],"neighbours":[{"slug":"myshell-ai-openvoice","name":"OpenVoice","tagline":"Instant voice cloning using an audio foundation model","github_url":"https://github.com/myshell-ai/OpenVoice","owner":"myshell-ai","repo":"OpenVoice","owner_avatar_url":"https://avatars.githubusercontent.com/u/127754094?v=4","primary_language":"Python","stars":37044,"forks":4146,"topics":["text-to-speech","tts","voice-clone","zero-shot-tts"],"archived":false,"github_pushed_at":"2025-04-19T16:00:00+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/myshell-ai-openvoice","markdown_url":"https://www.graphcanon.com/tools/myshell-ai-openvoice.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/myshell-ai-openvoice","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=myshell-ai-openvoice","shared_categories":["speech-audio"]},{"slug":"babysor-mockingbird","name":"MockingBird","tagline":"Clone a voice in 5 seconds to generate arbitrary speech in real-time","github_url":"https://github.com/babysor/MockingBird","owner":"babysor","repo":"MockingBird","owner_avatar_url":"https://avatars.githubusercontent.com/u/7423248?v=4","primary_language":"Python","stars":36913,"forks":5197,"topics":["ai","deep-learning","pytorch","speech","text-to-speech","tts"],"archived":false,"github_pushed_at":"2026-03-03T14:59:58+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/babysor-mockingbird","markdown_url":"https://www.graphcanon.com/tools/babysor-mockingbird.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/babysor-mockingbird","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=babysor-mockingbird","shared_categories":["speech-audio"]},{"slug":"openbmb-voxcpm","name":"VoxCPM","tagline":"Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning","github_url":"https://github.com/OpenBMB/VoxCPM","owner":"OpenBMB","repo":"VoxCPM","owner_avatar_url":"https://avatars.githubusercontent.com/u/89920203?v=4","primary_language":"Python","stars":34452,"forks":3939,"topics":["audio","deeplearning","minicpm","multilingual","python","pytorch","speech","speech-synthesis","text-to-speech","tts","tts-model","voice-cloning","voice-design","voxcpm"],"archived":false,"github_pushed_at":"2026-07-08T09:46:11+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/openbmb-voxcpm","markdown_url":"https://www.graphcanon.com/tools/openbmb-voxcpm.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/openbmb-voxcpm","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=openbmb-voxcpm","shared_categories":["speech-audio"]},{"slug":"supertone-inc-supertonic","name":"supertonic","tagline":"Lightning-Fast On-Device Multilingual TTS via ONNX","github_url":"https://github.com/supertone-inc/supertonic","owner":"supertone-inc","repo":"supertonic","owner_avatar_url":"https://avatars.githubusercontent.com/u/61007505?v=4","primary_language":"Swift","stars":13543,"forks":1427,"topics":["cpp","csharp","flutter","go","ios","java","lightweight","multilingual","nodejs","on-device","onnx","onnxruntime","python","rust","speech-synthesis","swift","text-to-speech","tts","web","webgpu"],"archived":false,"github_pushed_at":"2026-07-24T04:00:17+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/supertone-inc-supertonic","markdown_url":"https://www.graphcanon.com/tools/supertone-inc-supertonic.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/supertone-inc-supertonic","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=supertone-inc-supertonic","shared_categories":["speech-audio"]},{"slug":"abus-aikorea-voice-pro","name":"voice-pro","tagline":"Gradio WebUI for TTS and voice cloning with audio processing capabilities","github_url":"https://github.com/abus-aikorea/voice-pro","owner":"abus-aikorea","repo":"voice-pro","owner_avatar_url":"https://avatars.githubusercontent.com/u/161691694?v=4","primary_language":"Python","stars":11348,"forks":1663,"topics":["audiobook","faster-whisper","gradio","karaoke","podcasts","speech-recognition","speech-synthesis","speech-to-text","subtitles","text-to-speech","transcription","translator","tts","voice-cloning","voice-conversion","webui","whisper","whisperx","yt-dlp"],"archived":false,"github_pushed_at":"2026-07-13T01:28:10+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro","markdown_url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/abus-aikorea-voice-pro","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=abus-aikorea-voice-pro","shared_categories":["speech-audio"]},{"slug":"aigc-audio-audiogpt","name":"AudioGPT","tagline":"AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head","github_url":"https://github.com/AIGC-Audio/AudioGPT","owner":"AIGC-Audio","repo":"AudioGPT","owner_avatar_url":"https://avatars.githubusercontent.com/u/128504843?v=4","primary_language":"Python","stars":10172,"forks":850,"topics":["audio","gpt","music","sound","speech","talking-head"],"archived":false,"github_pushed_at":"2024-07-06T21:35:18+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt","markdown_url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/aigc-audio-audiogpt","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=aigc-audio-audiogpt","shared_categories":["speech-audio"]},{"slug":"debpalash-omnivoice-studio","name":"OmniVoice-Studio","tagline":"The open-source ElevenLabs alternative for local voice cloning and related tasks","github_url":"https://github.com/debpalash/OmniVoice-Studio","owner":"debpalash","repo":"OmniVoice-Studio","owner_avatar_url":"https://avatars.githubusercontent.com/u/4178343?v=4","primary_language":"Python","stars":9209,"forks":1494,"topics":["asr","audiobook","dubbing","dubbing-ai","elevenlabs","local-ai","omnivoice","omnivoice-studio","self-hosted","speech-recognition","speech-to-text","text-to-speech","transcription","tts","video-editing","voice-ai","voice-cloning","voice-generation"],"archived":false,"github_pushed_at":"2026-07-28T19:51:31+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/debpalash-omnivoice-studio","markdown_url":"https://www.graphcanon.com/tools/debpalash-omnivoice-studio.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/debpalash-omnivoice-studio","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=debpalash-omnivoice-studio","shared_categories":["speech-audio"]},{"slug":"netease-youdao-emotivoice","name":"EmotiVoice","tagline":"A Multi-Voice and Prompt-Controlled TTS Engine","github_url":"https://github.com/netease-youdao/EmotiVoice","owner":"netease-youdao","repo":"EmotiVoice","owner_avatar_url":"https://avatars.githubusercontent.com/u/3909232?v=4","primary_language":"Python","stars":8501,"forks":754,"topics":["ai","deep-learning","emotion","emotivoice","multi-speaker","prompt","python","pytorch","speech","speech-synthesis","style","text-to-speech","tts"],"archived":false,"github_pushed_at":"2024-08-13T10:23:52+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/netease-youdao-emotivoice","markdown_url":"https://www.graphcanon.com/tools/netease-youdao-emotivoice.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/netease-youdao-emotivoice","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=netease-youdao-emotivoice","shared_categories":["speech-audio"]},{"slug":"myshell-ai-melotts","name":"MeloTTS","tagline":"High-quality multi-lingual text-to-speech library by MyShell.ai","github_url":"https://github.com/myshell-ai/MeloTTS","owner":"myshell-ai","repo":"MeloTTS","owner_avatar_url":"https://avatars.githubusercontent.com/u/127754094?v=4","primary_language":"Python","stars":7551,"forks":1059,"topics":["chinese","english","french","japanese","korean","multilingual","spanish","text-to-speech","tts"],"archived":false,"github_pushed_at":"2024-12-24T19:17:13+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/myshell-ai-melotts","markdown_url":"https://www.graphcanon.com/tools/myshell-ai-melotts.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/myshell-ai-melotts","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=myshell-ai-melotts","shared_categories":["speech-audio"]},{"slug":"snakers4-silero-models","name":"silero-models","tagline":"Silero Models provide simple access to pre-trained text-to-speech models","github_url":"https://github.com/snakers4/silero-models","owner":"snakers4","repo":"silero-models","owner_avatar_url":"https://avatars.githubusercontent.com/u/12515440?v=4","primary_language":"Jupyter Notebook","stars":6030,"forks":369,"topics":["armenian","azerbaijani","belarus","colab","georgian","kazakh","kyrgyz","pretrained-models","pytorch","russian","speech","speech-synthesis","speech-to-text","tajik","text-to-speech","torch-hub","tts","tts-models","ukrainian","uzbek"],"archived":false,"github_pushed_at":"2026-06-04T05:33:28+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/snakers4-silero-models","markdown_url":"https://www.graphcanon.com/tools/snakers4-silero-models.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/snakers4-silero-models","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=snakers4-silero-models","shared_categories":["speech-audio"]},{"slug":"metavoiceio-metavoice-src","name":"metavoice-src","tagline":"Foundational model for human-like, expressive TTS","github_url":"https://github.com/metavoiceio/metavoice-src","owner":"metavoiceio","repo":"metavoice-src","owner_avatar_url":"https://avatars.githubusercontent.com/u/107063843?v=4","primary_language":"Python","stars":4203,"forks":693,"topics":["ai","deep-learning","pytorch","speech","speech-synthesis","text-to-speech","tts","voice-clone","zero-shot-tts"],"archived":false,"github_pushed_at":"2024-07-30T22:13:01+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/metavoiceio-metavoice-src","markdown_url":"https://www.graphcanon.com/tools/metavoiceio-metavoice-src.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/metavoiceio-metavoice-src","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=metavoiceio-metavoice-src","shared_categories":["speech-audio"]},{"slug":"rsxdalv-tts-webui","name":"TTS-WebUI","tagline":"A comprehensive WebUI for multiple TTS systems","github_url":"https://github.com/rsxdalv/TTS-WebUI","owner":"rsxdalv","repo":"TTS-WebUI","owner_avatar_url":"https://avatars.githubusercontent.com/u/6757283?v=4","primary_language":"TypeScript","stars":3216,"forks":326,"topics":["ace-step","ai","audio-generation","cosyvoice","generative-ai","generator","gradio","music","musicgen","openai-api","openvoice","rvc","styletts2","text-to-speech","tortoise-tts","tts","vocos"],"archived":false,"github_pushed_at":"2026-07-27T13:23:40+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui","markdown_url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/rsxdalv-tts-webui","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=rsxdalv-tts-webui","shared_categories":["speech-audio"]}]}}