{"data":{"node":{"slug":"lenml-speech-ai-forge","name":"Speech-AI-Forge","tagline":"A project for TTS generation with API and WebUI implementations","github_url":"https://github.com/lenML/Speech-AI-Forge","owner":"lenML","repo":"Speech-AI-Forge","owner_avatar_url":"https://avatars.githubusercontent.com/u/154655365?v=4","primary_language":"Python","stars":1413,"forks":187,"topics":["agent","asr","chattts","chattts-forge","chinese","colab","cosy-voice","cosyvoice","english","firered","fireredtts","fish-speech","gpt","llama","llm","ssml","stt","text-to-speech","tts","whisper"],"archived":false,"github_pushed_at":"2026-05-21T12:49:07+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/lenml-speech-ai-forge","markdown_url":"https://www.graphcanon.com/tools/lenml-speech-ai-forge.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/lenml-speech-ai-forge","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=lenml-speech-ai-forge"},"categories":[{"slug":"speech-audio","name":"Speech & Audio","url":"https://www.graphcanon.com/categories/speech-audio","markdown_url":"https://www.graphcanon.com/categories/speech-audio.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/speech-audio"}],"tags":[{"slug":"agent","name":"agent"},{"slug":"asr","name":"asr"},{"slug":"chattts","name":"chattts"},{"slug":"chattts-forge","name":"chattts-forge"},{"slug":"chinese","name":"chinese"},{"slug":"colab","name":"colab"},{"slug":"cosy-voice","name":"cosy-voice"},{"slug":"english","name":"english"}],"edges":[],"neighbours":[{"slug":"coqui-ai-tts","name":"TTS","tagline":"🐸💬 - a deep learning toolkit for Text-to-Speech","github_url":"https://github.com/coqui-ai/TTS","owner":"coqui-ai","repo":"TTS","owner_avatar_url":"https://avatars.githubusercontent.com/u/75583352?v=4","primary_language":"Python","stars":45832,"forks":6158,"topics":["deep-learning","glow-tts","hifigan","melgan","multi-speaker-tts","python","pytorch","speaker-encoder","speaker-encodings","speech","speech-synthesis","tacotron","text-to-speech","tts","tts-model","vocoder","voice-cloning","voice-conversion","voice-synthesis"],"archived":false,"github_pushed_at":"2024-08-16T12:07:14+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/coqui-ai-tts","markdown_url":"https://www.graphcanon.com/tools/coqui-ai-tts.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/coqui-ai-tts","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=coqui-ai-tts","shared_categories":["speech-audio"]},{"slug":"2noise-chattts","name":"ChatTTS","tagline":"A generative speech model for daily dialogue","github_url":"https://github.com/2noise/ChatTTS","owner":"2noise","repo":"ChatTTS","owner_avatar_url":"https://avatars.githubusercontent.com/u/164844019?v=4","primary_language":"Python","stars":39768,"forks":4257,"topics":["agent","chat","chatgpt","chattts","chinese","chinese-language","english","english-language","gpt","llm","llm-agent","natural-language-inference","python","text-to-speech","torch","torchaudio","tts"],"archived":false,"github_pushed_at":"2026-04-10T16:33:48+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/2noise-chattts","markdown_url":"https://www.graphcanon.com/tools/2noise-chattts.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/2noise-chattts","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=2noise-chattts","shared_categories":["speech-audio"]},{"slug":"nvidia-nemo-speech","name":"Speech","tagline":"A scalable generative AI framework for Speech AI","github_url":"https://github.com/NVIDIA-NeMo/Speech","owner":"NVIDIA-NeMo","repo":"Speech","owner_avatar_url":"https://avatars.githubusercontent.com/u/213689629?v=4","primary_language":"Python","stars":17940,"forks":3533,"topics":["asr","deeplearning","generative-ai","machine-translation","neural-networks","speaker-diariazation","speaker-recognition","speech-synthesis","speech-translation","tts"],"archived":false,"github_pushed_at":"2026-08-07T05:34:13+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/nvidia-nemo-speech","markdown_url":"https://www.graphcanon.com/tools/nvidia-nemo-speech.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/nvidia-nemo-speech","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=nvidia-nemo-speech","shared_categories":["speech-audio"]},{"slug":"abus-aikorea-voice-pro","name":"voice-pro","tagline":"Gradio WebUI for TTS and voice cloning with audio processing capabilities","github_url":"https://github.com/abus-aikorea/voice-pro","owner":"abus-aikorea","repo":"voice-pro","owner_avatar_url":"https://avatars.githubusercontent.com/u/161691694?v=4","primary_language":"Python","stars":11348,"forks":1663,"topics":["audiobook","faster-whisper","gradio","karaoke","podcasts","speech-recognition","speech-synthesis","speech-to-text","subtitles","text-to-speech","transcription","translator","tts","voice-cloning","voice-conversion","webui","whisper","whisperx","yt-dlp"],"archived":false,"github_pushed_at":"2026-07-13T01:28:10+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro","markdown_url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/abus-aikorea-voice-pro","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=abus-aikorea-voice-pro","shared_categories":["speech-audio"]},{"slug":"aigc-audio-audiogpt","name":"AudioGPT","tagline":"AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head","github_url":"https://github.com/AIGC-Audio/AudioGPT","owner":"AIGC-Audio","repo":"AudioGPT","owner_avatar_url":"https://avatars.githubusercontent.com/u/128504843?v=4","primary_language":"Python","stars":10172,"forks":850,"topics":["audio","gpt","music","sound","speech","talking-head"],"archived":false,"github_pushed_at":"2024-07-06T21:35:18+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt","markdown_url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/aigc-audio-audiogpt","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=aigc-audio-audiogpt","shared_categories":["speech-audio"]},{"slug":"debpalash-omnivoice-studio","name":"OmniVoice-Studio","tagline":"The open-source ElevenLabs alternative for local voice cloning and related tasks","github_url":"https://github.com/debpalash/OmniVoice-Studio","owner":"debpalash","repo":"OmniVoice-Studio","owner_avatar_url":"https://avatars.githubusercontent.com/u/4178343?v=4","primary_language":"Python","stars":9209,"forks":1494,"topics":["asr","audiobook","dubbing","dubbing-ai","elevenlabs","local-ai","omnivoice","omnivoice-studio","self-hosted","speech-recognition","speech-to-text","text-to-speech","transcription","tts","video-editing","voice-ai","voice-cloning","voice-generation"],"archived":false,"github_pushed_at":"2026-07-28T19:51:31+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/debpalash-omnivoice-studio","markdown_url":"https://www.graphcanon.com/tools/debpalash-omnivoice-studio.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/debpalash-omnivoice-studio","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=debpalash-omnivoice-studio","shared_categories":["speech-audio"]},{"slug":"netease-youdao-emotivoice","name":"EmotiVoice","tagline":"A Multi-Voice and Prompt-Controlled TTS Engine","github_url":"https://github.com/netease-youdao/EmotiVoice","owner":"netease-youdao","repo":"EmotiVoice","owner_avatar_url":"https://avatars.githubusercontent.com/u/3909232?v=4","primary_language":"Python","stars":8501,"forks":754,"topics":["ai","deep-learning","emotion","emotivoice","multi-speaker","prompt","python","pytorch","speech","speech-synthesis","style","text-to-speech","tts"],"archived":false,"github_pushed_at":"2024-08-13T10:23:52+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/netease-youdao-emotivoice","markdown_url":"https://www.graphcanon.com/tools/netease-youdao-emotivoice.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/netease-youdao-emotivoice","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=netease-youdao-emotivoice","shared_categories":["speech-audio"]},{"slug":"huggingface-speech-to-speech","name":"speech-to-speech","tagline":"Build local voice agents with open-source models","github_url":"https://github.com/huggingface/speech-to-speech","owner":"huggingface","repo":"speech-to-speech","owner_avatar_url":"https://avatars.githubusercontent.com/u/25720743?v=4","primary_language":"Python","stars":8219,"forks":1025,"topics":["ai","assistant","language-model","machine-learning","python","speech","speech-synthesis","speech-to-text","speech-translation"],"archived":false,"github_pushed_at":"2026-07-30T11:35:50+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/huggingface-speech-to-speech","markdown_url":"https://www.graphcanon.com/tools/huggingface-speech-to-speech.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/huggingface-speech-to-speech","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=huggingface-speech-to-speech","shared_categories":["speech-audio"]},{"slug":"snakers4-silero-models","name":"silero-models","tagline":"Silero Models provide simple access to pre-trained text-to-speech models","github_url":"https://github.com/snakers4/silero-models","owner":"snakers4","repo":"silero-models","owner_avatar_url":"https://avatars.githubusercontent.com/u/12515440?v=4","primary_language":"Jupyter Notebook","stars":6030,"forks":369,"topics":["armenian","azerbaijani","belarus","colab","georgian","kazakh","kyrgyz","pretrained-models","pytorch","russian","speech","speech-synthesis","speech-to-text","tajik","text-to-speech","torch-hub","tts","tts-models","ukrainian","uzbek"],"archived":false,"github_pushed_at":"2026-06-04T05:33:28+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/snakers4-silero-models","markdown_url":"https://www.graphcanon.com/tools/snakers4-silero-models.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/snakers4-silero-models","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=snakers4-silero-models","shared_categories":["speech-audio"]},{"slug":"remsky-kokoro-fastapi","name":"Kokoro-FastAPI","tagline":"Dockerized FastAPI wrapper for Kokoro-82M text-to-speech model","github_url":"https://github.com/remsky/Kokoro-FastAPI","owner":"remsky","repo":"Kokoro-FastAPI","owner_avatar_url":"https://avatars.githubusercontent.com/u/25017870?v=4","primary_language":"Python","stars":5265,"forks":858,"topics":["fastapi","huggingface-spaces","kokoro","kokoro-tts","openai-compatible-api","openwebui","pytorch","sillytavern","text-to-speech","tts","tts-api","uv"],"archived":false,"github_pushed_at":"2026-07-21T03:16:48+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/remsky-kokoro-fastapi","markdown_url":"https://www.graphcanon.com/tools/remsky-kokoro-fastapi.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/remsky-kokoro-fastapi","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=remsky-kokoro-fastapi","shared_categories":["speech-audio"]},{"slug":"rsxdalv-tts-webui","name":"TTS-WebUI","tagline":"A comprehensive WebUI for multiple TTS systems","github_url":"https://github.com/rsxdalv/TTS-WebUI","owner":"rsxdalv","repo":"TTS-WebUI","owner_avatar_url":"https://avatars.githubusercontent.com/u/6757283?v=4","primary_language":"TypeScript","stars":3216,"forks":326,"topics":["ace-step","ai","audio-generation","cosyvoice","generative-ai","generator","gradio","music","musicgen","openai-api","openvoice","rvc","styletts2","text-to-speech","tortoise-tts","tts","vocos"],"archived":false,"github_pushed_at":"2026-07-27T13:23:40+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui","markdown_url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/rsxdalv-tts-webui","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=rsxdalv-tts-webui","shared_categories":["speech-audio"]},{"slug":"6drf21e-chattts-colab","name":"ChatTTS_colab","tagline":"一键部署的ChatTTS项目，支持流式输出、音色抽卡和长音频生成。","github_url":"https://github.com/6drf21e/ChatTTS_colab","owner":"6drf21e","repo":"ChatTTS_colab","owner_avatar_url":"https://avatars.githubusercontent.com/u/29720712?v=4","primary_language":"Python","stars":2578,"forks":324,"topics":["chattts","colab-notebook","text-to-speech"],"archived":false,"github_pushed_at":"2026-05-31T14:43:08+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/6drf21e-chattts-colab","markdown_url":"https://www.graphcanon.com/tools/6drf21e-chattts-colab.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/6drf21e-chattts-colab","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=6drf21e-chattts-colab","shared_categories":["speech-audio"]}]}}