{"data":{"node":{"slug":"travisvn-chatterbox-tts-api","name":"chatterbox-tts-api","tagline":"Local OpenAI-compatible text-to-speech API using Chatterbox","github_url":"https://github.com/travisvn/chatterbox-tts-api","owner":"travisvn","repo":"chatterbox-tts-api","owner_avatar_url":"https://avatars.githubusercontent.com/u/2686415?v=4","primary_language":"Python","stars":681,"forks":154,"topics":["ai","chatgpt","chatterbox","cuda","docker","elevenlabs","gpt","local-llm","ollama","open-webui","openai","openai-api","python","self-hosted","speech","text-to-speech","tts","voice-clone","voice-cloning"],"archived":false,"github_pushed_at":"2025-12-23T01:05:47+00:00","maintenance_label":"Slowing","stars_delta_30d":15,"url":"https://www.graphcanon.com/tools/travisvn-chatterbox-tts-api","markdown_url":"https://www.graphcanon.com/tools/travisvn-chatterbox-tts-api.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/travisvn-chatterbox-tts-api","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=travisvn-chatterbox-tts-api"},"categories":[{"slug":"speech-audio","name":"Speech & Audio","url":"https://www.graphcanon.com/categories/speech-audio","markdown_url":"https://www.graphcanon.com/categories/speech-audio.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/speech-audio"}],"tags":[{"slug":"ai","name":"ai"},{"slug":"chatgpt","name":"chatgpt"},{"slug":"chatterbox","name":"chatterbox"},{"slug":"cuda","name":"cuda"},{"slug":"docker","name":"docker"},{"slug":"elevenlabs","name":"elevenlabs"},{"slug":"openai-api","name":"openai-api"},{"slug":"self-hosted","name":"self-hosted"}],"edges":[{"type":"alternative","direction":"in","explanation":"Chatterbox-TTS-API provides a local TTS API similar to GPT-SoVITS, but it is OpenAI-compatible and likely has a different underlying technology.","successor_context":null,"tool":{"slug":"rvc-boss-gpt-sovits","name":"GPT-SoVITS","tagline":"Voice Cloning and Text-to-Speech with Minimal Voice Data","github_url":"https://github.com/RVC-Boss/GPT-SoVITS","owner":"RVC-Boss","repo":"GPT-SoVITS","owner_avatar_url":"https://avatars.githubusercontent.com/u/129054828?v=4","primary_language":"Python","stars":61946,"forks":6667,"topics":["text-to-speech","tts","vits","voice-clone","voice-cloneai","voice-cloning"],"archived":false,"github_pushed_at":"2026-08-18T09:16:25+00:00","maintenance_label":"Steady","stars_delta_30d":1768,"url":"https://www.graphcanon.com/tools/rvc-boss-gpt-sovits","markdown_url":"https://www.graphcanon.com/tools/rvc-boss-gpt-sovits.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/rvc-boss-gpt-sovits","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=rvc-boss-gpt-sovits"}}],"neighbours":[{"slug":"myshell-ai-openvoice","name":"OpenVoice","tagline":"Instant voice cloning using an audio foundation model","github_url":"https://github.com/myshell-ai/OpenVoice","owner":"myshell-ai","repo":"OpenVoice","owner_avatar_url":"https://avatars.githubusercontent.com/u/127754094?v=4","primary_language":"Python","stars":37588,"forks":4222,"topics":["text-to-speech","tts","voice-clone","zero-shot-tts"],"archived":false,"github_pushed_at":"2025-04-19T16:00:00+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/myshell-ai-openvoice","markdown_url":"https://www.graphcanon.com/tools/myshell-ai-openvoice.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/myshell-ai-openvoice","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=myshell-ai-openvoice","shared_categories":["speech-audio"]},{"slug":"debpalash-omnivoice-studio","name":"OmniVoice-Studio","tagline":"The open-source ElevenLabs alternative for local voice cloning and related tasks","github_url":"https://github.com/debpalash/OmniVoice-Studio","owner":"debpalash","repo":"OmniVoice-Studio","owner_avatar_url":"https://avatars.githubusercontent.com/u/4178343?v=4","primary_language":"Python","stars":33281,"forks":3929,"topics":["ai","audiobook","cuda","dubbing","elevenlabs-alternative","huggingface","local-first","mlx","omnivoice-studio","speech-to-text","tauri","text-to-speech","transcription","translate","tts","voice-ai","voice-cloning","voice-generation","voicestudio","workflow"],"archived":false,"github_pushed_at":"2026-09-20T05:11:11+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/debpalash-omnivoice-studio","markdown_url":"https://www.graphcanon.com/tools/debpalash-omnivoice-studio.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/debpalash-omnivoice-studio","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=debpalash-omnivoice-studio","shared_categories":["speech-audio"]},{"slug":"nari-labs-dia","name":"dia","tagline":"A TTS model for generating ultra-realistic dialogue","github_url":"https://github.com/nari-labs/dia","owner":"nari-labs","repo":"dia","owner_avatar_url":"https://avatars.githubusercontent.com/u/208232306?v=4","primary_language":"Python","stars":19400,"forks":1690,"topics":["ai","open-weight","text-to-speech"],"archived":false,"github_pushed_at":"2025-11-19T21:11:55+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/nari-labs-dia","markdown_url":"https://www.graphcanon.com/tools/nari-labs-dia.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/nari-labs-dia","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=nari-labs-dia","shared_categories":["speech-audio"]},{"slug":"open-llm-vtuber-open-llm-vtuber","name":"Open-LLM-VTuber","tagline":"Voice interaction with LLMs and Live2D visuals","github_url":"https://github.com/Open-LLM-VTuber/Open-LLM-VTuber","owner":"Open-LLM-VTuber","repo":"Open-LLM-VTuber","owner_avatar_url":"https://avatars.githubusercontent.com/u/193920693?v=4","primary_language":"Python","stars":13842,"forks":1653,"topics":["ai","ai-companion","ai-vtuber","ai-waifu","chatbots","live2d","live2d-web","llm","neuro-sama","ollama"],"archived":false,"github_pushed_at":"2026-05-15T07:18:04+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/open-llm-vtuber-open-llm-vtuber","markdown_url":"https://www.graphcanon.com/tools/open-llm-vtuber-open-llm-vtuber.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/open-llm-vtuber-open-llm-vtuber","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=open-llm-vtuber-open-llm-vtuber","shared_categories":["speech-audio"]},{"slug":"huggingface-speech-to-speech","name":"speech-to-speech","tagline":"Build local voice agents with open-source models","github_url":"https://github.com/huggingface/speech-to-speech","owner":"huggingface","repo":"speech-to-speech","owner_avatar_url":"https://avatars.githubusercontent.com/u/25720743?v=4","primary_language":"Python","stars":13280,"forks":1683,"topics":["ai","assistant","language-model","machine-learning","python","speech","speech-synthesis","speech-to-text","speech-translation"],"archived":false,"github_pushed_at":"2026-09-18T23:15:28+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/huggingface-speech-to-speech","markdown_url":"https://www.graphcanon.com/tools/huggingface-speech-to-speech.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/huggingface-speech-to-speech","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=huggingface-speech-to-speech","shared_categories":["speech-audio"]},{"slug":"abus-aikorea-voice-pro","name":"voice-pro","tagline":"Gradio WebUI for TTS and voice cloning with audio processing capabilities","github_url":"https://github.com/abus-aikorea/voice-pro","owner":"abus-aikorea","repo":"voice-pro","owner_avatar_url":"https://avatars.githubusercontent.com/u/161691694?v=4","primary_language":"Python","stars":12849,"forks":1853,"topics":["audiobook","faster-whisper","gradio","karaoke","podcasts","speech-recognition","speech-synthesis","speech-to-text","subtitles","text-to-speech","transcription","translator","tts","voice-cloning","voice-conversion","webui","whisper","whisperx","yt-dlp"],"archived":false,"github_pushed_at":"2026-07-13T01:28:10+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro","markdown_url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/abus-aikorea-voice-pro","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=abus-aikorea-voice-pro","shared_categories":["speech-audio"]},{"slug":"aigc-audio-audiogpt","name":"AudioGPT","tagline":"AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head","github_url":"https://github.com/AIGC-Audio/AudioGPT","owner":"AIGC-Audio","repo":"AudioGPT","owner_avatar_url":"https://avatars.githubusercontent.com/u/128504843?v=4","primary_language":"Python","stars":10171,"forks":851,"topics":["audio","gpt","music","sound","speech","talking-head"],"archived":false,"github_pushed_at":"2024-07-06T21:35:18+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt","markdown_url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/aigc-audio-audiogpt","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=aigc-audio-audiogpt","shared_categories":["speech-audio"]},{"slug":"myshell-ai-melotts","name":"MeloTTS","tagline":"High-quality multi-lingual text-to-speech library by MyShell.ai","github_url":"https://github.com/myshell-ai/MeloTTS","owner":"myshell-ai","repo":"MeloTTS","owner_avatar_url":"https://avatars.githubusercontent.com/u/127754094?v=4","primary_language":"Python","stars":7644,"forks":1073,"topics":["chinese","english","french","japanese","korean","multilingual","spanish","text-to-speech","tts"],"archived":false,"github_pushed_at":"2024-12-24T19:17:13+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/myshell-ai-melotts","markdown_url":"https://www.graphcanon.com/tools/myshell-ai-melotts.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/myshell-ai-melotts","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=myshell-ai-melotts","shared_categories":["speech-audio"]},{"slug":"snakers4-silero-models","name":"silero-models","tagline":"Silero Models provide simple access to pre-trained text-to-speech models","github_url":"https://github.com/snakers4/silero-models","owner":"snakers4","repo":"silero-models","owner_avatar_url":"https://avatars.githubusercontent.com/u/12515440?v=4","primary_language":"Jupyter Notebook","stars":6115,"forks":373,"topics":["armenian","azerbaijani","belarus","colab","georgian","kazakh","kyrgyz","pretrained-models","pytorch","russian","speech","speech-synthesis","speech-to-text","tajik","text-to-speech","torch-hub","tts","tts-models","ukrainian","uzbek"],"archived":false,"github_pushed_at":"2026-07-31T16:28:45+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/snakers4-silero-models","markdown_url":"https://www.graphcanon.com/tools/snakers4-silero-models.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/snakers4-silero-models","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=snakers4-silero-models","shared_categories":["speech-audio"]},{"slug":"koljab-realtimetts","name":"RealtimeTTS","tagline":"Converts text to speech in realtime","github_url":"https://github.com/KoljaB/RealtimeTTS","owner":"KoljaB","repo":"RealtimeTTS","owner_avatar_url":"https://avatars.githubusercontent.com/u/7604638?v=4","primary_language":"Python","stars":4031,"forks":405,"topics":["python","realtime","speech-synthesis","text-to-speech"],"archived":false,"github_pushed_at":"2026-09-19T23:35:24+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/koljab-realtimetts","markdown_url":"https://www.graphcanon.com/tools/koljab-realtimetts.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/koljab-realtimetts","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=koljab-realtimetts","shared_categories":["speech-audio"]},{"slug":"rsxdalv-tts-webui","name":"TTS-WebUI","tagline":"A comprehensive WebUI for multiple TTS systems","github_url":"https://github.com/rsxdalv/TTS-WebUI","owner":"rsxdalv","repo":"TTS-WebUI","owner_avatar_url":"https://avatars.githubusercontent.com/u/6757283?v=4","primary_language":"TypeScript","stars":3266,"forks":333,"topics":["ace-step","ai","audio-generation","cosyvoice","generative-ai","generator","gradio","music","musicgen","openai-api","openvoice","rvc","styletts2","text-to-speech","tortoise-tts","tts","vocos"],"archived":false,"github_pushed_at":"2026-09-07T08:54:58+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui","markdown_url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/rsxdalv-tts-webui","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=rsxdalv-tts-webui","shared_categories":["speech-audio"]},{"slug":"elevenlabs-elevenlabs-python","name":"elevenlabs-python","tagline":"Official Python SDK for ElevenLabs API.","github_url":"https://github.com/elevenlabs/elevenlabs-python","owner":"elevenlabs","repo":"elevenlabs-python","owner_avatar_url":"https://avatars.githubusercontent.com/u/94471909?v=4","primary_language":"Python","stars":3104,"forks":448,"topics":["artificial-intelligence","conversational-ai","text-to-speech"],"archived":false,"github_pushed_at":"2026-09-16T15:32:46+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/elevenlabs-elevenlabs-python","markdown_url":"https://www.graphcanon.com/tools/elevenlabs-elevenlabs-python.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/elevenlabs-elevenlabs-python","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=elevenlabs-elevenlabs-python","shared_categories":["speech-audio"]}]}}