{"data":{"node":{"slug":"remsky-kokoro-fastapi","name":"Kokoro-FastAPI","tagline":"Dockerized FastAPI wrapper for Kokoro-82M text-to-speech model","github_url":"https://github.com/remsky/Kokoro-FastAPI","owner":"remsky","repo":"Kokoro-FastAPI","owner_avatar_url":"https://avatars.githubusercontent.com/u/25017870?v=4","primary_language":"Python","stars":5265,"forks":858,"topics":["fastapi","huggingface-spaces","kokoro","kokoro-tts","openai-compatible-api","openwebui","pytorch","sillytavern","text-to-speech","tts","tts-api","uv"],"archived":false,"github_pushed_at":"2026-07-21T03:16:48+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/remsky-kokoro-fastapi","markdown_url":"https://www.graphcanon.com/tools/remsky-kokoro-fastapi.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/remsky-kokoro-fastapi","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=remsky-kokoro-fastapi"},"categories":[{"slug":"speech-audio","name":"Speech & Audio","url":"https://www.graphcanon.com/categories/speech-audio","markdown_url":"https://www.graphcanon.com/categories/speech-audio.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/speech-audio"}],"tags":[{"slug":"docker","name":"docker"},{"slug":"fastapi","name":"fastapi"},{"slug":"kokoro-tts","name":"kokoro tts"},{"slug":"multi-gpu-support","name":"multi-gpu support"},{"slug":"openai-compatible-api","name":"openai-compatible-api"},{"slug":"pytorch","name":"pytorch"},{"slug":"text-to-speech","name":"text-to-speech"}],"edges":[{"type":"alternative","direction":"in","explanation":"Kokoro-FastAPI provides text-to-speech functionality similar to GPT-SoVITS, but it is a FastAPI wrapper rather than an extensive toolkit.","successor_context":null,"tool":{"slug":"rvc-boss-gpt-sovits","name":"GPT-SoVITS","tagline":"Voice Cloning and Text-to-Speech with Minimal Voice Data","github_url":"https://github.com/RVC-Boss/GPT-SoVITS","owner":"RVC-Boss","repo":"GPT-SoVITS","owner_avatar_url":"https://avatars.githubusercontent.com/u/129054828?v=4","primary_language":"Python","stars":60178,"forks":6553,"topics":["text-to-speech","tts","vits","voice-clone","voice-cloneai","voice-cloning"],"archived":false,"github_pushed_at":"2026-07-22T08:21:07+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/rvc-boss-gpt-sovits","markdown_url":"https://www.graphcanon.com/tools/rvc-boss-gpt-sovits.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/rvc-boss-gpt-sovits","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=rvc-boss-gpt-sovits"}}],"neighbours":[{"slug":"systran-faster-whisper","name":"faster-whisper","tagline":"Faster Whisper transcription with CTranslate2","github_url":"https://github.com/SYSTRAN/faster-whisper","owner":"SYSTRAN","repo":"faster-whisper","owner_avatar_url":"https://avatars.githubusercontent.com/u/1520500?v=4","primary_language":"Python","stars":24689,"forks":2006,"topics":["deep-learning","inference","openai","quantization","speech-recognition","speech-to-text","transformer","whisper"],"archived":false,"github_pushed_at":"2025-11-19T14:40:46+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/systran-faster-whisper","markdown_url":"https://www.graphcanon.com/tools/systran-faster-whisper.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/systran-faster-whisper","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=systran-faster-whisper","shared_categories":["speech-audio"]},{"slug":"k2-fsa-sherpa-onnx","name":"sherpa-onnx","tagline":"Speech-to-text and related audio processing tools using ONNX with cross-platform support","github_url":"https://github.com/k2-fsa/sherpa-onnx","owner":"k2-fsa","repo":"sherpa-onnx","owner_avatar_url":"https://avatars.githubusercontent.com/u/71431748?v=4","primary_language":"C++","stars":13842,"forks":1596,"topics":["aarch64","android","arm32","asr","cpp","csharp","dotnet","ios","lazarus","linux","macos","mfc","object-pascal","onnx","raspberry-pi","risc-v","speech-to-text","text-to-speech","vits","windows"],"archived":false,"github_pushed_at":"2026-07-29T03:35:02+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/k2-fsa-sherpa-onnx","markdown_url":"https://www.graphcanon.com/tools/k2-fsa-sherpa-onnx.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/k2-fsa-sherpa-onnx","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=k2-fsa-sherpa-onnx","shared_categories":["speech-audio"]},{"slug":"supertone-inc-supertonic","name":"supertonic","tagline":"Lightning-Fast On-Device Multilingual TTS via ONNX","github_url":"https://github.com/supertone-inc/supertonic","owner":"supertone-inc","repo":"supertonic","owner_avatar_url":"https://avatars.githubusercontent.com/u/61007505?v=4","primary_language":"Swift","stars":13543,"forks":1427,"topics":["cpp","csharp","flutter","go","ios","java","lightweight","multilingual","nodejs","on-device","onnx","onnxruntime","python","rust","speech-synthesis","swift","text-to-speech","tts","web","webgpu"],"archived":false,"github_pushed_at":"2026-07-24T04:00:17+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/supertone-inc-supertonic","markdown_url":"https://www.graphcanon.com/tools/supertone-inc-supertonic.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/supertone-inc-supertonic","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=supertone-inc-supertonic","shared_categories":["speech-audio"]},{"slug":"open-llm-vtuber-open-llm-vtuber","name":"Open-LLM-VTuber","tagline":"Voice interaction with LLMs and Live2D visuals","github_url":"https://github.com/Open-LLM-VTuber/Open-LLM-VTuber","owner":"Open-LLM-VTuber","repo":"Open-LLM-VTuber","owner_avatar_url":"https://avatars.githubusercontent.com/u/193920693?v=4","primary_language":"Python","stars":13224,"forks":1563,"topics":["ai","ai-companion","ai-vtuber","ai-waifu","chatbots","live2d","live2d-web","llm","neuro-sama","ollama"],"archived":false,"github_pushed_at":"2026-05-15T07:18:04+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/open-llm-vtuber-open-llm-vtuber","markdown_url":"https://www.graphcanon.com/tools/open-llm-vtuber-open-llm-vtuber.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/open-llm-vtuber-open-llm-vtuber","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=open-llm-vtuber-open-llm-vtuber","shared_categories":["speech-audio"]},{"slug":"abus-aikorea-voice-pro","name":"voice-pro","tagline":"Gradio WebUI for TTS and voice cloning with audio processing capabilities","github_url":"https://github.com/abus-aikorea/voice-pro","owner":"abus-aikorea","repo":"voice-pro","owner_avatar_url":"https://avatars.githubusercontent.com/u/161691694?v=4","primary_language":"Python","stars":11348,"forks":1663,"topics":["audiobook","faster-whisper","gradio","karaoke","podcasts","speech-recognition","speech-synthesis","speech-to-text","subtitles","text-to-speech","transcription","translator","tts","voice-cloning","voice-conversion","webui","whisper","whisperx","yt-dlp"],"archived":false,"github_pushed_at":"2026-07-13T01:28:10+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro","markdown_url":"https://www.graphcanon.com/tools/abus-aikorea-voice-pro.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/abus-aikorea-voice-pro","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=abus-aikorea-voice-pro","shared_categories":["speech-audio"]},{"slug":"aigc-audio-audiogpt","name":"AudioGPT","tagline":"AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head","github_url":"https://github.com/AIGC-Audio/AudioGPT","owner":"AIGC-Audio","repo":"AudioGPT","owner_avatar_url":"https://avatars.githubusercontent.com/u/128504843?v=4","primary_language":"Python","stars":10172,"forks":850,"topics":["audio","gpt","music","sound","speech","talking-head"],"archived":false,"github_pushed_at":"2024-07-06T21:35:18+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt","markdown_url":"https://www.graphcanon.com/tools/aigc-audio-audiogpt.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/aigc-audio-audiogpt","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=aigc-audio-audiogpt","shared_categories":["speech-audio"]},{"slug":"snakers4-silero-models","name":"silero-models","tagline":"Silero Models provide simple access to pre-trained text-to-speech models","github_url":"https://github.com/snakers4/silero-models","owner":"snakers4","repo":"silero-models","owner_avatar_url":"https://avatars.githubusercontent.com/u/12515440?v=4","primary_language":"Jupyter Notebook","stars":6030,"forks":369,"topics":["armenian","azerbaijani","belarus","colab","georgian","kazakh","kyrgyz","pretrained-models","pytorch","russian","speech","speech-synthesis","speech-to-text","tajik","text-to-speech","torch-hub","tts","tts-models","ukrainian","uzbek"],"archived":false,"github_pushed_at":"2026-06-04T05:33:28+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/snakers4-silero-models","markdown_url":"https://www.graphcanon.com/tools/snakers4-silero-models.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/snakers4-silero-models","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=snakers4-silero-models","shared_categories":["speech-audio"]},{"slug":"rsxdalv-tts-webui","name":"TTS-WebUI","tagline":"A comprehensive WebUI for multiple TTS systems","github_url":"https://github.com/rsxdalv/TTS-WebUI","owner":"rsxdalv","repo":"TTS-WebUI","owner_avatar_url":"https://avatars.githubusercontent.com/u/6757283?v=4","primary_language":"TypeScript","stars":3216,"forks":326,"topics":["ace-step","ai","audio-generation","cosyvoice","generative-ai","generator","gradio","music","musicgen","openai-api","openvoice","rvc","styletts2","text-to-speech","tortoise-tts","tts","vocos"],"archived":false,"github_pushed_at":"2026-07-27T13:23:40+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui","markdown_url":"https://www.graphcanon.com/tools/rsxdalv-tts-webui.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/rsxdalv-tts-webui","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=rsxdalv-tts-webui","shared_categories":["speech-audio"]},{"slug":"purfview-whisper-standalone-win","name":"whisper-standalone-win","tagline":"Standalone executables for Whisper and Faster-Whisper speech recognition on Windows, Linux, macOS","github_url":"https://github.com/Purfview/whisper-standalone-win","owner":"Purfview","repo":"whisper-standalone-win","owner_avatar_url":"https://avatars.githubusercontent.com/u/69023953?v=4","primary_language":null,"stars":3135,"forks":165,"topics":["asr","ctranslate2","diarization","faster-whisper","openai","speaker-diarization","speech-recognition","speech-to-text","subtitles","transcriber","uvr","vocal-extractor","whisper","whisper-faster","whisperx"],"archived":false,"github_pushed_at":"2025-11-07T19:21:55+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/purfview-whisper-standalone-win","markdown_url":"https://www.graphcanon.com/tools/purfview-whisper-standalone-win.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/purfview-whisper-standalone-win","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=purfview-whisper-standalone-win","shared_categories":["speech-audio"]},{"slug":"fluidinference-fluidaudio","name":"FluidAudio","tagline":"CoreML audio models for text-to-speech, speech-to-text, voice activity detection and speaker diarization in Swift.","github_url":"https://github.com/FluidInference/FluidAudio","owner":"FluidInference","repo":"FluidAudio","owner_avatar_url":"https://avatars.githubusercontent.com/u/216957621?v=4","primary_language":"Swift","stars":2554,"forks":360,"topics":["ane","asr","audio","automatic-speech-recognition","avfoundation","coreml","ios","macos","nvidia","parakeet","real-time","speaker-diarization","speaker-embedding","speaker-identification","speaker-recognition","speech-to-text","swift","vad","voice-activity-detection"],"archived":false,"github_pushed_at":"2026-07-26T00:49:55+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/fluidinference-fluidaudio","markdown_url":"https://www.graphcanon.com/tools/fluidinference-fluidaudio.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/fluidinference-fluidaudio","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=fluidinference-fluidaudio","shared_categories":["speech-audio"]},{"slug":"travisvn-openai-edge-tts","name":"openai-edge-tts","tagline":"Free text-to-speech API for edge computing","github_url":"https://github.com/travisvn/openai-edge-tts","owner":"travisvn","repo":"openai-edge-tts","owner_avatar_url":"https://avatars.githubusercontent.com/u/2686415?v=4","primary_language":"Python","stars":2007,"forks":304,"topics":["ai","azure","chatgpt","claude","edge-tts","elevenlabs","gpt","llm","llm-webui","llms","local-llm","ollama","ollama-webui","open-webui","openai","self-hosted","speech","text-to-speech","tts"],"archived":false,"github_pushed_at":"2025-07-01T23:56:27+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/travisvn-openai-edge-tts","markdown_url":"https://www.graphcanon.com/tools/travisvn-openai-edge-tts.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/travisvn-openai-edge-tts","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=travisvn-openai-edge-tts","shared_categories":["speech-audio"]},{"slug":"enemyx-net-vibevoice-comfyui","name":"VibeVoice-ComfyUI","tagline":"Comprehensive ComfyUI integration for Microsoft's VibeVoice text-to-speech","github_url":"https://github.com/Enemyx-net/VibeVoice-ComfyUI","owner":"Enemyx-net","repo":"VibeVoice-ComfyUI","owner_avatar_url":"https://avatars.githubusercontent.com/u/228984999?v=4","primary_language":"Python","stars":1521,"forks":243,"topics":["ai-audio","ai-tts","ai-voice","ai-voice-clone","ai-voice-clonining","comfyui-custom-node","comfyui-custom-nodes-text-to-speech","comfyui-nodes","t2s","text-to-speech","tts","vibevoice","vibevoice-microsoft","voice-cloning","voice-generation","voice-generator"],"archived":false,"github_pushed_at":"2026-02-18T07:40:52+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/enemyx-net-vibevoice-comfyui","markdown_url":"https://www.graphcanon.com/tools/enemyx-net-vibevoice-comfyui.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/enemyx-net-vibevoice-comfyui","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=enemyx-net-vibevoice-comfyui","shared_categories":["speech-audio"]}]}}