{"data":{"slug":"coqui-ai-stt","name":"STT","tagline":"A fast open-source deep-learning toolkit for speech-to-text","github_url":"https://github.com/coqui-ai/STT","owner":"coqui-ai","repo":"STT","owner_avatar_url":"https://avatars.githubusercontent.com/u/75583352?v=4","primary_language":"C++","stars":2599,"forks":299,"topics":["asr","automatic-speech-recognition","deep-learning","speech-recognition","speech-recognition-api","speech-recognizer","speech-to-text","stt","tensorflow","voice-recognition"],"archived":false,"github_pushed_at":"2024-03-11T07:55:56+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/coqui-ai-stt","markdown_url":"https://www.graphcanon.com/tools/coqui-ai-stt.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/coqui-ai-stt","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=coqui-ai-stt","description":"🐸STT - The deep learning toolkit for Speech-to-Text. Training and deploying STT models has never been so easy.","homepage_url":"https://coqui.ai","license":"MPL-2.0","open_issues":106,"watchers":59,"ai_summary":"🐸STT is an open-source toolkit for training and deploying Speech-to-Text models with features such as high-quality pre-trained models, efficient multi-GPU training pipeline, real-time inference, and support for multiple programming languages.","readme_excerpt":".. note::\n   **This project is no longer actively maintained**, and we have stopped hosting the online Model Zoo. We've seen focus shift towards newer STT models such as [Whisper](https://github.com/openai/whisper), and have ourselves focused on [Coqui TTS](https://github.com/coqui-ai/TTS) and [Coqui Studio](https://coqui.ai/).\n   \n   The models will remain available in [the releases of the coqui-ai/STT-models repo](https://github.com/coqui-ai/STT-models/releases).\n\n.. image:: images/coqui-STT-logo-green.png\n   :alt: Coqui STT logo\n\n\n.. |doc-img| image:: https://readthedocs.org/projects/stt/badge/?version=latest\n   :target: https://stt.readthedocs.io/?badge=latest\n   :alt: Documentation\n\n.. |covenant-img| image:: https://img.shields.io/badge/Contributor%20Covenant-2.0-4baaaa.svg\n   :target: CODE_OF_CONDUCT.md\n   :alt: Contributor Covenant\n\n.. |gitter-img| image:: https://badges.gitter.im/coqui-ai/STT.svg\n   :target: https://gitter.im/coqui-ai/STT?utm_source=badge&utm_medium=badge&utm_campaign=pr-badge\n   :alt: Gitter Room\n\n.. |doi| image:: https://zenodo.org/badge/344354127.svg\n   :target: https://zenodo.org/badge/latestdoi/344354127\n\n|doc-img| |covenant-img| |gitter-img| |doi|\n\n`👉 Subscribe to 🐸Coqui's Newsletter <https://coqui.ai/?subscription=true>`_\n\n**Coqui STT** (🐸STT) is a fast, open-source, multi-platform, deep-learning toolkit for training and deploying speech-to-text models. 🐸STT is battle tested in both production and research 🚀\n\n🐸STT features\n---------------\n\n* High-quality pre-trained STT model.\n* Efficient training pipeline with Multi-GPU support.\n* Streaming inference.\n* Multiple possible transcripts, each with an associated confidence score.\n* Real-time inference.\n* Small-footprint acoustic model.\n* Bindings for various programming languages.\n\n`Quickstart <https://stt.readthedocs.io/en/latest/#quickstart>`_\n================================================================\n\nWhere to Ask Questions\n----------------------\n\n.. list-table::\n   :widths: 25 25\n   :header-rows: 1\n\n   * - Type\n     - Link\n   * - 🚨 **Bug Reports**\n     - `Github Issue Tracker <https://github.com/coqui-ai/STT/issues/>`_\n   * - 🎁 **Feature Requests & Ideas**\n     - `Github Issue Tracker <https://github.com/coqui-ai/STT/issues/>`_\n   * - ❔ **Questions**\n     - `Github Discussions <https://github.com/coqui-ai/stt/discussions/>`_\n   * - 💬 **General Discussion**\n     - `Github Discussions <https://github.com/coqui-ai/stt/discussions/>`_ or `Gitter Room <https://gitter.im/coqui-ai/STT?utm_source=share-link&utm_medium=link&utm_campaign=share-link>`_\n\n\nLinks & Resources\n-----------------\n.. list-table::\n   :widths: 25 25\n   :header-rows: 1\n\n   * - Type\n     - Link\n   * - 📰 **Documentation**\n     - `stt.readthedocs.io <https://stt.readthedocs.io/>`_\n   * - 🚀 **Latest release with pre-trained models**\n     - `see the latest release on GitHub <https://github.com/coqui-ai/STT/releases/latest>`_\n   * - 🤝 **Contribution Guidelines**\n     - `CONTRIBUTING.rst <CONTRIBUTING.rst>`_","github_created_at":"2021-03-04T04:54:42+00:00","created_at":"2026-07-11T12:16:52.266579+00:00","updated_at":"2026-07-30T12:00:44.962298+00:00","categories":[{"slug":"speech-audio","name":"Speech & Audio","url":"https://www.graphcanon.com/categories/speech-audio","markdown_url":"https://www.graphcanon.com/categories/speech-audio.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/speech-audio"}],"tags":[{"slug":"asr","name":"asr"},{"slug":"automatic-speech-recognition","name":"automatic-speech-recognition"},{"slug":"deep-learning","name":"deep-learning"},{"slug":"speech-recognition","name":"speech-recognition"},{"slug":"tensorflow","name":"tensorflow"}],"trust":{"provenance":{"is_fork":false,"github_id":344354127,"owner_type":"Organization","methodology":"github_public_v1","parent_repo":null,"near_duplicate_slugs":[]},"computed_at":"2026-07-30T12:00:44.198Z","maintenance":{"label":"Dormant","score":18,"methodology":"github_public_v1","releases_90d":0,"days_since_push":871,"last_release_at":"2022-09-03T23:05:02Z"},"security_summary":{"status":"no_lockfile","scanner":null,"low_count":0,"high_count":0,"last_scan_at":"2026-07-11T12:16:56.631Z","medium_count":0,"scan_profile":"none","critical_count":0}},"capability_facts":{"scan":{"source":"repo_scan","observed_at":"2026-07-30T12:00:44.648Z"},"languages":{"value":["c++"],"source":"github.language","observed_at":"2026-07-30T12:00:44.648Z"},"license_spdx":{"value":"MPL-2.0","source":"github.license","observed_at":"2026-07-30T12:00:44.648Z"}},"decision_facts":{"hosting":null,"pricing":null,"requirements":null,"constraints":null,"when_to_use":["When you need a tool with high-quality pre-trained STT models","For scenarios requiring real-time inference capabilities","If small acoustic model footprint is important for deployment","When developing in C++ or using bindings for other languages"],"when_not_to_use":["Since its development has slowed, it may not suit users needing the latest research advancements","Avoid if you require community support as active maintenance has decreased","Not ideal if newer STT models like Whisper offer more suitable features","Consider alternatives with better-sustained Model Zoo access for more diverse pre-trained models"],"source":"enrich:decision_facts","observed_at":"2026-07-17T13:00:22.560Z"},"constraint_facets":null,"decision_summary":[{"label":"Adopt for","value":"STT is an open-source deep-learning toolkit for speech-to-text with high-quality pre-trained models and efficient training on multi-GPU setups."}]}}