{"data":{"slug":"dicklesworthstone-swiss-army-llama","name":"swiss_army_llama","tagline":"A FastAPI service for semantic text search using precomputed embeddings and advanced similarity measures","github_url":"https://github.com/Dicklesworthstone/swiss_army_llama","owner":"Dicklesworthstone","repo":"swiss_army_llama","owner_avatar_url":"https://avatars.githubusercontent.com/u/35050222?v=4","primary_language":"Python","stars":1056,"forks":66,"topics":["embedding-similarity","embedding-vectors","embeddings","llama2","llamacpp","semantic-search"],"archived":false,"github_pushed_at":"2025-02-27T11:19:55+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/dicklesworthstone-swiss-army-llama","markdown_url":"https://www.graphcanon.com/tools/dicklesworthstone-swiss-army-llama.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/dicklesworthstone-swiss-army-llama","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=dicklesworthstone-swiss-army-llama","description":"A FastAPI service for semantic text search using precomputed embeddings and advanced similarity measures, with built-in support for various file types through textract.","homepage_url":null,"license":null,"open_issues":0,"watchers":16,"ai_summary":"This Python-based repository offers a FastAPI service focused on semantic text search with support for various file types via textract, leveraging precomputed embeddings and advanced similarity techniques.","readme_excerpt":"## Requirements\n\nSystem requirements for running the application (to support all the file types handled by textract):\n\n```bash\nsudo apt-get update\nsudo apt-get install libxml2-dev libxslt1-dev antiword unrtf poppler-utils pstotext tesseract-ocr flac ffmpeg lame libmad0 libsox-fmt-mp3 sox libjpeg-dev swig -y\n```\n\nPython Requirements:\n\n```bash\naioredis\naioredlock\naiosqlite\napscheduler\nfaiss-cpu\nfast_vector_similarity\nfastapi\nfaster-whisper\nfilelock\nhttpx\nllama-cpp-python\nmagika\nmutagen\nnvgpu\npandas\npillow\npsutil\npydantic\nPyPDF2\npytest\npython-decouple\npython-multipart\npytz\nredis\nruff\nscikit-learn\nscipy\nsqlalchemy\ntextract-py3\nuvicorn\nuvloop\nzstandard\n```\n\n---\n\n## License\n\nThis project is licensed under the MIT License.","github_created_at":"2023-08-08T01:23:30+00:00","created_at":"2026-07-11T10:38:31.115937+00:00","updated_at":"2026-08-08T06:03:55.132105+00:00","categories":[{"slug":"data-retrieval","name":"Data & Retrieval","url":"https://www.graphcanon.com/categories/data-retrieval","markdown_url":"https://www.graphcanon.com/categories/data-retrieval.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/data-retrieval"},{"slug":"vector-databases","name":"Vector Databases","url":"https://www.graphcanon.com/categories/vector-databases","markdown_url":"https://www.graphcanon.com/categories/vector-databases.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/vector-databases"}],"tags":[{"slug":"embedding-similarity","name":"embedding-similarity"},{"slug":"embedding-vectors","name":"embedding-vectors"},{"slug":"embeddings","name":"embeddings"},{"slug":"llama2","name":"llama2"},{"slug":"llamacpp","name":"llamacpp"},{"slug":"semantic-search","name":"semantic-search"}],"trust":{"provenance":{"is_fork":false,"github_id":675892095,"owner_type":"User","methodology":"github_public_v1","parent_repo":null,"near_duplicate_slugs":[]},"computed_at":"2026-08-08T06:03:54.429Z","maintenance":{"label":"Dormant","score":18,"methodology":"github_public_v1","releases_90d":0,"days_since_push":526,"last_release_at":null},"security_summary":{"status":"ok","scanner":"osv@v1","low_count":0,"high_count":0,"last_scan_at":"2026-07-11T10:45:02.276Z","medium_count":0,"scan_profile":"deps","critical_count":0}},"capability_facts":{"scan":{"source":"repo_scan","observed_at":"2026-08-08T06:03:54.854Z"},"deploy":{"source":"dockerfile:Dockerfile","self_host":true,"observed_at":"2026-08-08T06:03:54.854Z","managed_saas":false},"languages":{"value":["python"],"source":"github.language+pyproject.toml","observed_at":"2026-08-08T06:03:54.854Z"},"has_docker":{"value":true,"source":"dockerfile:Dockerfile","observed_at":"2026-08-08T06:03:54.854Z"}},"decision_facts":{"hosting":null,"pricing":null,"requirements":null,"constraints":null,"when_to_use":["For projects requiring a comprehensive API solution that includes built-in support for diverse file formats like PDF, image, audio and more through textract","When you need integration with the llama-cpp-python library for advanced text search capabilities"],"when_not_to_use":["Avoid if your project is strictly focused on real-time embeddings calculation without leveraging precomputed data","Not suitable for developers looking to avoid extensive system dependencies listed in its requirements"],"source":"enrich:decision_facts","observed_at":"2026-07-15T08:28:53.396Z"},"constraint_facets":null,"decision_summary":[{"label":"Adopt for","value":"Swiss_army_llama offers a versatile semantic text search FastAPI service with precomputed embeddings, similarity measures, and support for various file types via textract."}]}}