{"data":{"node":{"slug":"google-litmus","name":"litmus","tagline":"A comprehensive LLM testing and evaluation tool for GenAI application development with user-friendly UI","github_url":"https://github.com/google/litmus","owner":"google","repo":"litmus","owner_avatar_url":"https://avatars.githubusercontent.com/u/1342004?v=4","primary_language":"Vue","stars":52,"forks":9,"topics":["api","apitesting","cicd","devops","llm","llm-evaluation","llm-security","llm-training","llmops","testing","testing-tools"],"archived":false,"github_pushed_at":"2026-03-29T16:13:21+00:00","maintenance_label":"Slowing","stars_delta_30d":1,"url":"https://www.graphcanon.com/tools/google-litmus","markdown_url":"https://www.graphcanon.com/tools/google-litmus.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/google-litmus","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=google-litmus"},"categories":[{"slug":"evaluation-observability","name":"Evaluation & Observability","url":"https://www.graphcanon.com/categories/evaluation-observability","markdown_url":"https://www.graphcanon.com/categories/evaluation-observability.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/evaluation-observability"},{"slug":"model-training","name":"Model Training","url":"https://www.graphcanon.com/categories/model-training","markdown_url":"https://www.graphcanon.com/categories/model-training.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/model-training"}],"tags":[{"slug":"api","name":"api"},{"slug":"apitesting","name":"apitesting"},{"slug":"cicd","name":"cicd"},{"slug":"devops","name":"devops"},{"slug":"llm-evaluation","name":"llm-evaluation"},{"slug":"testing-tools","name":"testing-tools"}],"edges":[],"neighbours":[{"slug":"langfuse-langfuse","name":"langfuse","tagline":"Open source agent evals & observability: Trace, evaluate, and improve LLM applications with one open platform.","github_url":"https://github.com/langfuse/langfuse","owner":"langfuse","repo":"langfuse","owner_avatar_url":"https://avatars.githubusercontent.com/u/134601687?v=4","primary_language":"TypeScript","stars":34763,"forks":3793,"topics":["analytics","autogen","evaluation","langchain","large-language-models","llama-index","llm","llm-evaluation","llm-observability","llmops","monitoring","observability","open-source","openai","playground","prompt-engineering","prompt-management","self-hosted","ycombinator"],"archived":false,"github_pushed_at":"2026-09-18T08:08:19+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/langfuse-langfuse","markdown_url":"https://www.graphcanon.com/tools/langfuse-langfuse.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/langfuse-langfuse","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=langfuse-langfuse","shared_categories":["evaluation-observability"]},{"slug":"openai-evals","name":"evals","tagline":"Framework for evaluating LLMs and LLM systems with an open-source registry of benchmarks.","github_url":"https://github.com/openai/evals","owner":"openai","repo":"evals","owner_avatar_url":"https://avatars.githubusercontent.com/u/14957082?v=4","primary_language":"Python","stars":19398,"forks":3077,"topics":[],"archived":false,"github_pushed_at":"2026-04-14T15:29:57+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/openai-evals","markdown_url":"https://www.graphcanon.com/tools/openai-evals.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/openai-evals","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=openai-evals","shared_categories":["evaluation-observability"]},{"slug":"vibrantlabsai-ragas","name":"ragas","tagline":"Supercharge Your LLM Application Evaluations 🚀","github_url":"https://github.com/vibrantlabsai/ragas","owner":"vibrantlabsai","repo":"ragas","owner_avatar_url":"https://avatars.githubusercontent.com/u/122604797?v=4","primary_language":"Python","stars":15783,"forks":1712,"topics":["evaluation","llm","llmops"],"archived":false,"github_pushed_at":"2026-02-24T07:47:19+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/vibrantlabsai-ragas","markdown_url":"https://www.graphcanon.com/tools/vibrantlabsai-ragas.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/vibrantlabsai-ragas","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=vibrantlabsai-ragas","shared_categories":["evaluation-observability"]},{"slug":"lightning-ai-litgpt","name":"litgpt","tagline":"High-performance LLMs for pretraining, finetuning, and deployment","github_url":"https://github.com/Lightning-AI/litgpt","owner":"Lightning-AI","repo":"litgpt","owner_avatar_url":"https://avatars.githubusercontent.com/u/58386951?v=4","primary_language":"Python","stars":13667,"forks":1503,"topics":["ai","artificial-intelligence","deep-learning","large-language-models","llm","llm-inference","llms"],"archived":false,"github_pushed_at":"2026-09-14T10:24:06+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/lightning-ai-litgpt","markdown_url":"https://www.graphcanon.com/tools/lightning-ai-litgpt.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/lightning-ai-litgpt","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=lightning-ai-litgpt","shared_categories":["model-training"]},{"slug":"openlit-openlit","name":"openlit","tagline":"Open-source observability & evaluation platform for AI agents and coding agents","github_url":"https://github.com/openlit/openlit","owner":"openlit","repo":"openlit","owner_avatar_url":"https://avatars.githubusercontent.com/u/149867240?v=4","primary_language":"TypeScript","stars":2770,"forks":390,"topics":["ai-engineering","ai-evaluation","ai-observability","ai-observability-platform","amd-gpu","claude-code","clickhouse","codex","coding-agent","coding-agents","cursor","genai","gpu-monitoring","llm-observability","llmops","nvidia-smi","observability","open-source","openai","opentelemetry"],"archived":false,"github_pushed_at":"2026-09-17T21:59:22+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/openlit-openlit","markdown_url":"https://www.graphcanon.com/tools/openlit-openlit.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/openlit-openlit","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=openlit-openlit","shared_categories":["evaluation-observability"]},{"slug":"huggingface-lighteval","name":"lighteval","tagline":"All-in-one toolkit for evaluating LLMs across multiple backends","github_url":"https://github.com/huggingface/lighteval","owner":"huggingface","repo":"lighteval","owner_avatar_url":"https://avatars.githubusercontent.com/u/25720743?v=4","primary_language":"Python","stars":2535,"forks":552,"topics":["evaluation","evaluation-framework","evaluation-metrics","huggingface"],"archived":false,"github_pushed_at":"2026-08-11T13:10:37+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/huggingface-lighteval","markdown_url":"https://www.graphcanon.com/tools/huggingface-lighteval.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/huggingface-lighteval","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=huggingface-lighteval","shared_categories":["evaluation-observability"]},{"slug":"alopatenko-llmevaluation","name":"LLMEvaluation","tagline":"A comprehensive guide to LLM evaluation methods","github_url":"https://github.com/alopatenko/LLMEvaluation","owner":"alopatenko","repo":"LLMEvaluation","owner_avatar_url":"https://avatars.githubusercontent.com/u/7122933?v=4","primary_language":"HTML","stars":201,"forks":24,"topics":["evaluation","generative-ai-benchmarking","llm","llm-benchmarking","llm-evaluation"],"archived":false,"github_pushed_at":"2026-09-15T00:35:53+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/alopatenko-llmevaluation","markdown_url":"https://www.graphcanon.com/tools/alopatenko-llmevaluation.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/alopatenko-llmevaluation","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=alopatenko-llmevaluation","shared_categories":["evaluation-observability"]},{"slug":"orgexyz-llfn","name":"LLFn","tagline":"A lightweight framework for creating applications using LLMs","github_url":"https://github.com/orgexyz/LLFn","owner":"orgexyz","repo":"LLFn","owner_avatar_url":"https://avatars.githubusercontent.com/u/138577559?v=4","primary_language":"Python","stars":96,"forks":7,"topics":[],"archived":false,"github_pushed_at":"2023-07-30T12:55:13+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/orgexyz-llfn","markdown_url":"https://www.graphcanon.com/tools/orgexyz-llfn.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/orgexyz-llfn","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=orgexyz-llfn","shared_categories":[]}]}}