{"data":{"node":{"slug":"rhesis-ai-rhesis","name":"rhesis","tagline":"Testing platform for AI teams to generate tests and evaluate system performance","github_url":"https://github.com/rhesis-ai/rhesis","owner":"rhesis-ai","repo":"rhesis","owner_avatar_url":"https://avatars.githubusercontent.com/u/168341335?v=4","primary_language":"Python","stars":381,"forks":31,"topics":["annotations","feedback-loop","hypothesis-testing","llmops","regression-testing","systematic-evaluation"],"archived":false,"github_pushed_at":"2026-07-28T15:13:49+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/rhesis-ai-rhesis","markdown_url":"https://www.graphcanon.com/tools/rhesis-ai-rhesis.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/rhesis-ai-rhesis","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=rhesis-ai-rhesis"},"categories":[{"slug":"developer-tools","name":"Developer Tools","url":"https://www.graphcanon.com/categories/developer-tools","markdown_url":"https://www.graphcanon.com/categories/developer-tools.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/developer-tools"},{"slug":"evaluation-observability","name":"Evaluation & Observability","url":"https://www.graphcanon.com/categories/evaluation-observability","markdown_url":"https://www.graphcanon.com/categories/evaluation-observability.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/evaluation-observability"}],"tags":[{"slug":"generative-ai","name":"generative-ai"},{"slug":"llm-evaluation","name":"llm-evaluation"},{"slug":"llmops","name":"llmops"},{"slug":"open-source","name":"open-source"},{"slug":"quality-assessment","name":"quality-assessment"},{"slug":"responsible-ai","name":"responsible-ai"},{"slug":"test-execution","name":"test-execution"},{"slug":"test-generation","name":"test-generation"}],"edges":[],"neighbours":[{"slug":"patchy631-ai-engineering-hub","name":"ai-engineering-hub","tagline":"Tutorials on LLMs, RAGs, and real-world AI agent applications","github_url":"https://github.com/patchy631/ai-engineering-hub","owner":"patchy631","repo":"ai-engineering-hub","owner_avatar_url":"https://avatars.githubusercontent.com/u/38653995?v=4","primary_language":"Jupyter Notebook","stars":37020,"forks":6107,"topics":["agents","ai","llms","machine-learning","mcp","rag"],"archived":false,"github_pushed_at":"2026-07-27T18:43:06+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/patchy631-ai-engineering-hub","markdown_url":"https://www.graphcanon.com/tools/patchy631-ai-engineering-hub.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/patchy631-ai-engineering-hub","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=patchy631-ai-engineering-hub","shared_categories":[]},{"slug":"promptfoo-promptfoo","name":"promptfoo","tagline":"Tool for evaluating prompts and AI agents by comparing performance across various models and red teaming.","github_url":"https://github.com/promptfoo/promptfoo","owner":"promptfoo","repo":"promptfoo","owner_avatar_url":"https://avatars.githubusercontent.com/u/137907881?v=4","primary_language":"TypeScript","stars":23838,"forks":2147,"topics":["ci","ci-cd","cicd","evaluation","evaluation-framework","llm","llm-eval","llm-evaluation","llm-evaluation-framework","llmops","pentesting","prompt-engineering","prompt-testing","prompts","rag","red-teaming","testing","vulnerability-scanners"],"archived":false,"github_pushed_at":"2026-08-01T23:47:56+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/promptfoo-promptfoo","markdown_url":"https://www.graphcanon.com/tools/promptfoo-promptfoo.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/promptfoo-promptfoo","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=promptfoo-promptfoo","shared_categories":["evaluation-observability"]},{"slug":"nirdiamant-agents-towards-production","name":"agents-towards-production","tagline":"End-to-end, code-first tutorials for building production-grade GenAI agents","github_url":"https://github.com/NirDiamant/agents-towards-production","owner":"NirDiamant","repo":"agents-towards-production","owner_avatar_url":"https://avatars.githubusercontent.com/u/28316913?v=4","primary_language":"Jupyter Notebook","stars":21298,"forks":2824,"topics":["agent","agent-framework","agentic-ai","agents","ai-agents","deployment","genai","generative-ai","langgraph","llm","llms","mcp","mlops","multi-agent-systems","observability","production","python","rag","tutorials"],"archived":false,"github_pushed_at":"2026-08-15T00:52:10+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/nirdiamant-agents-towards-production","markdown_url":"https://www.graphcanon.com/tools/nirdiamant-agents-towards-production.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/nirdiamant-agents-towards-production","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=nirdiamant-agents-towards-production","shared_categories":[]},{"slug":"raga-ai-hub-ragaai-catalyst","name":"RagaAI-Catalyst","tagline":"Python SDK for AI agent observability and evaluation","github_url":"https://github.com/raga-ai-hub/RagaAI-Catalyst","owner":"raga-ai-hub","repo":"RagaAI-Catalyst","owner_avatar_url":"https://avatars.githubusercontent.com/u/161833182?v=4","primary_language":"Python","stars":16148,"forks":3565,"topics":["agentic-ai","agentic-ai-development","agentneo","agents","ai-agent-monitoring","ai-application-debugging","ai-evaluation-tools","ai-performance-optimization","ai-tool-interaction-monitoring","llm-testing","llm-tracing","llmops"],"archived":false,"github_pushed_at":"2026-02-11T14:43:33+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/raga-ai-hub-ragaai-catalyst","markdown_url":"https://www.graphcanon.com/tools/raga-ai-hub-ragaai-catalyst.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/raga-ai-hub-ragaai-catalyst","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=raga-ai-hub-ragaai-catalyst","shared_categories":["evaluation-observability"]},{"slug":"chainlit-chainlit","name":"chainlit","tagline":"Build Conversational AI in minutes ⚡️","github_url":"https://github.com/Chainlit/chainlit","owner":"Chainlit","repo":"chainlit","owner_avatar_url":"https://avatars.githubusercontent.com/u/128686189?v=4","primary_language":"Python","stars":12373,"forks":1728,"topics":["chatgpt","langchain","llm","openai","openai-chatgpt","python","ui"],"archived":false,"github_pushed_at":"2026-08-04T11:11:47+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/chainlit-chainlit","markdown_url":"https://www.graphcanon.com/tools/chainlit-chainlit.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/chainlit-chainlit","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=chainlit-chainlit","shared_categories":[]},{"slug":"giskard-ai-giskard-oss","name":"giskard-oss","tagline":"Open-Source Evaluation & Testing library for LLM Agents","github_url":"https://github.com/Giskard-AI/giskard-oss","owner":"Giskard-AI","repo":"giskard-oss","owner_avatar_url":"https://avatars.githubusercontent.com/u/71782571?v=4","primary_language":"Python","stars":5727,"forks":511,"topics":["agent-evaluation","ai-red-team","ai-security","ai-testing","fairness-ai","llm","llm-eval","llm-evaluation","llm-security","llmops","ml-testing","ml-validation","mlops","rag-evaluation","red-team-tools","responsible-ai","trustworthy-ai"],"archived":false,"github_pushed_at":"2026-08-01T23:22:37+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/giskard-ai-giskard-oss","markdown_url":"https://www.graphcanon.com/tools/giskard-ai-giskard-oss.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/giskard-ai-giskard-oss","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=giskard-ai-giskard-oss","shared_categories":["evaluation-observability"]},{"slug":"trigaten-learn-prompting","name":"Learn_Prompting","tagline":"Your Go-To Resource for Mastering Generative AI","github_url":"https://github.com/trigaten/Learn_Prompting","owner":"trigaten","repo":"Learn_Prompting","owner_avatar_url":"https://avatars.githubusercontent.com/u/42948753?v=4","primary_language":"MDX","stars":4726,"forks":668,"topics":["chatgpt","chatgpt-api","deep-learning","gpt-3","gpt-4","gpt-4-api","gpt3","large-language-models","llm","machine-learning","nlp","openai-api","prompt-engineering","prompt-toolkit","prompt-tuning","prompting","transformers"],"archived":false,"github_pushed_at":"2025-01-14T15:04:07+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/trigaten-learn-prompting","markdown_url":"https://www.graphcanon.com/tools/trigaten-learn-prompting.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/trigaten-learn-prompting","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=trigaten-learn-prompting","shared_categories":["developer-tools"]},{"slug":"nyldn-claude-octopus","name":"claude-octopus","tagline":"Surface AI blindspots before you ship","github_url":"https://github.com/nyldn/claude-octopus","owner":"nyldn","repo":"claude-octopus","owner_avatar_url":"https://avatars.githubusercontent.com/u/4805949?v=4","primary_language":"Shell","stars":3962,"forks":374,"topics":["ai-agents","ai-orchestration","claude-code","claude-code-plugin","codex","copilot","developer-tools","double-diamond","gemini","multi-ai","multi-llm","ollama"],"archived":false,"github_pushed_at":"2026-08-13T23:28:23+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/nyldn-claude-octopus","markdown_url":"https://www.graphcanon.com/tools/nyldn-claude-octopus.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/nyldn-claude-octopus","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=nyldn-claude-octopus","shared_categories":["developer-tools"]},{"slug":"lmnr-ai-lmnr","name":"lmnr","tagline":"Open-source observability platform for AI agents.","github_url":"https://github.com/lmnr-ai/lmnr","owner":"lmnr-ai","repo":"lmnr","owner_avatar_url":"https://avatars.githubusercontent.com/u/161496104?v=4","primary_language":"TypeScript","stars":3183,"forks":223,"topics":["agent-observability","agents","ai","ai-observability","aiops","analytics","developer-tools","evals","evaluation","llm-evaluation","llm-observability","llmops","monitoring","observability","open-source","rust","rust-lang","self-hosted","ts","typescript"],"archived":false,"github_pushed_at":"2026-08-20T09:30:48+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/lmnr-ai-lmnr","markdown_url":"https://www.graphcanon.com/tools/lmnr-ai-lmnr.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/lmnr-ai-lmnr","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=lmnr-ai-lmnr","shared_categories":["developer-tools","evaluation-observability"]},{"slug":"hegelai-prompttools","name":"prompttools","tagline":"Open-source tools for prompt testing and experimentation","github_url":"https://github.com/hegelai/prompttools","owner":"hegelai","repo":"prompttools","owner_avatar_url":"https://avatars.githubusercontent.com/u/136523567?v=4","primary_language":"Python","stars":3046,"forks":255,"topics":["deep-learning","developer-tools","embeddings","large-language-models","llms","machine-learning","prompt-engineering","python","vector-search"],"archived":false,"github_pushed_at":"2026-02-11T03:24:04+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/hegelai-prompttools","markdown_url":"https://www.graphcanon.com/tools/hegelai-prompttools.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/hegelai-prompttools","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=hegelai-prompttools","shared_categories":["developer-tools"]},{"slug":"e2b-dev-awesome-ai-sdks","name":"awesome-ai-sdks","tagline":"A database of SDKs for AI agents creation and management","github_url":"https://github.com/e2b-dev/awesome-ai-sdks","owner":"e2b-dev","repo":"awesome-ai-sdks","owner_avatar_url":"https://avatars.githubusercontent.com/u/129434473?v=4","primary_language":null,"stars":1213,"forks":361,"topics":["agent","agentops","agents","ai","ai-agents","awesome","awesome-list","chatgpt","e2b","framework","langchain","llama-index","llm","llmops","openai","sdk","tools","vercel"],"archived":false,"github_pushed_at":"2026-07-09T17:29:58+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/e2b-dev-awesome-ai-sdks","markdown_url":"https://www.graphcanon.com/tools/e2b-dev-awesome-ai-sdks.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/e2b-dev-awesome-ai-sdks","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=e2b-dev-awesome-ai-sdks","shared_categories":["developer-tools"]},{"slug":"benchflow-ai-awesome-evals","name":"awesome-evals","tagline":"A curated library of resources for building and evaluating AI agents","github_url":"https://github.com/benchflow-ai/awesome-evals","owner":"benchflow-ai","repo":"awesome-evals","owner_avatar_url":"https://avatars.githubusercontent.com/u/190338344?v=4","primary_language":null,"stars":761,"forks":71,"topics":["agent-evaluation","ai-agents","awesome","awesome-list","benchmarks","evals","llm","llm-evaluation","rl-environments"],"archived":false,"github_pushed_at":"2026-07-01T22:53:19+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/benchflow-ai-awesome-evals","markdown_url":"https://www.graphcanon.com/tools/benchflow-ai-awesome-evals.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/benchflow-ai-awesome-evals","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=benchflow-ai-awesome-evals","shared_categories":["evaluation-observability"]}]}}