{"data":{"node":{"slug":"glo26-stepshield","name":"stepshield","tagline":"Temporal evaluation benchmark for AI agent guardrails","github_url":"https://github.com/glo26/stepshield","owner":"glo26","repo":"stepshield","owner_avatar_url":"https://avatars.githubusercontent.com/u/15223526?v=4","primary_language":"Python","stars":76,"forks":17,"topics":["agent-security","ai-safety","benchmark","dataset","guardrails","neurips-2026","step-level-detection"],"archived":false,"github_pushed_at":"2026-09-05T20:01:00+00:00","maintenance_label":"Active","stars_delta_30d":-1,"url":"https://www.graphcanon.com/tools/glo26-stepshield","markdown_url":"https://www.graphcanon.com/tools/glo26-stepshield.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/glo26-stepshield","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=glo26-stepshield"},"categories":[{"slug":"ai-agents","name":"AI Agents","url":"https://www.graphcanon.com/categories/ai-agents","markdown_url":"https://www.graphcanon.com/categories/ai-agents.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/ai-agents"},{"slug":"evaluation-observability","name":"Evaluation & Observability","url":"https://www.graphcanon.com/categories/evaluation-observability","markdown_url":"https://www.graphcanon.com/categories/evaluation-observability.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/evaluation-observability"}],"tags":[{"slug":"agent-security","name":"agent-security"},{"slug":"ai-safety","name":"ai-safety"},{"slug":"benchmark","name":"benchmark"},{"slug":"dataset","name":"dataset"},{"slug":"guardrails","name":"guardrails"},{"slug":"neurips-2026","name":"neurips-2026"},{"slug":"step-level-detection","name":"step-level-detection"}],"edges":[],"neighbours":[{"slug":"meta-llama-purplellama","name":"PurpleLlama","tagline":"Set of tools to assess and improve LLM security","github_url":"https://github.com/meta-llama/PurpleLlama","owner":"meta-llama","repo":"PurpleLlama","owner_avatar_url":"https://avatars.githubusercontent.com/u/153379578?v=4","primary_language":"Python","stars":4380,"forks":769,"topics":[],"archived":false,"github_pushed_at":"2026-08-18T01:15:09+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/meta-llama-purplellama","markdown_url":"https://www.graphcanon.com/tools/meta-llama-purplellama.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/meta-llama-purplellama","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=meta-llama-purplellama","shared_categories":["evaluation-observability"]},{"slug":"future-agi-future-agi","name":"future-agi","tagline":"Open-source, end-to-end platform for evaluating, observing, and improving LLM and AI agent applications","github_url":"https://github.com/future-agi/future-agi","owner":"future-agi","repo":"future-agi","owner_avatar_url":"https://avatars.githubusercontent.com/u/147392366?v=4","primary_language":"Python","stars":2032,"forks":627,"topics":["ai-agents","ai-evals","ai-gateway","ai-optimization","ai-simulations","evaluation-framework","guardrails","hallucination-detection","llm","llm-evaluation","llm-observability","llmops","model-evaluation","observability","opentelemetry","rag","rag-evaluation","simulation","telemetry","tracing"],"archived":false,"github_pushed_at":"2026-09-18T08:15:25+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/future-agi-future-agi","markdown_url":"https://www.graphcanon.com/tools/future-agi-future-agi.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/future-agi-future-agi","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=future-agi-future-agi","shared_categories":["evaluation-observability","ai-agents"]},{"slug":"corca-ai-awesome-llm-security","name":"awesome-llm-security","tagline":"A curation of tools, documents and projects about LLM Security","github_url":"https://github.com/corca-ai/awesome-llm-security","owner":"corca-ai","repo":"awesome-llm-security","owner_avatar_url":"https://avatars.githubusercontent.com/u/72978860?v=4","primary_language":null,"stars":1692,"forks":347,"topics":["awesome","awesome-list","llm","security"],"archived":false,"github_pushed_at":"2025-08-20T01:27:47+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/corca-ai-awesome-llm-security","markdown_url":"https://www.graphcanon.com/tools/corca-ai-awesome-llm-security.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/corca-ai-awesome-llm-security","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=corca-ai-awesome-llm-security","shared_categories":["evaluation-observability"]},{"slug":"ethz-spylab-agentdojo","name":"agentdojo","tagline":"A Dynamic Environment to Evaluate Prompt Injection Attacks and Defenses for LLM Agents","github_url":"https://github.com/ethz-spylab/agentdojo","owner":"ethz-spylab","repo":"agentdojo","owner_avatar_url":"https://avatars.githubusercontent.com/u/106388551?v=4","primary_language":"Python","stars":802,"forks":205,"topics":["benchmark","large-language-models","prompt-injection","security"],"archived":false,"github_pushed_at":"2026-06-02T10:01:31+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/ethz-spylab-agentdojo","markdown_url":"https://www.graphcanon.com/tools/ethz-spylab-agentdojo.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/ethz-spylab-agentdojo","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=ethz-spylab-agentdojo","shared_categories":["evaluation-observability","ai-agents"]},{"slug":"oxbshw-llm-agents-ecosystem-handbook","name":"LLM-Agents-Ecosystem-Handbook","tagline":"One-stop handbook for building, deploying, and understanding LLM agents","github_url":"https://github.com/oxbshw/LLM-Agents-Ecosystem-Handbook","owner":"oxbshw","repo":"LLM-Agents-Ecosystem-Handbook","owner_avatar_url":"https://avatars.githubusercontent.com/u/212214682?v=4","primary_language":"Python","stars":550,"forks":91,"topics":["ai","ai-agent","ai-agents","fine-tuning","finetuning-llms","freamework","llm","llmops","local-development","mcp-server","memory","rag","rag-chatbot","voice-agent"],"archived":false,"github_pushed_at":"2026-06-30T12:22:57+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/oxbshw-llm-agents-ecosystem-handbook","markdown_url":"https://www.graphcanon.com/tools/oxbshw-llm-agents-ecosystem-handbook.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/oxbshw-llm-agents-ecosystem-handbook","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=oxbshw-llm-agents-ecosystem-handbook","shared_categories":["evaluation-observability","ai-agents"]},{"slug":"deadbits-vigil-llm","name":"vigil-llm","tagline":"Detect prompt injections and other risky inputs in LLMs","github_url":"https://github.com/deadbits/vigil-llm","owner":"deadbits","repo":"vigil-llm","owner_avatar_url":"https://avatars.githubusercontent.com/u/1332757?v=4","primary_language":"Python","stars":496,"forks":56,"topics":["adversarial-attacks","adversarial-machine-learning","large-language-models","llm-security","llmops","prompt-injection","security-tools","yara-scanner"],"archived":false,"github_pushed_at":"2024-01-31T18:43:41+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/deadbits-vigil-llm","markdown_url":"https://www.graphcanon.com/tools/deadbits-vigil-llm.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/deadbits-vigil-llm","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=deadbits-vigil-llm","shared_categories":["evaluation-observability"]},{"slug":"liu00222-open-prompt-injection","name":"Open-Prompt-Injection","tagline":"Benchmark and toolkit for prompt injection attacks and defenses in LLMs","github_url":"https://github.com/liu00222/Open-Prompt-Injection","owner":"liu00222","repo":"Open-Prompt-Injection","owner_avatar_url":"https://avatars.githubusercontent.com/u/42081599?v=4","primary_language":"Python","stars":489,"forks":78,"topics":["llm","llm-security","llms","prompt-injection","prompt-injection-tool","security-and-privacy"],"archived":false,"github_pushed_at":"2025-10-29T17:11:34+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/liu00222-open-prompt-injection","markdown_url":"https://www.graphcanon.com/tools/liu00222-open-prompt-injection.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/liu00222-open-prompt-injection","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=liu00222-open-prompt-injection","shared_categories":["evaluation-observability"]},{"slug":"llm-tuning-safety-llms-finetuning-safety","name":"LLMs-Finetuning-Safety","tagline":"Demonstrates safety risks in fine-tuning GPT-3.5 Turbo with adversarial examples","github_url":"https://github.com/LLM-Tuning-Safety/LLMs-Finetuning-Safety","owner":"LLM-Tuning-Safety","repo":"LLMs-Finetuning-Safety","owner_avatar_url":"https://avatars.githubusercontent.com/u/146881603?v=4","primary_language":"Python","stars":358,"forks":38,"topics":["alignment","llm","llm-finetuning"],"archived":false,"github_pushed_at":"2024-02-23T21:19:44+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/llm-tuning-safety-llms-finetuning-safety","markdown_url":"https://www.graphcanon.com/tools/llm-tuning-safety-llms-finetuning-safety.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/llm-tuning-safety-llms-finetuning-safety","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=llm-tuning-safety-llms-finetuning-safety","shared_categories":["evaluation-observability"]},{"slug":"libr-ai-do-not-answer","name":"do-not-answer","tagline":"A Dataset for Evaluating Safeguards in LLMs","github_url":"https://github.com/Libr-AI/do-not-answer","owner":"Libr-AI","repo":"do-not-answer","owner_avatar_url":"https://avatars.githubusercontent.com/u/133515165?v=4","primary_language":"Jupyter Notebook","stars":343,"forks":29,"topics":[],"archived":false,"github_pushed_at":"2024-06-07T14:55:51+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/libr-ai-do-not-answer","markdown_url":"https://www.graphcanon.com/tools/libr-ai-do-not-answer.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/libr-ai-do-not-answer","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=libr-ai-do-not-answer","shared_categories":["evaluation-observability"]},{"slug":"justin0504-aegis","name":"Aegis","tagline":"Runtime policy enforcement for AI agents with cryptographic audit trail and human-in-the-loop approvals.","github_url":"https://github.com/Justin0504/Aegis","owner":"Justin0504","repo":"Aegis","owner_avatar_url":"https://avatars.githubusercontent.com/u/173865409?v=4","primary_language":"TypeScript","stars":340,"forks":37,"topics":["ai-agents","ai-safety","anthropic","audit-trail","langchain","llm-observability","mcp","policy-engine"],"archived":false,"github_pushed_at":"2026-09-06T03:16:51+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/justin0504-aegis","markdown_url":"https://www.graphcanon.com/tools/justin0504-aegis.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/justin0504-aegis","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=justin0504-aegis","shared_categories":["evaluation-observability","ai-agents"]},{"slug":"dipampaul17-agentguard","name":"AgentGuard","tagline":"Real-time guardrail that monitors token spend and manages LLM/agent loops in real time","github_url":"https://github.com/dipampaul17/AgentGuard","owner":"dipampaul17","repo":"AgentGuard","owner_avatar_url":"https://avatars.githubusercontent.com/u/40596409?v=4","primary_language":"JavaScript","stars":173,"forks":11,"topics":["ai-agents","anthropic","anthropic-claude","cost-monitoring","debugging","guardrails","llm","observability","openai","openai-api","prompt-engineering","token-usage"],"archived":false,"github_pushed_at":"2025-07-31T15:20:56+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/dipampaul17-agentguard","markdown_url":"https://www.graphcanon.com/tools/dipampaul17-agentguard.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/dipampaul17-agentguard","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=dipampaul17-agentguard","shared_categories":["evaluation-observability"]},{"slug":"zenguard-ai-fast-llm-security-guardrails","name":"fast-llm-security-guardrails","tagline":"The fastest Trust Layer for AI Agents","github_url":"https://github.com/ZenGuard-AI/fast-llm-security-guardrails","owner":"ZenGuard-AI","repo":"fast-llm-security-guardrails","owner_avatar_url":"https://avatars.githubusercontent.com/u/163059052?v=4","primary_language":"Python","stars":155,"forks":21,"topics":["agentic-ai","ai-agent","ai-agents","ai-runtime","cx-agent","llm-guard","llm-guardrails","llm-privacy","llm-security","prompt-security","security"],"archived":false,"github_pushed_at":"2026-02-03T18:31:21+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/zenguard-ai-fast-llm-security-guardrails","markdown_url":"https://www.graphcanon.com/tools/zenguard-ai-fast-llm-security-guardrails.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/zenguard-ai-fast-llm-security-guardrails","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=zenguard-ai-fast-llm-security-guardrails","shared_categories":["evaluation-observability","ai-agents"]}]}}