{"data":{"node":{"slug":"qiuhuachuan-latent-jailbreak","name":"latent-jailbreak","tagline":"Repository for evaluating text safety and output robustness of large language models","github_url":"https://github.com/qiuhuachuan/latent-jailbreak","owner":"qiuhuachuan","repo":"latent-jailbreak","owner_avatar_url":"https://avatars.githubusercontent.com/u/44393231?v=4","primary_language":"Python","stars":39,"forks":2,"topics":[],"archived":false,"github_pushed_at":"2024-05-21T04:23:32+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/qiuhuachuan-latent-jailbreak","markdown_url":"https://www.graphcanon.com/tools/qiuhuachuan-latent-jailbreak.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/qiuhuachuan-latent-jailbreak","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=qiuhuachuan-latent-jailbreak"},"categories":[{"slug":"evaluation-observability","name":"Evaluation & Observability","url":"https://www.graphcanon.com/categories/evaluation-observability","markdown_url":"https://www.graphcanon.com/categories/evaluation-observability.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/evaluation-observability"}],"tags":[{"slug":"large-language-models","name":"large language models"},{"slug":"latent-jailbreak","name":"latent jailbreak"},{"slug":"output-robustness","name":"output robustness"},{"slug":"text-safety","name":"text safety"}],"edges":[],"neighbours":[{"slug":"meta-llama-purplellama","name":"PurpleLlama","tagline":"Set of tools to assess and improve LLM security","github_url":"https://github.com/meta-llama/PurpleLlama","owner":"meta-llama","repo":"PurpleLlama","owner_avatar_url":"https://avatars.githubusercontent.com/u/153379578?v=4","primary_language":"Python","stars":4330,"forks":766,"topics":[],"archived":false,"github_pushed_at":"2026-07-27T21:53:59+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/meta-llama-purplellama","markdown_url":"https://www.graphcanon.com/tools/meta-llama-purplellama.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/meta-llama-purplellama","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=meta-llama-purplellama","shared_categories":["evaluation-observability"]},{"slug":"corca-ai-awesome-llm-security","name":"awesome-llm-security","tagline":"A curation of tools, documents and projects about LLM Security","github_url":"https://github.com/corca-ai/awesome-llm-security","owner":"corca-ai","repo":"awesome-llm-security","owner_avatar_url":"https://avatars.githubusercontent.com/u/72978860?v=4","primary_language":null,"stars":1672,"forks":312,"topics":["awesome","awesome-list","llm","security"],"archived":false,"github_pushed_at":"2025-08-20T01:27:47+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/corca-ai-awesome-llm-security","markdown_url":"https://www.graphcanon.com/tools/corca-ai-awesome-llm-security.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/corca-ai-awesome-llm-security","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=corca-ai-awesome-llm-security","shared_categories":["evaluation-observability"]},{"slug":"cyberark-fuzzyai","name":"FuzzyAI","tagline":"A tool for automated LLM fuzzing to detect and mitigate jailbreaks","github_url":"https://github.com/cyberark/FuzzyAI","owner":"cyberark","repo":"FuzzyAI","owner_avatar_url":"https://avatars.githubusercontent.com/u/30869256?v=4","primary_language":"Jupyter Notebook","stars":1543,"forks":214,"topics":["ai","ai-red-team","fuzzing","jailbreak","jailbreaking","llm","llm-evaluation","llm-security","llms","security"],"archived":false,"github_pushed_at":"2026-02-06T21:59:21+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/cyberark-fuzzyai","markdown_url":"https://www.graphcanon.com/tools/cyberark-fuzzyai.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/cyberark-fuzzyai","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=cyberark-fuzzyai","shared_categories":["evaluation-observability"]},{"slug":"georgian-io-llm-finetuning-toolkit","name":"LLM-Finetuning-Toolkit","tagline":"Toolkit for fine-tuning and testing open-source large language models","github_url":"https://github.com/georgian-io/LLM-Finetuning-Toolkit","owner":"georgian-io","repo":"LLM-Finetuning-Toolkit","owner_avatar_url":"https://avatars.githubusercontent.com/u/10764713?v=4","primary_language":"Python","stars":870,"forks":107,"topics":["ablation-study","classification","falcon","fine-tuning","finetuning","flan-t5","large-language-models","llama2","llm-test","lora","mistral-7b","nlp","nlp-machine-learning","qlora","redpajama","summarization","unit-testing","zephyr"],"archived":false,"github_pushed_at":"2026-05-04T16:33:40+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/georgian-io-llm-finetuning-toolkit","markdown_url":"https://www.graphcanon.com/tools/georgian-io-llm-finetuning-toolkit.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/georgian-io-llm-finetuning-toolkit","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=georgian-io-llm-finetuning-toolkit","shared_categories":[]},{"slug":"jailbreakbench-jailbreakbench","name":"jailbreakbench","tagline":"An Open Robustness Benchmark for Jailbreaking Language Models","github_url":"https://github.com/JailbreakBench/jailbreakbench","owner":"JailbreakBench","repo":"jailbreakbench","owner_avatar_url":"https://avatars.githubusercontent.com/u/151564101?v=4","primary_language":"Python","stars":645,"forks":75,"topics":[],"archived":false,"github_pushed_at":"2025-04-04T11:30:46+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/jailbreakbench-jailbreakbench","markdown_url":"https://www.graphcanon.com/tools/jailbreakbench-jailbreakbench.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/jailbreakbench-jailbreakbench","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=jailbreakbench-jailbreakbench","shared_categories":["evaluation-observability"]},{"slug":"sherdencooper-gptfuzz","name":"GPTFuzz","tagline":"Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","github_url":"https://github.com/sherdencooper/GPTFuzz","owner":"sherdencooper","repo":"GPTFuzz","owner_avatar_url":"https://avatars.githubusercontent.com/u/37368657?v=4","primary_language":"Python","stars":604,"forks":87,"topics":[],"archived":false,"github_pushed_at":"2026-02-27T17:19:03+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/sherdencooper-gptfuzz","markdown_url":"https://www.graphcanon.com/tools/sherdencooper-gptfuzz.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/sherdencooper-gptfuzz","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=sherdencooper-gptfuzz","shared_categories":["evaluation-observability"]},{"slug":"declare-lab-instruct-eval","name":"instruct-eval","tagline":"Quantitative evaluation for instruction-tuned language models","github_url":"https://github.com/declare-lab/instruct-eval","owner":"declare-lab","repo":"instruct-eval","owner_avatar_url":"https://avatars.githubusercontent.com/u/59164695?v=4","primary_language":"Python","stars":552,"forks":45,"topics":["instruct-tuning","llm"],"archived":false,"github_pushed_at":"2024-03-10T05:00:00+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/declare-lab-instruct-eval","markdown_url":"https://www.graphcanon.com/tools/declare-lab-instruct-eval.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/declare-lab-instruct-eval","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=declare-lab-instruct-eval","shared_categories":["evaluation-observability"]},{"slug":"deadbits-vigil-llm","name":"vigil-llm","tagline":"Detect prompt injections and other risky inputs in LLMs","github_url":"https://github.com/deadbits/vigil-llm","owner":"deadbits","repo":"vigil-llm","owner_avatar_url":"https://avatars.githubusercontent.com/u/1332757?v=4","primary_language":"Python","stars":496,"forks":56,"topics":["adversarial-attacks","adversarial-machine-learning","large-language-models","llm-security","llmops","prompt-injection","security-tools","yara-scanner"],"archived":false,"github_pushed_at":"2024-01-31T18:43:41+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/deadbits-vigil-llm","markdown_url":"https://www.graphcanon.com/tools/deadbits-vigil-llm.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/deadbits-vigil-llm","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=deadbits-vigil-llm","shared_categories":["evaluation-observability"]},{"slug":"liu00222-open-prompt-injection","name":"Open-Prompt-Injection","tagline":"Benchmark and toolkit for prompt injection attacks and defenses in LLMs","github_url":"https://github.com/liu00222/Open-Prompt-Injection","owner":"liu00222","repo":"Open-Prompt-Injection","owner_avatar_url":"https://avatars.githubusercontent.com/u/42081599?v=4","primary_language":"Python","stars":470,"forks":74,"topics":["llm","llm-security","llms","prompt-injection","prompt-injection-tool","security-and-privacy"],"archived":false,"github_pushed_at":"2025-10-29T17:11:34+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/liu00222-open-prompt-injection","markdown_url":"https://www.graphcanon.com/tools/liu00222-open-prompt-injection.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/liu00222-open-prompt-injection","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=liu00222-open-prompt-injection","shared_categories":["evaluation-observability"]},{"slug":"llm-tuning-safety-llms-finetuning-safety","name":"LLMs-Finetuning-Safety","tagline":"Demonstrates safety risks in fine-tuning GPT-3.5 Turbo with adversarial examples","github_url":"https://github.com/LLM-Tuning-Safety/LLMs-Finetuning-Safety","owner":"LLM-Tuning-Safety","repo":"LLMs-Finetuning-Safety","owner_avatar_url":"https://avatars.githubusercontent.com/u/146881603?v=4","primary_language":"Python","stars":358,"forks":38,"topics":["alignment","llm","llm-finetuning"],"archived":false,"github_pushed_at":"2024-02-23T21:19:44+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/llm-tuning-safety-llms-finetuning-safety","markdown_url":"https://www.graphcanon.com/tools/llm-tuning-safety-llms-finetuning-safety.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/llm-tuning-safety-llms-finetuning-safety","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=llm-tuning-safety-llms-finetuning-safety","shared_categories":["evaluation-observability"]},{"slug":"unispac-visual-adversarial-examples-jailbreak-large-language-models","name":"Visual-Adversarial-Examples-Jailbreak-Large-Language-Models","tagline":"Repository for visual adversarial examples that jailbreak large language models","github_url":"https://github.com/Unispac/Visual-Adversarial-Examples-Jailbreak-Large-Language-Models","owner":"Unispac","repo":"Visual-Adversarial-Examples-Jailbreak-Large-Language-Models","owner_avatar_url":"https://avatars.githubusercontent.com/u/45935569?v=4","primary_language":"Python","stars":282,"forks":30,"topics":[],"archived":false,"github_pushed_at":"2024-05-13T05:36:24+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/unispac-visual-adversarial-examples-jailbreak-large-language-models","markdown_url":"https://www.graphcanon.com/tools/unispac-visual-adversarial-examples-jailbreak-large-language-models.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/unispac-visual-adversarial-examples-jailbreak-large-language-models","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=unispac-visual-adversarial-examples-jailbreak-large-language-models","shared_categories":[]},{"slug":"tmlr-group-deepinception","name":"DeepInception","tagline":"Develops techniques to influence large language model behavior","github_url":"https://github.com/tmlr-group/DeepInception","owner":"tmlr-group","repo":"DeepInception","owner_avatar_url":"https://avatars.githubusercontent.com/u/102131272?v=4","primary_language":"Python","stars":177,"forks":19,"topics":["deep","gpt","gpt3","gpt4","inception","jailbreak","large-language-models","llm","safety","trustworthy"],"archived":false,"github_pushed_at":"2024-02-20T03:54:41+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/tmlr-group-deepinception","markdown_url":"https://www.graphcanon.com/tools/tmlr-group-deepinception.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/tmlr-group-deepinception","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=tmlr-group-deepinception","shared_categories":[]}]}}