{"data":{"node":{"slug":"lennart-finke-baba-is-eval","name":"baba_is_eval","tagline":"Evaluates language models' meta-level reasoning through the puzzle game Baba Is You","github_url":"https://github.com/lennart-finke/baba_is_eval","owner":"lennart-finke","repo":"baba_is_eval","owner_avatar_url":"https://avatars.githubusercontent.com/u/42694673?v=4","primary_language":"Python","stars":62,"forks":8,"topics":["llm-evaluation","llm-tool-call","mcp","mcp-server"],"archived":false,"github_pushed_at":"2025-06-30T20:54:43+00:00","maintenance_label":"Dormant","stars_delta_30d":0,"url":"https://www.graphcanon.com/tools/lennart-finke-baba-is-eval","markdown_url":"https://www.graphcanon.com/tools/lennart-finke-baba-is-eval.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/lennart-finke-baba-is-eval","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=lennart-finke-baba-is-eval"},"categories":[{"slug":"evaluation-observability","name":"Evaluation & Observability","url":"https://www.graphcanon.com/categories/evaluation-observability","markdown_url":"https://www.graphcanon.com/categories/evaluation-observability.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/evaluation-observability"}],"tags":[{"slug":"llm-evaluation","name":"llm-evaluation"},{"slug":"llm-tool-call","name":"llm-tool-call"},{"slug":"mcp","name":"mcp"},{"slug":"mcp-server","name":"mcp-server"}],"edges":[],"neighbours":[{"slug":"shareai-lab-learn-claude-code","name":"learn-claude-code","tagline":"A nano claude code-like agent harness built from scratch","github_url":"https://github.com/shareAI-lab/learn-claude-code","owner":"shareAI-lab","repo":"learn-claude-code","owner_avatar_url":"https://avatars.githubusercontent.com/u/189210346?v=4","primary_language":"Python","stars":77100,"forks":12399,"topics":["agent","agent-development","ai-agent","claude","claude-code","educational","llm","python","teaching","tutorial"],"archived":false,"github_pushed_at":"2026-08-26T16:38:22+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/shareai-lab-learn-claude-code","markdown_url":"https://www.graphcanon.com/tools/shareai-lab-learn-claude-code.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/shareai-lab-learn-claude-code","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=shareai-lab-learn-claude-code","shared_categories":[]},{"slug":"composiohq-awesome-claude-skills","name":"awesome-claude-skills","tagline":"A curated list of awesome Claude Skills for customizing AI workflows","github_url":"https://github.com/ComposioHQ/awesome-claude-skills","owner":"ComposioHQ","repo":"awesome-claude-skills","owner_avatar_url":"https://avatars.githubusercontent.com/u/128464815?v=4","primary_language":"Python","stars":75355,"forks":8736,"topics":["agent-skills","ai-agents","antigravity","automation","claude","claude-code","codex","composio","cursor","developer-tools","gemini-cli","mcp","openai-codex","rube","saas","skill","workflow-automation"],"archived":false,"github_pushed_at":"2026-09-18T07:16:11+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/composiohq-awesome-claude-skills","markdown_url":"https://www.graphcanon.com/tools/composiohq-awesome-claude-skills.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/composiohq-awesome-claude-skills","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=composiohq-awesome-claude-skills","shared_categories":[]},{"slug":"shanraisshan-claude-code-best-practice","name":"claude-code-best-practice","tagline":"from vibe coding to agentic engineering - practice makes claude perfect","github_url":"https://github.com/shanraisshan/claude-code-best-practice","owner":"shanraisshan","repo":"claude-code-best-practice","owner_avatar_url":"https://avatars.githubusercontent.com/u/11731897?v=4","primary_language":"HTML","stars":66122,"forks":6560,"topics":["agentic-ai","agentic-coding","agentic-engineering","agentic-workflow","ai","ai-agents","anthropic","best-practices","boris","claude","claude-ai","claude-code","claude-code-agents","claude-code-best-practices","claude-code-commands","claude-code-skills","context-engineering","pakistan","pakistani-developer","vibe-coding"],"archived":false,"github_pushed_at":"2026-09-20T05:12:27+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/shanraisshan-claude-code-best-practice","markdown_url":"https://www.graphcanon.com/tools/shanraisshan-claude-code-best-practice.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/shanraisshan-claude-code-best-practice","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=shanraisshan-claude-code-best-practice","shared_categories":[]},{"slug":"princeton-nlp-tree-of-thought-llm","name":"tree-of-thought-llm","tagline":"[NeurIPS 2023] Tree of Thoughts: Deliberate Problem Solving with Large Language Models","github_url":"https://github.com/princeton-nlp/tree-of-thought-llm","owner":"princeton-nlp","repo":"tree-of-thought-llm","owner_avatar_url":"https://avatars.githubusercontent.com/u/44678448?v=4","primary_language":"Python","stars":6048,"forks":624,"topics":["large-language-models","llm","prompting","tree-of-thoughts","tree-search"],"archived":false,"github_pushed_at":"2025-01-16T20:02:00+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/princeton-nlp-tree-of-thought-llm","markdown_url":"https://www.graphcanon.com/tools/princeton-nlp-tree-of-thought-llm.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/princeton-nlp-tree-of-thought-llm","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=princeton-nlp-tree-of-thought-llm","shared_categories":[]},{"slug":"florianbruniaux-claude-code-ultimate-guide","name":"claude-code-ultimate-guide","tagline":"Comprehensive guide for using Claude Code with extensive materials and production-ready templates","github_url":"https://github.com/FlorianBruniaux/claude-code-ultimate-guide","owner":"FlorianBruniaux","repo":"claude-code-ultimate-guide","owner_avatar_url":"https://avatars.githubusercontent.com/u/3902606?v=4","primary_language":"Python","stars":6002,"forks":783,"topics":["agentic-coding","ai-assistant","ai-coding","ai-pair-programming","ai-security","anthropic","best-practices","claude","claude-code","claude-code-guide","claude-code-tutorial","cli-tool","coding-assistant","cursor-alternative","developer-tools","llm","mcp-servers","prompt-engineering","tutorial","vibe-coding"],"archived":false,"github_pushed_at":"2026-09-19T13:58:30+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/florianbruniaux-claude-code-ultimate-guide","markdown_url":"https://www.graphcanon.com/tools/florianbruniaux-claude-code-ultimate-guide.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/florianbruniaux-claude-code-ultimate-guide","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=florianbruniaux-claude-code-ultimate-guide","shared_categories":[]},{"slug":"0xnyk-council-of-high-intelligence","name":"council-of-high-intelligence","tagline":"AI personas deliberate decisions across LLM providers","github_url":"https://github.com/0xNyk/council-of-high-intelligence","owner":"0xNyk","repo":"council-of-high-intelligence","owner_avatar_url":"https://avatars.githubusercontent.com/u/93952610?v=4","primary_language":"Shell","stars":4327,"forks":409,"topics":["agent-skill","ai-agents","claude-code","codex","decision-making","deliberation","gemini-cli","llm-routing","multi-agent-systems","multi-llm","open-source","opencode","prompt-engineering","structured-debate"],"archived":false,"github_pushed_at":"2026-09-19T10:13:00+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/0xnyk-council-of-high-intelligence","markdown_url":"https://www.graphcanon.com/tools/0xnyk-council-of-high-intelligence.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/0xnyk-council-of-high-intelligence","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=0xnyk-council-of-high-intelligence","shared_categories":["evaluation-observability"]},{"slug":"wesammustafa-claude-code-everything-you-need-to-know","name":"Claude-Code-Everything-You-Need-to-Know","tagline":"Beginner to power-user depth guide on Claude Code including setup, prompt engineering and more","github_url":"https://github.com/wesammustafa/Claude-Code-Everything-You-Need-to-Know","owner":"wesammustafa","repo":"Claude-Code-Everything-You-Need-to-Know","owner_avatar_url":"https://avatars.githubusercontent.com/u/33235742?v=4","primary_language":"Python","stars":3026,"forks":344,"topics":["agent-skills","agentic-coding","ai-agents","anthropic","anthropic-claude","best-practices","claude","claude-ai","claude-code","claude-code-guide","claude-code-hooks","claude-code-skills","claude-code-tutorial","claude-skills","guide","mcp","mcp-servers","prompt-engineering","subagents","tutorial"],"archived":false,"github_pushed_at":"2026-07-28T11:00:38+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/wesammustafa-claude-code-everything-you-need-to-know","markdown_url":"https://www.graphcanon.com/tools/wesammustafa-claude-code-everything-you-need-to-know.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/wesammustafa-claude-code-everything-you-need-to-know","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=wesammustafa-claude-code-everything-you-need-to-know","shared_categories":[]},{"slug":"evalplus-evalplus","name":"evalplus","tagline":"Rigorous evaluation of LLM-synthesized code","github_url":"https://github.com/evalplus/evalplus","owner":"evalplus","repo":"evalplus","owner_avatar_url":"https://avatars.githubusercontent.com/u/132106461?v=4","primary_language":"Python","stars":1806,"forks":206,"topics":["benchmark","chatgpt","efficiency","gpt-4","large-language-models","program-synthesis","testing"],"archived":false,"github_pushed_at":"2025-10-02T22:56:38+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/evalplus-evalplus","markdown_url":"https://www.graphcanon.com/tools/evalplus-evalplus.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/evalplus-evalplus","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=evalplus-evalplus","shared_categories":["evaluation-observability"]},{"slug":"miurla-babyagi-ui","name":"babyagi-ui","tagline":"BabyAGI UI for easier web app development and interaction similar to ChatGPT.","github_url":"https://github.com/miurla/babyagi-ui","owner":"miurla","repo":"babyagi-ui","owner_avatar_url":"https://avatars.githubusercontent.com/u/3412179?v=4","primary_language":"TypeScript","stars":1325,"forks":269,"topics":["agent","babyagi","langchain-js","nextjs","openai-api","pinecone","radix-ui","tailwindcss"],"archived":true,"github_pushed_at":"2024-10-24T00:27:33+00:00","maintenance_label":"Archived","url":"https://www.graphcanon.com/tools/miurla-babyagi-ui","markdown_url":"https://www.graphcanon.com/tools/miurla-babyagi-ui.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/miurla-babyagi-ui","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=miurla-babyagi-ui","shared_categories":[]},{"slug":"declare-lab-instruct-eval","name":"instruct-eval","tagline":"Quantitative evaluation for instruction-tuned language models","github_url":"https://github.com/declare-lab/instruct-eval","owner":"declare-lab","repo":"instruct-eval","owner_avatar_url":"https://avatars.githubusercontent.com/u/59164695?v=4","primary_language":"Python","stars":553,"forks":45,"topics":["instruct-tuning","llm"],"archived":false,"github_pushed_at":"2024-03-10T05:00:00+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/declare-lab-instruct-eval","markdown_url":"https://www.graphcanon.com/tools/declare-lab-instruct-eval.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/declare-lab-instruct-eval","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=declare-lab-instruct-eval","shared_categories":["evaluation-observability"]},{"slug":"gobii-ai-gobii-platform","name":"gobii-platform","tagline":"Your easy to use, always-on AI workforce","github_url":"https://github.com/gobii-ai/gobii-platform","owner":"gobii-ai","repo":"gobii-platform","owner_avatar_url":"https://avatars.githubusercontent.com/u/211511300?v=4","primary_language":"Python","stars":497,"forks":92,"topics":["agentic-ai","ai","anthropic","automation","deepseek","docker","easy","gemini","gemma","gpt","litellm","llm","manus-ai","manus-alternative","openclaw-alternative","openclaw-alternative-with-full-settings-ui","openrouter","oss","python"],"archived":false,"github_pushed_at":"2026-08-21T18:53:27+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/gobii-ai-gobii-platform","markdown_url":"https://www.graphcanon.com/tools/gobii-ai-gobii-platform.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/gobii-ai-gobii-platform","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=gobii-ai-gobii-platform","shared_categories":[]},{"slug":"leoyeai-myclaw-bench","name":"myclaw-bench","tagline":"Benchmark for AI agents on OpenClaw","github_url":"https://github.com/LeoYeAI/myclaw-bench","owner":"LeoYeAI","repo":"myclaw-bench","owner_avatar_url":"https://avatars.githubusercontent.com/u/121472001?v=4","primary_language":"Python","stars":223,"forks":36,"topics":["agent-testing","ai-agent","ai-benchmark","benchmark","llm-evaluation","myclaw","openclaw"],"archived":false,"github_pushed_at":"2026-07-20T08:48:41+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/leoyeai-myclaw-bench","markdown_url":"https://www.graphcanon.com/tools/leoyeai-myclaw-bench.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/leoyeai-myclaw-bench","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=leoyeai-myclaw-bench","shared_categories":["evaluation-observability"]}]}}