{"data":{"node":{"slug":"uclaml-spin","name":"SPIN","tagline":"Official implementation of Self-Play Fine-Tuning","github_url":"https://github.com/uclaml/SPIN","owner":"uclaml","repo":"SPIN","owner_avatar_url":"https://avatars.githubusercontent.com/u/22385378?v=4","primary_language":"Python","stars":1254,"forks":106,"topics":["deep-learning","fine-tuning","large-language-models","self-play"],"archived":false,"github_pushed_at":"2024-05-08T05:59:37+00:00","maintenance_label":"Dormant","stars_delta_30d":6,"url":"https://www.graphcanon.com/tools/uclaml-spin","markdown_url":"https://www.graphcanon.com/tools/uclaml-spin.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/uclaml-spin","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=uclaml-spin"},"categories":[{"slug":"llm-frameworks","name":"LLM Frameworks","url":"https://www.graphcanon.com/categories/llm-frameworks","markdown_url":"https://www.graphcanon.com/categories/llm-frameworks.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/llm-frameworks"},{"slug":"model-training","name":"Model Training","url":"https://www.graphcanon.com/categories/model-training","markdown_url":"https://www.graphcanon.com/categories/model-training.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/model-training"}],"tags":[{"slug":"deep-learning","name":"deep-learning"},{"slug":"fine-tuning","name":"fine-tuning"},{"slug":"large-language-models","name":"large language models"},{"slug":"self-play","name":"self-play"}],"edges":[],"neighbours":[{"slug":"huggingface-peft","name":"peft","tagline":"State-of-the-art Parameter-Efficient Fine-Tuning","github_url":"https://github.com/huggingface/peft","owner":"huggingface","repo":"peft","owner_avatar_url":"https://avatars.githubusercontent.com/u/25720743?v=4","primary_language":"Python","stars":21585,"forks":2446,"topics":["adapter","diffusion","fine-tuning","llm","lora","parameter-efficient-learning","peft","python","pytorch","transformers"],"archived":false,"github_pushed_at":"2026-08-22T01:15:06+00:00","maintenance_label":"Very active","url":"https://www.graphcanon.com/tools/huggingface-peft","markdown_url":"https://www.graphcanon.com/tools/huggingface-peft.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/huggingface-peft","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=huggingface-peft","shared_categories":["model-training","llm-frameworks"]},{"slug":"huggingface-trl","name":"trl","tagline":"Train transformer language models with reinforcement learning.","github_url":"https://github.com/huggingface/trl","owner":"huggingface","repo":"trl","owner_avatar_url":"https://avatars.githubusercontent.com/u/25720743?v=4","primary_language":"Python","stars":19016,"forks":2891,"topics":[],"archived":false,"github_pushed_at":"2026-08-06T10:02:43+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/huggingface-trl","markdown_url":"https://www.graphcanon.com/tools/huggingface-trl.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/huggingface-trl","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=huggingface-trl","shared_categories":["model-training"]},{"slug":"fareedkhan-dev-train-llm-from-scratch","name":"train-llm-from-scratch","tagline":"A straightforward method for training your LLM from raw text to aligned model generation","github_url":"https://github.com/FareedKhan-dev/train-llm-from-scratch","owner":"FareedKhan-dev","repo":"train-llm-from-scratch","owner_avatar_url":"https://avatars.githubusercontent.com/u/63067900?v=4","primary_language":"Python","stars":9141,"forks":1264,"topics":["gemini","large-language-models","llm","openai","training","transformers"],"archived":false,"github_pushed_at":"2026-08-17T05:07:26+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/fareedkhan-dev-train-llm-from-scratch","markdown_url":"https://www.graphcanon.com/tools/fareedkhan-dev-train-llm-from-scratch.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/fareedkhan-dev-train-llm-from-scratch","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=fareedkhan-dev-train-llm-from-scratch","shared_categories":["model-training"]},{"slug":"opendilab-awesome-rlhf","name":"awesome-RLHF","tagline":"A curated list of reinforcement learning with human feedback resources (continually updated)","github_url":"https://github.com/opendilab/awesome-RLHF","owner":"opendilab","repo":"awesome-RLHF","owner_avatar_url":"https://avatars.githubusercontent.com/u/86840398?v=4","primary_language":null,"stars":4422,"forks":258,"topics":["deep-learning","deep-reinforcement-learning","human-feedback","large-language-models","reinforcement-learning","rlhf"],"archived":false,"github_pushed_at":"2026-05-20T12:56:15+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/opendilab-awesome-rlhf","markdown_url":"https://www.graphcanon.com/tools/opendilab-awesome-rlhf.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/opendilab-awesome-rlhf","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=opendilab-awesome-rlhf","shared_categories":["model-training"]},{"slug":"alibaba-roll","name":"ROLL","tagline":"Scaling Library for Reinforcement Learning with Large Language Models","github_url":"https://github.com/alibaba/ROLL","owner":"alibaba","repo":"ROLL","owner_avatar_url":"https://avatars.githubusercontent.com/u/1961952?v=4","primary_language":"Python","stars":3354,"forks":304,"topics":["agentic","rlhf","rlvr"],"archived":false,"github_pushed_at":"2026-08-07T01:51:58+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/alibaba-roll","markdown_url":"https://www.graphcanon.com/tools/alibaba-roll.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/alibaba-roll","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=alibaba-roll","shared_categories":["model-training"]},{"slug":"ashishpatel26-llm-finetuning","name":"LLM-Finetuning","tagline":"LLM Finetuning with PEFT","github_url":"https://github.com/ashishpatel26/LLM-Finetuning","owner":"ashishpatel26","repo":"LLM-Finetuning","owner_avatar_url":"https://avatars.githubusercontent.com/u/3095771?v=4","primary_language":"Jupyter Notebook","stars":2979,"forks":771,"topics":["falcon","fine-tuning","huggingface","llama","llama2","llm","llms","lora","peft","pytorch","text-generation"],"archived":false,"github_pushed_at":"2025-08-01T12:00:20+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/ashishpatel26-llm-finetuning","markdown_url":"https://www.graphcanon.com/tools/ashishpatel26-llm-finetuning.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/ashishpatel26-llm-finetuning","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=ashishpatel26-llm-finetuning","shared_categories":["model-training","llm-frameworks"]},{"slug":"learnables-learn2learn","name":"learn2learn","tagline":"A PyTorch Library for Meta-learning Research","github_url":"https://github.com/learnables/learn2learn","owner":"learnables","repo":"learn2learn","owner_avatar_url":"https://avatars.githubusercontent.com/u/54878124?v=4","primary_language":"Python","stars":2891,"forks":359,"topics":["few-shot","finetuning","learn2learn","learning2learn","maml","meta-descent","meta-learning","meta-optimization","meta-rl","metalearning","pytorch"],"archived":false,"github_pushed_at":"2025-12-16T20:53:41+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/learnables-learn2learn","markdown_url":"https://www.graphcanon.com/tools/learnables-learn2learn.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/learnables-learn2learn","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=learnables-learn2learn","shared_categories":["model-training"]},{"slug":"stochasticai-xturing","name":"xTuring","tagline":"Personalize and control open-source LLMs with ease","github_url":"https://github.com/stochasticai/xTuring","owner":"stochasticai","repo":"xTuring","owner_avatar_url":"https://avatars.githubusercontent.com/u/66399337?v=4","primary_language":"Python","stars":2674,"forks":211,"topics":["adapter","deep-learning","fine-tuning","finetuning","gen-ai","generative-ai","gpt-2","gpt-j","language-model","llama","llm","lora","mistral","mixed-precision","peft","quantization"],"archived":false,"github_pushed_at":"2026-03-04T23:07:06+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/stochasticai-xturing","markdown_url":"https://www.graphcanon.com/tools/stochasticai-xturing.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/stochasticai-xturing","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=stochasticai-xturing","shared_categories":["model-training","llm-frameworks"]},{"slug":"thudm-p-tuning-v2","name":"P-tuning-v2","tagline":"Optimized deep prompt tuning strategy comparable to fine-tuning across scales and tasks","github_url":"https://github.com/THUDM/P-tuning-v2","owner":"THUDM","repo":"P-tuning-v2","owner_avatar_url":"https://avatars.githubusercontent.com/u/48590610?v=4","primary_language":"Python","stars":2077,"forks":213,"topics":["natural-language-processing","p-tuning","parameter-efficient-learning","pretrained-language-model","prompt-tuning"],"archived":false,"github_pushed_at":"2023-11-16T04:38:09+00:00","maintenance_label":"Dormant","url":"https://www.graphcanon.com/tools/thudm-p-tuning-v2","markdown_url":"https://www.graphcanon.com/tools/thudm-p-tuning-v2.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/thudm-p-tuning-v2","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=thudm-p-tuning-v2","shared_categories":["model-training"]},{"slug":"arahim3-mlx-tune","name":"mlx-tune","tagline":"Fine-tune LLMs on your Mac with Apple Silicon for various tasks including SFT, DPO, GRPO, Vision, TTS, STT, Embedding, and OCR.","github_url":"https://github.com/ARahim3/mlx-tune","owner":"ARahim3","repo":"mlx-tune","owner_avatar_url":"https://avatars.githubusercontent.com/u/41390319?v=4","primary_language":"Python","stars":1372,"forks":88,"topics":["apple-silicon","deep-learning","huggingface","large-language-models","llm","llm-finetuning","local-llm","lora","machine-learning","macos","mlx","on-device-ai","peft","speech-recognition","speech-to-text","text-to-speech","transformers","unsloth","vision-language-model","whisper"],"archived":false,"github_pushed_at":"2026-06-23T12:24:30+00:00","maintenance_label":"Steady","url":"https://www.graphcanon.com/tools/arahim3-mlx-tune","markdown_url":"https://www.graphcanon.com/tools/arahim3-mlx-tune.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/arahim3-mlx-tune","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=arahim3-mlx-tune","shared_categories":["model-training","llm-frameworks"]},{"slug":"georgian-io-llm-finetuning-toolkit","name":"LLM-Finetuning-Toolkit","tagline":"Toolkit for fine-tuning and testing open-source large language models","github_url":"https://github.com/georgian-io/LLM-Finetuning-Toolkit","owner":"georgian-io","repo":"LLM-Finetuning-Toolkit","owner_avatar_url":"https://avatars.githubusercontent.com/u/10764713?v=4","primary_language":"Python","stars":870,"forks":107,"topics":["ablation-study","classification","falcon","fine-tuning","finetuning","flan-t5","large-language-models","llama2","llm-test","lora","mistral-7b","nlp","nlp-machine-learning","qlora","redpajama","summarization","unit-testing","zephyr"],"archived":false,"github_pushed_at":"2026-05-04T16:33:40+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/georgian-io-llm-finetuning-toolkit","markdown_url":"https://www.graphcanon.com/tools/georgian-io-llm-finetuning-toolkit.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/georgian-io-llm-finetuning-toolkit","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=georgian-io-llm-finetuning-toolkit","shared_categories":["model-training","llm-frameworks"]},{"slug":"dvgodoy-finetuningllms","name":"FineTuningLLMs","tagline":"Official repository for 'A Hands-On Guide to Fine-Tuning LLMs with PyTorch and Hugging Face'","github_url":"https://github.com/dvgodoy/FineTuningLLMs","owner":"dvgodoy","repo":"FineTuningLLMs","owner_avatar_url":"https://avatars.githubusercontent.com/u/5184020?v=4","primary_language":"Jupyter Notebook","stars":855,"forks":116,"topics":["bitsandbytes","fine-tuning","finetuning","finetuning-llms","hugging-face","huggingface","large-language-models","llamacpp","lora","ollama","peft","peft-fine-tuning-llm","pytorch","transformers"],"archived":false,"github_pushed_at":"2026-02-28T14:57:29+00:00","maintenance_label":"Slowing","url":"https://www.graphcanon.com/tools/dvgodoy-finetuningllms","markdown_url":"https://www.graphcanon.com/tools/dvgodoy-finetuningllms.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/dvgodoy-finetuningllms","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=dvgodoy-finetuningllms","shared_categories":["model-training","llm-frameworks"]}]}}