{"data":{"node":{"slug":"reinflow-reinflow","name":"ReinFlow","tagline":"ReinFlow combines Flow Policy with online reinforcement learning for fine-tuning across various robotic tasks.","github_url":"https://github.com/ReinFlow/ReinFlow","owner":"ReinFlow","repo":"ReinFlow","owner_avatar_url":"https://avatars.githubusercontent.com/u/212894921?v=4","primary_language":"Python","stars":359,"forks":34,"topics":["actorcritic","fine-tuning","finetuning-rl","finetuning-vision-models","flow","flowmatching","locomotion","manipulation","onlinerl","pi0","policygradient","post-training","rl","robot-learning","robotics","visuomotor","vla"],"archived":false,"github_pushed_at":"2026-04-24T22:34:21+00:00","maintenance_label":"Slowing","stars_delta_30d":10,"url":"https://www.graphcanon.com/tools/reinflow-reinflow","markdown_url":"https://www.graphcanon.com/tools/reinflow-reinflow.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/reinflow-reinflow","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=reinflow-reinflow"},"categories":[{"slug":"evaluation-observability","name":"Evaluation & Observability","url":"https://www.graphcanon.com/categories/evaluation-observability","markdown_url":"https://www.graphcanon.com/categories/evaluation-observability.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/evaluation-observability"},{"slug":"model-training","name":"Model Training","url":"https://www.graphcanon.com/categories/model-training","markdown_url":"https://www.graphcanon.com/categories/model-training.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/model-training"}],"tags":[{"slug":"actorcritic","name":"actorcritic"},{"slug":"fine-tuning","name":"fine-tuning"},{"slug":"finetuning-rl","name":"finetuning-rl"},{"slug":"flowmatching","name":"flowmatching"},{"slug":"locomotion","name":"locomotion"},{"slug":"manipulation","name":"manipulation"},{"slug":"online-reinforcement-learning","name":"online-reinforcement-learning"},{"slug":"pi0","name":"pi0"}],"edges":[],"neighbours":[{"slug":"verl-project-verl","name":"verl","tagline":"A Flexible and Efficient RL Post-Training Framework","github_url":"https://github.com/verl-project/verl","owner":"verl-project","repo":"verl","owner_avatar_url":"https://avatars.githubusercontent.com/u/212961691?v=4","primary_language":"Python","stars":22854,"forks":4353,"topics":[],"archived":false,"github_pushed_at":"2026-08-07T04:17:39+00:00","maintenance_label":"Active","url":"https://www.graphcanon.com/tools/verl-project-verl","markdown_url":"https://www.graphcanon.com/tools/verl-project-verl.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/verl-project-verl","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=verl-project-verl","shared_categories":["model-training"]}]}}