{"data":{"slug":"data-infra-cube-studio","name":"cube-studio","tagline":"一站式云原生机器学习/深度学习平台","github_url":"https://github.com/data-infra/cube-studio","owner":"data-infra","repo":"cube-studio","owner_avatar_url":"https://avatars.githubusercontent.com/u/20157705?v=4","primary_language":"Python","stars":2435,"forks":195,"topics":["ai-platform","ascend","automl","cube-studio","cubestudio","deepseek","inference","kubernetes","llmops","maas","machine-learning","mlops","npu","pipeline","vgpu","workflow"],"archived":false,"github_pushed_at":"2026-08-17T01:22:20+00:00","maintenance_label":"Very active","stars_delta_30d":69,"url":"https://www.graphcanon.com/tools/data-infra-cube-studio","markdown_url":"https://www.graphcanon.com/tools/data-infra-cube-studio.md","api_url":"https://www.graphcanon.com/api/graphcanon/tools/data-infra-cube-studio","graph_url":"https://www.graphcanon.com/api/graphcanon/graph?tool=data-infra-cube-studio","description":"cubestudio开源云原生一站式机器学习/深度学习/大模型AI平台/MaaS/mlops/人工智能平台/训推平台，算法全链路流程，多租户，算力租赁平台，token中转，拖拉拽任务流pipeline编排，多机多卡分布式训练，超参搜索，推理服务，VGPU虚拟化，云边端协同，边缘计算，自动化标注平台，deepseek等大模型sft微调/奖励模型/强化学习训练，vllm/ollama/mindie大模型多机推理，私有知识库llmops智能体，AI模型市场，支持国产异构算力调度,昇腾/寒武纪/海光/摩尔/沐曦等，支持ib/roce/RDMA，信创支持","homepage_url":"https://cubestudio.vip","license":"Other","open_issues":27,"watchers":23,"ai_summary":"cube-studio is an open-source cloud-native machine learning and deep learning platform that supports the entire lifecycle of model development including training, inference, deployment, and management. It offers a comprehensive set of features such as automated pipeline orchestration, multi-tenant support, distributed training capabilities on diverse hardware, hyperparameter tuning, and more.","readme_excerpt":"# 不再同步更新旧仓库 tencentmusic/cube-studio\n\n# CubeStudio\n\nCubeStudio 是一款国产化、云原生的一站式开源人工智能平台，同时覆盖传统机器学习、深度学习与大模型全链路（MLOps / MaaS / 算力调度 / 训推平台），开源协议 MIT，开源免费商用，开源版本已有数千家企业私有化部署。平台提供多租户与算力纳管调度、算力租赁与 Token 中转站、拖拉拽 Pipeline 任务流编排、多机多卡分布式训练、超参搜索、推理服务、vGPU 虚拟化、云边端协同与边缘计算、图文音多模态自动化标注、大模型 SFT 微调 / 奖励模型 / 强化学习训练、vLLM / Ollama / MindIE 大模型多机推理、私有知识库 / LLMOps / 智能体、AI 模型市场，以及从数据到上线的全流程模型部署。原生适配昇腾、寒武纪、海光、摩尔线程、沐曦等国产异构算力与 x86 / ARM CPU 架构，支持 IB / RoCE / RDMA 高速网络及信创私有化、内网离线部署。\n\n# 帮助文档\n\nhttps://github.com/data-infra/cube-studio/wiki\n\n# 开源共建\n\n 学习、部署、体验、开源建设、商业合作 欢迎来撩。或添加微信luanpeng1234，备注<开源建设>\n\n <img border=\"0\" width=\"20%\" src=\"https://user-images.githubusercontent.com/20157705/219829986-66384e34-7ae9-4511-af67-771c9bbe91ce.jpg\" />\n\n\n### 整体架构\n\n\n\n\n# 功能清单\n\n| 模块分组 | 功能 | 功能描述 |\n| --- | --- | --- |\n| 用户权限 | SSO单点登录 | <li>账号密码注册自动登录<li><u>支持对接公司账号体系AUTH_OID/AUTH_LDAP/AUTH_REMOTE_USER等登录注册方式，支持消息推送</u></li><br><li><u>增加登录验证，强密码，远程用户，登录频率限制，密码密文传输显示等</u></li> |\n| 用户权限 | 项目组管理 | <li>AI平台需要通过项目划分，支持配置相应项目组用户的权限，任务/服务的挂载，资源组，集群，服务代理，项目组内角色控制，<u>支持用户和项目组删除，支持为项目组指定命名空间，项目组支持绑定多个资源组，支持设置组内用户可用资源组</u></li> |\n| 用户权限 | 用户管理<br>角色管理/权限管理 | <li>管理平台用户的基本信息，组织架构，支持账号密码，rbac权限体系</li><br><li><u>增加修改和删除，清理等操作的历史记录，支持菜单权限控制</u></li><br><li><u>支持只读者public角色，支持控制角色可访问接口，以及接口访问类型</u></li><br><li><u>支持多租户(多个用户公司)</u></li> |\n| 算力调度 | 数据大屏 | <li>支持全局，项目组，个人级别的任务pod的分布情况</li> |\n| 算力调度 | 多资源组/多集群 | <li>支持划分多资源组，支持docker运行时，<u>支持多k8s集群，支持ipvs网络模式，支持containerd容器运行态，支持边缘集群模式</u></li> |\n| 算力调度 | gpu调度能力 | <li>提供多种规格的资源支持不同的使用场景，cpu/gpu等 支持T4/V100/A100等多种卡型</li><br><li><u>支持gpu禁用模型，共享模式，独占模式，vgpu模式，支持虚拟化占用显存设定，英伟达支持指定卡序号，支持gpu调度binpack调度策略，支持ib/roce的rdma协议</u></li> |\n| 算力调度 | 支持多种算力 | <li><u>平台底层外部组件支持arm架构，前后端镜像支持arm架构，任务模板支持arm架构，notebook镜像支持arm架构，超参搜索支持arm架构，aihub应用70%支持arm架构</u></li><br><li><u>支持调度海光dcu，华为npu算力，壁仞，沐曦、寒武纪、摩尔线程，百度昆仑芯</u></li> |\n| 算力调度 | 算力市场 | <li><u>支持算力市场机器空闲状态查看，支持按需占用，和包月包日模式租赁</u></li> |\n| 算力调度 | 租赁实例 | <li><u>支持租赁启动pod实例管理，开关机释放等，支持查看当前租赁信息和使用费用ssh登录信息等</u></li><br><li><u>支持包月账单的管理</u></li> |\n| 算力调度 | 计量计费功能 | <li><u>1、支持平台资源限制的分配和查看</u></li><br><li><u>项目组资源限制，用户资源限制、任务资源限制，项目组下个人的资源限制，包括开发资源，训练资源、推理资源等</u></li><br><li><u>额度限制限制在notebook，docker构建，pipeline，超参搜索，内部服务，推理服务中的生效</u></li><br><li><u>限制支持单任务，并行任务总和和历史任务总和等方法</u></li><br><li><u>2、提供统一的开发、训练、推理服务资源监控，从用户、项目、任务角度分析模型资源分配及使用情况</u></li><br><li><u>3、支持自定义计费模式，通过计量结果自定义获取计费值</u></li><br><li><u>4、按需占用日结账单，产生用户每日账单费用和明细</u></li> |\n| 算力调度 | 机器资源管理 | <li><u>web界面控制机器调度类型，所属资源组，是否启动rdma，是否启动vgpu，可用任务场景等</u></li> |\n| 算力调度 | 存储盘管理 | <li><u>支持web界面添加存储盘，支持项目组绑定，notebook pipeline 推理服务，直接在pod中挂载外部分布式存储</u></li><br><li><u>支持nfs，cfs，oss，nas，cos，glusterfs，cephfs，s3/minio</u></li> |\n| 基础能力 | 网络 | <li>支持80、非80端口，支持公网/域名<u>，支持反向代理和内网穿透方式访问，支持https</u></li> |\n| 基础能力 | 数据库存储 | <li><u>支持外部</u>mysql<u>/postgres/OceanBase/人大金仓/达梦作为元数据库(不含标注模块)</u></li> |\n| 基础能力 | 国际化能力 | <li><u>mlops支持配置多语言配置，目前支持8国语言翻译</u></li> |\n| 数据管理 | 数据地图 | <li>元数据库表管理，指标，维表</li> |\n| 数据管理 | 数据计算 | <li>sqllab交互查询，支持mysql，<u>postgresql，clickhouse，hive，presto，达梦数据库</u>等计算引擎，<u>支持数据分析建模</u></li> |\n| 数据管理 | 数据集管理 | <li>允许用户随时上传样本集（图片、音频、文本等），<u>对表格数据支持数据集一键探索功能</u></li> |\n| 数据标注 | 数据标注 | <li><u>支持图/文/音/多模态各类型标注能力</u></li><br><li><u>支持分布式存储打通mlops平台</u></li><br><li><u>支持项目组权限控制，支持普通用户标注草稿，审核员核定，标注质量打分，导入导出批量删除设置等区分角色的权限控制</u></li><br><li><u>标注任务分配</u></li><br><li><u>目前支持8国语言翻译</u></li><br><li><u>labelstudio标注数据导入pipeline</u></li><br><li><u>支持从数据集模块导入和导出到数据集模块</u></li><br><li><u>支持pg/人大金仓数据库</u></li><br><li><u>支持项目状态管理和webhook</u></li> |\n| 数据标注 | 数据标注 | <li><u>支持自动化标注：支持目标识别，目标边界识别，目标遮罩识别，图片分类，图片描述，ocr，支持图片转markdown，关键点检测，视频多目标跟踪，多说话人语音分隔，语音识别，结构化数据标注</u></li><br><li><u>支持视觉大模型自动化标注：支持目标识别万物识别，支持目标边界检测万物分隔，支持目标遮罩万物分隔</u></li><br><li><u>支持大模型自动化标注：文本分类，文本翻译，命名实体识别，阅读理解，问答，摘要提取，答案排序</u></li> |\n| 在线开发 | 镜像功能 | <li>镜像仓库/镜像管理/在线构建镜像</li><br><li>同时提供平台所有镜像，包括模板镜像/服务镜像/notebook镜像/gpu基础环境的构建方法和构建后镜像，</li><br><li><u>支持同一仓库多个秘钥配置，支持在线镜像构建</u></li> |\n| 在线开发 | notebook | <li>支持基于开源的Jupyterlab/vscode<u>汉化版</u>，提供在线的交互式开发调试工具</li><br><li>提供多种可选环境ide和开发示例，支持资源类型选择</li><br><li","github_created_at":"2024-07-02T03:06:50+00:00","created_at":"2026-07-07T17:42:40.246145+00:00","updated_at":"2026-08-20T18:00:55.384854+00:00","categories":[{"slug":"developer-tools","name":"Developer Tools","url":"https://www.graphcanon.com/categories/developer-tools","markdown_url":"https://www.graphcanon.com/categories/developer-tools.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/developer-tools"},{"slug":"evaluation-observability","name":"Evaluation & Observability","url":"https://www.graphcanon.com/categories/evaluation-observability","markdown_url":"https://www.graphcanon.com/categories/evaluation-observability.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/evaluation-observability"},{"slug":"inference-serving","name":"Inference & Serving","url":"https://www.graphcanon.com/categories/inference-serving","markdown_url":"https://www.graphcanon.com/categories/inference-serving.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/inference-serving"},{"slug":"model-training","name":"Model Training","url":"https://www.graphcanon.com/categories/model-training","markdown_url":"https://www.graphcanon.com/categories/model-training.md","api_url":"https://www.graphcanon.com/api/graphcanon/categories/model-training"}],"tags":[{"slug":"ai-platform","name":"ai-platform"},{"slug":"ascend","name":"ascend"},{"slug":"automl","name":"automl"},{"slug":"cube-studio","name":"cube-studio"},{"slug":"deepseek","name":"deepseek"},{"slug":"inference","name":"inference"},{"slug":"kubernetes","name":"kubernetes"},{"slug":"llmops","name":"llmops"}],"trust":{"provenance":{"is_fork":false,"github_id":822887917,"owner_type":"User","methodology":"github_public_v1","parent_repo":null,"near_duplicate_slugs":[]},"computed_at":"2026-08-20T18:00:54.585Z","maintenance":{"label":"Very active","score":96,"methodology":"github_public_v1","releases_90d":1,"days_since_push":3,"last_release_at":"2026-07-26T05:27:25Z","stars_delta_30d":69,"open_issues_delta_30d":0},"security_summary":{"status":"no_lockfile","scanner":null,"low_count":0,"high_count":0,"last_scan_at":"2026-07-11T11:21:38.866Z","medium_count":0,"scan_profile":"none","critical_count":0}},"capability_facts":{"scan":{"source":"repo_scan","observed_at":"2026-08-20T18:00:55.064Z"},"languages":{"value":["python"],"source":"github.language","observed_at":"2026-08-20T18:00:55.064Z"},"license_spdx":{"value":"Other","source":"github.license","observed_at":"2026-08-20T18:00:55.064Z"}},"decision_facts":{"hosting":null,"pricing":null,"requirements":null,"constraints":null,"when_to_use":["For projects needing multi-tenant support with comprehensive distributed training capabilities on diverse hardware including ARM support.","If your infrastructure includes GPUs like T4/V100/A100 or other specialized chips such as Ascend/NPU."],"when_not_to_use":["Avoid if you only require basic services and do not need the advanced features like multi-tenant setup, extensive monitoring, or complex resource management.","Not ideal for teams that do not want to invest in a comprehensive setup offering multiple layers of user roles, automated pipeline orchestration, and hyperparameter tuning."],"source":"enrich:decision_facts","observed_at":"2026-07-14T18:36:00.808Z"},"constraint_facets":null,"decision_summary":[{"label":"Adopt for","value":"CubeStudio is an open-source cloud-native ML/DL platform that handles the full lifecycle of model development, training, inference, deployment, and management."}]}}