数据分析

Kedro

用于组织模块化、可维护和可复现数据科学代码的开源 Python 框架,提供管线、配置和数据目录抽象。

最近核验

ABOUT THIS TOOL

关于 Kedro

用于组织模块化、可维护和可复现数据科学代码的开源 Python 框架,提供管线、配置和数据目录抽象。它面向“把研究分析代码整理为可测试、可追踪的数据管线”这一类科研任务,可通过Python、CLI、Jupyter、Windows、macOS、Linux使用。本站将其归入数据分析,相关能力标签包括数据管线、可复现计算。

适合把数据读取、转换、建模和报告拆分为具有明确输入输出的节点,再通过管线、配置和数据目录连接。应将代码、环境、配置与数据版本纳入版本控制,为关键节点编写测试,并在部署或调度前明确外部计算与存储依赖。

Kedro 适合哪些科研任务?

  • 把数据科学代码拆分为模块化节点和管线
  • 通过数据目录统一管理输入与输出
  • 组织可测试、可配置的研究计算项目

选择与使用建议

建议先用不含敏感信息的小型任务试用,检查输出是否可追溯、能否导出,以及是否适合你所在团队的工作流。涉及论文结论、统计分析或专业模型时,应保留原始来源、参数和人工复核记录。

  • Kedro 提供项目结构和执行框架,但不会自动保存所有数据、软件环境或科学决策,不能单独保证研究可复现
  • Kedro-Viz、数据集连接器和部署插件是独立组件,功能与兼容性取决于具体版本和配置
数据管线可复现计算

最后核验:2026-09-10
资料来源:官方来源 ↗
工具功能、价格与政策可能变化,请以官方页面为准。