Back to Topics Directory
Topic Hub

#data-pipelines (15 Repositories)

Ranked open-source repositories tagged with #data-pipelines, scored by pull request acceptance likelihood and maintainer engagement velocity.

Topic Avg Merge Rate

39.1%

Avg Review Latency

56.4h

Filter by language

15 repositories tagged #data-pipelines

S TierRust 2.1k 2 GFIs

feldera/feldera

The Feldera Incremental Computation Engine

89.8%
Merge Rate
1d
First Review
73%
1st-Timers
25
Maintainers
S TierRust 214 7 GFIs

wingfoil-io/wingfoil

graph based stream processing framework

85.6%
Merge Rate
17h
First Review
100%
1st-Timers
6
Maintainers
A TierPython 100

conductor-oss/python-sdk

Conductor OSS SDK for Python programming language

85.7%
Merge Rate
4h
First Review
50%
1st-Timers
4
Maintainers
A TierGo 1.7k

bruin-data/bruin

Build data pipelines with SQL and Python, ingest data from different sources, add quality checks, and build end-to-end flows.

88.9%
Merge Rate
7d
First Review
64%
1st-Timers
10
Maintainers
B TierJava 14.4k 7 GFIs

apache/dolphinscheduler

Apache DolphinScheduler is the modern data orchestration platform. Agile to create high performance workflow with low-code

7.5%
Merge Rate
<1h
First Review
33%
1st-Timers
19
Maintainers
B TierScala 130

smart-data-lake/smart-data-lake

Smart Automation Tool for building modern Data Lakes and Data Pipelines

84.3%
Merge Rate
12d
First Review
33%
1st-Timers
2
Maintainers
B TierPython 322

tuva-health/tuva-core

Main repo including core data model, data marts, data quality tests, and terminology sets.

44.4%
Merge Rate
2d
First Review
0%
1st-Timers
1
Maintainers
B TierPython 11.0k

kedro-org/kedro

Kedro is a toolbox for production-ready data science. It uses software engineering best practices to help you create data engineering and data science pipelines that are reproducible, maintainable, and modular.

69.5%
Merge Rate
5d
First Review
64%
1st-Timers
30
Maintainers
C TierPython 62.4k

pathwaycom/pathway

Python ETL framework for stream processing, real-time analytics, LLM pipelines, and RAG.

31.4%
Merge Rate
7d
First Review
33%
1st-Timers
7
Maintainers
D TierHTML 2.4k

elementary-data/elementary

The dbt-native data observability solution for data & analytics engineers. Monitor your data pipelines in minutes. Available as self-hosted or cloud service with premium features.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierScala 1.5k

combust/mleap

MLeap: Deploy ML Pipelines to Production

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPython 8.8k

mage-ai/mage-ai

🧙 Build, run, and manage data pipelines for integrating and transforming data.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPython 259

Burla-Cloud/burla

The simplest way to scale Python.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierTypeScript 490

dataflint/spark

Drop-in replacement for Apache Spark UI

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPython 16.1k

dagster-io/dagster

An orchestration platform for the development, production, and observation of data assets.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
Best Data-pipelines Open Source Repositories & C-Rank™ | GetMerged