14 Open-Source-Anbieter für Datengovernance & MDM.
Open-Source-Software für Datengovernance & MDM, die Sie selbst hosten können, mit prüfbarem Quellcode — unabhängig vom Hauptsitz des Entwicklers.
- Apache AtlasSelbst hosten / Open Source
Der traditionelle Open-Source-Schwergewicht der Apache Software Foundation für Governance und Metadaten-Management in Enterprise-Data-Lakes und Hadoop/Spark-Ökosystemen.
Vereinigte Staaten
- Apache KnoxSelbst hosten / Open Source
Open-Source-Anwendungs-Gateway, das als zentraler Zugriffspunkt für Authentifizierung, Autorisierung und Umkreis-Sicherheit um Enterprise-Data-Lakes fungiert. Ein Projekt der Apache Software Foundation.
Vereinigte Staaten
- Apache RangerSelbst hosten / Open Source
Open-Source-Framework zur Verwaltung und Audit zentralisierter Sicherheits- und Zugriffsrechte (Datenzugriffs-Governance) über komplexe Enterprise-Daten-Plattformen (Hive, HBase, Kafka, Solr). Ein Projekt der Apache Software Foundation.
Vereinigte Staaten
- CKANNicht-EU-Anbieter
Der globale Open-Source-Standard für Datenportale und -kataloge, intensiv von europäischen Regierungen für Open-Data-Governance verwendet (einschließlich data.europa.eu, data.gov.uk, govdata.de). Gesteuert durch die Open Knowledge Foundation (UK).
Vereinigtes Königreich
- Data Contract CLISelbst hosten / Open Source
Open-Source-Befehlszeilentool (MIT-Lizenz) zum Erstellen und Validieren von 'Datenverträgen', um zu verhindern, dass Änderungen in Produktionssystemen nachgelagerte Reports unerwartet unterbrechen. Entwickelt von Beratern bei INNOQ (Deutschland).
Deutschland
- DataHubNicht-EU-Anbieter
Beliebter Open-Source-Unternehmens-Datenkatalog (ursprünglich LinkedIn OSS) mit Echtzeit-Metadaten-Erfassung und erweiterter Daten-Lineage-Visualisierung. Kommerziell gepflegt durch Acryl Data Inc. (Mountain View, US).
Vereinigte Staaten
- DeequNicht-EU-Anbieter
Open-Source-Bibliothek von Amazon, aufgebaut auf Apache Spark, speziell für die Messung und Überwachung der Datenqualität im großen Maßstab (Data Lakes).
Vereinigte Staaten
- Great ExpectationsNicht-EU-Anbieter
Der Open-Source-Industriestandard für Enterprise Data Quality und Data Profiling; definiert und validiert Datentests als Code. Entwickelt von Superconductive (Redwood City, US).
Vereinigte Staaten
- MagdaSelbst hosten / Open Source
Open-Source föderierter Enterprise-Datenkatalog mit Schwerpunkt auf Privacy-by-Design und Indexierung verteilter Datensätze ohne Bewegung. Ursprünglich ein australisches Regierungsprojekt (CSIRO Data61), jetzt von der Gemeinschaft gepflegt.
Australien
- MarquezSelbst hosten / Open Source
Open-Source, metadaten-zentrierte Plattform zum Sammeln, Organisieren und Visualisieren von Datenherkünften und dem Status aktiver Daten-Pipelines. Die Referenzimplementierung von OpenLineage, einem Graduated-Projekt der Linux Foundation AI & Data.
Vereinigte Staaten
- MindsDBNicht-EU-Anbieter
Open-Source-Plattform als Governance- und KI-Datenschicht, ermöglicht zentralisierte Audit von Datenflüssen in vorausschauende Modelle. US-Unternehmen (Berkeley, Kalifornien).
Vereinigte Staaten
- OpenMetadataNicht-EU-Anbieter
Moderne, zentrale Open-Source-Plattform für Data Governance, die Datenkatalogisierung, Herkunft, Datenqualität und Teamzusammenarbeit über einen API-First-Ansatz vereint. Kommerziell von Collate Inc. (Menlo Park, US) gepflegt.
Vereinigte Staaten
- OpenRefineSelbst hosten / Open Source
Mächtige, lokal ausgeführte Desktopanwendung zur Bereinigung, Umwandlung und Verwaltung unordentlicher Datensätze ohne Cloud-Transfer. Steuerlich gesponsert von der gemeinnützigen Organisation Code for Science & Society (US); keine Muttergesellschaft.
Vereinigte Staaten
- PanderaNicht-EU-Anbieter
Leichtes Open-Source-Datenvalidierungs-Framework für Datenwissenschaftler zur Durchsetzung von Schema- und Datenqualitätsprüfungen in Python-Pipelines (pandas/Polars/Spark). Entwickelt von Union.ai (Seattle, USA).
Vereinigte Staaten