{"id":13567388,"url":"https://github.com/opendatadiscovery/awesome-data-catalogs","last_synced_at":"2025-05-08T04:31:02.714Z","repository":{"id":44686123,"uuid":"385832397","full_name":"opendatadiscovery/awesome-data-catalogs","owner":"opendatadiscovery","description":"📙 Awesome Data Catalogs and Observability Platforms. ","archived":false,"fork":false,"pushed_at":"2025-04-15T10:02:08.000Z","size":122,"stargazers_count":844,"open_issues_count":5,"forks_count":62,"subscribers_count":22,"default_branch":"main","last_synced_at":"2025-05-06T19:08:30.262Z","etag":null,"topics":["awesome","awesome-list","big-data","data-catalog","data-discovery","data-engineering","data-quality","datacatalog","datadiscovery","dataops","metadata","metadata-management","ml","observability","open-source","opendata","opensource","oss"],"latest_commit_sha":null,"homepage":"","language":null,"has_issues":true,"has_wiki":null,"has_pages":null,"mirror_url":null,"source_name":null,"license":"mit","status":null,"scm":"git","pull_requests_enabled":true,"icon_url":"https://github.com/opendatadiscovery.png","metadata":{"files":{"readme":"README.md","changelog":null,"contributing":"CONTRIBUTING.MD","funding":null,"license":"LICENSE.md","code_of_conduct":"CODE_OF_CONDUCT.MD","threat_model":null,"audit":null,"citation":null,"codeowners":null,"security":null,"support":null,"governance":null,"roadmap":null,"authors":null,"dei":null,"publiccode":null,"codemeta":null,"zenodo":null}},"created_at":"2021-07-14T06:08:18.000Z","updated_at":"2025-05-06T15:48:03.000Z","dependencies_parsed_at":"2024-05-28T07:29:24.653Z","dependency_job_id":"192555b1-be2a-44de-a347-f93beb034154","html_url":"https://github.com/opendatadiscovery/awesome-data-catalogs","commit_stats":{"total_commits":90,"total_committers":12,"mean_commits":7.5,"dds":"0.19999999999999996","last_synced_commit":"34de0b05d9cd85896a34dea9f6f89bd6e2f7dec1"},"previous_names":[],"tags_count":0,"template":false,"template_full_name":null,"repository_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/opendatadiscovery%2Fawesome-data-catalogs","tags_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/opendatadiscovery%2Fawesome-data-catalogs/tags","releases_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/opendatadiscovery%2Fawesome-data-catalogs/releases","manifests_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/opendatadiscovery%2Fawesome-data-catalogs/manifests","owner_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners/opendatadiscovery","download_url":"https://codeload.github.com/opendatadiscovery/awesome-data-catalogs/tar.gz/refs/heads/main","host":{"name":"GitHub","url":"https://github.com","kind":"github","repositories_count":252999391,"owners_count":21838209,"icon_url":"https://github.com/github.png","version":null,"created_at":"2022-05-30T11:31:42.601Z","updated_at":"2022-07-04T15:15:14.044Z","host_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub","repositories_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories","repository_names_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repository_names","owners_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners"}},"keywords":["awesome","awesome-list","big-data","data-catalog","data-discovery","data-engineering","data-quality","datacatalog","datadiscovery","dataops","metadata","metadata-management","ml","observability","open-source","opendata","opensource","oss"],"created_at":"2024-08-01T13:02:30.250Z","updated_at":"2025-05-08T04:31:02.694Z","avatar_url":"https://github.com/opendatadiscovery.png","language":null,"funding_links":[],"categories":["Misc","Others","Other Lists","awesome-list"],"sub_categories":["TeX Lists"],"readme":"\n\n\n# Awesome Data Discovery and Observability [![Awesome](https://awesome.re/badge-flat.svg)](https://awesome.re)\n\nThis repository contains a curated list of awesome data catalogs and observability platforms that help you discover, manage, and observe data in your organization. \n\n\u003cbr\u003e\n\n## Contents: Existing Data Discovery and Observability Solutions\n\n| [OSS Data Catalogs](#opensource) | [ Proprietary Monocloud DCs](#monocloud)| [ Proprietary Observability Tools](#observability) | [Other Proprietary DCs](#proprietary) |\n|--------------------------|--------------------------------|---------------------------------|--------------------------------|\n| [📙 Amundsen](#amundsen) |  [📒 Google DC](#google)       | [🔍 Monte Carlo](#montecarlo)  | [📕 Alation](#alation)         |\n| [📙 DataHub](#datahub)   |  [📒 Azure DC](#azure)         | [🔍 Databand](#databand)       | [📕 Atlan](#atlan)             |\n| [📙 Marquez](#marquez)   |                                | [🔍 Datafold](#datafold)       | [📕 Collibra](#collibra)       |\n| [📙 Atlas](#atlas)       |                                | [🔍 Ataccama](#ataccama)       | [📕 DataGalaxy](#datagalaxy) |\n| [📙 CKAN](#ckan)         |                                | [🔍 DataKitchen Open Source Data Observability](#datakitchen)| [📕 Informatica](#informatica) |\n| [📙 Magda](#magda)       |                                |                                | [📕 Stemma](#stemma)          |\n| [📙 OpenDataDiscovery](#opendatadiscovery)|                                |                                | [📕 Talend](#talend) |\n| [📙 OpenMetadata](#openmetadata)|                                |                                | [📕 Select Star](#selectstar) |\n| [📙 Meta\\#Grid](#metagrid)|                                |                                | |\n| [📙 Grai](#grai) |                                |                                | |\n| [📙 Hamilton](#hamilton) |                                |                                | |\n\n\n\u003cbr\u003e\n\n## High-Level Feature Comparison\n\n\n| Tool | Specification -Based | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observ- ability | Column-level lineage | Data collaboration |\n|:-------------:|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:--:|:--:| \n| [Alation](#alation)    | ❌ | ✔️ | ❌  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ |\n| [Amundsen](#amundsen)  | ❌ | ✔️  | ✔️  | ✔️ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |\n| [Ataccama](#ataccama)  | ❌ | ✔️ | ❌  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ |\n| [Atlan](#atlan)        | ❌ | ✔️ | ❌  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ✔️ | ✔️ |\n| [Atlas](#atlas)        | ❌ | ✔️  | ❌  | ✔️ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |\n| [Azure DC](#azure)     | ❌ | ✔️ | ? | ✔️ | ❌ | ❌ | ? | ❌ | ❌ | ❌ | ❌ |\n| [CKAN](#ckan)          | ✔️ [DCAT, DCAT-AP, Schema.org and more](https://linkdigital.com.au/news/2024/10/enhancing-dcat-support-in-ckan-dcat-ap-v3-scheming-integration-and-more/) | ✔️ | ❌  | ❌ | ✔️ [details](https://github.com/ckan/ckanext-harvest/)| ❌ | ✔️ [details](https://github.com/ckan/ckanext-qa/) | ❌ | ✔️ [details](https://github.com/ckan/ckanext-archiver/) | ❌ | ❌ |\n| [Collibra](#collibra)  | ❌ | ✔️ | ?  | ✔️ | ❌ | ❌ | ? | ❌ | ❌ | ❌ | ❌ |\n| [DataGalaxy](#datagalaxy)  | ❌ | ✔️ | ✔️ | ✔️ | ❌ | ❌ | ❌ | ✔️ | ✔️ | ? | ? |\n| [Databand](#databand)  | ❌ | ? | ? | ? | ❌ | ? | ? | ? | ✔️ | ❌ | ❌ |\n| [Datafold](#datafold)  | ❌ | ✔️ | ✔️ | ✔️ | ❌ | ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ |\n| [DataHub](#datahub)    | ✔️ [details](https://datahubproject.io/docs/metadata-modeling/metadata-model/) | ✔️  | ✔️ | ✔️ | ✔ | ✔ | ✔ | ✔ | ✔ | ✔ | ✔ |\n| [Google DC](#google)   | ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ | ? | ❌ | ❌ | ❌ | ❌ |\n| [Informatica](#informatica)   | ❌ | ✔️ | ✔️  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ? | ❌ |\n| [Magda](#magda)        | ❌ | ✔️ | ❌  | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |\n| [Marquez](#marquez)    | [OpenLineage](https://github.com/OpenLineage/OpenLineage) | ✔️ | ❌| ✔️ | ? | ❌ | ❌ | ❌ | ❌ | ✔️ | ❌ |\n| [Monte Carlo](#montecarlo)   | ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ |\n| [Select Star](#selectstar)      | ❌ | ✔️ | ✔️ | ✔️ | ✔️ | ❌ | ❌ | ✔️ | ❌ | ✔️ | ✔️ |\n| [OpenDataDiscovery](#opendatadiscovery)   | [ODD Specification](https://github.com/opendatadiscovery/opendatadiscovery-specification) | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ❌ | ✔️ |\n| [OpenMetadata](#openmetadata)   | [JSON Schema](https://github.com/json-schema-org/json-schema-spec) | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ |\n| [Stemma](#stemma)      | ❌ | ✔️ | ✔️  | ✔️ | ❌ | ❌ | ? | ✔️ | ❌ | ❌ | ❌ |\n| [Talend](#talend)      | ❌ | ✔️ | ? | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ |\n| [Meta\\#Grid](#metagrid)      | ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ | not yet | ❌ | ❌ | ❌ | ✔️ |\n| [Grai](#grai) | [Grai Schemas](https://github.com/grai-io/grai-core/tree/master/grai-schemas) | ✔️ | ❌ | ✔️ | ❌ | ✔️ | ✔️ | ❌ | ❌ | ✔️ | ✔️ |\n| [Hamilton](#hamilton) | [Hamilton](https://github.com/dagworks-inc/hamilton) | ✔️ | ✔️ | ? | ✔️ | ❌ | ✔️ | ½ | ✔️ | ✔️ | ❌ |\n\n\nDefinitions:\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eSpecification-based\u003c/b\u003e - uses an open standard for collecting metadata to allow efficient time-to-discovery and federating data catalogs\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSearch-based\u003c/b\u003e - allows to search for data assets\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eNetwork-based\u003c/b\u003e - provides rich context about data asset ownership\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eLineage-based\u003c/b\u003e - provides lineage for all entities the solution operates\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eFederation\u003c/b\u003e - the ability to map multiple data catalogs into a single UI to avoid repeated data collection.\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eML 1st citizen\u003c/b\u003e - operates ML entities on a high level - you can use them as any other data assets.\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eData Quality\u003c/b\u003e - includes mature data quality assurance tools.\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eEnd-to-end lineage\u003c/b\u003e - data lineage that includes all data assets used in the organization across all its data catalogs and ML tools.\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eColumn-level lineage\u003c/b\u003e - data lineage with column level granularity\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData collaboration\u003c/b\u003e - provides possibility to bring together data from various internal and external sources to unlock combined data insights\u003c/li\u003e\n\u003c/ul\u003e\n\u003cbr\u003e\n\n\u003ca name=\"opensource\"\u003e\u003c/a\u003e\n## 📙 Open-Source Data Catalogs\n\n\u003ca name=\"amundsen\"\u003e\u003c/a\u003e\n### Amundsen \n[Website](https://www.amundsen.io/) | [GitHub](https://github.com/amundsen-io/amundsen)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/amundsen-io/amundsen/graphs/commit-activity)\n![](https://img.shields.io/github/stars/amundsen-io/amundsen.svg?style=social)\n\nA popular open-source data catalog for metadata management and data discovery originated from Lyft. Created by Amundsen maintainers, [Stemma](stemma.ai) provides a managed version of an enterprise data catalog, inspired by Amundsen.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n| ❌ | ✔️  | ✔️  | ✔️ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e  No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003eNo \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e  \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Hive, Redshift, Druid, RDBMS, Presto, Snowflake \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"datahub\"\u003e\u003c/a\u003e\n### DataHub\n\n[Website](https://datahubproject.io/) | [GitHub](https://github.com/datahub-project/datahub)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/linkedin/datahub/graphs/commit-activity)\n![](https://img.shields.io/github/stars/linkedin/datahub.svg?style=social)\n\nDataHub is an open-source data catalog enabling data discovery, data observability and federated governance that originated from LinkedIn and is commercially offered by Acryl Data as a cloud-hosted SaaS offering.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:| \n| ✔️ [details](https://datahubproject.io/docs/metadata-modeling/metadata-model/) | ✔️  | ✔️ | ✔️ | ✔ | ✔ | ✔ | ✔ | ❌ | ✔ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push, Pull\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eCustomizable metadata model:\u003c/b\u003e Yes. The metadata model can be declared using the open-source Pegasus language, and is interoperable with JSONSchema and Avro \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eLineage impact analysis:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eAutomation:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e docker-compose / Kubernetes with Helm, or using Acryl Data's SaaS offering \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e\n  \u003cul\u003e\n    \u003cli\u003eSnowflake\u003c/li\u003e\n    \u003cli\u003eBigQuery\u003c/li\u003e\n    \u003cli\u003eRedshift\u003c/li\u003e\n    \u003cli\u003eHive\u003c/li\u003e\n    \u003cli\u003eAthena\u003c/li\u003e\n    \u003cli\u003ePostgres\u003c/li\u003e\n    \u003cli\u003eMySQL\u003c/li\u003e\n    \u003cli\u003eSQL server\u003c/li\u003e\n    \u003cli\u003eTrino\u003c/li\u003e\n    \u003cli\u003eDelta Lake\u003c/li\u003e\n    \u003cli\u003eS3\u003c/li\u003e\n    \u003cli\u003eLooker\u003c/li\u003e\n    \u003cli\u003ePowerBI\u003c/li\u003e\n    \u003cli\u003eTableau\u003c/li\u003e\n    \u003cli\u003eMode\u003c/li\u003e\n    \u003cli\u003eMetabase\u003c/li\u003e\n    \u003cli\u003eRedash\u003c/li\u003e\n    \u003cli\u003eSuperset\u003c/li\u003e\n    \u003cli\u003eAirflow\u003c/li\u003e\n    \u003cli\u003eGreat Expectation\u003c/li\u003e\n    \u003cli\u003edbt\u003c/li\u003e\n    \u003cli\u003eFeast\u003c/li\u003e\n    \u003cli\u003eSageMaker\u003c/li\u003e\n    \u003cli\u003eGlue\u003c/li\u003e\n    \u003cli\u003eKafka\u003c/li\u003e\n    \u003cli\u003eNifi\u003c/li\u003e\n    \u003cli\u003eOkta\u003c/li\u003e\n    \u003cli\u003eLDAP\u003c/li\u003e\n    \u003cli\u003eSlack\u003c/li\u003e\n    \u003cli\u003eThere's 50+ integrations - see the \u003ca href=\"https://datahubproject.io/docs/\"\u003edocs\u003c/a\u003e for the latest.\u003c/li\u003e\n  \u003c/ul\u003e\n\u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"marquez\"\u003e\u003c/a\u003e\n### Marquez\n\n[Website](https://marquezproject.github.io/marquez/) | [GitHub](https://github.com/MarquezProject/marquez)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/MarquezProject/marquez/graphs/commit-activity)\n![](https://img.shields.io/github/stars/MarquezProject/marquez.svg?style=social)\n\nMarquez is an open-source data catalog for collection, aggregation, and visualization of a data ecosystem’s metadata originated from WeWork. \n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:-----------:|:--:|:--:|:--:|:---:|:--:|:---:|:--:|:---:|:--:|:---:| \n| [OpenLineage](https://github.com/OpenLineage/OpenLineage) | ✔️ | ❌| ✔️ | ? | ❌ | ❌ | ❌ | ❌ | ✔️ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e ? \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e  \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e S3, Kafka \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"atlas\"\u003e\u003c/a\u003e\n### Atlas \n\n[Website](https://atlas.apache.org/#/) | [GitHub](https://github.com/apache/atlas)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/apache/atlas/graphs/commit-activity)\n![](https://img.shields.io/github/stars/apache/atlas.svg?style=social)\n\nApache Atlas is an open-source data catalog for metadata collection, governance, and data democratization.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n| ❌ | ✔️  | ❌  | ✔️ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e No\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e ? \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e  \u003c/li\u003e  \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003eHBase, Hive, Sqoop, Kafka, Storm  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"ckan\"\u003e\u003c/a\u003e\n### CKAN\n\n[Website](https://ckan.org/) | [GitHub](https://github.com/ckan/ckan)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/ckan/ckan/graphs/commit-activity)\n![](https://img.shields.io/github/stars/ckan/ckan.svg?style=social)\n\nCKAN is an open-source data catalog for data management, widely adopted by governments, NGOs, research institutions, and enterprises. It is actively maintained by a global community, with four of the eight core maintainers currently funded by [Link Digital](https://linkdigital.com.au/).\n\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n| ✔️ Yes (DCAT, DCAT-AP, schema.org via plugins) | ✔️ | ❌  | ❌ | ✔️| ❌ | ✔️ (ckanext-qa) | ❌ | ✔️(ckanext-archiver)| ❌ | ⭕️ (possible via external integrations or Drupal front-end)|\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push, CKAN is used to publish or upload datasets into a central catalog \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e Achievable through integration with CMS platforms like Drupal or any custom front ends. \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e Yes. Can be experimented using ckanext-embeddings. \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes, via ckanext-validation extension.\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e Yes. Custom development or integration would be required. \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eMetadata Schemas and Custom Fields:\u003c/b\u003e Yes, using ckanext-scheming​.\nOne of the most widely used extensions for complex metadata schemas.\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e Yes (via ckanext-dcat extension) \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eVisual previews:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e Achievable using the stats-extension, which provides insights into user activity and dataset popularity.\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Achievable using ckanext-email-notification. \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e Yes (Self-hosted, cloud-hosted) \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Yes; various formats:\n  \u003cul\u003e\n    \u003cli\u003ePostgres\u003c/li\u003e\n    \u003cli\u003eMySQL\u003c/li\u003e\n    \u003cli\u003eSQL server\u003c/li\u003e\n    \u003cli\u003ePowerBI\u003c/li\u003e\n    \u003cli\u003eTableau\u003c/li\u003e\n    \u003cli\u003eCSV\u003c/li\u003e\n    \u003cli\u003eCroissant\u003c/li\u003e\n    \u003cli\u003eJSON\u003c/li\u003e\n    \u003cli\u003eGeoJSON\u003c/li\u003e\n    \u003cli\u003eXLS\u003c/li\u003e\n    \u003cli\u003eTableau\u003c/li\u003e\n    \u003cli\u003e...and more!\u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"magda\"\u003e\u003c/a\u003e\n### Magda\n\n[Website](https://magda.io/) | [GitHub](https://github.com/magda-io/magda)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/magda-io/magda/graphs/commit-activity)\n![](https://img.shields.io/github/stars/magda-io/magda.svg?style=social)\n\nMagda is an open-source data catalog that features data discovery, metadata enrichment, and federation, focused on geodata.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n| ❌ | ✔️ | ❌  | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push via UI \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e ? \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e  \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Mostly geodata \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"opendatadiscovery\"\u003e\u003c/a\u003e\n### OpenDataDiscovery \n\n[Website](https://opendatadiscovery.org/) | [GitHub](https://github.com/opendatadiscovery/odd-platform)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/opendatadiscovery/odd-platform/commits/main)\n![](https://img.shields.io/github/stars/opendatadiscovery/odd-platform.svg?style=social)\n\nFirst open-source data discovery and observability platform. ODD Platform is based on ODD Specification.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n| ✔️ | ✔️  | ✔️  | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ❌ | ✔️ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push/Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData collaboration:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eMetadata versioning:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSaaS:\u003c/b\u003e Yes \u003c/li\u003e  \n\u003cli\u003e\u003cb\u003eThird-party integrations:\u003c/b\u003e Dbt, Great Expectations, and Prefect \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  Airflow, Athena, AzureSQL, BigQuery, Clickhouse, Databricks, DeltaLake, Druid, DynamoDB, Fivetran, Glue, Hive, Kafka, Looker, MariaDB, MlFlow, MSSQL, MySQL, Oracle, Postgres, Presto, Redash, Redpanda, Redshift, Snowflake, Tableau, and Vertica \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"openmetadata\"\u003e\u003c/a\u003e\n### OpenMetadata \n\n[Website](https://open-metadata.org/) | [GitHub](https://github.com/open-metadata/OpenMetadata)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/open-metadata/OpenMetadata/commits/main)\n![](https://img.shields.io/github/stars/open-metadata/OpenMetadata.svg?style=social)\n\nOpenMetadata is the all-in-one platform for data collaboration, discovery, governance, lineage, and quality that lets you focus on building and analyzing.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:|\n| ✔️ | ✔️  | ✔️  | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | ✔️ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push/Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData collaboration:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eMetadata versioning:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSaaS:\u003c/b\u003e Yes \u003c/li\u003e  \n\u003cli\u003e\u003cb\u003eThird-party integrations:\u003c/b\u003e Dbt, Great Expectations, and Prefect \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Airbyte, Airflow, Athena, AzureSQL, BigQuery, Clickhouse, Dagster, Databricks, DB2, DeltaLake, Druid, DynamoDB, Fivetran, Glue, Glue, Hive, Kafka, Looker, MariaDB, Metabase, MlFlow, Mode, MSSQL, MySQL, NiFi, Oracle, Postgres, PowerBI, Presto, Redash, Redpanda, Redshift, Salesforce, SingleStore, Snowflake, Superset, Tableau, Trino, and Vertica \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"metagrid\"\u003e\u003c/a\u003e\n### Meta\\#Grid \n[Website](https://meta-grid.com/) | [GitHub](https://github.com/patschwork/meta_grid) | [Docs](https://docs.meta-grid.com)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/patschwork/meta_grid/graphs/commit-activity)\n![](https://img.shields.io/github/stars/patschwork/meta_grid.svg?style=social)\n\nMeta\\#Grid is an open source data catalog for metadata management. It is designed to help small and large organizations create an inventory of their data silos and connect between different technologies. Through a multi-client system, with granular permissions system, Meta\\#Grid can be used in consulting companies (with diverse clients and projects) as well as in data mesh organizations. It grows with the requirements of the demand. \n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n| ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ | not yet | ❌ | ❌ | ❌ | ✔️ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push, Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e  No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e  \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Hive, Redshift, Druid, RDBMS, Presto, Snowflake \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\n\u003ca name=\"grai\"\u003e\u003c/a\u003e\n### Grai \n[Website](https://grai.io/) | [GitHub](https://github.com/grai-io/grai-core) | [Docs](https://docs.grai.io)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/grai-io/grai-core/graphs/commit-activity)\n![](https://img.shields.io/github/stars/grai-io/grai-core.svg?style=social)\n\n\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n| [Grai Schemas](https://github.com/grai-io/grai-core/tree/master/grai-schemas) | ✔️ | ❌ | ✔️ | ❌ | ✔️ | ✔️ | ❌ | ❌ | ✔️ | ✔️ |\n\n\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push, Pull\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eCustomizable metadata model:\u003c/b\u003e Yes. The metadata model can be flexibly extended or modified as needed. \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eCI Integration:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eLineage impact analysis:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eAutomation:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e Yes \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e docker-compose / Kubernetes with Helm, or using Grai SaaS offering \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e\n  \u003cul\u003e\n    \u003cli\u003eSnowflake\u003c/li\u003e\n    \u003cli\u003eBigQuery\u003c/li\u003e\n    \u003cli\u003eRedshift\u003c/li\u003e\n    \u003cli\u003ePostgres\u003c/li\u003e\n    \u003cli\u003eMySQL\u003c/li\u003e\n    \u003cli\u003edbt\u003c/li\u003e\n    \u003cli\u003eSlack\u003c/li\u003e\n    \u003cli\u003e... many others see the \u003ca href=\"https://docs.grai.io\"\u003edocs\u003c/a\u003e for a full list.\u003c/li\u003e\n  \u003c/ul\u003e\n\u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"Hamilton\"\u003e\u003c/a\u003e\n### Hamilton \n[GitHub](https://github.com/dagworks-inc/hamilton)\n[![Maintenance](https://img.shields.io/badge/Maintained%3F-yes-green.svg)](https://github.com/dagworks-inc/hamilton/commit-activity)\n![](https://img.shields.io/github/stars/dagworks-inc/hamilton.svg?style=social)\n\nA popular open-source framework for describing transformations that comes with a catalog (the Hamilton UI). The project originated from Stitch Fix. Created by Hamilton maintainers, [Dagworks Inc. (YCW23)](www.dagworks.io) provides a managed version of the Hamilton UI in addition to self-hosted on-premise features.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:----:|:---:|:---:|:--:|:---:|:--:|:---:|:--:|:---:|:--:| \n[Hamilton](https://github.com/dagworks-inc/hamilton) | ✔️ | ✔️ | ? | ✔️ | ❌ | ✔️ | ½ | ✔️ | ✔️ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Use python to describe DAG, add one-line of code to capture: lineage \u0026 provenance, metadata, data summary profiles, versions, and execution telemetry. [See blog for details](https://blog.dagworks.io/p/hamilton-ui-streamlining-metadata). \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Pluggable\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRecommendations:\u003c/b\u003e No \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSchemas, Description:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eComplex schemas:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Only summary statistics \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eColumn statistics:\u003c/b\u003e Yes, only for python. \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owner:\u003c/b\u003e Via tags.\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e Not yet \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange notifications:\u003c/b\u003e Not yet \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eChange feed:\u003c/b\u003e No yet\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDeployment:\u003c/b\u003e pip installable locally, self-hosted via docker, managed SaaS \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e No direct ingrations as of yet. \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\n\n\u003ca name=\"proprietary\"\u003e\u003c/a\u003e\n## 📕 Proprietary Data Catalogs\n\n\u003ca name=\"collibra\"\u003e\u003c/a\u003e\n### Collibra\n\n[Website](https://www.collibra.com) | [GitHub](https://github.com/collibra)\n\nCollibra is an enterprise data catalog that helps to discover and understand data that matters and drive impactful insights from it.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:--:|:---:|:--:|:---:|:-:|:--:|:--:|:--:|:--:|  \n| ❌ | ✔️ | ?  | ✔️ | ❌ | ❌ | ? | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"informatica\"\u003e\u003c/a\u003e\n### Informatica\n\n[Website](https://www.informatica.com/) | [GitHub](https://github.com/InformaticaCloudApplicationIntegration) \n\nInformatica is an enterprise data catalog that provides AI-powered data discovery engine to scan and catalog data assets. \n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:--:|:--:|:---:|:--:|:---:|:--:|  \n| ❌ | ✔️ | ✔️  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ? | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n \u003cbr\u003e\n\n\u003ca name=\"alation\"\u003e\u003c/a\u003e\n### Alation\n\n[Website](https://www.alation.com/) | [GitHub](https://github.com/Alation)\n\nAlation is a collaborative data catalog that helps companies to drive value and business impact from their data. \n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:--:|:--:|:---:|:---:|:---:|:---:|\n| ❌ | ✔️ | ❌  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"atlan\"\u003e\u003c/a\u003e\n### Atlan\n\n[Website](https://atlan.com/) | [GitHub](https://github.com/atlanhq)\n\nAtlan is a modern data catalog offering data discovery, data profiling, data quality, data lineage and data governance.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:---:|:---:|:---:|:---:| \n| ❌ | ✔️ | ❌  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ✔️ | ✔️ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Presto, Deequ, Atlas, Airflow, Hudi  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"datagalaxy\"\u003e\u003c/a\u003e\n### DataGalaxy\n\n[Website](https://www.datagalaxy.com/en-gb/home/) | [GitHub](https://github.com/datagalaxy-lab)\n\nDataGalaxy is a modern data catalog offering data discovery, data profiling, data quality, data lineage and data governance.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:---:|:---:|:---:|:---:| \n| ❌ | ✔️ | ✔️ | ✔️ | ❌ | ❌ | ❌ | ✔️ | ✔️ | ? | ? |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Pull \u0026 Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e Yes \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e [Available connectors](https://www.datagalaxy.com/fr/integrations-connecteurs/) \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"stemma\"\u003e\u003c/a\u003e\n### Stemma\n\n[Website](https://www.stemma.ai/)  \n\nStemma is a fully managed data catalog powered by the open-source data catalog Amundsen that helps data teams have total trust in their data. \n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:|\n| ❌ | ✔️ | ✔️  | ✔️ | ❌ | ❌ | ? | ✔️ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"talend\"\u003e\u003c/a\u003e\n### Talend\n\n[Website](https://www.talend.com/) | [GitHub](https://github.com/Talend)\n\nTalend is a data catalog that helps enterprises power critical business descisions with trusted data. \n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:| \n| ❌ | ✔️ | ? | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\n\u003ca name=\"selectstar\" id=\"selectstar\"\u003e\u003c/a\u003e\n### Select Star\n\n[Website](https://www.selectstar.com/)\n\nSelect Star is an intelligent data discovery platform that automatically analyzes and documents your data. Select Star provides an easy to use data portal that everyone can use to find and understand data.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:| \n| ❌ | ✔️ | ✔️ | ✔️ | ✔️ | ❌ | ❌ | ✔️ | ❌ | ✔️ | ✔️ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eER Diagram generation:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eRole \u0026 Policy based access control:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003ePopularity \u0026 usage:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eDescription \u0026 Tag propagation:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData preview:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eData owners:\u003c/b\u003e Yes\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eTop data users:\u003c/b\u003e Yes \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No\u003c/li\u003e\n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e\n  \u003cul\u003e\n    \u003cli\u003eSnowflake\u003c/li\u003e\n    \u003cli\u003eBigQuery\u003c/li\u003e\n    \u003cli\u003eRedshift\u003c/li\u003e\n    \u003cli\u003ePostgres\u003c/li\u003e\n    \u003cli\u003eLooker\u003c/li\u003e\n    \u003cli\u003ePowerBI\u003c/li\u003e\n    \u003cli\u003eTableau\u003c/li\u003e\n    \u003cli\u003eMode\u003c/li\u003e\n    \u003cli\u003eSigma\u003c/li\u003e\n    \u003cli\u003eSisense\u003c/li\u003e\n    \u003cli\u003eMetabase\u003c/li\u003e\n    \u003cli\u003eLooker Studio\u003c/li\u003e\n    \u003cli\u003eDBT Cloud \u0026 Core\u003c/li\u003e\n    \u003cli\u003eSlack\u003c/li\u003e\n  \u003c/ul\u003e\n\u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"monocloud\"\u003e\u003c/a\u003e\n## 📒 Monocloud Data Catalogs\n\n\u003ca name=\"google\"\u003e\u003c/a\u003e\n### Google Cloud Data Catalog\n\n[Website](https://cloud.google.com/data-catalog) | [GitHub](https://github.com/GoogleCloudPlatform)\n\nGoogle Cloud Data Catalog is a fully managed, scalable metadata management service in Google Cloud's Data Analytics family of products.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:| \n| ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ | ? | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"azure\"\u003e\u003c/a\u003e\n### Azure Data Catalog\n\n[Website](https://azure.microsoft.com/en-us/services/data-catalog/)  \n\nAzure Data Catalog is a fully managed, enterprise-wide metadata catalog that makes data asset discovery straightforward.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:|\n| ❌ | ✔️ | ? | ✔️ | ❌ | ❌ | ? | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"observability\"\u003e\u003c/a\u003e\n## 🔍 Data Observability Platforms\n\n\u003ca name=\"DataKitchen\"\u003e\u003c/a\u003e\n### DataKitchen Open Source Data Observability\n\n[Website](https://docs.datakitchen.io/articles/#!open-source-data-observability/data-observability-overview)  \n\nDataKitchen's Open Source Data Observability Products are full featured with Apache 2.0 license. Data breaks. Servers break. Your toolchain breaks. Ensure your team is the first to know and the first to solve with visibility across and down your data estate. Save time with simple, fast data quality test generation and execution. Trust your data, tools, and systems end to end.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:| \n|  ✔️ | ✔️ |  ✔️ | ✔️ |  ✔️ |  ✔️ | ✔️ |  ✔️ | ✔️ | ❌ | ✔️ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Full featured, with UI for singlue user.  Enterprise version for teams \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e No \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e DataOps TestGen data quality verification tool that does five main tasks: (1) data profiling, (2) new dataset screening and hygiene review, (3) AI/algorithmic generation of data quality validation tests, (4) ongoing production testing of new data refreshes and (5) continuous periodic monitoring of datasets for anomalies \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e Data Journey based\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e 51 characteristics, with UI \u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Snowflake, Redshift, Tableau, Synapse, Postgres, Tableau, PowerBI, Airflow, Fivetran, Databricks, dbt,  Databricks\nAzure Data Factory, SSIS, Synapse Pipelines, ADF-managed Airflow, Google Composer, AWS S3, Qlik Sense, Amazon Managed Workflows for Apache Airflow, Talend Cloud, Azure Functions (via Event Hub), Azure ADLS/Blob Storage (via Event Hub)\u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003ca name=\"montecarlo\"\u003e\u003c/a\u003e\n### Monte Carlo\n\n[Website](https://www.montecarlodata.com/)  \n\nMonte Carlo is a data observability tool that helps to increase trust in data by eliminating or preventing data downtime.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:| \n| ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ | ✔️ | ❌ | ✔️ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e Snowflake, Hive, Kafka, Looker, Redshift, Tableau, Big Query, Airflow, Fivetran, Presto, Mode, Periscope, Databricks, Glue, dbt, Chartio, Spark, AWS, S3, data.world, Google Cloud Platform \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\n\u003cbr\u003e\n\n\u003ca name=\"databand\"\u003e\u003c/a\u003e\n### Databand\n\n[Website](https://databand.ai/) | [GitHub](https://github.com/databand-ai/)\n\nDataband is an observability platform that helps data engineers identify and troubleshoot pipeline issues and data quality problems.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:|\n| ❌ | ? | ? | ? | ❌ | ? | ? | ? | ✔️ | ? | ? |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca name=\"datafold\"\u003e\u003c/a\u003e\n### Datafold\n\n[Website](https://www.datafold.com/) | [GitHub](https://github.com/datafold)\n\nDatafold is a data monitoring and observability platform that gives you confidence in your data quality through diffs, profiling, and anomaly detection.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:--:|:--:|:--:|:--:|\n| ❌ | ✔️ | ✔️ | ✔️ | ❌ | ❌ | ✔️ | ❌ | ✔️ | ? | ? |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Push \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e ?\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e \n\n\u003ca name=\"ataccama\"\u003e\u003c/a\u003e\n### Ataccama\n\n[Website](https://www.ataccama.com/) | [GitHub](https://github.com/ataccama)\n\nAtaccama is an enterprise data catalog and observability tool featuring data profiling and data quality management, designed for data professionals.\n\n|Based on Open Standard | Search-based | Network-based | Lineage-based | Federation | ML 1st Citizen | Data Quality | End-to-end Lineage | Observability | Column-level lineage | Data collaboration |\n|:--:|:---:|:---:|:---:|:--:|:---:|:--:|:---:|:---:|:---:|:---:|\n| ❌ | ✔️ | ❌  | ✔️ | ❌ | ❌ | ✔️ | ❌ | ❌ | ❌ | ❌ |\n\n\u003cdetails\u003e\n\u003csummary\u003eMore features\u003c/summary\u003e\n\u003cbr\u003e\n\u003cul\u003e\n\u003cli\u003e\u003cb\u003eStrategy:\u003c/b\u003e Pull \u003c/li\u003e\n\u003cli\u003e\u003cb\u003eUX personalization:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eAI autowiring:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eNetwork-based:\u003c/b\u003e No\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eRich data profiling:\u003c/b\u003e Yes\u003c/li\u003e \n\u003cli\u003e\u003cb\u003eSupported data sources:\u003c/b\u003e  \u003c/li\u003e\n\u003c/ul\u003e\n\u003c/details\u003e\n\n\u003cbr\u003e\n\n\u003ca href=\"#top\"\u003eBack to top\u003c/a\u003e\n","project_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fopendatadiscovery%2Fawesome-data-catalogs","html_url":"https://awesome.ecosyste.ms/projects/github.com%2Fopendatadiscovery%2Fawesome-data-catalogs","lists_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fopendatadiscovery%2Fawesome-data-catalogs/lists"}