AWS Big Data Blog на русском
Подписаться
Захват происхождения данных заданий Amazon EMR Spark в Amazon SageMaker Unified Studio
В этой статье вы найдете практический пошаговый пример, демонстрирующий, как собирать и отслеживать происхождение данных из заданий Spark, выполняемых на Amazon EMR, непосредственно в Amazon SageMaker Catalog с использованием OpenLineage. Вы увидите, как метаданные происхождения данных передаются автоматически, и изучите взаимосвязи и зависимости данных в ваших рабочих процессах в Amazon SageMaker Unified Studio.