DZone.com Feed 中文 关注 使用 Azure Databricks、Apache Spark、Delta Lake 和 MLflow 实现可扩展的 MLOps 与特征工程 原始数据无法赢得模型竞赛,特征才能。当您的原始数据量达数十亿行,且分散在多个数据源中时,您无法仅通过在 Notebook 中运行 pandas 就了事。在本教程中,我将演示如何在 Azure Databricks 上构建生产级别的特征工程流水线,使用: Azure Databricks for Scalable MLOps and Feature Engineering With Apache Spark, Delta Lake, and MLflow dzone.com