Search NASASearch

DOE OSTI · code-188433

Data Agnostic Feature-Target Analysis & Ranking Machine Learning Pipeline (DAFTAR-ML) v0.1.0

Abstract

DAFTAR-ML is a specialized machine-learning pipeline that identifies relevant features based on their relationship to a target variable. Many ML pipelines focus solely on prediction, and feature ranking is often absent or lacks robust statistical methods. DAFTAR-ML performs its tasks with this outcome in mind. Model training is robust, using nested cross-validation and hyperparameter tuning. Instead of relying on native feature-importance scores, it employs SHAP (SHapley Additive exPlanations) to quantify feature importance. The pipeline also produces comprehensive results, including publication-quality visualizations.

Keep this discovery

Explore connections, maps & timelines

BibTeXRIS

Melie, Tina [Lawrence Berkeley National Laboratory (LBNL), Berkeley, CA (United States)]. 2025-10-30. Data Agnostic Feature-Target Analysis & Ranking Machine Learning Pipeline (DAFTAR-ML) v0.1.0. https://doi.org/10.11578/dc.20260819.1

Cite the original work for its findings. Save a collection to share your selection of sources.