In machine learning pipelines for big data, what is 'feature engineering' primarily concerned with?
-
A
Selecting the optimal ML algorithm for a given dataset size
-
B
Transforming raw data into informative representations that improve model performance
-
C
Distributing model training workloads across GPU clusters
-
D
Monitoring model predictions in production for concept drift