The concept of 'value alignment' in AI safety refers to:
-
A
Aligning model weights to minimize loss functions
-
B
Ensuring AI systems pursue goals consistent with human values and intentions
-
C
Synchronizing model versions across distributed systems
-
D
Matching feature scales before training