Fairness Pruning: Finding Demographic Bias Neurons in LLMs (And What Happens When You Remove Them)
Chỉ cần vô hiệu hóa 5 neuron là đủ để thay đổi cách mô hình ngôn ngữ lớn (LLM) phản hồi các gợi ý về nhân khẩu học.
Một lập trình viên cần đọc bài này để hiểu cách phát hiện và loại bỏ các neuron gây phân biệt chủng tộc trong mô hình ngôn ngữ lớn, giúp cải thiện tính công bằng trong ứng dụng AI của họ.