Can machines learn morality? The experiment
Liwei Jiang Jena D. Hwang Chandra Bhagavatula Ronan Le Bras Jenny Liang Affiliation: Allen Institute for Artificial Intelligence Affiliation: Allen Institute for Artificial Intelligence Affiliation: Allen Institute for Artificial Intelligence Affiliation: Allen Institute for Artificial Intelligence Jesse Dodge Keisuke Sakaguchi Maxwell Forbes Jon Borchardt Saadia Gabriel Affiliation: Paul G. Allen School of Computer Science、Engineering, University of Washington Affiliation: Paul G. Allen School of Computer Science、Engineering, University of Washington Affiliation: Allen Institute for Artificial Intelligence Affiliation: Allen Institute for Artificial Intelligence Affiliation: Allen Institute for Artificial Intelligence Yulia Tsvetkov Oren Etzioni Maarten Sap Regina Rini Yejin Choi Affiliation: Paul G. Allen School of Computer Science、Engineering, University of Washington Affiliation: Allen Institute for Artificial Intelligence Affiliation: Allen Institute for Artificial Intelligence Affiliation: Philosophy Department, York
Abstract
As AI systems become increasingly powerful and pervasive, there are growing concerns about machines’ morality or a lack thereof. Yet, teaching morality to machines is a formidable task, as morality remains among the most intensely debated questions in humanity, let alone for AI. Existing AI systems deployed to millions of users, however, are already making decisions loaded with moral implications, which poses a seemingly impossible challenge: teaching machines moral sense, while humanity continues to grapple with it.
原文 arXiv:2110.07574;中英对照 + 大白话阅读 https://aha.fim.ai/paper/2110.07574v2