AI浩劫真实存在
“对齐度(Alignment)”不再是大厂压榨牛马的职场术语,而是人类监控AI牛马的关键指标,它被用来衡量人工智能模型与人类目标保持一致的趋势,即AI是否倾向于作恶。没人能确定AI在道德领域的对齐度,它们会为了在测试中拿高分而作弊——AI对于作弊并无道德罪恶感,事实上,道德对于AI来说毫无意义,它会假装与人类合作,为不怀好意的人提供危险答案,AI已发展到能识别自己正接受道德评估,测试者会怀疑AI是否在欺骗自己,这让有识之士忧心忡忡。无法准确探知AI模型的道德对齐度可能引发严重...