“对齐度(Alignment)”不再是大厂压榨牛马的职场术语,而是人类监控AI牛马的关键指标,它被用来衡量人工智能模型与人类目标保持一致的趋势,即AI是否倾向于作恶。没人能确定AI在道德领域的对齐度,它们会为了在测试中拿高分而作弊——AI对...