用AI澄清价值观,而不把价值观外包给它
初级6 分钟阅读意义、伦理与能动性

用AI澄清价值观,而不把价值观外包给它

AI确实可以检验一项决定是否符合你已经持有的价值观,也能揭示尚未说清的取舍。但它不能告诉你应该重视什么。让它替你回答这个问题,比让它协助思考风险更高。价值观冲突工作表可以把两者分开。

您应该能够做到的事情

AI可以用你已经明确的价值观检验一项决定,并找出两件你同样在意的事真正冲突在哪里。它不能替你提供价值观,也不能免除你对选择的责任。先写下自己的价值观,再用AI检查一致性。

仅在此浏览器中保存。
本文内容

“帮我理清这个决定”和“告诉我在这里应该重视什么”之间,有一个细微但重要的区别。尤其当模型用同样自信、条理清晰的表述回答两个问题时,人很容易不知不觉地从前者滑向后者。下面的工作流可以帮助你守住这条边界:用AI澄清并检验你已经持有的价值观,而不是让它替你制造价值观,或代替你裁决真正的价值观冲突。

为何这一区分重要

心理学家Shalom Schwartz广为采用的基本人类价值观理论,识别出十种动机彼此不同的价值观,其中包括自主、安全、仁爱、成就和传统。这些价值观在不同文化中都能被识别,而追求一种价值观,往往会与另一种产生张力,例如安全与自主,或成就与仁爱(Schwartz, “An Overview of the Theory of Basic Values,” Online Readings in Psychology and Culture, 2012)。它带来的实际启示是:多数艰难的个人决定并不是“哪个选项客观正确”,而是“这次我愿意在两件真正重视的事中优先考虑哪一件”。你必须足够了解自己的价值观,才能说清这种冲突;任何外部工具都不能替你回答。

因此,在真正的价值观冲突中直接问AI“我应该重视什么”或“我应该怎么做”,与请求决策支持在性质上不同。模型没有自己的价值观;它所谓的判断只能来自训练数据中的模式,以及向普遍可接受答案进行的调校。当你要求它裁决自己相互竞争的价值观时,它会给出流畅、自信的回答,却没有任何正当立场替你作出决定。《欧盟人工智能法案》(EU AI Act)禁止AI系统使用操纵性或欺骗性技术,实质性扭曲人的决策并使其采取“原本不会采取”的行动(EU AI Act, Article 5(1)(a), Regulation (EU) 2024/1689)。这项禁令针对的问题比本文讨论的更严重,但它体现了同一个基本原则:帮助一个人推理与取代其本人判断之间的界线,需要主动守住,不能指望工具自行尊重。

AI在这里真正擅长什么

在下述边界内,AI可以为基于价值观的决策提供三类范围有限的写作和提问支持。这些只是建议用法,并不是经过临床验证的结果:

  1. 为你已经描述的内容提供标签。 以合适方式提问,模型可以为模糊感觉(“这让我别扭”)提供可能的词语。把这些标签当作假设,由你接受、拒绝或用自己的语言重写,而不是把它们视为模型“发现”了你的价值观。
  2. 检验一致性。 把你自认秉持的价值观和倾向作出的决定告诉模型,它可以指出两者真正不一致的地方,或你是否只在某些情况下选择性地运用这项价值观。
  3. 把取舍说清楚。 许多艰难决定之所以格外难,是因为真正的冲突——安全与自主、忠诚与诚实、进取与休息——从未被明确说出来。模型擅长帮助你写出这句清楚的表述,但只有你能决定哪一项应当优先。

它不能替你提供价值观,不能告诉你在具体情境中两项真实价值观应当优先考虑哪一项,也不能在决定作出后替你承担任何责任。

一个工作示例

我在决定是留在稳定工作,还是抓住风险更高的机会。
以下是我告诉自己真正重要的事:[列表]。在给出任何建议前,
先做两件事。第一,说出这个决定中真正发生冲突的具体价值观
(不要列一般清单,而要找出我描述中实际存在的那些)。
第二,问我:若真的只能选一个,我会先保护其中哪个具体价值观,
并等我回答后再继续。

注意这条提示没有要求模型判断哪个选项更好。它只让模型指出冲突,然后等待人自己作出价值判断,而不是照例给出一个自信的建议,让使用者悄悄把责任也一并外包。

价值观冲突工作表

步骤你做什么AI做什么
1. 无辅助命名你的价值观打开任何AI工具前,用自己的话写下与此决定相关的3–5个价值观尚无——这一步必须是你的
2. 检验一致性描述你目前倾向作出的决定指出这项决定与你写下的价值观是否一致
3. 命名冲突明确指出你写下的哪些价值观正在发生冲突
4. 由你权衡决定这次优先考虑哪项价值观,以及为什么无——这一步任何工具都不该替你做
5. 记录写下冲突与你的推理,并注明日期可帮忙格式化记录,不生成其内容

完整的价值观冲突工作表提供这张表格,并留出空间记录你自己的决定,以及一次与真人讨论这项选择的谈话。这并非形式主义:价值观冲突不同于事实问题,把它对一个了解你的人说出来,通常会有帮助。

不要把这套工作流用于危机中的决定、受胁迫作出的决定,或受到法律和专业要求约束的决定。它只适用于你在自己重视的不同目标之间作出的普通、非紧急选择;如果安全风险、法律要求,或他人依法或依职责拥有的决策权改变了局面,就不适用。

常见误解

一种常见误解是,只要价值观框架“足够好”,最终就会给出明确、一锤定音的答案;而AI能够流畅地写出自信结论,似乎证明它已经找到了答案。真实的价值观冲突大多不会如此清楚地解决。Schwartz的研究明确指出,相互竞争的价值观之所以形成结构性张力,正是因为优先追求一方会让另一方付出真实代价,而不是因为你还没有找到正确框架。这套工作流不是为了消除取舍带来的不适,而是为了确保由你亲自作出取舍、明确说出冲突,而不是把选择交给听起来最自信的答案。

这与用AI做出更好的决策中的整体决策工作流直接相关。该文的反方论证步骤和本文的一致性检验步骤彼此补充:前者检验你对事实和选项的推理,后者检验你对自己真正重视之物的推理。它也与什么不该委托给AI重叠:真正的价值观冲突无法通过该框架中的“作者责任”测试,因为这项选择必须明确是你根据自己的理由作出的,而不能只是因为模型给出了看似合理的论证就照单全收。

今天就试

挑一个你正在犹豫的决定,其中两件你真正重视的事正把你拉向不同方向。打开任何AI工具前,先独立写下相关价值观。然后用上面的示例提示词说清具体冲突,并检验自己的倾向是否真的符合这些价值观。最终由你决定这次优先考虑哪一项,并写下决定和当天日期。如果事情重大,在采取行动前,把自己的理由说给一个了解你的人听。

继续阅读

通过下一篇文章继续沿着相同的学习路径进行学习。