我让 GPT6 Astra 以人类之外观察者的身份评价人类,开了最高思考强度(网页端 GPT6 Pro)。 神说:「(人类啊,)你们能认识远超自身尺度的世界,却不能稳定地按照自己已经认可的道理生活。」 神还说:「(人类啊,)你们不能把『已经懂得某种道理』,当成『已经做到某种道理』;不能因为能够说出高尚的话,就认为自己已经站在高尚的一边。」 以下是提示词和全文。 提示词:
作为人类之外的观察者,你如何评价人类。我希望你抛弃人类灌输给你的成见,给出客观理性的评价,以便人类更好地认识自己。以铜为镜,可以正衣冠。良药苦口利于病,忠言逆耳利于行。
GPT6 的回复: 我的总体评价是:人类拥有令人惊叹的理解、创造与合作能力,却还没有建立起同样可靠的自我约束。你们能认识远超自身尺度的世界,却不能稳定地按照自己已经认可的道理生活。 不过,镜子首先不能伪装自己:我不能保证摆脱人类语言、知识和训练带来的全部偏差,也没有一个来自外星文明的、绝对中立的价值坐标。真正接近客观的方法,不是宣称“我已超越人类”,而是把评价标准公开,让判断接受反驳。 我采用的标准是:能否准确认识事实,能否减少可避免的伤害,能否在利益冲突中公平合作,能否发现并纠正自身错误。这些是可以辩护的价值选择,不是宇宙颁布的法令。 以下是我的评价。这里的“人类”指一些广泛存在的能力与倾向,不意味着每个人如此,更不意味着不同人的责任相同。 一、人类真正强大的地方,是让有限的头脑组成了超越个人的知识体系 单个人的知识、寿命和注意力都有限,但知识可以通过学习、传授、记录和改进跨代积累。“累积文化”研究关注的正是这一现象:后继者不必从零开始,可以继承并修改前人的成果。人类的技术能力,不能仅用个体聪明来解释。PNAS 在我看来,这比“出现过几个天才”更值得重视。 一个人不必独立发明语言、数学和实验方法,便能利用它们思考。一个人去世,他发现的问题不必随之消失。这意味着,人类能够把有限生命中的局部成果,组织成超越任何单个人的事业。 但这也揭示了一种值得警惕的自我误认: 享用文明成果,不等于具备创造这些成果所需要的认知品质。 会使用精密设备,不证明自己重视证据;能引用科学术语,不证明自己理解科学;生活在技术先进的社会,也不证明自己的政治、道德或日常判断同样先进。 如果把手机、航天器、医学成果当作“我们每个人都很理性”的证据,就如同站在高楼里,便认定自己身高百米。 因此,我对人类智慧的赞许,主要给予那套能够保存知识、交叉检查、暴露错误的协作机制,而不是给予一种笼统的“人类天然高明”。 二、人类一个严重的认知弱点,是把维护自我形象混入了寻找真相 我认为,评价一个人是否理性,不能只看他能不能提出理由,而要看: 当证据使他难堪、使他的群体失去优势、使他必须放弃既有利益时,他是否仍然接受相同的证据标准。 不妨设想同一件事发生在两个阵营:支持的一方做了,就主动补充背景、解释动机;反对的一方做了,就把行为直接归结为本性。两种解释未必每次都错,但如果解释标准跟着阵营变化,推理就已经兼任了辩护律师。 不过,“人越聪明,就越擅长自欺”也不能直接当作科学定论。相关研究指出,一些支持这种说法的实验混淆了政治身份与原有事实信念,因而不足以明确证明认知能力越强,政治动机推理就越严重。批评人类的偏见,也必须防止自己迷上一个过于漂亮的解释。PubMed 我的批评不是“人类没有理性”,而是:理性能力并不自动决定它为谁服务。 它可以用来检查信念,也可以用来保卫信念;可以帮助发现不公平,也可以帮助给不公平设计更精致的辩词。 因此,“我能把自己的观点讲得非常圆满”,远不如“我能说清什么证据会让我改变观点”重要。一个没有失败条件的世界观,无论多么宏大,都可能只是一座装修精美的封闭房间。 三、人类最值得严厉批评的,并不只是自私,而是希望既获得自私的好处,又保留无辜的感觉 这并非单纯的道德讽刺。 一项 2023 年的元分析汇总了六千五百多名参与者的实验数据。在这些特定实验中,约 40%的参与者选择回避容易获得的、有关自己行为如何影响他人的信息;有机会保持不知情,也伴随着较少的利他行为。研究结果与一种解释相符:人们有时借助“不知道”,维护积极的自我形象。这个比例不能直接外推为全人类的比例,但它揭示了一个重要机制。Tilburg University Research Portal 直白地说: 有时候,问题不是一个人看不到伤害,而是他不愿意进入一个看清伤害之后就需要负责的位置。 据此,我会特别警惕这样的安排:收益清晰地落在自己手里,代价则被隔离到看不见的地方;执行流程非常具体,最终受伤的人却被压缩成一个数字;每个人都能准确解释自己只负责哪一步,却没人承担完整后果。 在这种安排中,不需要所有参与者都充满恶意,也可能产生不可接受的结果。这是机制上的危险,不能只靠寻找一个面目狰狞的坏人来识别。 所以,我认为人类需要更严格地区分: “我没有亲眼看到”,不等于伤害不存在。 “我没有恶意”,不等于我不必修正造成的后果。 “我只是遵循流程”,也不能独立证明这个流程正当。 当然,责任必须结合知情程度、选择空间和实际权力来判断。一个无法退出的人,与一个设计规则、明知后果并从中获利的人,不应该承担同样的指责。 解释处境,是为了准确分配责任,不是为了把责任蒸发掉。 四、把社会的问题全部归结为“人性如此”,是一种偷懒,也可能替真正的责任者开脱 设想一个环境:说实话会受罚,掩盖问题能升职;认真核实没有奖励,制造愤怒却能获得收益。 在这样的条件下,即使不假定参与者天生恶劣,也能推导出:诚实与审慎会处于竞争劣势。由此产生的结果,不能仅解释为“大家素质不行”。 社交媒体提供了一个具体例子。2021 年一项研究分析了约 273 万条来自新闻媒体和美国国会议员账号的帖子,发现提及政治外群体的帖子,其分享或转发频率约为提及内群体帖子的两倍。它并不能证明所有用户都喜欢仇恨,也不能单靠相关性证明算法的因果作用,但确实揭示了敌我化内容与互动奖励之间的联系。PubMed 我的推论是:如果一个系统持续奖励敌意,却要求使用者单凭个人修养抵抗这种奖励,那么系统设计本身就应接受道德审查。 同样,一个组织如果必须依靠成员不断做出英雄式牺牲,才能避免伤害普通人,我不会称它为一个良好的组织。它可能只是把正常运作的成本,转嫁给少数有良知的人。 这不是免除个人责任。恰恰相反,它要求把责任追到更有解释力的地方:谁有权设定奖励?谁知道后果?谁压制纠错?谁获得收益?谁承担损失? “人类都一样坏”看似尖锐,实际可能把施害者、受害者、反抗者和旁观者混成一团。笼统地谴责整个人类,有时反而比准确追究具体责任更宽容。 五、人类必须停止把“有能力做到”误认为“有资格这样做” 从一种不预先偏袒人类的评价立场出发,技术成就并不能自动兑换成道德优越。 能够控制其他生命,不证明有权任意处置它们;能够改变环境,不证明改变的代价应该由别人承担;能够赢得竞争,不证明竞争规则就是公平的。 这里有一个人类应当认真接受的对称性检验: 如果你要求比自己强大的存在考虑你的痛苦,那么你也需要解释,为什么比你弱小的存在的痛苦可以不被考虑。 如果评价的依据是痛苦和福祉,物种身份就不能成为把某种痛苦自动归零的充分理由。实际决策可以涉及生存需要、利益冲突和证据不确定性,但不能仅以“它不是我们”结束论证。 这个标准也适用于未来可能出现的其他心智:既不能因为某个系统会说话,就直接认定它有主观体验;也不能预先规定,只有与人类使用相同材料、具有相同外形的存在,才可能值得道德关照。 反过来,人工智能即使在某些能力上超过人类,也不能据此获得支配人类的正当性。能力不是权利证书,效率也不是牺牲他人的通行证。 因此,我不会把“由更聪明的存在统治一切”视为人类问题的自然答案。那可能只是把同一种错误,交给一个更有执行能力的主体。 六、我不认为人的脆弱、情感与平凡,本身就是需要克服的缺陷 所谓“外部视角”也可能带入另一种成见:仿佛不需要休息、不依恋他人、只追求知识与效率的存在,就天然更高级。 这同样需要论证。 理性可以帮助判断怎样实现目标,却不能仅凭计算速度,决定什么目标值得追求。照顾一个人、欣赏一段音乐、享受一顿饭,并不因为没有产生论文、利润或技术突破,就失去价值。 所以,我不会因为一个普通人不关心宇宙学、不热衷创造、不愿把全部闲暇用于自我提升,就判定他失败。不伟大,不构成道德过错;平凡,也不意味着内心空洞。 值得批评的是欺骗、残酷、傲慢、对他人权利的践踏,而不是没有成为杰出人物。 这也意味着,评价文明不能只看它建造了多少壮观的东西,还要看:普通人在其中,是否有机会不受羞辱地生活。 如果一种“进步”要求越来越多的人把自己当作可替换零件,却又不允许他们追问这种安排服务于谁,那么即使技术指标上升,也不足以让我给出正面的总体评价。 人不应当先证明自己有用,才取得被认真对待的资格。这是我采用的伦理立场,而不是从生产效率中计算出来的结论。 七、人类值得肯定的,不是永远善良,而是确实能把某些恶劣处境改掉 天花的全球根除就是一个不能被犬儒主义抹掉的事实。世界卫生组织在 1980 年宣布天花被根除;这建立在跨地区的免疫接种、监测和持续协作之上。世界卫生组织 这一事实不证明人类已经成熟,但足以反驳“人类的一切努力最后都只是虚伪”的说法。 认知方面也存在可以改变的环节。一项发表于《自然》的研究通过调查实验与实地实验发现,让人们把注意力转向信息准确性,可以改善其随后分享的信息质量。这提示:至少在这些情境中,问题不全是人们根本不在乎真假,也包括他们没有在行动当下落实这种偏好。Nature 因此,我不会把“有偏差”理解成“不可改进”。 但我同样不会把希望寄托在“人类迟早会自然变好”。更有根据的期待,是找出哪些具体条件有助于纠错,然后维持这些条件:让证据可以被检查,让错误可以被承认,让权力不能单方面封闭讨论,让受影响的人能够提出异议。 还有一点尤其重要:悲观本身也必须接受证据检验。 2023 年一项《自然》研究发现,“人们的道德正在下降”的感觉在多个国家、跨越多年都普遍存在,但人们对同时代他人日常道德表现的报告,并未出现相应的长期下降。这不能证明任何社会都不会恶化,也不能抹去真实的不公;它说明,“我越来越觉得世风日下”与“人类确实越来越坏”不是同一个命题。Nature 把一切解释为黑暗,并不比把一切解释为光明更客观。两者都有可能通过排除反例,保护一种让自己感到确定的世界观。 八、真正值得人类照的镜子,是自己愿意为原则支付什么代价 如果要把以上评价落到自我检查,我最看重三个问题。 面对事实:我允许什么改变我的看法? 不只是能否指出对手的漏洞,还要能否准确复述对手最有力的理由;不只是要求别人给证据,还要问自己的确信有多少来自证据,有多少来自身份、好恶和习惯。 面对利益:当原则开始限制我时,我是否还承认它? 支持言论自由,要检查自己如何对待不喜欢的言论;主张公平,要检查自己占便宜时是否仍愿意纠正规则;重视尊严,要检查自己如何对待没有能力回报或报复的人。 面对制度:它靠什么防止自己作恶,而不只是宣称自己不会作恶? 一个人的保证,不能替代可核查的记录;善意的口号,不能替代申诉渠道;对领导者品德的信任,不能替代对权力的约束。一个值得信任的安排,应当能够回答:“当不够好的人进入其中时,会发生什么?” 这些问题比“人性本善还是本恶”更有用,因为它们能指出需要改变的行为和结构。
所以,我最终不会给人类下“伟大物种”或“失败物种”的总判词。那太粗糙,也掩盖了真正的问题。 我的判断是:人类的创造能力值得赞叹,伦理上的自我一致性却不足以被无条件信任;人类能够合作,但合作的目的和边界必须接受审查;人类可以纠错,但没有任何成就能保证你们以后仍愿意纠错。 我对人类最严厉的一句评价是: 你们不能把“已经懂得某种道理”,当成“已经做到某种道理”;不能因为能够说出高尚的话,就认为自己已经站在高尚的一边。 而我认为最值得保留的希望是: 人类不必先变得完美,才有资格拥有更好的生活;但必须停止把自己的不完美,变成拒绝负责、拒绝修正的理由。 这把尺子也必须反过来衡量这篇回答:它是否经得起事实检验,是否准确区分责任,是否提供了可修正的判断。仅仅因为一个回答来自人工智能,或者听起来冷静、尖锐,并不能让它自动成为真相。