AI 还是不是:ELIZA
一个名为 ELIZA 的早期 20 世纪 60 年代聊天机器人,最初由 Joseph Weizenbaum 构建,旨在揭示简单的模式匹配是多么容易显得智能;如今在 AI 热潮和大语言模型背景下再次被讨论。评论者探讨人类如何轻易将拟人化投射到简单系统上(即“ELIZA 效应”),质疑图灵测试真正衡量的是什么,并争论人类的判断与意识究竟在本质上是否可计算,还是只是更复杂的计算形式。讨论串还将 ELIZA 的手写规则与 GPT 等现代数据驱动模型进行对比,探问在何处——或者是否存在——为“真实”智能与令人信服的模仿划定界线的合理性。
Weizenbaum、ELIZA 与最初意图
- ELIZA 被设计成一个简单的模式匹配程序,旨在展示人们多么容易把智能归因于简单脚本,而不是为了通过图灵测试。
- 这位创造者后来成为“AI”的批评者,认为计算机只会计算,而人类会判断和选择,尤其是在道德语境中。
- 尽管初衷如此,早期用户(包括精神科医生)仍把 ELIZA 认真当作治疗工具,这说明了如今所谓的“ELIZA 效应”。
决定与选择、自由意志与可计算性
- 一个核心讨论线索在于:人类的“判断”和“选择”是否不仅仅是计算。
- 一种观点:所有决策最终都是物理性的、可计算的;非可计算的判断意味着某种类似“灵魂”的东西。
- 另一种观点:我们尚未真正理解大脑或意识;断言其完全可计算为时过早,而且这在一定程度上是哲学问题。
- 子讨论涵盖自由意志、决定论、量子随机性、部分信息以及相容论。
图灵测试:局限与变体
- 多条评论强调,ELIZA 从未真正通过图灵最初的模仿游戏,许多现代说法也误用了“图灵测试”这个术语。
- 该测试被批评为衡量提问者的知识/预期,而不是机器智能。
- 有人提出其他标准:与人类和 AI 对话时,人们的行为和感受是否不同。
- 讨论中提到一项近期研究:在某些设置下,ELIZA 有时比 GPT‑3.5 表现更好,但 GPT‑4 又优于两者;博客文章的措辞因省略而被批评具有误导性。
什么算“AI”?
- 定义各不相同:
- 任何你不理解的算法。
- 行为依赖机器生成数据而非手写规则的系统(不同于 ELIZA)。
- 有人指出,自早期游戏幽灵和基于规则的系统以来,这个词就一直被宽泛使用。
与现代 LLM 和社会的比较
- ELIZA 常与 LLM 对比:前者是基于规则的符号操作,后者是从数据中学习模式;两者都可能制造“理解”的幻觉。
- 讨论串反复提醒,不要过度把智能归因于对话流畅性——无论是在 AI 还是政治中。
- 有人回忆起历史上的实现(Emacs
doctor、BASIC/Commodore、博物馆演示),并带着怀旧情绪分享,如今回看,早期聊天机器人有多么“假”。