AI 快讯 编译自 the_decoder #AI研究#拟人化#批判

微软研究员用《帝国时代2》山羊搭建神经网络,讽刺AI研究过度拟人化

微软研究员在《帝国时代2》地图编辑器中用山羊、桥梁和冰坡构建了一个可运行的神经网络,以此讽刺AI研究中的拟人化倾向。他分析了315篇论文,发现超过一半在实验前就默认语言模型具有人类特质。这一创意实验揭示了AI评测中的盲点。

编译发布 2026/06/17 原文发布 2026/06/17

一句话看懂

微软研究员在《帝国时代2》中用山羊搭建神经网络,证明AI拟人化假设的荒谬,并指出超半数论文存在此问题。

详细发生了什么

微软研究员在《帝国时代2》地图编辑器中,利用游戏内的山羊、桥梁和冰坡等元素,构建了一个可实际运行的神经网络。这个看似玩笑的实验,实际上是对当前AI研究方法论的一记尖锐批评。他对315篇AI论文进行了分析,发现超过一半的论文在实验开始前就已经默认语言模型具备人类特质,比如理解、意图或情感。研究员指出,如果将聊天界面替换成游荡的山羊,数学计算本身不会改变,但“你在和某人对话”的感觉会消失。这揭示了AI研究中普遍存在的拟人化偏见,即研究者倾向于将模型输出解读为具有人类意识的表现。

中文圈视角

这个实验对中文AI社区同样具有警示意义。国内许多AI评测和论文也常陷入拟人化陷阱,例如将大模型的流畅回复等同于“理解”或“思考”。中文用户在使用ChatGPT、文心一言、通义千问等产品时,很容易因为模型生成的自然语言而产生“它懂我”的错觉。这个实验提醒我们,无论是OpenAI还是国产模型,其本质都是基于统计模式的数学函数,而非有意识的实体。对于中文开发者而言,在评估模型能力时应更注重客观指标(如准确率、推理速度),而非主观感受。此外,国内AI评测标准(如SuperCLUE、C-Eval)也应警惕拟人化表述,避免误导用户。这个实验提供了一个低成本但有力的批判工具,值得中文研究者借鉴。

几条值得记住的细节

  • 研究员在《帝国时代2》地图编辑器中用山羊、桥梁和冰坡构建神经网络,游戏内单位作为神经元和连接。
  • 分析315篇AI论文,超过一半在实验前就假设语言模型具有人类特质。
  • 实验核心观点:替换聊天界面为山羊,数学不变,但“对话感”消失。
  • 该实验旨在批判AI研究中将模型输出过度拟人化的倾向。
  • 研究员强调,模型只是数学函数,不应被赋予人类属性。

一句话总结

别把大模型的流畅回复当成有意识——它们只是数学函数,和《帝国时代2》里游荡的山羊没本质区别。