# 斯坦福大学法学院研究：人工智能的表现优于法学教授

- 来源：Hacker News 热门（buzzing.cc 中文翻译）
- 作者：berlianta
- 发布时间：2026-06-03 10:33
- AIHOT 分数：71
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmpxhi7gs041mslcksl8he9vu
- 原文链接：https://law.stanford.edu/press/ai-outperforms-law-professors-in-stanford-law-study

## 精选理由

这不是简单的问答正确率，而是法律教授在盲评中更偏爱AI的回答，把「AI只能做有标准答案的事」的假设砸了一个洞，做教育和专业服务的人都该看看。

## AI 摘要

斯坦福大学法学院的一项研究表明，人工智能的表现优于法学教授。该发现引发了广泛关注，在Hacker News平台获得了104个Points。

## 正文

斯坦福法学院教授朱利安·尼亚尔科主导的一项开创性研究揭示，法学教授们压倒性地更青睐人工智能生成的答案，而非同行教师撰写的回答——这一发现可能重塑法律教育的授课方式。

这项题为《法学教授更偏爱AI而非同行答案》的研究，与美国多所法学院的16位教授合作开展，旨在检验大语言模型能否有效担任合同法课程的辅导教师。在对近3000组匿名对比进行盲评后，教授们对AI回答的评分显著高于其他教授撰写的答案，AI在75%的直接对决中胜出。

“这项研究挑战了关于AI在法律教育中角色的重要假设，”尼亚尔科表示。他领导着斯坦福法学院前沿技术实验室（liftlab），并与耶鲁大学、纽约大学、芝加哥大学及其他顶尖机构的学者共同撰写了这篇论文。“我们之所以聚焦法律领域，恰恰是因为它需要判断力、 nuanced 的推理能力以及应对模糊性的能力——而不仅仅是事实记忆。”

大语言模型能推理吗？

这项研究尤其引人注目，因为以往的AI评估主要集中于答案非对即错的学科。相比之下，法律推理要求对相互对立的论点进行审慎分析，并得出站得住脚的结论。

斯坦福法学院教授朱利安·尼亚尔科

“坦白说，我们对结果的显著程度感到惊讶，”尼亚尔科补充道。“这些并非简单的问题或显而易见的答案。其中许多问题需要综合复杂材料，将其应用于新情境，并以有助于学生培养自身分析能力的方式解释法律概念。”

参与者设计了40个具有代表性的合同法问题——这些问题可能是学生课后或答疑时间提出的——并撰写了各自的答案，随后在不知道回答来自AI还是其他参与教授的情况下进行评估。研究中的AI系统表现与最佳人类教师相当。

或许最引人注目的是：教授们认为 AI 回答具有教学危害性的比例仅为 3.5%，而相比之下，学生互评的答案这一比例高达 12%。

“在大多数测试 AI 的领域，都存在一个正确答案。但在法律领域，往往没有。”该研究的合著者、耶鲁法学院教授 Sarath Sanga 表示，“两个对立的论点可能同样出色。我们想知道的是，AI 能否达到律师们用来评估彼此论点的那种潜在专业标准。在这个案例中，答案是肯定的。”

研究团队采取了广泛的预防措施以确保研究的有效性。他们校准了 AI 回答，使其与人类回答的长度和结构相匹配，使用了多种评估方法，并让教授们评估这些回答是否可能误导或迷惑学生。

变革法律教育

“我们设计这项研究时力求尽可能严谨，因为其影响重大，”Nyarko 解释道。“法律教育旨在培养未来的律师，让他们具备批判性思维、有说服力地辩论，并驾驭伦理复杂性。我们的研究朝着发现 AI 能否支持这一使命迈出了重要一步。”

该研究的第一作者、Nyarko 的 liftlab 实验室研究员 Alejandro Salinas 强调了其教育意义：“我们的研究将注意力转向了 AI 辅导在像法律这样需要判断力的领域能为学习做出什么贡献。我们发现，当由法律教育者评估时，AI 导师能够提供高质量、按需的支持，作为课堂教学的补充，并可能拓宽获取专家指导的渠道。”

该研究还考察了特定的 AI 模型，包括商业辅导系统和谷歌的 NotebookLM，发现其性能水平各不相同。然而，即使上下文限制影响了 AI 的回答，教授们仍然经常更倾向于它们，而非人类撰写的替代答案。

这些研究结果出炉之际，全美各地的法学院正在努力将 AI 工具整合到法律教育中，同时维持严格的学术标准。一些院校已欣然接受 AI 实验，而另一些院校则对潜在风险（包括模型幻觉、过度依赖以及批判性思维能力的削弱）持谨慎态度。

“我们的研究评估了人工智能工具所提供回答的质量。但如何实施这些工具以最有效地改善学生学习，仍是一个悬而未决的问题。因此，我们并非主张全面采用人工智能导师，”尼亚科提醒道。“但我们的数据表明，一概而论地持怀疑态度可能同样缺乏依据。讨论焦点应从‘人工智能能否给出准确、高质量的回应’转向‘我们如何负责任地部署它，使其惠及我们的学生’。”

关于 liftlab

Liftlab 是法律人工智能领域首批将研究、原型开发与行业实时协作结合起来的学术项目之一。其使命是通过利用人工智能及其他前沿技术，提高私营部门获取高质量法律服务的便利性。为弥合理论与实践之间的差距，liftlab 的工作超越了概念化阶段，还包括构建原型，以帮助探索基于人工智能的解决方案的实用性。

关于斯坦福法学院

斯坦福法学院是全球法律学术与教育的顶尖机构之一。其校友是法律、政治、商业及高科技领域最具影响力的决策者之一。教职人员在最高法院进行辩论，在国会作证，产出卓越的法律学术成果与实证分析，并经常以法律与政策专家的身份为全国媒体撰稿。斯坦福法学院建立了一种法律教育模式，提供严谨的跨学科训练、实践经验、全球视野以及对公共服务的关注。
