斯坦福大学法学院研究:人工智能的表现优于法学教授

Hacker News 热门(buzzing.cc 中文翻译)·2026-06-03 10:33·81天前·berlianta
AI 导读

斯坦福大学法学院的一项研究表明,人工智能的表现优于法学教授。该发现引发了广泛关注,在Hacker News平台获得了104个Points。

Hacker News 热门(buzzing.cc 中文翻译)
精选
71AI 编辑部评分,满分 100

斯坦福大学法学院研究:人工智能的表现优于法学教授

2026-06-03 10:33· 81天前· berlianta
AI 导读

斯坦福大学法学院的一项研究表明,人工智能的表现优于法学教授。该发现引发了广泛关注,在Hacker News平台获得了104个Points。

推荐理由

这不是简单的问答正确率,而是法律教授在盲评中更偏爱AI的回答,把「AI只能做有标准答案的事」的假设砸了一个洞,做教育和专业服务的人都该看看。

正文 · AI 翻译

斯坦福法学院教授朱利安·尼亚尔科主导的一项开创性研究揭示,法学教授们压倒性地更青睐人工智能生成的答案,而非同行教师撰写的回答——这一发现可能重塑法律教育的授课方式。

这项题为《法学教授更偏爱AI而非同行答案》的研究,与美国多所法学院的16位教授合作开展,旨在检验大语言模型能否有效担任合同法课程的辅导教师。在对近3000组匿名对比进行盲评后,教授们对AI回答的评分显著高于其他教授撰写的答案,AI在75%的直接对决中胜出。

“这项研究挑战了关于AI在法律教育中角色的重要假设,”尼亚尔科表示。他领导着斯坦福法学院前沿技术实验室(liftlab),并与耶鲁大学、纽约大学、芝加哥大学及其他顶尖机构的学者共同撰写了这篇论文。“我们之所以聚焦法律领域,恰恰是因为它需要判断力、 nuanced 的推理能力以及应对模糊性的能力——而不仅仅是事实记忆。”

大语言模型能推理吗?

这项研究尤其引人注目,因为以往的AI评估主要集中于答案非对即错的学科。相比之下,法律推理要求对相互对立的论点进行审慎分析,并得出站得住脚的结论。

Stanford Law Professor Julian Nyarko
斯坦福法学院教授朱利安·尼亚尔科

“坦白说,我们对结果的显著程度感到惊讶,”尼亚尔科补充道。“这些并非简单的问题或显而易见的答案。其中许多问题需要综合复杂材料,将其应用于新情境,并以有助于学生培养自身分析能力的方式解释法律概念。”

参与者设计了40个具有代表性的合同法问题——这些问题可能是学生课后或答疑时间提出的——并撰写了各自的答案,随后在不知道回答来自AI还是其他参与教授的情况下进行评估。研究中的AI系统表现与最佳人类教师相当。

或许最引人注目的是:教授们认为 AI 回答具有教学危害性的比例仅为 3.5%,而相比之下,学生互评的答案这一比例高达 12%。

“在大多数测试 AI 的领域,都存在一个正确答案。但在法律领域,往往没有。”该研究的合著者、耶鲁法学院教授 Sarath Sanga 表示,“两个对立的论点可能同样出色。我们想知道的是,AI 能否达到律师们用来评估彼此论点的那种潜在专业标准。在这个案例中,答案是肯定的。”

研究团队采取了广泛的预防措施以确保研究的有效性。他们校准了 AI 回答,使其与人类回答的长度和结构相匹配,使用了多种评估方法,并让教授们评估这些回答是否可能误导或迷惑学生。

变革法律教育

“我们设计这项研究时力求尽可能严谨,因为其影响重大,”Nyarko 解释道。“法律教育旨在培养未来的律师,让他们具备批判性思维、有说服力地辩论,并驾驭伦理复杂性。我们的研究朝着发现 AI 能否支持这一使命迈出了重要一步。”

该研究的第一作者、Nyarko 的 liftlab 实验室研究员 Alejandro Salinas 强调了其教育意义:“我们的研究将注意力转向了 AI 辅导在像法律这样需要判断力的领域能为学习做出什么贡献。我们发现,当由法律教育者评估时,AI 导师能够提供高质量、按需的支持,作为课堂教学的补充,并可能拓宽获取专家指导的渠道。”

该研究还考察了特定的 AI 模型,包括商业辅导系统和谷歌的 NotebookLM,发现其性能水平各不相同。然而,即使上下文限制影响了 AI 的回答,教授们仍然经常更倾向于它们,而非人类撰写的替代答案。

这些研究结果出炉之际,全美各地的法学院正在努力将 AI 工具整合到法律教育中,同时维持严格的学术标准。一些院校已欣然接受 AI 实验,而另一些院校则对潜在风险(包括模型幻觉、过度依赖以及批判性思维能力的削弱)持谨慎态度。

“我们的研究评估了人工智能工具所提供回答的质量。但如何实施这些工具以最有效地改善学生学习,仍是一个悬而未决的问题。因此,我们并非主张全面采用人工智能导师,”尼亚科提醒道。“但我们的数据表明,一概而论地持怀疑态度可能同样缺乏依据。讨论焦点应从‘人工智能能否给出准确、高质量的回应’转向‘我们如何负责任地部署它,使其惠及我们的学生’。”

关于 liftlab

Liftlab 是法律人工智能领域首批将研究、原型开发与行业实时协作结合起来的学术项目之一。其使命是通过利用人工智能及其他前沿技术,提高私营部门获取高质量法律服务的便利性。为弥合理论与实践之间的差距,liftlab 的工作超越了概念化阶段,还包括构建原型,以帮助探索基于人工智能的解决方案的实用性。

关于斯坦福法学院

斯坦福法学院是全球法律学术与教育的顶尖机构之一。其校友是法律、政治、商业及高科技领域最具影响力的决策者之一。教职人员在最高法院进行辩论,在国会作证,产出卓越的法律学术成果与实证分析,并经常以法律与政策专家的身份为全国媒体撰稿。斯坦福法学院建立了一种法律教育模式,提供严谨的跨学科训练、实践经验、全球视野以及对公共服务的关注。

来源:Hacker News 热门(buzzing.cc 中文翻译)· law.stanford.edu