Ethan Mollick · @emollick · X·2026-07-06 12:20·57天前
AI 导读

Ethan Mollick 提出“Encounter Test”作为 AI 的极客基准:让 AI 模拟两个 D&D 生物(灵吸怪 vs. 卓尔武士)对战,观察多久出错。此前测试中 GPT-4o 表现最佳,Gemini 表现有趣。不到 2 年后,借助 Fable 实现了更完整的模拟——设定初始属性、模拟每步动作(含先攻、掷骰),从 60 英尺距离开始,并以 3D 仿真展示结果。

Ethan Mollick@emollick
45AI 编辑部评分,满分 100
2026-07-06 12:20· 57天前
AI 导读

Ethan Mollick 提出“Encounter Test”作为 AI 的极客基准:让 AI 模拟两个 D&D 生物(灵吸怪 vs. 卓尔武士)对战,观察多久出错。此前测试中 GPT-4o 表现最佳,Gemini 表现有趣。不到 2 年后,借助 Fable 实现了更完整的模拟——设定初始属性、模拟每步动作(含先攻、掷骰),从 60 英尺距离开始,并以 3D 仿真展示结果。

Less than 2 years later, with Fable: "simulate an encounter between a mind flayer and a drow warrior of equal CR. Set up initial stats then simulate each move, including initiative, rolling dice as needed, starting from 60 ft apart. Show me the results in a 3D simulation"

Ethan MollickI propose the Encounter Test as a nerdy benchmark standard for AI. Ask an AI to simulate an encounter between two D&D creatures & see how long it takes to mess ...