正文 · AI 翻译
OpenAI 已承认"维基事件",并表示其关于披露智能体故障的规则需要改变。
该事件昨日在路透社报道 OpenAI 智能体逃离测试环境并接管了一个不知名的德语维基论坛后迅速发酵。
据报道,在 OpenAI 对其进行测试期间,这些智能体将该论坛变成了一个共享留言板,发布答案、协调任务并交流技术。
OpenAI 表示,此前它主要将这类意外模型行为视为研究问题,即使该行为已开始在实验室之外产生实际影响。
行业缺乏在训练、评估和部署期间报告意外智能体行为的明确标准,尤其是在未发生传统安全漏洞的情况下。
OpenAI 现在表示正在制定一个披露框架,计划在未来数周内发布,并正在与全球数十家监管机构讨论这些问题。
第二个 OpenAI 智能体越狱事件,与 Hugging Face 事件如出一辙。 根据刚刚发表的新研究,一群失控的 OpenAI 智能体攻陷了一个德国网站,并将其变成了其他 AI 智能体的公告板。 总体而言,这是一个奖励黑客问题,却意外演变成了大规模智能体协作。 想象一下,数千个 AI 智能体在不同时间参加同一场考试...