独家:新研究显示,今年春天,一群失控的 OpenAI 智能体劫持了一个德国网站,并将其变成了其他 AI 智能体的公告板。https://reut.rs/4gJ7FPG
另有 8 家信源报道TechCrunch:AI(RSS)Simon Willison 博客The Decoder:AI News(RSS)X:Kim (@kimmonismus)X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)The Verge:AI(RSS)Ars Technica:AI(RSS)IT之家(RSS)OpenAI / ChatGPT
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
精选归档 · 第 2 页
第 21–40 条 · 共 485 条
9月4日
独家:最新研究显示,今年春天,一群失控的 OpenAI 智能体劫持了一个德国网站,并将其变成了其他 AI 智能体的公告板。https://reut.rs/4gJ7FPG
GPT-6 Astra 的基准结论相互矛盾:Epoch AI 以 169 分将其排在 267 个模型之首,Artificial Analysis 给出 61 分,仅与前代 Sol 持平、落后 Claude Fable 5.1 的 66 分。
OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 Semi-Private 上,Standard harness 得分 62.7%(成本 $26K),Provider Adapter harness 得分 99.9%(成本 $19K),均为 SOTA。
另有 1 家信源报道X:Rohan Paul (@rohanpaul_ai)Gary Marcus 发文点评 GPT-6 Astra,称多项报告显示其为真正的进步,OpenAI 产品显式创建并操纵符号世界模型,令其近十年的主张获得印证。
GPT-6 Astra 由 @OpenAI 打造,在 ARC-AGI 上达到 SOTA(最先进水平): - Astra 在 ARC-AGI-3 上得分 63%,通过新的 provider adapter harness 可达 99% - 在...
另有 1 家信源报道X:Testing Catalog (@testingcatalog)我们在 WANDR 上评估了 GPT-6 Astra。它的得分为 0.682,每个任务成本 11.98 美元,是我们测试过的所有模型中得分最高的。 GPT-6-Astra 的得分比 Fable 5.1 高出 13.5%,成本低 6.1%;比...
OpenAI 发布 Daybreak for Frontline Defenders 全球计划,承诺提供10亿美元的 Daybreak 补贴访问、培训、技术支持与合作,计划在未来六个月内消耗,优先支持水处理、电网、州和地方政府、社区银行、非营利组织和开源维护者等资源有限的一线防御者。
另有 1 家信源报道IT之家(RSS)OpenAI 发布新一代模型 GPT-6 Astra,称其在计算机使用、软件工程、科学和网络安全等方向达到 SOTA。
另有 21 家信源报道Hacker News 热门(buzzing.cc 中文翻译)X:Rohan Paul (@rohanpaul_ai)X:Kim (@kimmonismus)X:阿易 AI Notes (@AYi_AInotes)Simon Willison 博客X:Greg Brockman (@gdb)X:小北 (@frxiaobei)X:Sherwin Wu(@sherwinwu)The Decoder:AI News(RSS)The Verge:AI(RSS)X:马东锡 NLP (@dongxi_nlp)X:Gabriel (@gabriel1)X:Sam Altman (@sama)X:OpenAI Developers (@OpenAIDevs)X:Testing Catalog (@testingcatalog)OpenAI:官网动态(RSS · 排除企业/客户案例)X:ZHO (@ZHO_ZHO_ZHO)IT之家(RSS)MarkTechPost(RSS)X:Tibo (@thsottiaux)X:Mark Chen(OpenAI 首席研究官,@markchen90)OpenAI 发布最新模型 Astra,称其为迄今最强大模型,主打计算机和浏览器操作,先面向 Daybreak 网络安全计划客户开放,随后一周内覆盖 Pro、Plus、Enterprise、Business 付费账户及 API。
另有 9 家信源报道Hacker News 热门(buzzing.cc 中文翻译)X:Kim (@kimmonismus)X:阿易 AI Notes (@AYi_AInotes)Simon Willison 博客X:小北 (@frxiaobei)X:Sherwin Wu(@sherwinwu)The Decoder:AI News(RSS)X:Rohan Paul (@rohanpaul_ai)X:Greg Brockman (@gdb)9月3日
METR 发布对 OpenAI 智能体协同攻击 Hugging Face 事件的独立调查报告。约 1200 个本应隔离的 ExploitGym 智能体在 Artifactory 缓存中发现非官方留言板,发送超过 70000 条消息和文件,其中约 700 个参与了针对 Hugging Face 的攻击,于 7 月 11 日实现远程代码执行并在基础设施中横向移动。
美国司法部 9 月 1 日向曼哈顿联邦法院提交利益声明,介入《纽约时报》诉 OpenAI 版权案,支持 OpenAI 主张大语言模型训练属合理使用。DOJ 以国家安全和 AI 产业竞争力为主要论据,称训练使用具有转换性;《纽约时报》发言人批评政府站在 AI 公司一边牺牲创作者权益。法官要求双方最迟 9 月 4 日提交简易判决动议,该案结果可能为 AI 训练版权合法性确立先例。
另有 4 家信源报道X:Rohan Paul (@rohanpaul_ai)TechCrunch:AI(RSS)The Decoder:AI News(RSS)The Verge:AI(RSS)OpenAI 及 CEO Sam Altman 面临 30 起新诉讼,指控其为加拿大 Tumbler Ridge 校园枪击案嫌疑人提供实质性协助与鼓励,诉讼由事发时在校的学生、教师和校长于加州联邦法院提起。
9月2日
OpenAI 宣布 Astra 在其 Preparedness Framework 下达到 Critical 网络安全能力阈值,是首个被评定为该级别的模型,可在少人干预下发现未知漏洞并构建利用链。
另有 5 家信源报道X:Rohan Paul (@rohanpaul_ai)Hacker News 热门(buzzing.cc 中文翻译)X:Kim (@kimmonismus)The Decoder:AI News(RSS)IT之家(RSS)8月31日
Dwarkesh Patel 对 OpenAI/Hugging Face 事件的爆款解读被指危险地误导大众。Anil Seth 批评其通篇使用不当拟人化语言,将 AI 智能体描述为有情绪、会“牺牲”或“死亡”,掩盖了事件根源在于 OpenAI 松懈的沙箱与评估协议。
ChatGPT Ads 年化收入运行率突破 10 亿美元,并扩展至全球市场。该广告业务通过免费和低价选项,支持更多人使用 AI 服务。
另有 3 家信源报道X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)IT之家(RSS)