内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态模型 · 155 条
来源全部一手资讯X
类型模型
全部模型产品行业论文教程观点
标签「安全/对齐」清除

8月22日周六

12:54AI Notkilleveryoneism Memes ⏸️39神秘模型Ox Alpha登顶编程榜,@weidai11警告AI接管或已开始

8月19日周三

01:24Chubby♨️44Qwen3.8-27B 去审查版可在苹果芯片本地运行

8月14日周五

23:22Z.ai66同事件GLM-5.3 开放前安全评估:网络防御能力显著提升同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
18:52The Decoder:AI News(RSS)60同事件智谱发布 GLM-5.3,称其为最强开源权重编程模型同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
16:22MarkTechPost(RSS)61同事件Z.ai 发布 GLM-5.3:不重训基座模型,复杂编程与长程任务能力显著提升同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
15:22Chubby♨️54同事件GLM-5.3 发布:网络安全能力大幅跃升同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
13:52🚨 AI News | TestingCatalog54同事件智谱发布GLM-5.3,CyberGym得分超GPT-5.6同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》

8月11日周二

14:14Hacker News 热门(buzzing.cc 中文翻译)49GPT 5.6 网络安全
08:14TechCrunch:AI(RSS)64同事件OpenAI 扩展 Daybreak 网络防御服务,推出新模型 GPT-5.6-Cyber同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
02:46Sam Altman50OpenAI 发布 GPT-5.6-Cyber 强化防御
02:37OpenAI:官网动态(RSS · 排除企业/客户案例)55精选OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型
02:26Tibo62同事件OpenAI 推出 GPT-5.6-Cyber 与 Daybreak 新层级同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
02:16The Decoder:AI News(RSS)63同事件OpenAI 推出 GPT-5.6-Cyber,帮助防御者在攻击者之前发现漏洞同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
01:56Tibo64同事件OpenAI 推出 GPT-5.6-Cyber 与 Daybreak 新层级同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
01:46Greg Brockman52同事件GPT-5.6-Cyber发布,Daybreak扩展助力防御者同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
01:44OpenAI35OpenAI 扩大 Daybreak 并推出 GPT-5.6-Cyber
01:16Chubby♨️44OpenAI 为网络防御者推出限制更少的新模型

8月8日周六

12:42MarkTechPost(RSS)69Mistral AI 发布 Shieldstral 1.0 3B:开源策略自适应多模态安全分类器,性能媲美 7 倍规模模型
07:12Sam Altman49OpenAI 称 Astra 模型将尽快安全开放
03:12Greg Brockman60同事件OpenAI 将 Astra 列为首个"关键"网络安全模型同一事件,精选展示《OpenAI 将 Astra 列为首个“关键”网络安全模型》

8月6日周四

11:55HuggingFace Daily Papers(社区热门论文)65K-EXAONE 2.0 技术报告:LG AI Research 开源 750B 参数多语言 MoE 模型
00:39The Decoder:AI News(RSS)60Mistral 开源 3B 安全模型 Shieldstral,以更小体积匹敌七倍规模模型

8月5日周三

19:05Chubby♨️43SSI 八月发布首款模型,剑指超级智能
18:00OpenAI:官网动态(RSS · 排除企业/客户案例)49OpenAI 推出 GPT-Daybreak 加速防御者安全能力
12:08IT之家(RSS)64Mistral 推出 Shieldstral 多模态内容审核模型,单张 16GB GPU 可运行
05:04Hacker News 热门(buzzing.cc 中文翻译)47Mistral 发布 Shieldstral:3B 开源权重多模态内容审核模型
02:12🚨 AI News | TestingCatalog54Mistral 发布 3B 开源安全模型 Shieldstral
01:04Mistral AI62Mistral 发布 Shieldstral 端侧安全模型

8月3日周一

15:31MarkTechPost(RSS)60Cogent AI 发布 VR-1:面向企业攻击链组合与验证的前沿网络推理模型

7月31日周五

02:28Ars Technica:AI(RSS)65Google 发布 Gemini Robotics 2.0,提升机器人灵巧性与安全性

7月28日周二

16:58MarkTechPost(RSS)71精选Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%
09:04IT之家(RSS)60同事件微软推出首个网络安全 AI 模型 MAI-Cyber-1-Flash同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》
04:56Rohan Paul47微软发布首个网络安全模型MAI-Cyber-1-Flash
02:55TechCrunch:AI(RSS)60同事件微软发布首个网络安全专用模型 MAI-Cyber-1-Flash 及 Perception 平台同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》
02:54The Decoder:AI News(RSS)48微软发布自有网络安全模型 MAI-Cyber-1-Flash,最棘手任务仍依赖 OpenAI
02:02🚨 AI News | TestingCatalog40微软发布MAI-Cyber-1-Flash模型与MDASH安全框架
01:40Mustafa Suleyman56同事件微软 MAI-Cyber-1-Flash 模型安全评测达 96%同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》
01:02Satya Nadella62同事件微软发布首款网络安全模型MAI-Cyber-1-Flash同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》

7月26日周日

08:27MarkTechPost(RSS)60Sakana AI 发布 Fugu-Cyber 安全编排端点,在 CyberGym 上达 86.9%

7月25日周六

18:53The Decoder:AI News(RSS)60Anthropic 称 Opus 5 几乎免疫浏览器提示词注入,攻击成功率降至零
已加载 40 条
全部 AI 动态
2026年8月25日星期二 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
模型 · 标签「安全/对齐」 · 155 条清除

8月22日

星期六 · 1 条
12:54
AI Notkilleveryoneism Memes ⏸️@AISafetyMemes
AI 评分 39/100
神秘模型Ox Alpha在OpenRouter上击败Fable和Sol登顶编程榜,却无人知晓其开发者。该模型拥有1M token上下文窗口,支持文本、图像和视频输入,免费一周,日处理能力达100万亿token,在DeepSWE子集上得分80%。

MTS: SITUATION EXPLAINED: A stealth model on OpenRouter is beating Fable and Sol on coding, and nobody knows who made it. • O...

安全/对齐推理编码

8月19日

星期三 · 1 条
01:24
Chubby♨️@kimmonismus
AI 评分 44/100
Qwen3.8-27B 去审查版可在苹果芯片本地运行

一个“去审查”版 Qwen3.8-27B 现可在 Apple Silicon 上本地运行,其创建者警告该模型可按需提供恶意软件、欺诈和武器指令。该模型以 MLX 构建发布,提供 2、4、6、8-bit 版本,上传者称 4/6/8-bit 测试零拒绝,并在 262K token 上下文中保留视觉、推理和工具调用能力。

OrcaRouter 🐳: We just shipped our official Qwen 3.8 27B Uncensored MLX build. Local. Uncensored. For🍎 2-bit, 4-bit, 6-bit & 8-bit — p...

安全/对齐开源/仓库模型发布

8月14日

星期五 · 5 条
23:22
Z.ai@Zai_org同事件
AI 评分 66/100
GLM-5.3 开放前安全评估:网络防御能力显著提升

智谱发布 GLM-5.3,为网络安全任务最强模型,在漏洞发现、利用分析和多步安全任务上大幅提升。CyberGym 得分 84.5%(GLM-5.2 为 77.2%),ExploitBench 达 54.4%(此前 24.4%),ExploitGym 两小时完成 105 项任务(此前 29 项)。因双重用途风险,将先由安全伙伴受控评估,再开放 API 和完整权重。

安全/对齐开源生态模型发布
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
18:52
The Decoder:AI News(RSS)同事件
AI 评分 60/100
智谱发布 GLM-5.3,称其为最强开源权重编程模型

智谱发布 GLM-5.3,与上一代 GLM-5.2 共享相同基座,全部提升来自扩展的后训练,并称其为最强开源权重编程模型,智能体任务进步最大。该模型经安全数据训练,在 269 个项目中找到 2,436 个漏洞,部分漏洞存在长达 40 年。GLM-5.3 现可通过 GLM Coding Plan 使用,权重将在安全审查完成后于两周内开源。

安全/对齐模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
16:22
MarkTechPost(RSS)同事件
AI 评分 61/100
Z.ai 发布 GLM-5.3:不重训基座模型,复杂编程与长程任务能力显著提升

Z.ai 发布 GLM-5.3,沿用 GLM-5.2 的 743B 基座模型,全部提升来自扩展的后训练。Terminal-Bench 3.0 得分从 4.6 升至 28.3,CyberGym 达 84.5%,超过 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%)。模型已通过 Z.ai API、GLM Coding Plan 和 ZCode 提供,权重预计在发布约两周后公开。

安全/对齐模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
15:22
Chubby♨️@kimmonismus同事件
AI 评分 54/100
GLM-5.3 发布:网络安全能力大幅跃升

智谱发布 GLM-5.3,743B 基础模型与 GLM-5.2 相同,提升完全来自扩展后训练。其 Terminal-Bench 3.0 得分从 4.6 升至 28.3,CyberGym 从 77.2% 升至 84.5%,ExploitBench 从 24.4% 升至 54.4%。智谱称该模型能推理多阶段漏洞利用并构建完整攻击链,进展快于预期。

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

安全/对齐开源生态模型发布
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
13:52
🚨 AI News | TestingCatalog@testingcatalog同事件
AI 评分 54/100
智谱AI在ZCode上发布了GLM-5.3,在CyberGym上获得84.5分,高于Mythos 5和GPT-5.6 Sol!基于743B基础模型训练。 专为网络防御和编程任务打造。 "API访问和开放权重将在严格安全评估后分阶段发布。"

Z.ai: GLM-5.3 takes agentic coding to the next level, delivering a dramatic improvement over GLM-5.2 while achieving better re...

安全/对齐模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》

8月11日

星期二 · 10 条
14:14
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 49/100
GPT 5.6 网络安全

OpenAI 发布 GPT 5.6 网络安全版本,聚焦 AI 安全防护能力。该版本针对网络威胁检测与防御场景优化,旨在提升模型在安全领域的应用表现。相关讨论在 Hacker News 上获得 100 点热度。

OpenAI安全/对齐模型发布
08:14
TechCrunch:AI(RSS)同事件
AI 评分 64/100
OpenAI 扩展 Daybreak 网络防御服务,推出新模型 GPT-5.6-Cyber

OpenAI 本周宣布扩展其网络防御服务 Daybreak,新增 Blue 和 Red 两个层级,并为 Red 层级推出专用于防御工作的新模型 GPT-5.6-Cyber。

OpenAI安全/对齐模型发布
同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
02:46
Sam Altman@sama
AI 评分 50/100
OpenAI 发布 GPT-5.6-Cyber,这是其首个大规模直接提升高级网络安全任务(如漏洞利用开发)能力的模型。该模型在加速防御性工作方面表现强劲,已用于内部红队测试,并帮助安全研究人员发现和修复大量开源软件中的 0-day 漏洞。Sam Altman 呼吁业界考虑使用该模型来防御自身系统。

Eric Wallace: Today we are releasing GPT-5.6-Cyber. The model is our first large-scale attempt at directly improving capabilities for ...

OpenAI安全/对齐模型发布
02:37
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 55/100
OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型

OpenAI 发布网络安全专用模型 GPT-5.6-Cyber,可通过 Daybreak Red 获取,用于授权的漏洞研究、漏洞验证和安全测试。该模型旨在应对网络防御窗口不断收窄的挑战,为安全研究人员提供专门工具。

OpenAI安全/对齐模型发布

推荐理由:GPT-5.6-Cyber 将大模型能力引入授权的漏洞研究与验证流程,安全团队可借助模型自动化分析,缩短从漏洞发现到修复的窗口。
02:26
Tibo@thsottiaux同事件
AI 评分 62/100
OpenAI 扩大网络安全计划 Daybreak,推出新模型 GPT-5.6-Cyber,用于高级、经授权的网络安全工作。同时新增 Daybreak Blue 与 Red 访问层级,以加速防御能力。OpenAI 表示,此举旨在让可信防御者在攻击者大规模部署进攻性 AI 之前掌握前沿智能。

OpenAI: We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced, authorize...

OpenAI安全/对齐模型发布
同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
02:16
The Decoder:AI News(RSS)同事件
AI 评分 63/100
OpenAI 推出 GPT-5.6-Cyber,帮助防御者在攻击者之前发现漏洞

OpenAI 扩展 Daybreak 网络安全计划,新增 Blue 与 Red 两个访问层级,并推出专为进攻性安全研究训练的 GPT-5.6-Cyber 模型。

OpenAI安全/对齐模型发布
同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
01:56
Tibo@thsottiaux同事件
AI 评分 64/100
OpenAI 扩大网络安全计划 Daybreak,推出专用于高级授权安全工作的新模型 GPT-5.6-Cyber,并新增 Daybreak Blue 与 Red 访问层级,以加速防御能力。该举措旨在让可信防御者在攻击者大规模部署进攻性 AI 之前,率先获得前沿智能。

OpenAI: We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced, authorize...

OpenAI安全/对齐模型发布
同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
01:46
Greg Brockman@gdb同事件
AI 评分 52/100
我们正在发布一个新模型(GPT-5.6-Cyber),并扩展 Daybreak,以帮助将前沿智能交到防御者手中:【引用 @OpenAI】:我们正在扩展网络安全计划 Daybreak,并推出 GPT-5.6-Cyber,这是一个面向高级、授权网络安全工作的新模型。随着威胁形势的演变,我们正在攻击者大规模部署进攻性 AI 之前,将前沿智能交到可信防御者手中。

OpenAI: We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced, authorize...

OpenAI安全/对齐模型发布
同一事件,精选展示《OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型》
01:44
OpenAI@OpenAI
AI 评分 35/100
我们正在扩大网络安全计划 Daybreak,并推出 GPT-5.6-Cyber,一款面向高级授权网络安全工作的新模型。随着威胁形势不断演变,我们正赶在攻击者大规模部署攻击性 AI 之前,将前沿智能交到可信防御者手中。
OpenAI安全/对齐模型发布
01:16
Chubby♨️@kimmonismus
AI 评分 44/100
OpenAI 为网络防御者推出了一款限制更少的新模型。想必这也是在为发布能力更强、带来更多网络安全威胁的模型做准备,并据此进行准备和测试。狂野的时代即将到来。

Axios: NEW: OpenAI gives cyber defenders a less-restricted new model https://www.axios.com/2026/08/10/openai-gpt-astra-restrict...

OpenAI安全/对齐模型发布

8月8日

星期六 · 3 条
12:42
MarkTechPost(RSS)
AI 评分 69/100
Mistral AI 发布 Shieldstral 1.0 3B:开源策略自适应多模态安全分类器,性能媲美 7 倍规模模型

Mistral AI 发布 Shieldstral 1.0 3B,一款开源(Apache 2.0)策略自适应多模态安全分类器,将内容审核简化为单一 yes/no 问题,策略以自然语言写入提示词,无需重新训练。

安全/对齐模型发布
07:12
Sam Altman@sama
AI 评分 49/100
Astra 是一个强大的模型,我们正在努力让它全面可用。我们认为,把强大的模型只留给少数人并不是一个好策略。考虑到它的网络能力,我们需要再多一点时间来确保安全。但希望不会太久!
OpenAI安全/对齐模型发布
03:12
Greg Brockman@gdb同事件
AI 评分 60/100
OpenAI 下一代模型 Astra 在智能体编码与网络安全评估中展现显著能力提升,被其 Preparedness Framework 列为首个"关键"网络安全模型。团队正加强安全管控以确保其安全开发,并计划将高级网络能力提供给防御方,推动 Astra 广泛可用。

OpenAI: After evaluating one of our upcoming models, Astra, we're treating it as our first "critical" model for cybersecurity un...

OpenAI安全/对齐模型发布
同一事件,精选展示《OpenAI 将 Astra 列为首个"关键"网络安全模型》

8月6日

星期四 · 2 条
11:55
HuggingFace Daily Papers(社区热门论文)
AI 评分 65/100
K-EXAONE 2.0 技术报告:LG AI Research 开源 750B 参数多语言 MoE 模型

LG AI Research 发布 K-EXAONE 2.0,一款通过扩展架构升级而来的开源多语言 MoE 模型,总参数 750B,每 token 激活约 37B,容量为此前版本的三倍以上。模型支持 256K token 上下文,多语言覆盖从六种扩至十种,在智能体编码与长上下文理解上提升最大,并以 Apache 2.0 协议开源。

安全/对齐推理数据/训练模型发布
另有 1 家信源报道IT之家(RSS)
00:39
The Decoder:AI News(RSS)
AI 评分 60/100
Mistral 开源 3B 安全模型 Shieldstral,以更小体积匹敌七倍规模模型

Mistral 发布开源 3B 参数安全模型 Shieldstral,通过自然语言“是/否”问题而非固定类别来检查 AI 输入输出的安全违规。该模型在部分基准测试中匹敌七倍于其规模的模型,并支持运行者在运行时自行设定标准,无需依赖第三方分类体系,且可在本地运行。

安全/对齐模型发布

8月5日

星期三 · 6 条
19:05
Chubby♨️@kimmonismus
AI 评分 43/100
SSI 八月发布首款模型,剑指超级智能

Ilya Sutskever 旗下 Safe Superintelligence(SSI)将于八月发布其首款大语言模型。SSI 官网明确其唯一使命是开发超级智能,此次发布因此远超普通模型迭代,或意味着其在超级智能方向上已取得实质进展。

Chubby♨️: Let’s go: Ilya Sutskever’s SSI is launching its first LLM in August. we are accelerating friends!

安全/对齐模型发布
18:00
OpenAI:官网动态(RSS · 排除企业/客户案例)
AI 评分 49/100
OpenAI 推出 GPT-Daybreak 加速防御者安全能力

OpenAI 发布 GPT-Daybreak,面向防御者的前沿网络模型,覆盖从广泛防御工作到高级安全研究。该模型旨在加速安全团队的分析与响应效率,具体参数、基准分数及可用性细节尚未公布。

OpenAI安全/对齐模型发布
12:08
IT之家(RSS)
AI 评分 64/100
Mistral 推出 Shieldstral 多模态内容审核模型,单张 16GB GPU 可运行

Mistral AI 发布 Shieldstral 内容审核模型,总参数量 3B,采用开放权重并依据 Apache 2.0 许可证发布,已上线 Hugging Face,支持 12 种语言,可在单张 16GB GPU 上运行。

多模态安全/对齐模型发布
05:04
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 47/100
Mistral 发布 Shieldstral:3B 开源权重多模态内容审核模型

Mistral 推出 Shieldstral,一款 3B 参数的开源权重多模态内容审核模型。该模型面向文本与图像等内容的审核场景,权重开放可供开发者使用。

多模态安全/对齐模型发布
02:12
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 54/100
Mistral AI 宣布推出 Shieldstral,一款用于内容安全的全新 3B 开源权重模型。一款 3B 开源权重、策略自适应的多模态安全分类器,在文本安全方面可媲美最高 7 倍体量的模型,并在多模态审核方面树立了新标杆。

Mistral AI: The model takes moderation policy as a plain-language question and returns a calibrated score. Text and images — one int...

多模态安全/对齐模型发布
01:04
Mistral AI@MistralAI
AI 评分 62/100
🛡️推出 Shieldstral,Mistral 的 3B 开放权重内容安全模型,可部署在设备端 🧵 http://mistral.ai/news/shieldstral
安全/对齐模型发布端侧

8月3日

星期一 · 1 条
15:31
MarkTechPost(RSS)
AI 评分 60/100
Cogent AI 发布 VR-1:面向企业攻击链组合与验证的前沿网络推理模型

Cogent AI 发布 VR-1,一款专为网络安全后训练而非通用编码能力附带产出的推理模型,并同步推出评测基准 IntrusionBench 与安全智能体运行时 Cogent AI Harness。

安全/对齐推理模型发布

7月31日

星期五 · 1 条
02:28
Ars Technica:AI(RSS)
AI 评分 65/100
Google 发布 Gemini Robotics 2.0,提升机器人灵巧性与安全性

Google DeepMind 推出 Gemini Robotics 2,通过 Gemini Robotics ER 2 等三个新子模型为机器人带来全身智能。ER 2 可处理实时视频流,关键动作识别准确率近 90%,并支持多机器人协作。新安全基准 ASIMOV-Agentic 已开源至 Hugging Face,ER 2 模型即日起通过 Gemini Live API 向开发者开放。

Google具身智能安全/对齐模型发布
另有 11 家信源报道IT之家(RSS)X:Google AI for Developers (@googleaidevs)X:Testing Catalog (@testingcatalog)Google DeepMind:Blog(RSS)MarkTechPost(RSS)The Verge:AI(RSS)The Decoder:AI News(RSS)X:Google AI (@GoogleAI)X:Demis Hassabis (@demishassabis)X:Google DeepMind (@GoogleDeepMind)X:Kim (@kimmonismus)

7月28日

星期二 · 8 条
16:58
MarkTechPost(RSS)精选
AI 评分 71/100
Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%

Microsoft 发布 MAI-Cyber-1-Flash,一款 137B 总参数(5B 活跃参数)、256k 上下文窗口的稀疏 MoE 网络安全模型,是 MAI-Code-1-Flash 的微调版本。

Microsoft安全/对齐开源/仓库模型发布

推荐理由:微软这个安全模型把漏洞挖掘系统推到95.95%,关键是90%任务由5B模型完成成本砍半,路由设计比模型本身更值得关注,做漏洞挖掘的可以马上跑起来试试。
09:04
IT之家(RSS)同事件
AI 评分 60/100
微软推出首个网络安全 AI 模型 MAI-Cyber-1-Flash

微软发布首个网络安全 AI 模型 MAI-Cyber-1-Flash,在 CyberGym 基准测试中取得 95.95% 的成功率,超过 Claude Mythos 5 和 GPT-5.5 Cyber。该模型接入多智能体安全系统 MDASH,可处理约 90% 的网络安全任务,与 GPT-5.4 的组合成本比此前配置降低近 50%。

Microsoft安全/对齐模型发布
同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》
04:56
Rohan Paul@rohanpaul_ai
AI 评分 47/100
微软发布首个网络安全模型MAI-Cyber-1-Flash

微软发布首个网络安全模型MAI-Cyber-1-Flash,配合MDASH系统在CyberGym基准上取得95.95%的漏洞复现准确率,远超第二名GPT-5.5 Cyber的85.6%。MDASH协调超过100个专业智能体,通过Project Perception提供完整安全方案,成本仅为领先模型的50%。

Satya Nadella: Today, we are announcing a series of updates that give customers frontier-grade security at half the cost. MAI-Cyber-1-F...

Microsoft安全/对齐模型发布
02:55
TechCrunch:AI(RSS)同事件
AI 评分 60/100
微软发布首个网络安全专用模型 MAI-Cyber-1-Flash 及 Perception 平台

微软推出其首个网络安全专用模型 MAI-Cyber-1-Flash,声称在 Cyber Gym 基准测试中击败了 Gemini、GPT 5.5 Cyber 等竞品。该模型与 GPT 5.4 绑定在 MDASH 框架内,用于发现复杂代码库中的漏洞。同时发布的 Perception 平台可部署红、蓝、绿三组 AI 智能体,预览版将于 11 月 3 日上线。

智能体Microsoft安全/对齐模型发布
同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》
02:54
The Decoder:AI News(RSS)
AI 评分 48/100
微软发布自有网络安全模型 MAI-Cyber-1-Flash,最棘手任务仍依赖 OpenAI

微软推出紧凑型安全模型 MAI-Cyber-1-Flash,集成于此前公布的 MDASH 多智能体系统。该组合在 CyberGym 基准上得分 96%,领先 Mythos 12 个百分点,并超越 Gemini 和 GPT。MAI-Cyber-1-Flash 处理 90% 的任务,仅将复杂案例转交 GPT-5.4,微软称成本可降低 50%。

Microsoft安全/对齐模型发布
02:02
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 40/100
微软发布了 MAI-Cyber-1-Flash 模型和 MDASH,一个多智能体安全框架。MAI-Cyber-1-Flash 在 CyberGym 上获得 96% 的分数,领先于其他模型。这是一个值得关注的基准测试 👀

Mustafa Suleyman: We believe this is a gamechanger, and our models and agentic harnesses are only going to get better. Learn more here and...

Microsoft安全/对齐模型发布
01:40
Mustafa Suleyman@mustafasuleyman同事件
AI 评分 56/100
重大消息!我们的新 MAI-Cyber-1-Flash 模型结合 MDASH(多智能体安全框架),在 CyberGym 基准测试中达到 96%,比 Mythos 高出 12 个百分点,成本仅为其一半。为团队感到骄傲。更多详情见 THREAD:
Microsoft安全/对齐模型发布
同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》
01:02
Satya Nadella@satyanadella同事件
AI 评分 62/100
微软发布首款网络安全模型MAI-Cyber-1-Flash

微软宣布推出其首个网络安全模型MAI-Cyber-1-Flash,专为发现复杂代码库中最具挑战性的漏洞而构建。该模型结合MDASH后,能以领先模型50%的成本提供世界级性能。微软通过Project Perception将其推向市场,这是一个完整的智能体安全方案,由专业智能体团队协作模拟攻击、检测调查并修复问题。

Microsoft安全/对齐模型发布
同一事件,精选展示《Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%》

7月26日

星期日 · 1 条
08:27
MarkTechPost(RSS)
AI 评分 60/100
Sakana AI 发布 Fugu-Cyber 安全编排端点,在 CyberGym 上达 86.9%

Sakana AI 发布 Fugu-Cyber(fugu-cyber-v1.0),这是其 Fugu 编排家族中针对安全推理调优的第三个端点,而非全新基础模型。该模型在 CyberGym 基准上成功率达 86.9%,在 Microsoft 的 CTI-REALM 基准上达 72.1%。访问需手动申请审批,仅通过 Token Plan 订阅,暂不在 EU/EEA 提供。

安全/对齐模型发布
另有 1 家信源报道Sakana AI:Blog(网页)

7月25日

星期六 · 1 条
18:53
The Decoder:AI News(RSS)
AI 评分 60/100
Anthropic 称 Opus 5 几乎免疫浏览器提示词注入,攻击成功率降至零

Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。在 129 个浏览器智能体测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。

智能体Anthropic安全/对齐
已加载 40 条