ginobefun@hongming731
36AI 编辑部评分,满分 100

全球三大模型防蒸馏机制告破

2026-08-16 08:38· 44分钟前
AI 导读

116页论文证实Anthropic、OpenAI、Google的API存在密码学旁路漏洞,可将加密推理包注入同厂轻量模型并越狱,使其逐字转录隐藏思维链,解码1万条成本约720美元。研究还发现Kimi-K3复现Opus推理概率较其他模型高约百万倍,但作者强调不足以直接证明蒸馏。

BestBlogs 早报 · 08-16

思维链防蒸馏 / DeepSeek Harness / Flue / Avatar IV TPU / Agent 追踪

[1] ★ 精讲|全球三大顶尖模型的防蒸馏机制全面告破 MATS 研究员 Panfilov 领衔、马克斯·普朗克智能系统研究所与 Snyk 参与的 116 页论文证实,Anthropic、OpenAI、Google 的 API 普遍存在密码学旁路漏洞:把顶级模型的加密推理包注入同厂轻量模型并越狱,小模型便会逐字转录其隐藏思维链,提取的明文 Token 数与 API 计费高度吻合,解码 1 万条成本约 720 美元。文中还发现 Kimi-K3 复现 Opus 推理的概率较其他模型高出约百万倍,但作者强调这不足以直接证明蒸馏。 来源:InfoQ 中文 https://www.bestblogs.dev/article/fc16a94b00

[2] ★ 精讲|DeepSeek 的 Harness,有一套新世界观|Hao 好聊趋势 腾讯科技这篇解读跳出插件架构本身,把 DeepSeek Harness 放进递归式 Harness 自我改进(RHI)的研究脉络:先梳理进化什么、怎么进化、何为真递归三重未解困境,再借 MIT CSAIL 的论文给出世界观--Harness 是组合泛化器,负责把陌生大任务拆成模型熟悉的局部调用。文章进一步论证,可回退效应与显式依赖为奖励归因提供了结构地图,这可能才是 GRPO 提出者为 Agent RL 藏下的底牌。 来源:腾讯科技 https://www.bestblogs.dev/article/47a69cb12c

[3] ★ 精讲|面向智能体的 React:Astro 创始人将 Hook 引入他的元挂载器 Flue Astro 创始人 Fred Schott 发布 Flue 2 首个稳定版,把 React 式 Hook 引入智能体开发:智能体是一个每次模型调用前重新渲染的 JavaScript 函数,内置 16 个 Hook 并支持自定义,配置可随对话进程动态调整。他从大客户全公司只有一个智能体的现实出发,把文件路由视为反模式;Flue 构建于极简 Harness Pi 之上,坚持对各类宿主开放,与偏向 Vercel 特性的 eve 形成对照。 来源:http://Latent.Space https://www.bestblogs.dev/article/2905b1829f

[4] 大模型后训练配方演进与多教师在线策略蒸馏|对话 AI2 研究员 Finbarr Timbers [播客] 深度梳理前沿大模型后训练配方从 InstructGPT 到多教师在线策略蒸馏的演进路径,剖析 DPO 衰落、教师模型融合困境与学术/工业界分歧。 来源:跨国串门儿计划 https://www.bestblogs.dev/podcast/474029fe1

[5] HeyGen 联手 Google Cloud:Avatar IV 视频模型移植 TPU 实测 HeyGen 与 Google Cloud 详细说明了将 180 亿参数的 Avatar IV 扩散模型移植至 Trillium TPU 的工程工作,通过三项针对性的内核和编译器优化,实现了 1.86 倍的加速。 来源:Google Developers Blog https://www.bestblogs.dev/article/978b81ddc9

[6] Cloudflare 新增 Agent 追踪,存在截断限制与不一致的 Payload 默认设置 Cloudflare 推出 Agent 追踪,作为 Cloudflare Agents 的首个组件,为 Workers 可观测性增加了 Agent 级别的跨度,同时揭示了开发者需要关注的 Payload 默认设置不一致、截断限制及定价影响。 来源:InfoQ https://www.bestblogs.dev/article/006c776634

[7] Stack Overflow 的衰退与知识生产的结构性迁移 本文通过 Stack Overflow 提问量的断崖式下跌,分析了 AI 时代下知识生产从公共论坛向私人对话迁移的趋势,并探讨了这一转变对人类专业能力形成及公共知识库的深远影响。 来源:机器之心 https://www.bestblogs.dev/article/366fe87300

[8] 为智能体而非人类构建文档:OpenWiki 的设计思路 [视频] OpenWiki 将面向智能体的代码库文档视为一种可落地的智能体记忆,通过聚焦的 Markdown、确定性元数据、基于 Git 的自动更新与早期检索效率验证来实现。 来源:LangChain https://www.bestblogs.dev/video/90fe08560

[9] 用 ChatGPT Work 交付可提交董事会的报告材料 [视频] OpenAI 演示了 ChatGPT Work 如何交叉核验关联财务材料、发现不一致,并引导团队完成可提交董事会的报告。 来源:OpenAI https://www.bestblogs.dev/video/f4bb11cba

[10] 别再吹高端 Agent 了,国内绝大多数企业,连豆包都还没入门 文章通过四位行业从业者的圆桌对话,揭示了中国 AI 在 2026 年落地的真实水平--大多数企业甚至连基础 AI 工具(如豆包)都还未入门,更别说高端 Agent 技术,核心问题在于企业缺乏 AI 需求明确性和落地实践能力。 来源:非凡产研 https://www.bestblogs.dev/article/91a0589803

--- http://BestBlogs.dev · 发现真正适合你的高质量内容 BestBlogs 是 AI 驱动的私人阅读助手,帮助你发现真正适合你的高质量内容,关注你感兴趣的来源和主题,每天生成一份更适合自己的「我的早报」,欢迎体验和关注我们。 在线阅读:https://www.bestblogs.dev/explore/brief/2026-08-16

ginobefunhttps://x.com/i/article/2088785861869776896

来源:ginobefun · x.com

全球三大模型防蒸馏机制告破

ginobefun · @hongming731 · X·2026-08-16 08:38·44分钟前
AI 导读

116页论文证实Anthropic、OpenAI、Google的API存在密码学旁路漏洞,可将加密推理包注入同厂轻量模型并越狱,使其逐字转录隐藏思维链,解码1万条成本约720美元。研究还发现Kimi-K3复现Opus推理概率较其他模型高约百万倍,但作者强调不足以直接证明蒸馏。

BestBlogs 早报 · 08-16

思维链防蒸馏 / DeepSeek Harness / Flue / Avatar IV TPU / Agent 追踪

[1] ★ 精讲|全球三大顶尖模型的防蒸馏机制全面告破 MATS 研究员 Panfilov 领衔、马克斯·普朗克智能系统研究所与 Snyk 参与的 116 页论文证实,Anthropic、OpenAI、Google 的 API 普遍存在密码学旁路漏洞:把顶级模型的加密推理包注入同厂轻量模型并越狱,小模型便会逐字转录其隐藏思维链,提取的明文 Token 数与 API 计费高度吻合,解码 1 万条成本约 720 美元。文中还发现 Kimi-K3 复现 Opus 推理的概率较其他模型高出约百万倍,但作者强调这不足以直接证明蒸馏。 来源:InfoQ 中文 https://www.bestblogs.dev/article/fc16a94b00

[2] ★ 精讲|DeepSeek 的 Harness,有一套新世界观|Hao 好聊趋势 腾讯科技这篇解读跳出插件架构本身,把 DeepSeek Harness 放进递归式 Harness 自我改进(RHI)的研究脉络:先梳理进化什么、怎么进化、何为真递归三重未解困境,再借 MIT CSAIL 的论文给出世界观--Harness 是组合泛化器,负责把陌生大任务拆成模型熟悉的局部调用。文章进一步论证,可回退效应与显式依赖为奖励归因提供了结构地图,这可能才是 GRPO 提出者为 Agent RL 藏下的底牌。 来源:腾讯科技 https://www.bestblogs.dev/article/47a69cb12c

[3] ★ 精讲|面向智能体的 React:Astro 创始人将 Hook 引入他的元挂载器 Flue Astro 创始人 Fred Schott 发布 Flue 2 首个稳定版,把 React 式 Hook 引入智能体开发:智能体是一个每次模型调用前重新渲染的 JavaScript 函数,内置 16 个 Hook 并支持自定义,配置可随对话进程动态调整。他从大客户全公司只有一个智能体的现实出发,把文件路由视为反模式;Flue 构建于极简 Harness Pi 之上,坚持对各类宿主开放,与偏向 Vercel 特性的 eve 形成对照。 来源:http://Latent.Space https://www.bestblogs.dev/article/2905b1829f

[4] 大模型后训练配方演进与多教师在线策略蒸馏|对话 AI2 研究员 Finbarr Timbers [播客] 深度梳理前沿大模型后训练配方从 InstructGPT 到多教师在线策略蒸馏的演进路径,剖析 DPO 衰落、教师模型融合困境与学术/工业界分歧。 来源:跨国串门儿计划 https://www.bestblogs.dev/podcast/474029fe1

[5] HeyGen 联手 Google Cloud:Avatar IV 视频模型移植 TPU 实测 HeyGen 与 Google Cloud 详细说明了将 180 亿参数的 Avatar IV 扩散模型移植至 Trillium TPU 的工程工作,通过三项针对性的内核和编译器优化,实现了 1.86 倍的加速。 来源:Google Developers Blog https://www.bestblogs.dev/article/978b81ddc9

[6] Cloudflare 新增 Agent 追踪,存在截断限制与不一致的 Payload 默认设置 Cloudflare 推出 Agent 追踪,作为 Cloudflare Agents 的首个组件,为 Workers 可观测性增加了 Agent 级别的跨度,同时揭示了开发者需要关注的 Payload 默认设置不一致、截断限制及定价影响。 来源:InfoQ https://www.bestblogs.dev/article/006c776634

[7] Stack Overflow 的衰退与知识生产的结构性迁移 本文通过 Stack Overflow 提问量的断崖式下跌,分析了 AI 时代下知识生产从公共论坛向私人对话迁移的趋势,并探讨了这一转变对人类专业能力形成及公共知识库的深远影响。 来源:机器之心 https://www.bestblogs.dev/article/366fe87300

[8] 为智能体而非人类构建文档:OpenWiki 的设计思路 [视频] OpenWiki 将面向智能体的代码库文档视为一种可落地的智能体记忆,通过聚焦的 Markdown、确定性元数据、基于 Git 的自动更新与早期检索效率验证来实现。 来源:LangChain https://www.bestblogs.dev/video/90fe08560

[9] 用 ChatGPT Work 交付可提交董事会的报告材料 [视频] OpenAI 演示了 ChatGPT Work 如何交叉核验关联财务材料、发现不一致,并引导团队完成可提交董事会的报告。 来源:OpenAI https://www.bestblogs.dev/video/f4bb11cba

[10] 别再吹高端 Agent 了,国内绝大多数企业,连豆包都还没入门 文章通过四位行业从业者的圆桌对话,揭示了中国 AI 在 2026 年落地的真实水平--大多数企业甚至连基础 AI 工具(如豆包)都还未入门,更别说高端 Agent 技术,核心问题在于企业缺乏 AI 需求明确性和落地实践能力。 来源:非凡产研 https://www.bestblogs.dev/article/91a0589803

--- http://BestBlogs.dev · 发现真正适合你的高质量内容 BestBlogs 是 AI 驱动的私人阅读助手,帮助你发现真正适合你的高质量内容,关注你感兴趣的来源和主题,每天生成一份更适合自己的「我的早报」,欢迎体验和关注我们。 在线阅读:https://www.bestblogs.dev/explore/brief/2026-08-16

ginobefunhttps://x.com/i/article/2088785861869776896

来源:ginobefun· x.com