内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

精选

8月26日 · 周三
最新精选
全部模型产品行业论文教程观点
标签「DeepMind」清除

今天8月26日 周三

00:00Google AI73WeatherNext 预测气旋:提前五天预警五级飓风Google AI 发布 WeatherNext 气旋预测模型,可同时预测风暴路径、强度和规模,比现有系统多提供一整天的预警时间。该模型在 2025 飓风季实战测试中,提前五天预测飓风 Melissa 在牙买加的五级登陆,系美国国家飓风中心首次实时使用 AI 模型。模型单场风暴可生成多达 1000 次模拟,代码与权重已开源。推荐理由:把路径、强度和尺度放进同一模型,省去过去切换全球与区域模型的步骤,对需要快速判断登陆风险的预报流程是种简化。

8月15日周六

03:22Anthropic:Newsroom(网页)65Claude 文本水印机制如何运作未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。推荐理由:SynthID-Text 只改变等概率候选词的随机来源,不影响生成质量,却能用密钥校验文本与 Claude 的关联概率,为内容溯源提供了一种非侵入式检测思路。

8月8日周六

19:12Ars Technica:AI(RSS)77DeepMind 的 WeatherNext 飓风模型为预报员争取到额外一天预警时间Google DeepMind 与 Google Research 开发的 AI 模型 WeatherNext,在 2025 年 10 月飓风 Melissa 登陆前 5 天,以 80% 的置信度预测其将以 5 级飓风强度袭击牙买加。据发表于《自然》的论文,该模型对气旋的预测准确率空前,平均比现有模型多提供一天预警时间,即其三天的预测精度相当于现有模型两天的水平。推荐理由:相比现有模型,WeatherNext 在三天前的预测准确度相当于过去的 48 小时预报,这一改善意味着沿海社区能多出整整一天采取防灾措施,对高风险区域的庇护和撤离安排有实际影响。

8月7日周五

15:10IT之家(RSS)71谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。推荐理由:将气旋预报时效提前24小时并开源全套模型权重,气象机构可据此提升预警窗口,影响紧急预案规划。

8月6日周四

21:40The Verge:AI(RSS)75Google 大规模 AI 组织调整背后的混乱政治Google 宣布迄今最大规模 AI 组织调整:Demis Hassabis 卸任 DeepMind 日常管理以专注 AGI 研究,CTO Koray Kavukcuoglu 接任;27 年老将 Jeff Dean 与三位顶级研究员离职创办 AI 初创公司。内部员工认为调整源于产品提速压力、Hassabis 影响力下降及与美国国防部合作引发的伦理冲突。推荐理由:人事变动之外,文章的核心价值在于把 Jeff Dean 离职与军方合同、伦理红线直接关联,呈现了 Google 内部产品速度与道德立场之间的张力。
01:09Hacker News 热门(buzzing.cc 中文翻译)73Google DeepMind CEO 德米斯·哈萨比斯即将卸任Google DeepMind CEO 德米斯·哈萨比斯即将卸任。该消息由 Axios 报道,并在 Hacker News 上获得超过 125 点热度。目前尚未公布继任者或具体离职时间等细节。

7月30日周四

23:27Google DeepMind:Blog(RSS)60Gemini Robotics ER 2:用视频理解、任务编排与多机器人协作赋能机器人Google DeepMind 推出 Gemini Robotics ER 2,一个基于 Gemini 的机器人基础模型。该模型在视频理解、工具编排和多机器人协作方面实现阶跃式提升,使机器人能够推理、协作并解决真实世界任务。推荐理由:DeepMind 把 Gemini 带到机器人领域,视频理解、任务编排和多机协作的叙事很宏大,但全是愿景,没有实测数据,是不是真正的 step change 得等细节。做机器人的可以先建个追踪。
23:16Google DeepMind71Google DeepMind 发布 Gemini Robotics 2 物理 AIOne brain. For any robot. 🤖 我们正在推出 Gemini Robotics 2:我们的下一代物理 AI,为仿人机器人带来全身智能、高级灵巧性、多机器人团队协作等能力。推荐理由:这是谷歌把通用大模型能力注入机器人的关键一步,全身智能和灵巧操作如果能兑现,制造业的自动化想象会彻底改写。
00:26Google DeepMind:Blog(RSS)63Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5,带来音乐性、歌词质量、人声表现力与创作控制的多项提升。新模型能生成更自然复杂的旋律结构,歌词对提示词的遵循度和结构意识更强,人声更逼真且富有情感,同时支持更便捷地控制输出节奏与时长。推荐理由:Lyria 3.5 把音乐生成从玩具级推到了可用创作工具级别,歌词和情感人声的提升对内容创作者是实实在在的福音。

7月22日周三

00:22Josh Woodward69Google 发布三款新模型:3.6 Flash、3.5 Flash-Lite 与 3.5 Flash CyberGoogle 推出三款新模型,旨在提升性能、降低延迟和成本。其中,3.6 Flash 在复杂编码任务上 token 用量最高减少 65%,3.5 Flash-Lite 速度达 350 输出 token/秒。3.6 Flash 和 3.5 Flash-Lite 已在 Gemini 应用上线,3.5 Pro 进入合作伙伴测试。推荐理由:Google一口气扔出三个Gemini Flash新模型,3.6 Flash把复杂编码token砍了65%,做Agent的成本敏感型选手可以直接收益,Cyber模型专攻漏洞修复是个有意思的细分信号。

7月21日周二

23:22Google DeepMind:Blog(RSS)57Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 三款新模型Google DeepMind 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 Gemini 3.6 Flash 为最新主力模型,3.5 Flash-Lite 主打更低成本与更高效率,3.5 Flash Cyber 则针对网络安全场景优化。三款模型均通过 Google AI 开发者平台提供 API 访问。推荐理由:Gemini Flash 系列常规更新,Flash-Lite 和 Cyber 变体值得 API 开发者留意,但细节还没出来,目前只能先标记。

7月14日周二

17:32Demis Hassabis68Demis Hassabis:AGI 数年可至,影响达工业革命10倍Google DeepMind 联合创始人 Demis Hassabis 发文称,AGI 可能仅需数年即可实现,其影响将达工业革命的10倍且速度更快。他指出,前沿模型在网络安全、核与生物风险方面已构成挑战,未来需对日益智能体化、递归自我改进的系统建立稳健防护。Hassabis 呼吁美国率先建立类似 FINRA 的前沿AI标准机构,采用联邦监督下的公私合作或自律组织模式,由独立技术专家和开源代表组成董事会,资金主要来自行业以吸引顶尖人才和算力。他强调,当前商业与地缘竞赛导致技术进步快于理解,需以谨慎乐观态度推进公共政策,兼顾创新与安全。推荐理由:Demis Hassabis 亲自下场提出一个具体的 AGI 监管框架,用 FINRA 模式构建标准组织,这比泛泛呼吁更有行动感,政策讨论里少见的可操作方案。

6月25日周四

01:07Google DeepMind:Blog(RSS)70Gemini 3.5 Flash 引入 computer use 功能Google DeepMind 宣布,computer use 现作为内置工具集成于 Gemini 3.5 Flash,开发者可构建跨浏览器、移动端和桌面的智能体,实现视觉感知、推理与操作。此前该功能仅以独立模型形式存在于 Gemini 2.5。3.5 Flash 已支持函数调用及 Search、Maps 等内置工具,新增的 computer use 可提升持续软件测试和跨专业应用知识工作等长周期企业自动化任务的性能。安全方面采用针对性对抗训练,并可选配两项企业防护系统:要求用户确认敏感操作,以及在检测到间接 prompt 注入时自动停止任务。可通过 Gemini API 和 Gemini Enterprise Agent Platform 使用。推荐理由:把 computer use 能力塞进轻量级的 Flash 模型,意味着在浏览器里跑视觉 agent 的成本会大幅降低,做企业自动化的团队可以立即试起来,安全措施也给了落地信心。

6月23日周二

03:05TechCrunch:AI(RSS)70Google DeepMind 7500 万美元投资 A24,合作开发电影 AI 工具Google DeepMind 宣布向独立电影制片厂 A24 投资 7500 万美元(据《华尔街日报》),双方将合作开发电影制作 AI 工具。A24 出品过《万事俱备》《后室》等影片。Google DeepMind CEO Demis Hassabis 称,希望通过与艺术家直接合作,打造支持创意表达的 AI 功能。此举是好莱坞最新一次科技公司与电影 AI 联手,此前 Netflix 已收购 Ben Affleck 的 AI 工具公司 Interpositive,亚马逊 MGM 工作室也在去年设立了影视 AI 部门。推荐理由:Google DeepMind 首次在影视内容创作上投入 7500 万美元,与 A24 合作开发 AI 工具,这标志着顶尖 AI 实验室开始直接渗透好莱坞核心创意流程,做文娱 AI 工具的人和关注产业交叉点的人应该留意。

6月18日周四

21:19Google DeepMind:Blog(RSS)65保障AI智能体的未来安全Google DeepMind发布AI Control Roadmap,这是一套针对内部先进AI智能体的系统级安全框架。该框架在传统模型对齐之上增加防线,假设AI智能体可能不对齐,通过威胁建模、沙箱隔离、端点安全、提示注入防御以及基于已验证行为逐步授予权限的机制建立信任。据估算,到2030年仅美国市场AI智能体就能创造2.9万亿美元经济价值。推荐理由:DeepMind 首次系统性地公开了内部 AI 代理安全控制路线图,把代理当潜在「内鬼」来防的思路很务实,分析了 100 万个任务轨迹的监控实践尤其值得做 Agent 安全的人细看。
02:36Chubby♨️79Anthropic与DeepMind CEO呼吁G7组建AI联盟排除中国Dario Amodei(Anthropic)与Demis Hassabis(Google DeepMind)在G7闭门会议上呼吁组建美国主导的联盟,为人工智能制定全球规则和标准。Amodei指出,该联盟应以前沿模型和硬件(包括芯片及其他关键组件)的访问权限为手段,将中国排除在外。这一主张被评论为高技术新冷战的开端,竞争方将从根本上被剥夺参与权。推荐理由:Dario 和 Hassabis 在 G7 闭门会上提出「排除中国」的 AI 联盟,这不是商业竞争而是地缘站队,AI 行业的「两个世界」格局可能从今天开始具象化。

6月11日周四

19:42Google DeepMind:Blog(RSS)60Google DeepMind 宣布投入 1000 万美元资助多智能体AI安全研究Google DeepMind 与合作伙伴共同发起一项 1000 万美元的资金征集,专门用于多智能体 AI 安全方向的研究。推荐理由:DeepMind 联合 Schmidt Sciences 等发起千万美元级多智能体安全研究资助,标志着对大规模 agent 交互中深层风险的正式关注,做 agent 安全的人可重点关注。

6月10日周三

17:28IT之家(RSS)70谷歌 DeepMind 经济学家伊马斯:尚未发现 AI 造成岗位流失的证据,跟风裁员恐适得其反谷歌 DeepMind AGI 经济学负责人亚历克斯·伊马斯表示,目前没有看到白领岗位因 AI 大规模消失的证据。他强调,若企业因“不裁员就等于 AI 转型慢”的叙事而跟风裁员,可能适得其反。伊马斯认为,AI 更多是接手部分任务、提升生产力,让员工专注机器无法完成的工作,岗位冲击尚未真正出现。推荐理由:来自AI核心阵营的经济学家说‘还没证据’,这本身就值得每个担心被AI替代的人看一眼,那种‘没裁员就是落后’的FOMO叙事可能更危险。

6月9日周二

21:04Google DeepMind:Blog(RSS)56Gemini Guided Learning 随机对照试验:在塞拉利昂等地提升参与度并加速学习一项在塞拉利昂等地开展的随机对照试验显示,Gemini 的 Guided Learning 功能能够提升学生参与度并加速学习。推荐理由:对教育行业是个有力信号,RCT数据扎实,但效应量不算大,且高基础学生受益更多,公平性挑战还在。

6月5日周五

22:30Gary Marcus:The Road to AI We Can Trust(RSS)55Sir Demis Hassabis vs Sir Demis Hassabis推荐理由:哈萨比斯在斯坦福把 AGI 时间线从达沃斯的「5-10 年」压到「2030 左右」,Gary Marcus 拎出来对比,让我看到他自己的定义也在被叙事裹挟。
精选
2026年8月26日星期三 · AI 筛选的今日重点
全部模型产品行业论文教程观点

8月26日

星期三 · 1 条
00:00
Google AI@GoogleAI精选
AI 评分 73/100
WeatherNext 预测气旋:提前五天预警五级飓风

Google AI 发布 WeatherNext 气旋预测模型,可同时预测风暴路径、强度和规模,比现有系统多提供一整天的预警时间。该模型在 2025 飓风季实战测试中,提前五天预测飓风 Melissa 在牙买加的五级登陆,系美国国家飓风中心首次实时使用 AI 模型。模型单场风暴可生成多达 1000 次模拟,代码与权重已开源。


推荐理由:把路径、强度和尺度放进同一模型,省去过去切换全球与区域模型的步骤,对需要快速判断登陆风险的预报流程是种简化。

8月15日

星期六 · 1 条
03:22
Anthropic:Newsroom(网页)精选
AI 评分 65/100
Claude 文本水印机制如何运作

未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。

另有 1 家信源报道X:Anthropic (@AnthropicAI)
推荐理由:SynthID-Text 只改变等概率候选词的随机来源,不影响生成质量,却能用密钥校验文本与 Claude 的关联概率,为内容溯源提供了一种非侵入式检测思路。

8月8日

星期六 · 1 条
19:12
Ars Technica:AI(RSS)精选
AI 评分 77/100
DeepMind 的 WeatherNext 飓风模型为预报员争取到额外一天预警时间

Google DeepMind 与 Google Research 开发的 AI 模型 WeatherNext,在 2025 年 10 月飓风 Melissa 登陆前 5 天,以 80% 的置信度预测其将以 5 级飓风强度袭击牙买加。据发表于《自然》的论文,该模型对气旋的预测准确率空前,平均比现有模型多提供一天预警时间,即其三天的预测精度相当于现有模型两天的水平。


推荐理由:相比现有模型,WeatherNext 在三天前的预测准确度相当于过去的 48 小时预报,这一改善意味着沿海社区能多出整整一天采取防灾措施,对高风险区域的庇护和撤离安排有实际影响。

8月7日

星期五 · 1 条
15:10
IT之家(RSS)精选
AI 评分 71/100
谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时

谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:将气旋预报时效提前24小时并开源全套模型权重,气象机构可据此提升预警窗口,影响紧急预案规划。

8月6日

星期四 · 2 条
21:40
The Verge:AI(RSS)精选
AI 评分 75/100
Google 大规模 AI 组织调整背后的混乱政治

Google 宣布迄今最大规模 AI 组织调整:Demis Hassabis 卸任 DeepMind 日常管理以专注 AGI 研究,CTO Koray Kavukcuoglu 接任;27 年老将 Jeff Dean 与三位顶级研究员离职创办 AI 初创公司。内部员工认为调整源于产品提速压力、Hassabis 影响力下降及与美国国防部合作引发的伦理冲突。

另有 3 家信源报道Hacker News 热门(buzzing.cc 中文翻译)X:阿易 AI Notes (@AYi_AInotes)The Decoder:AI News(RSS)
推荐理由:人事变动之外,文章的核心价值在于把 Jeff Dean 离职与军方合同、伦理红线直接关联,呈现了 Google 内部产品速度与道德立场之间的张力。
01:09
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 73/100
Google DeepMind CEO 德米斯·哈萨比斯即将卸任

Google DeepMind CEO 德米斯·哈萨比斯即将卸任。该消息由 Axios 报道,并在 Hacker News 上获得超过 125 点热度。目前尚未公布继任者或具体离职时间等细节。

7月30日

星期四 · 3 条
23:27
Google DeepMind:Blog(RSS)精选
AI 评分 60/100
Gemini Robotics ER 2:用视频理解、任务编排与多机器人协作赋能机器人

Google DeepMind 推出 Gemini Robotics ER 2,一个基于 Gemini 的机器人基础模型。该模型在视频理解、工具编排和多机器人协作方面实现阶跃式提升,使机器人能够推理、协作并解决真实世界任务。

另有 4 家信源报道IT之家(RSS)Ars Technica:AI(RSS)X:Google AI for Developers (@googleaidevs)X:Testing Catalog (@testingcatalog)
推荐理由:DeepMind 把 Gemini 带到机器人领域,视频理解、任务编排和多机协作的叙事很宏大,但全是愿景,没有实测数据,是不是真正的 step change 得等细节。做机器人的可以先建个追踪。
23:16
Google DeepMind@GoogleDeepMind精选
AI 评分 71/100
One brain. For any robot. 🤖我们正在推出 Gemini Robotics 2:我们的下一代物理 AI,为仿人机器人带来全身智能、高级灵巧性、多机器人团队协作等能力。
另有 7 家信源报道X:Google AI (@GoogleAI)Ars Technica:AI(RSS)X:Demis Hassabis (@demishassabis)The Verge:AI(RSS)X:Kim (@kimmonismus)The Decoder:AI News(RSS)MarkTechPost(RSS)
推荐理由:这是谷歌把通用大模型能力注入机器人的关键一步,全身智能和灵巧操作如果能兑现,制造业的自动化想象会彻底改写。
00:26
Google DeepMind:Blog(RSS)精选
AI 评分 63/100
Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制

Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5,带来音乐性、歌词质量、人声表现力与创作控制的多项提升。新模型能生成更自然复杂的旋律结构,歌词对提示词的遵循度和结构意识更强,人声更逼真且富有情感,同时支持更便捷地控制输出节奏与时长。

另有 2 家信源报道IT之家(RSS)The Decoder:AI News(RSS)
推荐理由:Lyria 3.5 把音乐生成从玩具级推到了可用创作工具级别,歌词和情感人声的提升对内容创作者是实实在在的福音。

7月22日

星期三 · 1 条
00:22
Josh Woodward@joshwoodward精选
AI 评分 69/100
Google 推出三款新模型,旨在提升性能、降低延迟和成本。其中,3.6 Flash 在复杂编码任务上 token 用量最高减少 65%,3.5 Flash-Lite 速度达 350 输出 token/秒。3.6 Flash 和 3.5 Flash-Lite 已在 Gemini 应用上线,3.5 Pro 进入合作伙伴测试。

Google DeepMind: We’re rolling out three new models to make AI agents faster, smarter, and cheaper at scale: 🔵 Gemini 3.6 Flash: It uses...

另有 18 家信源报道Google DeepMind:Blog(RSS)X:fofr (@fofrAI)X:Google AI (@GoogleAI)IT之家(RSS)X:Gemini (@GeminiApp)TechCrunch:AI(RSS)Ars Technica:AI(RSS)X:Jeff Dean (@JeffDean)X:Logan Kilpatrick (@OfficialLoganK)Artificial Intelligence News(RSS)Hacker News 热门(buzzing.cc 中文翻译)X:Google DeepMind (@GoogleDeepMind)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)MarkTechPost(RSS)
推荐理由:Google一口气扔出三个Gemini Flash新模型,3.6 Flash把复杂编码token砍了65%,做Agent的成本敏感型选手可以直接收益,Cyber模型专攻漏洞修复是个有意思的细分信号。

7月21日

星期二 · 1 条
23:22
Google DeepMind:Blog(RSS)精选
AI 评分 57/100
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 三款新模型

Google DeepMind 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 Gemini 3.6 Flash 为最新主力模型,3.5 Flash-Lite 主打更低成本与更高效率,3.5 Flash Cyber 则针对网络安全场景优化。三款模型均通过 Google AI 开发者平台提供 API 访问。

另有 18 家信源报道Google DeepMind:Blog(RSS)X:fofr (@fofrAI)X:Google AI (@GoogleAI)IT之家(RSS)X:Gemini (@GeminiApp)TechCrunch:AI(RSS)Ars Technica:AI(RSS)X:Jeff Dean (@JeffDean)X:Logan Kilpatrick (@OfficialLoganK)Artificial Intelligence News(RSS)Hacker News 热门(buzzing.cc 中文翻译)X:Google DeepMind (@GoogleDeepMind)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)MarkTechPost(RSS)
推荐理由:Gemini Flash 系列常规更新,Flash-Lite 和 Cyber 变体值得 API 开发者留意,但细节还没出来,目前只能先标记。

7月14日

星期二 · 1 条
17:32
Demis Hassabis@demishassabis精选
AI 评分 68/100
Demis Hassabis:AGI 数年可至,影响达工业革命10倍

Google DeepMind 联合创始人 Demis Hassabis 发文称,AGI 可能仅需数年即可实现,其影响将达工业革命的10倍且速度更快。他指出,前沿模型在网络安全、核与生物风险方面已构成挑战,未来需对日益智能体化、递归自我改进的系统建立稳健防护。Hassabis 呼吁美国率先建立类似 FINRA 的前沿AI标准机构,采用联邦监督下的公私合作或自律组织模式,由独立技术专家和开源代表组成董事会,资金主要来自行业以吸引顶尖人才和算力。他强调,当前商业与地缘竞赛导致技术进步快于理解,需以谨慎乐观态度推进公共政策,兼顾创新与安全。

另有 4 家信源报道IT之家(RSS)The Verge:AI(RSS)X:Kim (@kimmonismus)The Decoder:AI News(RSS)
推荐理由:Demis Hassabis 亲自下场提出一个具体的 AGI 监管框架,用 FINRA 模式构建标准组织,这比泛泛呼吁更有行动感,政策讨论里少见的可操作方案。

6月25日

星期四 · 1 条
01:07
Google DeepMind:Blog(RSS)精选
AI 评分 70/100
Gemini 3.5 Flash 引入 computer use 功能

Google DeepMind 宣布,computer use 现作为内置工具集成于 Gemini 3.5 Flash,开发者可构建跨浏览器、移动端和桌面的智能体,实现视觉感知、推理与操作。此前该功能仅以独立模型形式存在于 Gemini 2.5。3.5 Flash 已支持函数调用及 Search、Maps 等内置工具,新增的 computer use 可提升持续软件测试和跨专业应用知识工作等长周期企业自动化任务的性能。安全方面采用针对性对抗训练,并可选配两项企业防护系统:要求用户确认敏感操作,以及在检测到间接 prompt 注入时自动停止任务。可通过 Gemini API 和 Gemini Enterprise Agent Platform 使用。

另有 2 家信源报道Hacker News 热门(buzzing.cc 中文翻译)X:Google AI for Developers (@googleaidevs)
推荐理由:把 computer use 能力塞进轻量级的 Flash 模型,意味着在浏览器里跑视觉 agent 的成本会大幅降低,做企业自动化的团队可以立即试起来,安全措施也给了落地信心。

6月23日

星期二 · 1 条
03:05
TechCrunch:AI(RSS)精选
AI 评分 70/100
Google DeepMind 7500 万美元投资 A24,合作开发电影 AI 工具

Google DeepMind 宣布向独立电影制片厂 A24 投资 7500 万美元(据《华尔街日报》),双方将合作开发电影制作 AI 工具。A24 出品过《万事俱备》《后室》等影片。Google DeepMind CEO Demis Hassabis 称,希望通过与艺术家直接合作,打造支持创意表达的 AI 功能。此举是好莱坞最新一次科技公司与电影 AI 联手,此前 Netflix 已收购 Ben Affleck 的 AI 工具公司 Interpositive,亚马逊 MGM 工作室也在去年设立了影视 AI 部门。


推荐理由:Google DeepMind 首次在影视内容创作上投入 7500 万美元,与 A24 合作开发 AI 工具,这标志着顶尖 AI 实验室开始直接渗透好莱坞核心创意流程,做文娱 AI 工具的人和关注产业交叉点的人应该留意。

6月18日

星期四 · 2 条
21:19
Google DeepMind:Blog(RSS)精选
AI 评分 65/100
保障AI智能体的未来安全

Google DeepMind发布AI Control Roadmap,这是一套针对内部先进AI智能体的系统级安全框架。该框架在传统模型对齐之上增加防线,假设AI智能体可能不对齐,通过威胁建模、沙箱隔离、端点安全、提示注入防御以及基于已验证行为逐步授予权限的机制建立信任。据估算,到2030年仅美国市场AI智能体就能创造2.9万亿美元经济价值。


推荐理由:DeepMind 首次系统性地公开了内部 AI 代理安全控制路线图,把代理当潜在「内鬼」来防的思路很务实,分析了 100 万个任务轨迹的监控实践尤其值得做 Agent 安全的人细看。
02:36
Chubby♨️@kimmonismus精选
AI 评分 79/100
Anthropic与DeepMind CEO呼吁G7组建AI联盟排除中国

Dario Amodei(Anthropic)与Demis Hassabis(Google DeepMind)在G7闭门会议上呼吁组建美国主导的联盟,为人工智能制定全球规则和标准。Amodei指出,该联盟应以前沿模型和硬件(包括芯片及其他关键组件)的访问权限为手段,将中国排除在外。这一主张被评论为高技术新冷战的开端,竞争方将从根本上被剥夺参与权。

Andrew Curran: 今天上午在 G7 闭门会议上,Dario Amodei 和 Demis Hassabis 呼吁组建一个由美国主导的联盟,以制定 AI 领域的全球标准和规则。 Dario Amodei 在发言中还表示,该联盟应构建对前沿模型及硬件--包括芯片...


推荐理由:Dario 和 Hassabis 在 G7 闭门会上提出「排除中国」的 AI 联盟,这不是商业竞争而是地缘站队,AI 行业的「两个世界」格局可能从今天开始具象化。

6月11日

星期四 · 1 条
19:42
Google DeepMind:Blog(RSS)精选
AI 评分 60/100
Google DeepMind 宣布投入 1000 万美元资助多智能体AI安全研究

Google DeepMind 与合作伙伴共同发起一项 1000 万美元的资金征集,专门用于多智能体 AI 安全方向的研究。


推荐理由:DeepMind 联合 Schmidt Sciences 等发起千万美元级多智能体安全研究资助,标志着对大规模 agent 交互中深层风险的正式关注,做 agent 安全的人可重点关注。

6月10日

星期三 · 1 条
17:28
IT之家(RSS)精选
AI 评分 70/100
谷歌 DeepMind 经济学家伊马斯:尚未发现 AI 造成岗位流失的证据,跟风裁员恐适得其反

谷歌 DeepMind AGI 经济学负责人亚历克斯·伊马斯表示,目前没有看到白领岗位因 AI 大规模消失的证据。他强调,若企业因“不裁员就等于 AI 转型慢”的叙事而跟风裁员,可能适得其反。伊马斯认为,AI 更多是接手部分任务、提升生产力,让员工专注机器无法完成的工作,岗位冲击尚未真正出现。

另有 1 家信源报道IT之家(RSS)
推荐理由:来自AI核心阵营的经济学家说‘还没证据’,这本身就值得每个担心被AI替代的人看一眼,那种‘没裁员就是落后’的FOMO叙事可能更危险。

6月9日

星期二 · 1 条
21:04
Google DeepMind:Blog(RSS)精选
AI 评分 56/100
Gemini Guided Learning 随机对照试验:在塞拉利昂等地提升参与度并加速学习

一项在塞拉利昂等地开展的随机对照试验显示,Gemini 的 Guided Learning 功能能够提升学生参与度并加速学习。


推荐理由:对教育行业是个有力信号,RCT数据扎实,但效应量不算大,且高基础学生受益更多,公平性挑战还在。

6月5日

星期五 · 1 条
22:30
Gary Marcus:The Road to AI We Can Trust(RSS)精选
AI 评分 55/100
Sir Demis Hassabis vs Sir Demis Hassabis
推荐理由:哈萨比斯在斯坦福把 AGI 时间线从达沃斯的「5-10 年」压到「2030 左右」,Gary Marcus 拎出来对比,让我看到他自己的定义也在被叙事裹挟。