数学家 Timothy Gowers 和 Peter Sarnak 认为,大语言模型擅长组合已知方法并探索多条搜索路径,但缺乏在广阔搜索空间中挑选少数有效路径的直觉,难以产生真正的新想法。
数学家 Timothy Gowers 和 Peter Sarnak 认为,大语言模型擅长组合已知方法并探索多条搜索路径,但缺乏在广阔搜索空间中挑选少数有效路径的直觉,难以产生真正的新想法。
智谱正式发布 GLM-5.3,称其为编程能力最强的开源模型,较 GLM-5.2 提升 50%。基座模型未变,但通过后训练 Scaling 提高智能上界,包括数十倍的长程任务环境、更丰富多样的环境类型和超长的后训练时间。
未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。
另有 1 家信源报道X:Anthropic (@AnthropicAI)Google 上周重组 AI 部门 Google DeepMind:首席科学家 Jeff Dean 离职创业,DeepMind CEO Demis Hassabis 转任董事长专注长期研究。
路透社援引知情人士称,谷歌下一代旗舰 Gemini 模型发布时间已推迟约两个月,内部测试显示其在编程等关键能力上仍落后于竞争对手。开发团队存在多名项目负责人、内讧不断,算力紧张与协调问题叠加,使编程方向一度资源不足。8 月 5 日 DeepMind 大规模调整,哈萨比斯转任董事长,卡武库奥卢接任主要管理并拥有最终决定权,布林则敦促加快开发并推动“递归自我改进”研究。
另有 1 家信源报道X:Kim (@kimmonismus)谷歌 DeepMind 推出一款大规模多语言手语转文本(SL2T)翻译模型,使手语 AI 首次进入消费级产品。该模型已在谷歌 Pixel 11 系列手机的 Gboard 和 Live Transcribe 中支持手语转文本输入,初期仅限美国手语。模型在超过 50 种手语的 10 万小时数据上训练,通过将手语转化为姿势特征点保护隐私,无需发送原始视频流。
另有 3 家信源报道X:Google DeepMind (@GoogleDeepMind)X:Sundar Pichai (@sundarpichai)X:Demis Hassabis (@demishassabis)知情人士称,谷歌联合创始人布林近几个月敦促 DeepMind 员工全力投入 Gemini 模型,以缩小与 Anthropic 的差距。因内部测试显示新旗舰版本在编程等领域仍落后,谷歌将发布时间推迟两个月。8 月 5 日 DeepMind 换帅,哈萨比斯转任董事长,卡武克丘奥鲁接任 CEO,部分团队将并入谷歌公司。
另有 1 家信源报道X:Kim (@kimmonismus)Google DeepMind 发布手语转文本(SL2T)模型,为聋哑及听障用户提供新的手语功能。该模型是此次发布的突破性技术核心,旨在将手语实时转化为文本,帮助用户更顺畅地沟通。目前尚未公布具体参数规模、基准测试分数或可用性细节。
外媒报道称,2024年诺贝尔化学奖得主Demis Hassabis在Alphabet近期AI高管变动前曾有意离职,本想与Jeff Dean同步离开,但Alphabet认为短时间内失去两位AI业务领袖会导致股价崩盘。
Google DeepMind 推出 WeatherNext Cyclones(WN-C),可同时预测热带气旋路径与强度,五天路径误差平均 230 公里,优于 ECMWF ENS 的 370 公里。该模型基于 Functional Generative Networks,单次前向传播即可生成预测,速度比扩散模型快 8 倍,代码与权重已在 GitHub 开源。
同一事件,精选展示《谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时》DeepMind 的 WeatherNext 模型在气旋预报上实现突破,相关成果已发布在 deepmind.google。该模型在预测准确率上表现显著,为气象预报领域带来新的进展。
Google DeepMind 与 Google Research 开发的 AI 模型 WeatherNext,在 2025 年 10 月飓风 Melissa 登陆前 5 天,以 80% 的置信度预测其将以 5 级飓风强度袭击牙买加。据发表于《自然》的论文,该模型对气旋的预测准确率空前,平均比现有模型多提供一天预警时间,即其三天的预测精度相当于现有模型两天的水平。
The Vergecast 本期讨论 Google AI 团队领导层变动,包括传奇工程师 Jeff Dean 离开 Google,并探讨这是否预示 Google 在 AI 竞赛中陷入动荡。节目还谈及 Google 与 Reddit 的相互依赖关系及其潜在问题,以及 Disney+ 内容扩张、BMW 车载广告等话题。
谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。
谷歌 DeepMind 持续出现顶尖 AI 研究员离职,Semafor 与 CNBC 披露了背后原因。CEO Demis Hassabis 约一年前已退出日常运营,交由新任负责人 Koray Kavukcuoglu 接管。许多研究员因谷歌 TPU 芯片访问受限而不满,且谷歌云将这些芯片出售给 Anthropic 等竞争对手,同时公司官僚作风也让年轻公司更具吸引力。
Google 宣布迄今最大规模 AI 组织调整:Demis Hassabis 卸任 DeepMind 日常管理以专注 AGI 研究,CTO Koray Kavukcuoglu 接任;27 年老将 Jeff Dean 与三位顶级研究员离职创办 AI 初创公司。内部员工认为调整源于产品提速压力、Hassabis 影响力下降及与美国国防部合作引发的伦理冲突。
另有 3 家信源报道The Decoder:AI News(RSS)X:阿易 AI Notes (@AYi_AInotes)Hacker News 热门(buzzing.cc 中文翻译)谷歌DeepMind宣布重大人事调整:德米斯·哈萨比斯从CEO转任Google DeepMind董事长兼Alphabet首席科学家,继续领导Isomorphic Labs;现任CTO Koray Kavukcuoglu升任Google DeepMind高级副总裁,负责Gemini模型开发与前沿AI研究。
同一事件,精选展示《Demis Hassabis 转任 Google DeepMind 主席与 Alphabet 首席科学家》Google CEO Sundar Pichai 周三宣布,AI 负责人 Demis Hassabis 将卸任现职,转任 Google DeepMind 主席及 Alphabet 首席科学家,同时继续领导药物研发公司 Isomorphic Labs。
同一事件,精选展示《Demis Hassabis 转任 Google DeepMind 主席与 Alphabet 首席科学家》Google DeepMind CEO 德米斯·哈萨比斯即将卸任。该消息由 Axios 报道,并在 Hacker News 上获得超过 125 点热度。目前尚未公布继任者或具体离职时间等细节。
OpenAI Codex 工程负责人蒂博·索蒂奥爆料,谷歌 DeepMind 曾在 ChatGPT 发布一年前做出类似产品 LMChat,但最终未发布。原因是公司担心该产品与谷歌搜索互相竞争,且规定 DeepMind 不能发布可能颠覆 Google 现有业务的产品。谷歌员工杰夫·迪恩也曾表示,公司认为该聊天机器人并不比谷歌搜索更好。
Google DeepMind 发布 Gemini Robotics 2,称其为迄今最先进的视觉-语言-动作(VLA)模型,可控制从桌面机械臂到全身人形机器人的各类系统。该模型支持全身运动、精细操作及多机器人协同,开发者可通过候补名单申请早期访问。同期发布的 Gemini Robotics ER 2 专为具身推理设计,已上线 Google AI Studio。
另有 6 家信源报道Ars Technica:AI(RSS)The Verge:AI(RSS)X:Google AI (@GoogleAI)X:Demis Hassabis (@demishassabis)X:Google DeepMind (@GoogleDeepMind)X:Kim (@kimmonismus)谷歌 DeepMind 发布 Gemini Robotics ER 2,这是其面向机器人的最强具身推理模型。相比 1.6 版本,ER 2 可分析连续视频流以追踪任务进度、在出错时调整,并在任务进度分类测试中准确率达 57.4%,时刻寻找测试中准确率为 91.3%。该模型执行速度为更大模型的 4 倍,支持多机器人协作,现已通过 Gemini API 和 Google AI Studio 公开提供。
同一事件,精选展示《Gemini Robotics ER 2:用视频理解、任务编排与多机器人协作赋能机器人》前 OpenAI 研究员 Andrew Ho 创立新公司,专门为生物信息学和日常实验室工作构建高质量训练数据集。他认为仅靠扩大大语言模型规模无法实现真正的泛化能力,并预测 AI 实验室未来需投入超 1000 亿美元用于针对性数据收集。剑桥大学和 Google DeepMind 的研究也支持这一观点,发现当前 AI 系统正趋向于更专业化而非通用化,在创造性问题解决上遇到瓶颈。
Google DeepMind 发布 Gemini Robotics 2,作为其下一代机器人的智能层。该版本包含三个模型:用于全身人形控制的视觉-语言-动作模型、用于具身推理与任务编排的 Gemini Robotics ER 2,以及可在数小时内适配新机器人本体的端侧 VLA。单个检查点驱动 Apptronik Apollo 2 与 Franka Duo,仅 ER 2 公开可用。
另有 6 家信源报道Ars Technica:AI(RSS)The Verge:AI(RSS)X:Google AI (@GoogleAI)X:Demis Hassabis (@demishassabis)X:Google DeepMind (@GoogleDeepMind)X:Kim (@kimmonismus)Google DeepMind 发布 Gemini Robotics 2,为机器人赋予全身智能。该模型基于 Gemini 架构,使机器人能协调手臂、躯干和腿部动作以完成复杂任务,并具备物体操控与环境适应能力。目前尚未公布具体参数规模、上下文长度及可用性细节。
Google DeepMind 推出 Gemini Robotics ER 2,一个基于 Gemini 的机器人基础模型。该模型在视频理解、工具编排和多机器人协作方面实现阶跃式提升,使机器人能够推理、协作并解决真实世界任务。
另有 3 家信源报道Ars Technica:AI(RSS)X:Google AI for Developers (@googleaidevs)X:Testing Catalog (@testingcatalog)Google DeepMind 的 Tom Zahavy 在一篇立场论文中认为,大语言模型缺乏创造全新科学理论的认知机制,无法实现“操控性溯因”——即发明尚无语言模板的新原因。他指出,Einstein 和 Archimedes 的突破源于具身模拟,而语言模型如同“中文屋”般仅处理符号。Zahavy 提出,像 Genie 这类可交互的世界模型或许能通过模拟反事实实验,为发明新公理提供反馈回路。
Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5,带来音乐性、歌词质量、人声表现力与创作控制的多项提升。新模型能生成更自然复杂的旋律结构,歌词对提示词的遵循度和结构意识更强,人声更逼真且富有情感,同时支持更便捷地控制输出节奏与时长。
另有 2 家信源报道The Decoder:AI News(RSS)IT之家(RSS)Google DeepMind 已解散 AlphaFold 团队,多数原论文作者在过去一年内被内部重新分配,近四分之一全职作者已离职。联合创始人 John Jumper 与另两位同事 Jonas Adler、Alexander Pritzel 上月加入 Anthropic。DeepMind 战略从专注蛋白质折叠等单一科学挑战转向构建基于 Gemini 的 AI 科学助手及前沿 AI 智能体。
谷歌旗下DeepMind已解散其诺贝尔奖获奖AI系统AlphaFold背后的团队,过去一年里大多数原始作者被重新分配到其他团队。这些员工已内部转岗至围绕Gemini大语言模型构建的项目,以及酶设计、核聚变和基因组学等领域。AlphaFold原始论文的全职作者中近四分之一已离开公司,包括联合负责人江珀已离职前往Anthropic。
北京大学生命科学学院伊成器课题组联合华东师大团队,在《自然》发表论文,提出基于AlphaFold3接触概率(CP)的AI框架ContactSeek。该框架整合AlphaFold3预测的CP与高通量脱靶编辑数据,系统识别Cas蛋白和脱氨酶中决定编辑特异性的关键氨基酸残基,并据此工程化改造碱基编辑工具。研究鉴定出一系列可提升ABE精准性的全新Cas9变体,在维持高效在靶编辑的同时降低DNA脱靶编辑。
研究人员改造了 AI 蛋白质折叠软件 AlphaFold,用于识别基因编辑蛋白中导致脱靶效应的关键区域,并对这些区域进行修改以降低脱靶率。该成果发表于《自然》期刊,旨在解决基因编辑疗法中因人类基因组庞大而难以避免的脱靶编辑问题。
中国科学院遗传与发育生物学研究所高彩霞团队首次提出“可编程植物合成免疫”新理念,并建立合成植物免疫受体设计平台。团队利用AlphaFold 3和BindCraft等AI工具,针对13种植物病毒及细菌、真菌等病原蛋白设计391个合成受体,其中71个(成功率18.2%)能特异识别靶标并激活免疫反应。经植物体内定向进化系统(GRAPE)优化的合成受体在转基因本氏烟草中展现了对番茄褐色皱果病毒的有效抗性。
Google 承诺为 Genesis Mission 提供 4000 万美元的 AI tokens 和 credits,以加速科学发现的前沿探索。这笔资金将用于支持研究人员利用 AI 工具推动生物学、化学和材料科学等领域的突破。Genesis Mission 旨在通过大规模 AI 计算资源,解决人类面临的最紧迫科学挑战。
Google DeepMind 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 Gemini 3.6 Flash 为最新主力模型,3.5 Flash-Lite 主打更低成本与更高效率,3.5 Flash Cyber 则针对网络安全场景优化。三款模型均通过 Google AI 开发者平台提供 API 访问。
另有 19 家信源报道X:Google AI (@GoogleAI)X:Logan Kilpatrick (@OfficialLoganK)X:Artificial Analysis (@ArtificialAnlys)MarkTechPost(RSS)Ars Technica:AI(RSS)The Verge:AI(RSS)X:Google DeepMind (@GoogleDeepMind)Google DeepMind:Blog(RSS)Artificial Intelligence News(RSS)TechCrunch:AI(RSS)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Josh Woodward (@joshwoodward, Google Labs VP)X:Jeff Dean (@JeffDean)X:fofr (@fofrAI)X:Gemini (@GeminiApp)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)谷歌 DeepMind 发布 GenCeption 模型,将预训练视频生成器逆向改造成单一模型,可同时完成深度估计、图像分割等核心视觉任务。该模型基于阿里 Wan2.1 训练,一次前向传播即可输出结果,小模型处理 81 帧视频约需 6 秒。
2026 年 5 月,ChatGPT 推翻了离散几何中的 Erdős 单位距离猜想,构造出反例。一周后,Logical Intelligence 的 AI 系统将该证明自动形式化为 Lean 代码。6 月,OpenAI 的 Sol 模型在无任何数学公理假设下完成了完整形式化,生成 120 万行 Lean 代码,证明中涉及百页以上的全局类域论定理。
非营利组织 Current AI 正构建类似万维网的免费公共 AI 替代方案,已获法国政府、福特基金会、DeepMind 等机构共计 4 亿美元资助。其最新成果包括与印度政府合作的离线设备 Suno Sutra(支持 22 种印度语言),以及开源聊天机器人 Alpha Chat。
Google DeepMind 提出 GenCeption,将阿里巴巴开源的 Wan2.1 视频生成模型改造为单次前向传播即可完成深度估计、分割等任务的模型。它仅用 7,500 段合成视频训练,数据量仅为竞品的 1/7 至 1/500,但在多个基准上匹配甚至超越了 DepthAnything 3 等专用模型。
谷歌 DeepMind CEO 德米斯·哈萨比斯表示,AI 虽在重塑科技行业,但 STEM 学位不会因此失去价值。他认为掌握软件和计算机科学基础知识能帮助人们更有效使用 AI,深入理解技术的人使用 AI 工具的效率可能达到缺乏基础者的 10 倍。哈萨比斯同时指出,AI 时代也需要伦理学、社会科学等人文学科。