Topic · 主题全部主题 →

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

1,761条收录
274条精选
● 持续更新

8月8日

星期六 · 1 条
19:12
Ars Technica:AI(RSS)精选
77
DeepMind 的 WeatherNext 飓风模型为预报员争取到额外一天预警时间

Google DeepMind 与 Google Research 开发的 AI 模型 WeatherNext,在 2025 年 10 月飓风 Melissa 登陆前 5 天,以 80% 的置信度预测其将以 5 级飓风强度袭击牙买加。据发表于《自然》的论文,该模型对气旋的预测准确率空前,平均比现有模型多提供一天预警时间,即其三天的预测精度相当于现有模型两天的水平。


推荐理由:相比现有模型,WeatherNext 在三天前的预测准确度相当于过去的 48 小时预报,这一改善意味着沿海社区能多出整整一天采取防灾措施,对高风险区域的庇护和撤离安排有实际影响。

8月7日

星期五 · 2 条
15:10
IT之家(RSS)精选
71
谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时

谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:将气旋预报时效提前24小时并开源全套模型权重,气象机构可据此提升预警窗口,影响紧急预案规划。
00:53
Google Developers Blog(RSS)精选
75
Agent Plugins 1.0.0 发布:谷歌、亚马逊、微软等支持的统一智能体插件规范

Agent Plugins 1.0.0 是一项由谷歌、亚马逊、微软等支持的中立目录规范,将 Agent Skills 和 MCP 服务器打包为单一可移植单元。通过标准化 plugin.json 清单和固定目录布局,开发者无需为不同 AI 编码智能体和 IDE 维护单独封装。谷歌已作为核心维护者加入,并在 Agents CLI 和 Data Agent Kit 中提供支持。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:此前不同AI编码代理和IDE的插件需要单独适配,Agent Plugins通过统一manifest和目录结构,使单个插件可跨工具复用,降低了多代理环境的分发成本。

8月6日

星期四 · 6 条
21:40
The Verge:AI(RSS)精选
75
Google 大规模 AI 组织调整背后的混乱政治

Google 宣布迄今最大规模 AI 组织调整:Demis Hassabis 卸任 DeepMind 日常管理以专注 AGI 研究,CTO Koray Kavukcuoglu 接任;27 年老将 Jeff Dean 与三位顶级研究员离职创办 AI 初创公司。内部员工认为调整源于产品提速压力、Hassabis 影响力下降及与美国国防部合作引发的伦理冲突。

另有 3 家信源报道The Decoder:AI News(RSS)X:阿易 AI Notes (@AYi_AInotes)Hacker News 热门(buzzing.cc 中文翻译)
推荐理由:人事变动之外,文章的核心价值在于把 Jeff Dean 离职与军方合同、伦理红线直接关联,呈现了 Google 内部产品速度与道德立场之间的张力。
21:10
IT之家(RSS)精选
71
谷歌地图 Ask Maps 智能体升级:可对话订餐、找酒店并接入 Gemini Personal Intelligence

谷歌地图宣布 Ask Maps 迎来新一轮升级,新增智能体功能,可替用户执行订餐操作,并综合考虑饮食要求、当前位置和收藏地点等信息;用户还可通过对话指定装修风格、环境氛围等条件查找酒店和当地活动。

另有 1 家信源报道TechCrunch:AI(RSS)
推荐理由:在地图导航中直接完成订餐和订房,把位置感知的便利性延伸到了生活服务的交易环节,可能改变用户对地图工具的功能预期。
06:09
MarkTechPost(RSS)精选
71
用 Google Meridian 构建端到端贝叶斯营销组合模型:媒体测量、ROI 分析与预算优化

本教程使用 Google Meridian 构建完整的贝叶斯营销组合建模工作流,涵盖数据加载、ROI 先验配置、NUTS 采样拟合及收敛性评估。通过 Analyzer API 提取渠道贡献、ROI、边际 ROI、adstock 与饱和曲线等后验指标,并计算渠道间 ROI 比较概率。最后用 BudgetOptimizer 优化固定与灵活预算,生成可分享的 HTML 报告并保存模型复用。


推荐理由:完整工作流把先验设定、后验采样、诊断和预算优化串联为可执行步骤,让营销分析团队能自行量化渠道贡献与 ROI 不确定性。
02:13
Jeff Dean@JeffDean精选
81
Jeff Dean 宣布离开谷歌,创办 DiscoLoop AI

Jeff Dean 在谷歌任职 27 年后宣布离职,将于明日正式离开。他称谷歌已从 25 人发展到 19 万余人,拥有十三款用户超十亿的产品。他将与 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 共同创办 DiscoLoop AI。

另有 10 家信源报道X:swyx (@swyx)X:Kim (@kimmonismus)X:阿易 AI Notes (@AYi_AInotes)X:Tibo (@thsottiaux)X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)TechCrunch:AI(RSS)X:Jeff Dean (@JeffDean)X:Elvis Saravia (@omarsar0, DAIR.AI)Hacker News 热门(buzzing.cc 中文翻译)X:Rohan Paul (@rohanpaul_ai)
推荐理由:27年Google生涯中,Jeff Dean参与建设了多个超过十亿用户的产品,他的离职与集体创业可能反映AI研究从大厂向独立团队的又一次转移。
01:09
00:09
Demis Hassabis@demishassabis精选
77
Demis Hassabis 转任 Google DeepMind 主席与 Alphabet 首席科学家

Demis Hassabis 宣布卸任 Google DeepMind CEO,转任主席兼 Alphabet 首席科学家,专注长期战略与科学突破,包括推进 Isomorphic 的疾病治愈研究。Koray Kavukcuoglu 将接任 GDM 高级副总裁,与 Josh Woodward 及执行团队共同领导下一阶段发展。

另有 6 家信源报道X:Kim (@kimmonismus)X:Rohan Paul (@rohanpaul_ai)IT之家(RSS)X:Sundar Pichai (@sundarpichai)Hacker News 热门(buzzing.cc 中文翻译)The Verge:AI(RSS)
推荐理由:Demis 卸任日常管理转向长期战略和科学突破,关注 AI 与疾病治疗融合的读者可留意其后续对 Isomorphic 和基础研究的投入分配。

8月5日

星期三 · 3 条
19:08
IT之家(RSS)精选
78
Google Assistant 下月起逐步退场,"Hey Google"将由谷歌 Gemini 接棒

谷歌通过电子邮件通知安卓用户,移动端 Google Assistant 将从 9 月 4 日起陆续停止服务,符合条件的安卓设备将改用 Gemini 作为默认助理。设备完成切换后,用户无法再通过手机、平板电脑或配对设备使用 Google Assistant,也不能切回原有服务。与手机配对的 Wear OS 手表及受支持的头戴式耳机和入耳式耳机也将同步改用 Gemini。

另有 3 家信源报道Ars Technica:AI(RSS)The Decoder:AI News(RSS)The Verge:AI(RSS)
推荐理由:迁移时间表与例外条件明确后,依赖语音助理的安卓及 Wear OS 用户可以判断自己的设备是否需提前做兼容预案。
00:45
Google Developers Blog(RSS)精选
61
Google Cloud API Gateway 推出统一模型路由功能,支持 Gemini、Claude 与 OpenAI OSS-GPT

Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无需硬编码端点或管理开源代理。网关作为无服务器入口层,接受标准 OpenAI 兼容请求,自动将负载转码为目标模型的原生格式并动态路由流量。


推荐理由:将模型路由规则直接内嵌到 OpenAPI 规范中,减少了多模型调度时的入口适配工作,也无需自行维护代理层。
00:33
Google Cloud:Databases(RSS)精选
60
Google Cloud 推出 Database Operations Agents,实现自主数据库管理

Google Cloud 在 Agentic Data Cloud 发布中推出两款 AI 数据库智能体:Database Onboarding Agent 负责 Day 0 的配置与部署,Database Observability Agent 负责 Day 1/2 的监控、故障排查与维护。


推荐理由:数据库代理将排错和调优从手动查找变为自然语言交互,DevOps团队可能因此缩短平均恢复时间。

8月3日

星期一 · 1 条
23:30
Google AI:DEV 作者专属(RSS)精选
63
Google Agent Skills 幕后:如何构建、测试与规模化

Google Agent Skills 团队详解其开源技能库的构建与治理流程:项目始于 Google Cloud Next 2026 前的“swarm”冲刺,发布后 GitHub 星标超 15,000。为保证规模化下的质量,每个技能须通过标准化目录结构、CI/CD 流水线(含 linter、链接检查、AI 辅助清单)及提交时与每周的持续评估,并优先引用远程 MCP 工具。


推荐理由:标准化目录、自动化链接检查和持续评估的完整流程,可帮助团队避免技能库随规模扩大而失控。

7月31日

星期五 · 4 条
22:28
Google AI:DEV 作者专属(RSS)精选
68
教程:用 Antigravity SDK 与 Google Cloud 构建自主财务审计智能体团队

本教程演示如何用 Google Antigravity SDK 与 Google Cloud 构建多智能体财务对账系统,将供应商交易与 PDF 发票核对。系统由审计编排器、数据研究员、发票分析器和对账引擎四个智能体组成,并设有人工合规门控,将超过 $1,000 的差异升级人工审核。


推荐理由:这是一篇完整的多智能体财务审计实战,从零搭建到部署全链路,代码和架构图齐全。想做企业级 Agent 的开发者能直接复用其中最小权限、安全护栏和可观测性模式。
08:00
HuggingFace Daily Papers(社区热门论文)精选
80
DiffusionGemma 技术报告:基于离散扩散的高效文本生成模型

DiffusionGemma 是一个实验性开源权重语言模型,通过离散扩散并行迭代精炼 256 个 token 的块,而非逐 token 解码,从而避免自回归模型的顺序解码瓶颈。


推荐理由:扩散生成首次在文本领域将吞吐推高至约1500 token/s,此前这类速度仅见于非文本生成架构,为实时交互和批量生成场景提供了新的可行上限。
04:28
03:16
Google AI@GoogleAI精选
69
Google Earth 集成 Nano Banana 2 图像生成

Google Earth 网页版上线基于 Nano Banana 2 的图像生成功能,用户可通过文本提示词将卫星与 3D 影像结合,重新想象全球任意地点(如百年前的城市风貌或社区新球场)。该功能现已面向所有用户开放。


推荐理由:Google 把图像生成塞进地球,直接用 Nano Banana 2 在卫星图上创作,门槛低得谁都能玩,做城市设计或创意提案的人可以立刻试试。

7月30日

星期四 · 5 条
23:50
LMSYS:Blog(Chatbot Arena 团队)精选
61
RadixArk 与 Google Cloud 合作,将完整 SGLang 功能引入 TPU

RadixArk 与 Google Cloud 合作,将开源推理框架 SGLang 引入 Google TPU,开发者可通过 SGL-JAX 在最新 TPU 上运行 Gemma、Qwen、DeepSeek 等大语言模型及多模态模型。


推荐理由:SGLang 正式登陆 TPU,推理框架的硬件自由终于实现,选 GPU 还是 TPU 从此只看性价比不看兼容性,做推理服务的团队可以重新算账了。
23:27
Google DeepMind:Blog(RSS)精选
60
Gemini Robotics ER 2:用视频理解、任务编排与多机器人协作赋能机器人

Google DeepMind 推出 Gemini Robotics ER 2,一个基于 Gemini 的机器人基础模型。该模型在视频理解、工具编排和多机器人协作方面实现阶跃式提升,使机器人能够推理、协作并解决真实世界任务。

另有 4 家信源报道IT之家(RSS)Ars Technica:AI(RSS)X:Google AI for Developers (@googleaidevs)X:Testing Catalog (@testingcatalog)
推荐理由:DeepMind 把 Gemini 带到机器人领域,视频理解、任务编排和多机协作的叙事很宏大,但全是愿景,没有实测数据,是不是真正的 step change 得等细节。做机器人的可以先建个追踪。
23:16
Google DeepMind@GoogleDeepMind精选
71
One brain. For any robot. 🤖我们正在推出 Gemini Robotics 2:我们的下一代物理 AI,为仿人机器人带来全身智能、高级灵巧性、多机器人团队协作等能力。
另有 7 家信源报道X:Kim (@kimmonismus)X:Google AI (@GoogleAI)MarkTechPost(RSS)Ars Technica:AI(RSS)X:Demis Hassabis (@demishassabis)The Verge:AI(RSS)The Decoder:AI News(RSS)
推荐理由:这是谷歌把通用大模型能力注入机器人的关键一步,全身智能和灵巧操作如果能兑现,制造业的自动化想象会彻底改写。
00:26
Google DeepMind:Blog(RSS)精选
63
Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制

Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5,带来音乐性、歌词质量、人声表现力与创作控制的多项提升。新模型能生成更自然复杂的旋律结构,歌词对提示词的遵循度和结构意识更强,人声更逼真且富有情感,同时支持更便捷地控制输出节奏与时长。

另有 2 家信源报道IT之家(RSS)The Decoder:AI News(RSS)
推荐理由:Lyria 3.5 把音乐生成从玩具级推到了可用创作工具级别,歌词和情感人声的提升对内容创作者是实实在在的福音。
00:00
Google Research:Blog(网页)精选
76
Science One Framework:通过 Chain-of-Evidence 实现可验证的自主科研框架

Google Research 推出 Science One Framework,一个原生构建证据链的自主科研原型,旨在消除模型幻觉,并配套自动化评估协议 CoE Audit。


推荐理由:对自主科研系统而言,可验证性从后置修补变为前置架构,提出的审计方法让生成论文的完整性有了可量化的衡量尺度。

7月29日

星期三 · 1 条
00:27
Google Blog:AI(RSS)精选
72
Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐

Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini 3.6 Flash,并支持显式选择 3.5 Flash 或 3.5 Flash-Lite。新增环境钩子允许在沙箱内工具调用前后执行自定义脚本,用于安全审查或代码格式化。此外,还推出了免费套餐、预算控制和基于 cron 的定时触发功能。


推荐理由:Gemini 的 managed agents 把钩子机制和预算控制做进了官方 API,对重度依赖 agent 做代码审计和任务的团队是个实用升级,Offdeal 已经用上了。

7月28日

星期二 · 2 条
21:27
Google Blog:AI(RSS)精选
71
Google Search 的 AI Mode 推出 5 项新功能,帮你规划线下生活

Google Search 的 AI Mode 新增 5 项工具,帮助用户规划线下活动。功能包括:通过 Personal Intelligence 连接 Google Calendar 推荐本地课程;在 AI Mode 内直接购物并查询附近库存;利用 Canvas 生成桌游策略指南并模拟对弈;根据预算和人数筛选并预订演唱会等门票;连接 Canva 生成邀请函设计。


推荐理由:Google搜索的AI Mode把线下生活场景串起来了,从找课到订票都是实用教程,对普通用户比单纯benchmark更有体感,看完就能照着做。
00:25
TechCrunch:AI(RSS)精选
76
Google AI Overviews 搜索结果出现率升至43%

Google AI Overviews 在搜索结果中的出现率一年内从15%升至43%,AI Mode月访问量从1.26亿增至2.79亿。用户搜索长度增加,正从短关键词转向更长的自然对话式查询。

另有 1 家信源报道Artificial Intelligence News(RSS)
推荐理由:Similarweb 的数据坐实了搜索范式的代际切换,Google 从链接跳板变成终点站。网站主和 SEO 从业者该认真对待 AI 引文不带来点击的现实了。

7月26日

星期日 · 1 条
14:11
Google AI:DEV 作者专属(RSS)精选
68
Gemini 3.6 Flash 登陆 Google Cloud 数据库:更快更便宜

Google Cloud 数据库现已支持 Gemini 3.6 Flash,该模型知识截止日期约为今年 3 月底,且成本更低。在 Cloud SQL for Postgres 的基准测试中,Gemini 3.6 Flash 平均延迟 3694.53ms,快于 Gemini 3.5 Flash 的 4918.86ms;在 AlloyDB 中两者响应时间几乎相同。


推荐理由:在Cloud SQL和AlloyDB环境中的实测表明,Gemini 3.5 Flash Lite以7倍速度与接近满分质量,为简单任务提供了更经济的选项,但样本量小且评判模型自带偏好,结论需谨慎采纳。

7月23日

星期四 · 4 条
23:24
TechCrunch:AI(RSS)精选
72
Google Gemini 月活用户逼近 9.5 亿,有望成为下一个十亿级产品

Google 在 Q2 2026 财报电话会上宣布,AI 助手 Gemini 月活跃用户已超过 9.5 亿,用户数较去年增长三倍。Gemini 正与月活突破 10 亿的 ChatGPT 展开更直接竞争,其 AI 搜索模式用户也已超过 10 亿。Sensor Tower 报告显示,Gemini 在 AI 助手市场份额升至 27.7%,而 ChatGPT 份额首次跌破 50%。


推荐理由:Gemini 快 10 亿用户了,ChatGPT 份额跌破 50%,双雄争霸格局成形。谷歌把搜索和 AI 助手绑在一起,这个策略比 OpenAI 更稳。
19:11
Google AI:DEV 作者专属(RSS)精选
61
Google Cloud Agent Skills 完整指南:从基础到高级云运维

Google Cloud 推出官方 Agent Skills 开源指令集,旨在让 AI 编码智能体安全、高效地执行多步骤云操作。该仓库基于 agentskills.io 开放标准,目前收录 70 多项技能,涵盖安全审计、无服务器部署、BigQuery 优化等 8 个类别。技能采用渐进式披露模型,通过验证工作流、安全门控和上下文感知机制,防止智能体盲目执行破坏性命令。


推荐理由:这是 Google Cloud Skills 系列教程第一篇,从安装到触发讲得很细,把 Agent Skills 的“渐进式披露”和安全门机制都拆解了,适合想让 AI 编码代理帮你管云资源的开发者。
17:25
Google AI:DEV 作者专属(RSS)精选
73
Gemini 3.6 Flash 与 3.5 Flash-Lite 正式版发布

Google 发布 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 正式版。3.6 Flash 在复杂智能体和多模态任务上性能更强,输出 token 价格降至 $7.50/1M,支持 1M token 上下文窗口和 Computer Use 工具。


推荐理由:Gemini 3.6 Flash 降本增效,3.5 Flash-Lite 主打低成本高速,弃用 temperature 等参数是个硬变更,使用 Gemini 的开发者必须检查迁移。
04:25
Sundar Pichai@sundarpichai精选
62
Alphabet Q2:AI 投资推动营收增长 24%,Gemini 月活达 9.5 亿

Alphabet Q2 营收同比增长 24%,Google Cloud 增速达 82%。Gemini 应用月活跃用户达 9.5 亿,模型 API 处理量升至 220 亿 token/分钟,由 Flash 模型驱动。Gemini Enterprise 已被 90% 的财富 100 强企业采用。

另有 3 家信源报道X:Rohan Paul (@rohanpaul_ai)TechCrunch:AI(RSS)IT之家(RSS)
推荐理由:Google 这份季报显示 AI 正在变成真金白银的驱动引擎,云业务 82% 增长和 Gemini 近 10 亿用户是硬信号,做 AI 应用的人该看看风向。

7月22日

星期三 · 4 条
00:22
Josh Woodward@joshwoodward精选
69
Google 推出三款新模型,旨在提升性能、降低延迟和成本。其中,3.6 Flash 在复杂编码任务上 token 用量最高减少 65%,3.5 Flash-Lite 速度达 350 输出 token/秒。3.6 Flash 和 3.5 Flash-Lite 已在 Gemini 应用上线,3.5 Pro 进入合作伙伴测试。

Google DeepMind: We're rolling out three new models to make AI agents faster, smarter, and cheaper at scale: 🔵 Gemini 3.6 Flash: It uses...

另有 18 家信源报道X:Google AI (@GoogleAI)X:Logan Kilpatrick (@OfficialLoganK)X:Artificial Analysis (@ArtificialAnlys)MarkTechPost(RSS)Ars Technica:AI(RSS)The Verge:AI(RSS)X:Google DeepMind (@GoogleDeepMind)Google DeepMind:Blog(RSS)Artificial Intelligence News(RSS)TechCrunch:AI(RSS)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Jeff Dean (@JeffDean)X:fofr (@fofrAI)X:Gemini (@GeminiApp)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)
推荐理由:Google一口气扔出三个Gemini Flash新模型,3.6 Flash把复杂编码token砍了65%,做Agent的成本敏感型选手可以直接收益,Cyber模型专攻漏洞修复是个有意思的细分信号。
00:00
Google Developers Blog(RSS)精选
63
Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库

Google 发布 Tunix,一个基于 JAX 的原生后训练库,旨在消除多轮、使用工具的 LLM 推理智能体训练中的 TPU 闲置瓶颈。Tunix 通过高并发异步 rollout 与解耦的生产者-消费者流水线最大化硬件吞吐量,确保训练器持续获得数据。该库提供即插即用抽象和持续宏观级性能分析,便于集成自定义环境。


推荐理由:Google 这个训练库直接解决 agent 训练中 TPU 空转的隐性成本,对做后训练的团队可能是基础设施级改进,值得跟进。
00:00
Google Cloud:Databases(RSS)精选
71
AlloyDB 推出列式引擎加速 HNSW,pgvector 向量搜索 QPS 提升最高 4.9 倍

Google Cloud 的 AlloyDB 在预览版中推出列式引擎加速的 HNSW 索引,使 pgvector 向量搜索的每秒查询数(QPS)相比标准 PostgreSQL HNSW 提升最高 4.9 倍,在固定 QPS 下召回率可提升 0.163。该加速通过将索引固定在列式引擎内存中、使用向量化内存布局并绕过标准 PostgreSQL 缓冲管理器开销实现,无需修改应用即可获得性能提升。


推荐理由:AlloyDB 把 pgvector 的 HNSW 搜索提速 4 倍,不是靠 GPU 而是靠内存架构,对已经在 PostgreSQL 上跑 RAG 的团队可能是个省钱又提精度的实用升级,点开看看基准测试。

7月21日

星期二 · 1 条
23:22
Google DeepMind:Blog(RSS)精选
57
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 三款新模型

Google DeepMind 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 Gemini 3.6 Flash 为最新主力模型,3.5 Flash-Lite 主打更低成本与更高效率,3.5 Flash Cyber 则针对网络安全场景优化。三款模型均通过 Google AI 开发者平台提供 API 访问。

另有 18 家信源报道X:Google AI (@GoogleAI)X:Logan Kilpatrick (@OfficialLoganK)X:Artificial Analysis (@ArtificialAnlys)MarkTechPost(RSS)Ars Technica:AI(RSS)The Verge:AI(RSS)X:Google DeepMind (@GoogleDeepMind)Google DeepMind:Blog(RSS)Artificial Intelligence News(RSS)TechCrunch:AI(RSS)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Jeff Dean (@JeffDean)X:fofr (@fofrAI)X:Gemini (@GeminiApp)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)
推荐理由:Gemini Flash 系列常规更新,Flash-Lite 和 Cyber 变体值得 API 开发者留意,但细节还没出来,目前只能先标记。

7月17日

星期五 · 1 条
00:32
Google Blog:AI(RSS)精选
60
Google Vids 上线 Gemini Omni 与个人数字分身功能

Google Vids 推出两项更新:Gemini Omni 支持用户通过自然语言提示词和图片参考生成、逐步编辑高质量视频片段;个人数字分身功能允许用户上传自拍和语音录制后,输入文字即可让数字分身出镜。两项功能面向 Google AI Pro 和 Ultra 订阅者及 Google Workspace 商业客户开放,所有生成内容均含不可见的 SynthID 数字水印。


推荐理由:如果你已经在用 Google Workspace,这两个更新让 Vids 的可用性提升了一档,但对于外部的 AI 视频生成,没带来新变量。

7月16日

星期四 · 4 条
22:27
Google AI:DEV 作者专属(RSS)精选
72
DiffusionGemma 开发者指南发布

Google AI 发布 DiffusionGemma 开发者指南,该实验性模型基于 Gemma 4 架构,采用计算受限并行生成,在单张 NVIDIA H100 上实现 1000+ tokens/秒的生成速度。模型为 26B 参数的 MoE 架构,推理时仅激活 3.8B 参数,可在 18 GB VRAM 内量化部署。


推荐理由:虽然 DiffusionGemma 是实验性的,但把文本生成从内存带宽瓶颈转向计算瓶颈的思路非常新颖,这篇指南给出了可落地的服务方案和微调手法,做推理优化的值得跟进。
20:10
The Verge:AI(RSS)精选
78
欧盟裁定 Google 必须向竞争对手开放 Android 和 Search,影响 Gemini 等 AI 服务

欧盟依据《数字市场法案》(DMA)裁定 Google 必须向竞争对手开放 Android 和 Google Search 的关键部分,包括允许第三方 AI 助手和搜索引擎获得更大访问权限。这两项决定可能削弱 Google 对两大核心平台的控制,并为其 AI 工具 Gemini 的未来格局带来深远影响,同时为竞争对手创造新的发展机会。


推荐理由:欧盟这两项裁决直接撬开了谷歌安卓和搜索的围墙,对Gemini等AI助手的地位是实质冲击,做AI应用和搜索的创业者值得盯着后续执行细节。
17:58
Google Developers Blog(RSS)精选
60
Gemini Enterprise Agent Platform 新增 Parallel Web Search 网络接地提供商

Google Cloud 与 Parallel Web Systems 合作,将 Parallel 的搜索基础设施作为新的网络接地提供商原生集成到 Gemini Enterprise Agent Platform 中。该集成使开发者能将 AI 智能体锚定在可验证的实时网络结果上,以提升企业工作流的事实准确性。用户还可编程提取、永久缓存并与其他大语言模型一起处理网络数据。


推荐理由:为 Gemini Agent 平台引入第三方搜索 grounding,企业开发者多了一个直接可用的实时事实核查选项,虽非重大突破,但对做合规和知识库场景的团队是个实用更新。
04:02
Hacker News 热门(buzzing.cc 中文翻译)精选
73
前谷歌DeepMind研究员因公司签署无限制军事AI协议而离职

前谷歌DeepMind研究员Alex Turner因谷歌向国土安全部出售云服务并最终签署无限制军事AI协议而离职。他曾起草25页提案要求加入禁止杀手机器人和大规模监控的合同条款,但提案被CEO转交后无人跟进。Turner指出,包括Jeff Dean和Stuart Russell在内的多位AI伦理领袖在关键时刻未能兑现承诺。


推荐理由:Alex Turner用亲身经历戳穿了AI巨头们的伦理承诺,Jeff Dean、Stuart Russell等名人在关键时刻失声,这份记录比任何声明都真实。