Gemini 3.7 Flash is here. It's stronger for coding, knowledge work, and web development. 🧵
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》Gemini 3.7 Flash is here. It's stronger for coding, knowledge work, and web development. 🧵
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》Gemini 3.7 Flash is here. It's stronger for coding, knowledge work, and web development. 🧵
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》SL2T is our breakthrough sign language-to-text model powering new features for Deaf and hard of hearing users on @Androi...
另有 2 家信源报道X:Google DeepMind (@GoogleDeepMind)X:Sundar Pichai (@sundarpichai)谷歌 DeepMind 推出一款大规模多语言手语转文本(SL2T)翻译模型,使手语 AI 首次进入消费级产品。该模型已在谷歌 Pixel 11 系列手机的 Gboard 和 Live Transcribe 中支持手语转文本输入,初期仅限美国手语。模型在超过 50 种手语的 10 万小时数据上训练,通过将手语转化为姿势特征点保护隐私,无需发送原始视频流。
另有 2 家信源报道X:Google DeepMind (@GoogleDeepMind)X:Sundar Pichai (@sundarpichai)Google DeepMind 发布手语转文本(SL2T)模型,为聋哑及听障用户提供新的手语功能。该模型是此次发布的突破性技术核心,旨在将手语实时转化为文本,帮助用户更顺畅地沟通。目前尚未公布具体参数规模、基准测试分数或可用性细节。
DeepMind 的 WeatherNext 模型在气旋预报上实现突破,相关成果已发布在 deepmind.google。该模型在预测准确率上表现显著,为气象预报领域带来新的进展。
谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。
另有 1 家信源报道The Decoder:AI News(RSS)Google DeepMind 发布 Gemini Robotics 2,称其为迄今最先进的视觉-语言-动作(VLA)模型,可控制从桌面机械臂到全身人形机器人的各类系统。该模型支持全身运动、精细操作及多机器人协同,开发者可通过候补名单申请早期访问。同期发布的 Gemini Robotics ER 2 专为具身推理设计,已上线 Google AI Studio。
另有 3 家信源报道Ars Technica:AI(RSS)The Verge:AI(RSS)X:Demis Hassabis (@demishassabis)谷歌 DeepMind 发布 Gemini Robotics ER 2,这是其面向机器人的最强具身推理模型。相比 1.6 版本,ER 2 可分析连续视频流以追踪任务进度、在出错时调整,并在任务进度分类测试中准确率达 57.4%,时刻寻找测试中准确率为 91.3%。该模型执行速度为更大模型的 4 倍,支持多机器人协作,现已通过 Gemini API 和 Google AI Studio 公开提供。
同一事件,精选展示《Gemini Robotics ER 2:用视频理解、任务编排与多机器人协作赋能机器人》Google DeepMind 发布 Gemini Robotics 2,作为其下一代机器人的智能层。该版本包含三个模型:用于全身人形控制的视觉-语言-动作模型、用于具身推理与任务编排的 Gemini Robotics ER 2,以及可在数小时内适配新机器人本体的端侧 VLA。单个检查点驱动 Apptronik Apollo 2 与 Franka Duo,仅 ER 2 公开可用。
另有 3 家信源报道Ars Technica:AI(RSS)The Verge:AI(RSS)X:Demis Hassabis (@demishassabis)Google DeepMind 推出 Gemini Robotics 2,可控制人形机器人全身动作,包括行走、蹲伏及五指精细操作。该系统融合三个模型,在全身任务上成功率 45.7%-76.3%,五指操作成功率从 32%(用簸箕)到 92%(拧灯泡)不等。
One brain. For any robot. 🤖 We're launching Gemini Robotics 2: our next-generation physical AI bringing full body intel...
另有 3 家信源报道Ars Technica:AI(RSS)X:Demis Hassabis (@demishassabis)The Verge:AI(RSS)Google DeepMind 发布 Gemini Robotics 2,为机器人赋予全身智能。该模型基于 Gemini 架构,使机器人能协调手臂、躯干和腿部动作以完成复杂任务,并具备物体操控与环境适应能力。目前尚未公布具体参数规模、上下文长度及可用性细节。
Google DeepMind 发布三款新机器人模型。Gemini Robotics 2 是高级视觉-语言-动作模型,支持全身人形机器人、指尖操作和双臂机器人。Gemini Robotics ER 2 具备具身推理能力,可帮助机器人与人沟通、理解世界并规划多步骤任务。
Google DeepMind 推出 Gemini Robotics ER 2,一个基于 Gemini 的机器人基础模型。该模型在视频理解、工具编排和多机器人协作方面实现阶跃式提升,使机器人能够推理、协作并解决真实世界任务。
另有 3 家信源报道Ars Technica:AI(RSS)X:Google AI for Developers (@googleaidevs)X:Testing Catalog (@testingcatalog)Google DeepMind 推出 Gemini Robotics 2,作为新一代自适应机器人的智能层,支持全身控制、高级灵巧操作及多机器人协作。同时发布新具身推理模型 Gemini Robotics ER 2,作为机器人的“高层大脑”,负责观察环境、推理任务步骤、协调视觉-语言-动作模型执行动作并追踪进度,使机器人能执行复杂多步骤工作流、自我纠错并适应全新场景。
同一事件,精选展示《Google DeepMind 发布 Gemini Robotics 2 物理 AI》Google 发布旗舰音乐模型 Lyria 3.5,带来更动态的人声、更丰富的音乐性和更强的提示词遵循能力,支持设定精确 BPM 并导出全曲分轨。Flow Music 同步上线翻唱、对口型音乐视频功能及 iOS 应用,其中对口型视频由 Gemini Omni Flash 驱动。
Expecting A Minor update? We prefer to B Major. 🎶 @GoogleDeepMind just released Lyria 3.5, and we've plugged it directl...
Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5,带来音乐性、歌词质量、人声表现力与创作控制的多项提升。新模型能生成更自然复杂的旋律结构,歌词对提示词的遵循度和结构意识更强,人声更逼真且富有情感,同时支持更便捷地控制输出节奏与时长。
另有 2 家信源报道IT之家(RSS)The Decoder:AI News(RSS)Google 发布三款新 Gemini 模型,包括性能更强的 Gemini 3.6 Flash、高性价比的 3.5 Flash-Lite 以及专为网络安全设计的 3.5 Flash Cyber。其中,3.6 Flash 在编码测试 DeepSWE 上得分从 37% 升至 49%,输出 token 减少 17%,定价为 $1.50/1M 输入、$7.50/1M 输出。
We're rolling out three new models to make AI agents faster, smarter, and cheaper at scale: 🔵 Gemini 3.6 Flash: It uses...
另有 16 家信源报道X:Jeff Dean (@JeffDean)X:Google DeepMind (@GoogleDeepMind)MarkTechPost(RSS)TechCrunch:AI(RSS)Google DeepMind:Blog(RSS)IT之家(RSS)X:fofr (@fofrAI)Ars Technica:AI(RSS)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Artificial Intelligence News(RSS)Hacker News 热门(buzzing.cc 中文翻译)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Google AI for Developers (@googleaidevs)The Decoder:AI News(RSS)Google has released Gemini 3.6 Flash and Gemini 3.5 Flash-Lite. Both halve time per task relative to their predecessors ...
We're rolling out three new models to make AI agents faster, smarter, and cheaper at scale: 🔵 Gemini 3.6 Flash: It uses...
另有 15 家信源报道TechCrunch:AI(RSS)Google DeepMind:Blog(RSS)IT之家(RSS)X:fofr (@fofrAI)Ars Technica:AI(RSS)X:Jeff Dean (@JeffDean)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Artificial Intelligence News(RSS)Hacker News 热门(buzzing.cc 中文翻译)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Google AI for Developers (@googleaidevs)The Decoder:AI News(RSS)MarkTechPost(RSS)We're rolling out three new models to make AI agents faster, smarter, and cheaper at scale: 🔵 Gemini 3.6 Flash: It uses...
另有 15 家信源报道TechCrunch:AI(RSS)Google DeepMind:Blog(RSS)IT之家(RSS)X:fofr (@fofrAI)Ars Technica:AI(RSS)X:Jeff Dean (@JeffDean)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Artificial Intelligence News(RSS)Hacker News 热门(buzzing.cc 中文翻译)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Google AI for Developers (@googleaidevs)The Decoder:AI News(RSS)MarkTechPost(RSS)Google DeepMind 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 Gemini 3.6 Flash 为最新主力模型,3.5 Flash-Lite 主打更低成本与更高效率,3.5 Flash Cyber 则针对网络安全场景优化。三款模型均通过 Google AI 开发者平台提供 API 访问。
另有 15 家信源报道TechCrunch:AI(RSS)Google DeepMind:Blog(RSS)IT之家(RSS)X:fofr (@fofrAI)Ars Technica:AI(RSS)X:Jeff Dean (@JeffDean)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Artificial Intelligence News(RSS)Hacker News 热门(buzzing.cc 中文翻译)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Google AI for Developers (@googleaidevs)The Decoder:AI News(RSS)MarkTechPost(RSS)Google DeepMind 推出 Gemini 3.5 Flash Cyber,一款专用于发现和修补漏洞的轻量级网络安全模型。该模型旨在通过自动化方式提升漏洞检测与修复效率。
🚨 SCOOP: As previously reported, OpenAI plan to launch GPT-5.6 once back in office next week, with a target window of J...
BREAKING: Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite) by @GoogleDeepMind is 7th on Image Arena with an Elo of 1271....
Google 推出 Nano Banana 2 Lite,号称最快、最高效的 Gemini 图像模型,以最低成本实现高速生成和编辑。模型延迟显著降低,适合大规模图像生成,同时不牺牲质量,支持角色一致性、精确视觉编辑和真实世界知识。目前可通过 Google AI Studio 试用,并在 Space Lift、Gridscape、Peek-A-Word 和 Anywhere 等应用中展示了能力。
Google DeepMind 发布 Nano Banana 2 Lite(正式名 Gemini 3.1 Flash Lite Image),默认低思考模式下约4秒生成一张图像,标准 Nano Banana 需约20秒。API 价格为每1000张图像 $0.034,输入 token $0.25/1M,输出 token $1.50/1M,是 Nano Banana 2 的一半,输出成本为 Nano Banana Pro 的八分之一。用户 Arena.ai Elo 评分接近非 Lite 版本,但在文本处理、小字和角色一致性上较弱。所有输出图像均带有 SynthID 水印。即日起可通过 Google AI Studio、API 及 Gemini(选择 Flash-Lite 选项)使用。
Google DeepMind 推出 Gemma 4 量化感知训练(QAT)检查点,包含 Q4_0 格式和一种新的移动端格式,旨在降低设备端内存占用。对比 BF16、Q4_0 QAT 和移动版 QAT 三种边缘端格式,官方公布了各格式的内存数据与设计权衡。
Google DeepMind 发布 Gemma 4 QAT 量化感知训练模型,专为本地 / 设备端优化。通过量化感知训练减少内存占用,同时相比标准训练后量化保留更多质量。支持 Q4_0 格式及新的移动专用量化格式。Gemma 4 E2B 版本可运行于约 1GB 内存,纯文本版本甚至低于 1GB,使手机、笔记本、边缘设备和消费级 GPU 上的本地 AI 更实用。
Google DeepMind的AlphaProof Nexus系统自主解决了9个开放的Erdős问题(部分问题存在56年),每个问题的成本约几百美元。它还证明了44个OEIS猜想,解决了一个15年的代数几何问题,并在优化理论中发现了新算法参数。其核心机制是将大语言模型的推理能力与Lean形式化验证系统结合,Lean自动检查每一步逻辑,无需人工复核。研究发现,一个仅交替使用大语言模型生成与编译器反馈的基础智能体,便能复现全部9个Erdős问题的成功。该系统还能检测并修正现有数学文献中的表述错误。其局限在于成功案例集中于Lean数学库成熟的领域(如组合、数论),仍无法解决需要全新理论的大问题。
Google推出Gemini Omni,首个面向消费者的世界模型。它通过自然语言交互,将Gemini的智能与生成媒体系统结合,实现了对物理规律、历史、生物等世界的深刻理解。用户可以像编辑ChatGPT文本一样用单句指令编辑视频,实现人物一致性、风格迁移、角度调整等功能。它不是单纯生成像素,而是模拟连贯的物理与语义世界,标志着AI视频生成从拼接工具向智能创作系统的飞跃。
We're dropping Gemini Omni: our first step towards a model that can create anything from anything - starting with video....
同一事件,精选展示《推出Gemini Omni多模态AI模型》谷歌发布新模型Gemini 3.5 Flash,其在智能指数上提升9分至55分,超越Grok 4.3和Claude Sonnet 4.6,尤其在代理任务和知识真实性(大幅减少幻觉)方面进步显著。输出速度超280 tokens/s,使其位于速度与智能的领先前沿。然而,模型运行成本相比前代增加5.5倍,主要由于输入令牌用量及定价上涨。此外,它在多模态评估MMMU-Pro中取得最高分,支持多模态输入,展现了谷歌的综合优势。
同一事件,精选展示《Gemini 3.5:前沿智能与行动能力相结合》谷歌推出原生多模态AI模型Gemini Omni,能够整合视频、图像、音频和文本等多种输入,生成高质量视频内容。其核心能力是通过自然语言对话进行视频编辑,并能保持角色一致性、物理规律与场景连贯性。首个模型Gemini Omni Flash已上线,未来将支持图像和音频输出。Gemini Omni结合了对物理世界的直觉理解与丰富的知识库,支持从写实到叙事的创意生成,并可通过多轮对话持续编辑视频,而不丢失原始场景上下文。
另有 17 家信源报道IT之家(RSS)X:Gemini (@GeminiApp)X:Jeff Dean (@JeffDean)Google Blog:AI(RSS)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Google Developers Blog(RSS)Hacker News 热门(buzzing.cc 中文翻译)X:Google DeepMind (@GoogleDeepMind)X:阿易 AI Notes (@AYi_AInotes)The Verge:AI(RSS)X:Ethan Mollick (@emollick)X:Sundar Pichai (@sundarpichai)X:Kim (@kimmonismus)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)Google发布了Gemini 3.5模型,该模型专注于提升执行复杂任务的能力。其核心特点是支持“代理式工作流”,即能够像助手一样自主规划并执行一系列多步骤、复杂的操作,旨在将先进的语言理解与实际问题解决能力相结合。
另有 17 家信源报道IT之家(RSS)X:Gemini (@GeminiApp)X:Jeff Dean (@JeffDean)Google Blog:AI(RSS)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Google Developers Blog(RSS)Hacker News 热门(buzzing.cc 中文翻译)X:Google DeepMind (@GoogleDeepMind)X:阿易 AI Notes (@AYi_AInotes)The Verge:AI(RSS)X:Ethan Mollick (@emollick)X:Sundar Pichai (@sundarpichai)X:Kim (@kimmonismus)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)