Topic · 主题全部主题 →

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

6,913条收录
855条精选
● 持续更新
近期焦点近 14 天 · 按多源报道热度

8月14日

星期五 · 2 条
02:23
Cursor Blog精选
AI 评分 65/100
Cursor 推出 builds:云智能体启动速度提升至 3 倍

Cursor 推出 builds 功能,在后台持续准备就绪的开发环境副本,让云智能体启动时无需从零搭建,响应速度最高提升 3 倍。内部环境启动快 10 倍,首个 token 生成快 3 倍;智能体始终从最近一次成功的 build 启动,依赖更新或安装脚本出错时不会影响运行。8 月 17 日起所有环境默认启用 builds,无需额外费用。


推荐理由:把环境准备从每次会话冷启动改为后台持续快照,云代理长任务的启动成本和中断风险降低,为把更多工程流程交给自动代理提供了更可靠的运行基础。
01:52
Google Blog:AI(RSS)精选
AI 评分 61/100
Google Sheets 推出 Sheets canvas:用 Gemini 将表格数据变为交互式迷你应用

Google Sheets 发布新功能 Sheets canvas,基于 Gemini 构建,用户只需用自然语言提示词即可将表格数据转化为交互式仪表盘、学习追踪器、座位表等“迷你应用”。


推荐理由:与单独 BI 工具不同,Sheets canvas 直接在原表上生成可读写界面,临时仪表盘能沿用表格的共享和权限体系,降低轻量场景的搭建成本。

8月13日

星期四 · 3 条
12:41
公众号:数字生命卡兹克精选
AI 评分 65/100
WorkBuddy上线远程控制,国内也有了最丝滑的Agent工作方式

WorkBuddy更新上线远程控制功能,将PC、App和小程序打通,手机端可实时同步电脑端的任务、对话、工作空间和产物,支持一台手机连接多台电脑并随时切换。App需升级至1.2.0及以上,电脑端需升级至5.3.8及以上,连接无需扫码。本次更新还新增资料库(我的文档与团队空间)、Markdown多人共同编辑、AI原生审阅模式,以及将资料库内容生成可发布链接的HTML网站。

另有 1 家信源报道IT之家(RSS)
推荐理由:远程控制把 Agent 任务从电脑旁解放到手机上,连接和多设备切换比 Codex 更省事,对国内依赖 Agent 处理长任务的用户直接降低了使用门槛。
04:15
Claude:Blog(网页)精选
AI 评分 65/100
Claude in Chrome 侧边栏升级为 Claude Cowork 会话

Claude in Chrome 浏览器扩展的侧边栏现已升级为 Claude Cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:把浏览器扩展升级为与桌面、网页、移动共享的 Cowork 会话,解决以往侧边栏与主应用上下文割裂的问题,长流程任务可以在不同设备间接力。
00:13
SiliconFlow@SiliconFlowAI精选
AI 评分 67/100
Qwen3.8-2.4T-A95B 开源,硅基流动即日上线

阿里开源 Qwen3.8-2.4T-A95B,硅基流动已提供 Day-0 支持。该模型拥有 2.4T 参数、95B 激活参数,主打自主编码、深度研究与端到端智能体执行。API 定价为输入 $2.00/百万 token,输出 $6.00/百万 token,缓存输入 $0.25/百万 token。

另有 5 家信源报道X:硅基流动 SiliconFlow (@SiliconFlowAI)X:通义千问 / Qwen (@Alibaba_Qwen)X:Rohan Paul (@rohanpaul_ai)IT之家(RSS)X:Clément Delangue(Hugging Face CEO) (@ClementDelangue)
推荐理由:缓存输入每百万 token 0.25 美元,让需要反复读取长上下文的 agent 工作流更接近可长期运行,而非只看单次生成价格。

8月12日

星期三 · 6 条
23:45
OpenRouter:Announcements(RSS)精选
AI 评分 67/100
OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型

OpenRouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 BrowseComp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本。


推荐理由:这份基准把搜索预算的作用量化到分数与成本上,显示从单轮增加到 25 轮搜索,质量提升幅度超过更换模型或引擎,为 agent 搜索配置提供了更直接的取舍依据。
20:02
OpenRouter@OpenRouter精选
AI 评分 72/100
Meta AI 超级智能实验室的首个开放权重模型 Muse Glimmer 已在 OpenRouter 上线!这是一款 30B 密集文本+图像模型,采用 Apache 2.0 许可证,旨在成为可靠的本地智能体,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。https://openrouter.ai/meta/muse-glimmer-30b
推荐理由:Apache 2.0许可和两项代理基准得分,为评估30B规模本地开源模型是否达到生产可用提供了直接参照,分数分别指向工具调用和编码能力。
04:15
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 73/100
Mojo 1.0 正式发布:为生态系统增长提供稳定基础

Mojo 语言正式发布 1.0 版本,提供稳定、可用于生产环境的语言基础,自 2023 年首次发布以来已发展成通用语言。自开源标准库以来,近 200 名贡献者合入超 1,100 个拉取请求,改动超 200,000 行代码。

另有 1 家信源报道IT之家(RSS)
推荐理由:稳定性承诺让 Mojo 成为 AI 基础设施可长期选用的语言基础,lambda 语法和内存安全诊断减少了日常开发阻力,对 MAX 生态项目直接降低维护成本。
03:17
02:47
00:44
Google Cloud:Databases(RSS)精选
AI 评分 72/100
Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移

Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。


推荐理由:将AI编解能力直接嵌入数据库迁移流程,不同于通用聊天工具,它能感知全量Schema上下文,并保留审查与校验环节,更适合企业级迁移场景。

8月11日

星期二 · 2 条
14:01
公众号:智谱(GLM)精选
AI 评分 71/100
ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线

ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。

另有 1 家信源报道IT之家(RSS)
推荐理由:Goal模式将复杂任务从需要开发者逐轮推动变为设定目标后自行迭代,搭配Subagents并行协作,适合跨文件重构和全栈开发的长流程任务。
00:16

8月10日

星期一 · 5 条
23:44
OpenRouter:Announcements(RSS)精选
AI 评分 77/100
OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

OpenRouter 基于每周超 55T token 的社区消费数据,推出新版 Auto 路由器(openrouter/auto),其模型选择在多数任务和成本档位上优于旧版。新路由器按约 30 种任务类型匹配近 7 天社区实际消费的模型,支持 cost_tier 参数(low 至 max)并遵循账户隐私设置。在 MMLU Pro 等基准上,新默认档位在多数领域以更低成本达到旧版同等性能。

另有 1 家信源报道X:OpenRouter (@OpenRouter)
推荐理由:基于平台每周55T token的社区支出分布,新路由将模型选择众包化,基准显示默认档成本下降超60%且多数任务性能不减,适合调用量大的应用。
12:14
Qwen@Alibaba_Qwen精选
AI 评分 71/100
👀 看见只是开始。借助 Qwen-MM-Plugins,让你的智能体原生支持多模态--读取图片、视频和文档,编辑视频,处理 3D/CAD,以及更多。从多模态模型 → 多模态智能体。🚀观看实际效果:https://github.com/QwenLM/Qwen-MM-Plugins

推荐理由:让智能体直接获得视觉、文档和 3D 感知能力,把原本需要单独集成的工作流变成一组可调用的插件,原型开发速度可能因此加快。
10:11
公众号:千问APP(阿里)精选
AI 评分 73/100
千问开放平台上线:租房、寄快递、查理财等十余领域服务可对话办理

千问开放平台今日上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入,首批覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。用户可在对话中@相关服务或点击“圆点角标”进入智能体,完成从咨询、推荐到下单的完整流程。平台支持标准化协议接入、一键授权与端到端调测,并提供账号、AI支付、订单接入等基础设施。

另有 1 家信源报道IT之家(RSS)
推荐理由:把快递查询、租房比价、天气建议等高频生活服务接入对话窗口,用户从「问信息」到「下单」不再跳出应用,减少了多任务切换和重复输入的摩擦。
09:14
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 70/100
OpenChamber:一个基于代理的开发环境

OpenChamber 是一个基于代理的开发环境,可跨桌面、浏览器、手机和 VS Code 使用,支持会话目标、多模型并行运行与融合、变更走查、从 issue 到 PR 的完整流程及定时任务。该工具基于 OpenCode SDK,完全开源且免费,代码和会话内容均保存在本地,远程访问可通过 UI 密码和端到端加密的 Private Relay 保护。


推荐理由:将多模型并行、日程化任务和跨设备工作区整合到同一界面,减少了切工具的时间,适合需要在多个 AI 代理间协调的开发者。
09:01
公众号:数字生命卡兹克精选
AI 评分 61/100
我花了54个小时,做了一个可能更公平的AI大模型排行榜。

作者耗时54小时开发并免费开放了一个聚合多家可信榜单的AI大模型综合排行榜LatentRank。该榜单采用Bradley-Terry成对比较算法,并加入先验限制小样本结果,以解决不同榜单规模、领先幅度和模型缺失带来的评分偏差。目前榜单前五名中,Opus 5超过Fable 5位居前列。


推荐理由:聚合榜单的难点在于不同榜的排名含金量不可比,作者用 Bradley-Terry 模型将问题转为成对比较,为评估模型综合能力提供了比简单平均更合理的框架。

8月9日

星期日 · 2 条
07:11
IT之家(RSS)精选
AI 评分 72/100
OpenAI 桌面端 ChatGPT 上线语音交互功能,可语音操控电脑执行多步骤任务

OpenAI 更新 ChatGPT 桌面应用,新增对 ChatGPT Voice 的支持,用户可直接通过语音对话控制 AI 智能体并让其在电脑上执行任务。该功能基于全新语音模型系列 ChatGPT-Live,支持 ChatGPT Work 和 Codex,在 macOS 上还可借助 Appshots 访问屏幕内容。


推荐理由:桌面端语音不再只是对话,演示中一条指令完成创建线程、提PR和定位Bug,语音开始成为开发者工作流中的可执行指令层。
00:42
Elon Musk@elonmusk精选
AI 评分 66/100
Grok Imagine 图像编辑功能重大升级【引用 @XFreeze】:你可以直接悬停在 Grok Imagine 中的任意特定区域,并即时进行编辑

X Freeze: 你只需将鼠标悬停在 Grok Imagine 中的任意特定片段上,就能立即对其进行编辑。

另有 1 家信源报道X:cb_doge (@cb_doge)
推荐理由:悬停选中并即时编辑把图层和遮罩等概念替换为手势,降低了图像修改的操作门槛。

8月8日

星期六 · 6 条
17:11
IT之家(RSS)精选
AI 评分 76/100
苹果 Mac 简体中文支持文档更新,"Apple 智能"阿里千问扩展现身

苹果官网 Mac 简体中文使用手册新增《在 Mac 上配合 Apple 智能使用千问》支持文档,明确 Apple 智能可配合阿里巴巴千问模型工作。千问扩展适用于 macOS 26.6 或更高版本,需中国大陆 Apple 账户及机型,支持写作工具与 Siri,用户需登录千问账户使用。


推荐理由:苹果智能在中国大陆的落地路径终于清晰,支持文档揭示了写作工具和Siri集成千问的具体方式,Mac用户将能在系统级直接使用大模型能力。
04:12
ClaudeDevs@ClaudeDevs精选
AI 评分 73/100
Claude Code 新功能:你的会话现在可以互相发送消息了。无需在另一个会话中重新解释自己,你现在可以让 Claude 代为传达。它会发送一份摘要(而非你的历史记录或文件),另一个会话会在任务进行中接收该摘要。
另有 1 家信源报道X:阿易 AI Notes (@AYi_AInotes)
推荐理由:跨会话传递上下文不再是复制粘贴,摘要消息让多个并行任务间保持连贯成为可能,降低了开发者维护长流程的心智负担。
03:12
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 77/100
Kitesurf:一款在 V8 隔离环境中运行的"代理优先"浏览器

Cloudflare 推出 Kitesurf,一款专为 AI 智能体设计的浏览器,完全运行在 Workers 上,基于 V8 隔离环境,现已在 Browser Run 中免费开放测试。

另有 3 家信源报道TechCrunch:AI(RSS)MarkTechPost(RSS)IT之家(RSS)
推荐理由:Kitesurf 将浏览器重新设计为无状态、隔离的 Agent 引擎,CPU 和内存占用仅为 Chromium 的 1/3 到 1/7,这对大规模自动化任务的成本结构可能产生实质影响。
02:42
ClaudeDevs@ClaudeDevs精选
AI 评分 57/100
自 8 月 14 日起,自动模式将成为 Claude Code 中 Pro、Max 和 Team 用户的默认权限模式。自动模式使用独立的分类器审查 shell 命令和操作。在测试中,它捕获了 89% 的危险命令。手动审批仅捕获了 14%。另有 4 家信源报道X:Boris Cherny (@bcherny)Simon Willison 博客The Decoder:AI News(RSS)TechCrunch:AI(RSS)
推荐理由:将默认模式从手动批准改为自动分类器,给出 89% 的危险命令捕获率,意味着降低使用摩擦的同时把安全基线从 14% 拉到了接近九成。
01:51
LMSYS:Blog(Chatbot Arena 团队)精选
AI 评分 76/100
HPC-Ops × SGLang:腾讯混元开源高性能 Attention、Router GEMM 与 MoE 算子

腾讯混元开源算子库 HPC-Ops 已集成至 SGLang 主分支,其 Dynamic Attention 与 Fused MoE 在 Hy3 模型上最高降低 TPOT 48.8%。


推荐理由:HPC-Ops 集成到 SGLang,带来生产验证的负载均衡 Attention 和精度感知 Router GEMM,实测 Hy3 TPOT 降幅最高 48.8%,为 MoE 低延迟服务提供了可直接使用的开源优化。
01:31
LangChain:Blog(RSS)精选
AI 评分 62/100
LangChain 推出 Managed Deep Agents 公开测试版

LangChain 的 Managed Deep Agents 进入公开测试版,可将 Deep Agents 部署到托管的 LangSmith 运行时。该服务提供持久化执行、记忆、沙箱、通道、评估(evals)及生产级基础设施。


推荐理由:托管执行、内存和沙箱等基础能力被封装成生产化服务,让 Agent 从原型到上线不再需要单独搭建这些工程设施。

8月7日

星期五 · 7 条
19:13
Runway@runwayml精选
AI 评分 75/100
Seedance 2.5 现已登陆 Runway。每次生成最多可引用 50 个角色参考,构建充满角色的完整世界;可创作最长 30 秒、带完整音效与对白的片段,再按你的故事需求随意剪辑与延展。点击下方链接立即开始。
另有 1 家信源报道X:Runway (@runwayml)
推荐理由:支持最多50个角色引用和30秒带对话的片段,从单镜头生成迈向构建完整场景,更适合需要连贯叙事的视频创意。
15:42
14:11
公众号:火山引擎精选
AI 评分 81/100
Seedance 2.5 API上线,视频生成开启「电影级长叙事」

火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。

另有 1 家信源报道公众号:数字生命卡兹克
推荐理由:原生30秒时长和秒级时间戳控制,把长叙事视频从靠抽卡变为导演级调度;角色与光影的稳定提升让广告、影视等商业场景更接近实际生产标准。
10:11
公众号:千问APP(阿里)精选
AI 评分 67/100
千问功能上新:推出思考研究、定时任务、办公助理、语音通话等多项新功能,并支持 Qwen3.8-MAX

千问今日上线多项新功能,并支持最新旗舰模型 Qwen3.8-MAX。其中“思考研究”在原“深度思考”基础上升级,强化复杂推理与工具调用;“定时任务”可预设执行时间自动完成行业简报梳理等周期工作;“办公助理”能连接备忘录、日历等应用并操作电脑浏览器,直接输出可用的 Office 文档。语音通话支持 7x24 小时多场景,智能体广场首批覆盖物流、房产等十多个领域。

另有 1 家信源报道IT之家(RSS)
推荐理由:办公助理将大模型从问答扩展到任务执行,多步操作与跨端协同可能改变繁琐的数据汇总与文档生成流程。
07:40
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 74/100
OpenAI 优化 ChatGPT 中的 GPT-5.6 Sol,并扩大免费用户对 GPT-5.6 Luna 的访问权限

OpenAI 更新 ChatGPT:Plus 和 Pro 用户的 GPT-5.6 Sol 在事实准确性和回答聚焦度上有所提升,新增滑块可控制模型思考投入。免费用户默认模型升级为 GPT-5.6 Luna,并开放无限文本聊天,新增 Think 按钮以处理更复杂问题。

另有 10 家信源报道X:Kim (@kimmonismus)X:Greg Brockman (@gdb)OpenAI:官网动态(RSS · 排除企业/客户案例)TechCrunch:AI(RSS)X:OpenAI (@OpenAI)X:Rohan Paul (@rohanpaul_ai)X:Testing Catalog (@testingcatalog)The Decoder:AI News(RSS)The Verge:AI(RSS)IT之家(RSS)
推荐理由:事实错误减少68%让这次更新更像信息质量提升而非体验优化,对依赖事实核查的场景有实际价值。
00:53
Google Developers Blog(RSS)精选
AI 评分 75/100
Agent Plugins 1.0.0 发布:谷歌、亚马逊、微软等支持的统一智能体插件规范

Agent Plugins 1.0.0 是一项由谷歌、亚马逊、微软等支持的中立目录规范,将 Agent Skills 和 MCP 服务器打包为单一可移植单元。通过标准化 plugin.json 清单和固定目录布局,开发者无需为不同 AI 编码智能体和 IDE 维护单独封装。谷歌已作为核心维护者加入,并在 Agents CLI 和 Data Agent Kit 中提供支持。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:此前不同AI编码代理和IDE的插件需要单独适配,Agent Plugins通过统一manifest和目录结构,使单个插件可跨工具复用,降低了多代理环境的分发成本。

8月6日

星期四 · 4 条
21:10
IT之家(RSS)精选
AI 评分 71/100
谷歌地图 Ask Maps 智能体升级:可对话订餐、找酒店并接入 Gemini Personal Intelligence

谷歌地图宣布 Ask Maps 迎来新一轮升级,新增智能体功能,可替用户执行订餐操作,并综合考虑饮食要求、当前位置和收藏地点等信息;用户还可通过对话指定装修风格、环境氛围等条件查找酒店和当地活动。

另有 1 家信源报道TechCrunch:AI(RSS)
推荐理由:在地图导航中直接完成订餐和订房,把位置感知的便利性延伸到了生活服务的交易环节,可能改变用户对地图工具的功能预期。
20:10
公众号:千问APP(阿里)精选
AI 评分 64/100
千问全网首发公测,全新 Wan3.0 来了!

阿里千问全网首发公测视频生成模型 Wan3.0,在生成时长、镜头语言、角色真实感及一致性保持等维度全面升级。该模型支持稳定直出 30 秒一镜到底视频,具备导演级镜头与蒙太奇叙事,并强调角色、道具、场景高一致性保持。Wan3.0 主打超高性价比,现已在千问创作(c.qianwen.com)开放体验,千问 app 也将陆续开启。

另有 2 家信源报道IT之家(RSS)X:阿里云 / Alibaba Cloud (@alibaba_cloud)
推荐理由:30秒一镜到底和导演级镜头控制将视频生成从短片段推向长叙事,配合低试错成本,可能加速短剧和广告的创作节奏。
09:39
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 70/100
Prime Agent:一个具有自我改进能力的RLM代理

Prime Agent 是一个自我改进的编码代理,围绕递归语言模型(RLM)和持续框架(Continual Harness)两大抽象构建,将上下文视为变量、子代理委派视为 REPL 内的函数调用,并允许代理对其提示词、技能、记忆和子代理进行 CRUD 操作。它完全开源,可通过 curl 命令安装,支持与前沿模型即时使用,并具备后台守护进程、会话恢复、分支分叉和异步内核压缩等特性。

另有 1 家信源报道MarkTechPost(RSS)
推荐理由:不同于固定工具调用模式,Prime Agent 将上下文视为可编程变量并允许智能体自行改进技能和记忆,为长程自主任务提供了新的基准方案。

8月5日

星期三 · 3 条
12:35
08:55
Simon Willison 博客精选
AI 评分 79/100
LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能的日志

Simon Willison 发布 LLM 0.32,这是该项目自启动以来最重要的新版本。新版本支持显示推理轨迹、服务端工具、OpenAI Responses API,并默认使用 GPT-5.6 Luna 模型。


推荐理由:推理追踪输出到标准错误,日志改为内容寻址存储,让 LLM 作为管道工具和代理框架都摆脱了早期消息抽象带来的重复与混乱。