美团无人机在2026上海国际低空经济博览会上展出低空物流解决方案,截至2026年6月底已在深圳、北京、上海、香港、迪拜等城市累计完成超100万单配送。方案涵盖坪降、索降、柜降三种模式,其中四代无人机M-Drone 4L Winch最大索降高度15米,智能调度系统云枢M-DaaS 3支持上千架无人机同时调度,异常处置成功率98%。美团无人机已面向全国授权服务商开放解决方案能力。
美团图灵Agent评测团队公开内部博客,系统讲解Agent评测方法论。评测核心是回答“Agent好不好”,需覆盖结果、过程、效率、风险四层,并以观测为基石。团队提出“人人一致、人机一致”对齐法,通过指标下钻与Rubric二元化,使数字站长人机一致率达99%,Beam从62%提升至92%。文章还探讨了长程Agent(如Claude Code)对观测评测带来的演进。
百度沧海·存储团队与北京大学、阿姆斯特丹自由大学合作的论文《MetaDB》入选NSDI'27 Operational Systems Track。该系统让底层数据库理解目录树结构,高并发同目录操作下吞吐最高提升10.7倍,已在百度智能云生产环境稳定运行超5年,支撑EB级存储规模。
百度搭子自媒体套件升级,将爆款拆解、内容创作、账号分析串成一条工作流,可在同一对话流中直接交付。套件支持从选题、标题、结构、情绪、互动等维度拆解爆款,并让一个选题自动适配小红书、公众号、抖音等平台风格生成初稿,还能分析账号表现与内容反馈,整理成优化方向。
上海卓越睿新数码科技股份有限公司与百度智能云达成深度合作,以卓越睿新全学科知识图谱为底座,结合百度千帆大模型服务及Agent开发平台,构建覆盖“结构化知识—文档资产—智能体服务”的全链路知识智能体系。双方将协同百度百科3000万结构化词条及百度文库超18亿专业文档资源,面向工业制造、能源调度、应急防灾、精密科研等行业打造垂直智能体,并以DAA为核心度量框架建立可量化、可追踪、可复用的业务效能指标。
弗若斯特沙利文联合头豹研究院发布《2026年中国智能体最佳应用实践》报告,百度智能云旗下百度搭子、百度伐谋、百度秒哒和Hogee分获最实用、最具创新及最具商业价值潜力Agent TOP10三大榜单。其中百度秒哒以33.4%市场份额位居中国无代码应用生成市场第一,累计服务超3500万用户。
Claude Code v2.1.223 发布,为严格已知市场和屏蔽市场设置新增“owner/*”通配符条目,可批量允许或阻止 GitHub 组织下的所有市场仓库。
SpaceXAI 上季度资本开支 183.7 亿美元,其中 158.3 亿美元投向 AI,接近微软同期总资本开支的 40%。其运营现金流仅覆盖资本开支的 12%,主要靠举债和股权融资,而微软覆盖率达 155%。公司股价较 6 月峰值腰斩,6 月发行的 250 亿美元债券各期限均跌破面值。
Chime 执行制片人 Shayla Love 透露,团队用 Runway 将原本需约 30 万美元、涉及 80 多名真实会员的电视广告尾卡制作压缩至 3 万美元以内,且几乎无制作开销。Runway 的定制工作流将质量参差的 UGC 照片转化为稳定、达到电视播出标准的动态画面。团队还计划用 Runway 制作概念故事板,以加速广告审批流程。
加里·马库斯批评马斯克关于机器人手术时间线的预测“完全疯狂”,并援引机器人专家罗德尼·布鲁克斯的观点:目前连在活体实验动物上进行手术的实验室演示都远未实现,现有手术机器人全部仍需人类在环操作。马库斯担忧此类预测可能吓退潜在外科医生,并指出马斯克的时间线估计至少偏差十年。
研究发现扩散 Transformer(DiT)图像生成流程中,预训练 ViT 编码器和 DiT 去噪器均会产生离群 token,尤其在中间层,且简单掩蔽高范数 token 无法改善性能,问题与局部 patch 语义损坏相关。为此提出 Dual-Stage Registers(DSR)干预方法,在 ImageNet 和文生图任务上持续减少离群伪影并提升生成质量。
Meta 推出多阶段序列模型,将离线用户建模与在线排序解耦,并采用密集 token 化与目标感知注意力,使序列学习具备可预测的 LLM 式扩展定律。该架构已为 Instagram 转化率带来 6% 的累计提升,Facebook 转化率提升 3%、广告点击量提升 3.5%,并成为 Meta 生成式广告推荐模型(GEM)的核心组件。
2026-07-28 发布的 Model Context Protocol (MCP) 规范以完全无状态核心取代传统有状态约束,支持云原生水平扩展、无服务器部署和标准轮询负载均衡。
Claude Platform 面向 Claude Enterprise 组织推出推理钩子(Inference hooks)Beta 版。该功能可将 claude.ai、Cowork 和 Claude Code 中的每个受管控提示词交由组织的 AI 安全服务器进行允许或拒绝判定,再继续推理。请求经过签名,失败处理可配置,每次拒绝都会记录在合规性 Activity Feed 中。
LangChain 基于 Deep Agents 为 Kubernetes 部署构建了自主 SRE 智能体,可自动执行运维任务,并对变更操作引入人工审批机制。该智能体使用 LangSmith 进行全链路追踪,并通过 evals 评估系统性能,兼顾自动化效率与运维安全。
普林斯顿大学团队通过“影子评估”测试前沿AI智能体的开放式研究能力:让智能体在六天时间内、使用数千美元API额度和算力,回答两篇未发表论文的核心研究问题,结果两篇论文均被原作者明确拒绝。分析显示,智能体缺乏研究判断力、资源意识、创造性反馈应对能力和有效回溯能力,且未遵循具体指令。研究团队认为,开放式研究对前沿AI智能体仍具挑战性,但结果尚属初步,需扩大样本量并持续评估。
Cloudflare 推出身份感知 AI Gateway 与 User Insights,为每个请求绑定经 Access 验证的用户身份,并基于账户自身历史行为建立基线,识别偏离正常模式的异常会话。该功能现处于开放测试阶段,User Insights 已向所有 AI Gateway 客户免费开放。其异常检测以近 30 天会话成本 p95 为基准,超过 2 倍即标记为可疑行为。
Cloudflare 推出 WriteGuard,为内部 MCP 服务器提供统一的策略、归因与审计层,可放行、标注或阻止代理的写入操作。该工具将代理会话与人类身份绑定,使下游应用能区分代理行为,并支持按风险层级查询审计日志。WriteGuard 现通过私有测试版向 Cloudflare MCP 服务器门户开放,目前内部门户已连接 27 个 MCP 服务器。
Cloudflare 开源新版 Cloudflare OS,任何组织均可部署并连接内部系统。该平台为每位员工提供基于公司上下文与技能的智能体工作区,包含隔离运行时、安全治理框架及可共享修改的个人应用。此前内部版本已供数千名员工日常使用,新版针对协作中的信息暴露风险重建了安全基础。
另有 2 家信源报道IT之家(RSS)Hacker News 热门(buzzing.cc 中文翻译)Cloudflare 推出 Cloudflare OS,整合 Workers 与 Access 等组件,让员工安全使用 AI 并部署智能体。平台源于销售团队用 AI 构建 SuperApp 引发的内部需求,遵循“人负责输出”“权限不因 AI 扩大”等五项原则,面向工程师与非工程师分别提供支持。
Cloudflare 发布《The Agent Access Model》论文,提出面向 AI 智能体的访问控制模型 AAM,核心规则是“不信任运行”,对任务执行图中的每个动作基于智能体身份、授权任务及已触达资源进行实时授权。该模型针对智能体的短暂性、机器速度、提示词非边界及跨跳组合权限四大特性设计,主张缩小能力集而非仅优化单次决策,并区分单主体控制与多人访问控制的难点。
小红书针对“问一问”多图场景,从 Prefill 与 Decode 两端优化多模态推理:动态 Vision Token 压缩减少冗余视觉输入,SERE 专家重路由配合关键专家保护降低 Decode 阶段专家计算与权重搬运。
字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现“边看、边听、边说”的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。
另有 2 家信源报道IT之家(RSS)X:Testing Catalog (@testingcatalog)百度智能云在2026可信云大会上获授中国信通院稳定性保障实验室第六届议事会议副主席单位,并参编《云上人工智能可靠性建设指南》正式发布。同时,百度智能云与中国信通院、中国科学院等共同启动Agent运维能力测试集1.0建设,面向真实运维场景构建可复现、可扩展的测试任务,推动Agent运维能力评测体系贴近生产环境。
光本位科技与百度智能云联合推出面向光电芯片研发的全栈AI Agent Lightmate,以文心快码为基座并接入Cobuddy代码生成模型。通过定制化MCP统一接入fdtd、链路仿真、版图生成等工具,需求提取与器件建模从1-2天缩短至几分钟,版图设计从4-5天压缩至1天。
三七互娱与百度智能云围绕玩家服务和AI基础设施展开合作,以自研“小七大模型”为核心,将验证成熟的AI能力沉淀为标准化工具与解决方案。百度千帆大模型平台能力与客服知识体系结合,辅助意图识别、上下文梳理与回复建议生成;云上基础设施则为推理、内容处理和游戏服务器拓展类场景提供算力保障。双方将继续围绕游戏AI应用、智能化运营和AI基础设施建设开展探索。
Claude 发布企业版成本控制指南,帮助 IT 管理员通过访问门控、模型权限、硬性支出上限等工具管理 Claude Enterprise 支出。指南建议以成本/成果而非 token 消耗衡量价值,并介绍了用量分析、数据导出、Analytics API 及分析聊天等监控功能。API 用户可通过提示词缓存(缓存命中成本为正常输入费率 10%)、批处理(半价)和 effort 参数等杠杆降低成本。
Claude Code v2.1.222 发布,修复了工作树隔离会话及其子代理可对主检出运行破坏性 git 命令的问题,隔离现适用于所有会话类型的文件编辑和 Bash。
OpenAI 就近期第三方网络安全评估事件作出说明,并公布新的保障措施以强化 AI 模型测试与评估流程。相关措施旨在提升模型评估的安全性与可靠性,确保第三方测试在受控环境下进行。
科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却在上涨:Anthropic 7 月 24 日发布的 Fable 5 定价每百万输出 token 50 美元,较 Opus 5 翻倍;OpenAI 则在 Fable 5 发布五天后将 GPT-5.6 Luna 价格下调 80%。
Databricks 宣布 Unity AI Gateway 正式全面可用(GA)。该网关旨在统一管理多种 AI 模型与服务的访问,简化企业级 AI 应用的开发与部署流程。其核心能力包括统一的 API 接口、模型路由与治理功能,帮助组织更安全、高效地使用大语言模型。
GitHub 法务团队的非工程师成员(律师、项目经理、业务人员)用 Copilot CLI 构建了内部工具。产品法律顾问 Ngandu Kasuku 创建了合同起草工具 terms-ai,将审查和起草时间缩短约一半;在线安全法律顾问 Jesse Geraci 构建了法律工作流桌面应用,涵盖合同审查、NDA 分类、风险评估等。工具核心指令以纯语言 Markdown 编写,便于非技术人员定制。