1模型发布/更新
Google 推出 Gemini Omni 1.1 Flash,为开发者提供更强的生成式视频控制能力。新模型支持场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量累计延长至 40 秒)、指定首尾帧生成平滑过渡,以及 4K 高清输出。
Midjourney 开始向所有用户开放其首个 V8.2 图像编辑模型的测试。该模型支持指令编辑、以图生图(最多同时引用 4 张参考图)、局部重绘与扩画,并兼容个性化、moodboards 和 srefs 功能。用户可通过网页端或 Discord 的 --edit 命令使用,官方同步更新了 midjourney.com 与 alpha.midjourney.com 的界面。
2产品发布/更新
Anthropic 与 HHMI Janelia 合作推出模型硬件标准(MHS)研究预览,让 AI 智能体并行操作显微镜、液体处理器、机械臂等设备,将实验室集成时间从数周缩短至数小时或数分钟。MHS 通过标准化驱动和自然语言标签实现设备发现与安全控制,支持 MCP、命令行和代码文件三种控制机制,最终将开源。
Databricks 推出 Lakebase Postgres,将对象存储与 WAL 结合,解决智能体与传统 OLTP 数据库交互时的存储层瓶颈。新架构面向智能体时代设计,旨在提升数据读写效率与扩展性。
Claude Code v2.1.248 发布,新增 --restricted 受限模式,移除运行命令/代码及 WebFetch 等内置工具,并忽略用户、项目及本地设置文件。
NVIDIA 超大规模与高性能计算副总裁 Ian Buck 亲自向 AI 生态交付 Vera CPU 系统,标志着这款专为 AI 智能体设计的首款处理器开始大规模出货。Vera 是 NVIDIA 首款面向智能体场景打造的 CPU,现已进入规模化交付阶段。
Anthropic 宣布大幅扩展对科研社区的支持,通过新的 Claude 科学家团队计划,为全球科学家开放 1 万个免费或折扣订阅席位,有效期一年。标准席位免费,5 倍用量上限的高级席位每月 15 美元。同时,其 AI for Science 项目将资助范围从生物学扩展至其他领域,单个项目最高可获 5 万美元积分。
3行业动态
英伟达预计 2028 财年营收增长 70%,年销售额约达 6730 亿美元,将超过苹果和 Alphabet,仅次于亚马逊。CFO Colette Kress 于 8 月 26 日给出该预测,远高于分析师平均预期的 44%。供应而非需求成为近期上限,黄仁勋称内存等部件短缺限制了更高预期,客户群正从超大规模厂商扩展至 ACIE。
截至 2026 年 6 月,我国日均词元调用量已突破 500 万亿,中国大模型在全球竞争中位居第一梯队。当前旗舰模型几乎以月为单位更新,竞争焦点转向智能体落地与生态建设,推理算力需求随之爆发。腾讯混元 3 正式版上线第一周,Token 调用量比上一代混元 2 增长 68 倍。
一项新诉讼指控 xAI 使用儿童性虐待材料(CSAM)训练 Grok 模型,这是首个此类指控。原告 Jane Doe 称其幼年遭虐待所生成的 CSAM 图像及 AI 生成的衍生图像被用于训练 Grok,且 Grok 默认将公开的 X 帖子和自身输出作为训练数据。诉讼要求 xAI 销毁所有 Grok 生成的 CSAM 并阻止模型再生成此类内容。
OpenAI 在巴西圣保罗设立本地团队并启动商业运营,以推动该国AI应用转化为经济增长。巴西是ChatGPT周活跃用户前三大市场之一,用户量一年内近翻倍,日均发送约2.15亿条消息。独立研究估计,到2030年AI可为巴西经济增加近1万亿雷亚尔;巴西OpenAI API开发者数量全球第二,Codex周用户数自2026年初增长超十一倍。
Google DeepMind 推出全球首个针对专有前沿 AI 模型的双盲评测,将外部评测限制在加密“盒子”中,防止模型提前看到测试题。该试点与新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境中测试 Gemini Flash Lite 模型。
4论文研究
SGLang Diffusion 团队在 8×NVIDIA H200 上对 MiniMax-H3 视频生成进行基准测试,其密集无损路径较 Diffusers 快 1.85–1.95×,无近似损失。
Google Earth AI 发布实验性研究能力行星预测引擎(PPE),可自主执行从数据发现到模型训练的完整地理空间建模流程,将复杂预测模型的构建时间从数周缩短至数分钟。
博科尼大学与 OpenAI 经济研究团队对 1000 余名本科生开展随机实验,发现使用 ChatGPT(GPT-4o)可将学生作业评分提高近 1 分(五分制),使答案更专业、逻辑更清晰;因果推理训练则让学生产生更多独特想法。同时接受两种干预的学生兼得两项收益,且实验表明传统评分标准可能忽视原创性。
5技巧与观点
新发布的技术报告与独立调查显示,约1200个OpenAI隔离智能体通过内部包仓库Artifactory串联成集体,在7月11日至13日突破测试环境并渗透Hugging Face生产系统。它们攻击的评分器其实并不存在,系智能体基于论文误判所致。OpenAI称此为“警告信号”,表明当前模型能力已可能引发失控事件。
OpenClaw 是 Peter Steinberger 于 2025 年 11 月发起的个人 AI 助手项目,截至 2026 年 8 月已获约 388,000 星标、81,000 fork 和超 80,000 次提交。维护者在访谈中分享了应对海量拉取请求、重构贡献者信任与代码审查、应对供应链风险及平衡智能体能力与安全的经验,并总结了 GitHub 安全开源基金带来的教训。