内容
精选全部 AI 动态AI 日报主题收藏
接入
Agent 接入
更多
关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈
AI 日报每早八时
日报周报月报
今天7月27日7月26日更早
AIHOT DAILY
2026年7月28日 · 周二
今日看点16 篇报道 · 约 7 分钟
  1. 01模型发布/更新Kimi K3 开源:2.8T MoE 模型与技术报告2
  2. 02产品发布/更新Kimi 发布视觉感知基准 PerceptionBench2
  3. 03行业动态Google AI Overviews 搜索结果出现率升至43%3
  4. 04论文研究Apple 提出 GH-ESD:面向实例级视觉任务的假设驱动错误切片发现方法1
  5. 05技巧与观点用AI Skill自动生成可协作HTML PPT8

1模型发布/更新

Kimi K3 开源:2.8T MoE 模型与技术报告

Kimi 发布其最强模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,具备原生视觉理解和 1M token 上下文窗口。新架构实现了每单位计算 2.5 倍的智能提升。除模型权重外,Kimi 还开源了高性能注意力内核、MoE 通信库及大规模智能体运行环境基础设施。

X:Kimi.ai (@Kimi_Moonshot)
Kimi K3 上线 Modal,支持无损加速推理

很高兴 @modal 成为 Kimi K3 的 Day 0 发布合作伙伴! 他们为 K3 的架构训练了自定义 DFlash 投机器,实现更快推理且无质量损失。

X:Kimi.ai (@Kimi_Moonshot)

2产品发布/更新

Kimi 发布视觉感知基准 PerceptionBench

Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。

X:Kimi.ai (@Kimi_Moonshot)
SGLang 和 Miles 为月之暗面 2.8T 参数 Kimi K3 模型提供发布当日支持

SGLang 和 Miles 为月之暗面开源的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s。

LMSYS:Blog(Chatbot Arena 团队)

3行业动态

Google AI Overviews 搜索结果出现率升至43%

Google AI Overviews 在搜索结果中的出现率一年内从15%升至43%,AI Mode月访问量从1.26亿增至2.79亿。用户搜索长度增加,正从短关键词转向更长的自然对话式查询。

TechCrunch:AI(RSS)
NVIDIA 等多家行业领袖联合成立 Open Secure AI Alliance,推动 AI 安全与防御开源化

NVIDIA、Microsoft、Hugging Face、IBM 等数十家机构联合成立 Open Secure AI Alliance,旨在通过开源模型、工具和框架构建可审查、可定制的 AI 安全防御体系。

NVIDIA Blog(RSS)
Cognizant 与 Anthropic 扩大合作,成为 Claude Partner Network 全球首要合作伙伴

Cognizant 与 Anthropic 扩大合作,成为 Claude Partner Network 中的 Global Premier Partner,并将 Claude 嵌入其 Flowsource 等平台。已有超过 3 万名员工完成 Claude 培训,其为一家生物制药公司构建的智能合约系统将合同审核时间缩短最高 40%,提取准确率超过 88%。

Anthropic:Newsroom(网页)

4论文研究

Apple 提出 GH-ESD:面向实例级视觉任务的假设驱动错误切片发现方法

Apple 机器学习研究团队提出 GH-ESD(Grounded Hypothesis-Driven Error Slice Discovery),一种针对目标检测与分割等实例级视觉任务的错误切片发现方法。现有方法主要适用于图像级分类,难以捕捉由上下文关系和空间视觉模式导致的实例级失败。GH-ESD 通过基于假设的驱动方式,系统性地发现模型在语义连贯子集上的系统性失效。

Apple Machine Learning Research(RSS)

5技巧与观点

用AI Skill自动生成可协作HTML PPT

Vista 基于 bento PPT 改造了一个 Skill,输入内容或主题即可自动生成可编辑、在线演示并支持协作的 HTML PPT。安装指令为 npx skills add joeseesun/qiaomu-bento-ppt,推荐使用 Kimi K3 或 Opus 4.8+ 等前端审美好的模型。

X:Vista (@vista8)
GitHub Copilot 发布“Harness”工作流:用单一工具完成原型、规划、实现与代码审查

GitHub Copilot 推出“Harness”工作流,让开发者通过单一 AI 工具完成从原型设计、规划、实现到代码审查的完整软件开发流程,无需追逐多种新 AI 工具。该工作流强调实用性与集成性,旨在减少工具切换带来的效率损耗。

GitHub Blog
用Claude和Python构建技能驱动的金融分析智能体

本教程基于Anthropic的financial-services仓库,用纯Python复现其技能驱动架构。通过解析SKILL.md文件构建可搜索技能注册表,并创建可复用SkillAgent,将金融分析剧本注入Anthropic Messages API,支持迭代工具调用循环。

MarkTechPost(RSS)
OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作

OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和工程任务交叉最多。用户用 AI 处理合同审查、数据分析、网站故障排查等原由专家负责的工作。OpenAI 认为这是岗位职责正在变化的早期信号,该趋势在缺乏专业团队的小公司尤为明显。

The Decoder:AI News(RSS)
GitHub Copilot app 入门指南:多 Agent 会话工作区与 Canvas 预览

GitHub Copilot app 将 AI 编码工具升级为多 Agent 会话工作区,支持同时管理多个任务线程而不丢失进度。用户可为每个会话绑定项目上下文,通过 /create-canvas 命令在浏览器 Canvas 中预览 UI 并直接点选修改,还能启用 Agent Merge 自动处理 PR 审查反馈和合并冲突。

GitHub Blog
浪费20亿Token后,我开源了帮Agent定义目标的Leader.skill

作者开源了Leader.skill,用于将模糊的人类需求转化为Agent可独立执行数小时的目标任务书。该Skill基于“目标七问”方法论,涵盖目的、完成态、反作弊、边界等维度,并推荐用Claude Fable 5或Kimi K3规划目标,再交由GPT-5.6 Sol或GLM-5.2等模型长程执行。项目已开源。

公众号:数字生命卡兹克
Anthropic 澄清立场:从未主张全面禁止开源权重模型,支持芯片出口管制与安全测试

Anthropic CEO Dario Amodei 明确表示公司从未主张禁止开源权重模型,并认为不具备危险能力的开源权重模型是公共产品。他提出三项实际措施:对华芯片出口管制、打击工业级知识蒸馏、对所有足够强大的模型进行强制性安全测试。Amodei 指出,保护主义禁令无法解决其最担忧的国家安全威胁,包括威权政府利用更强大 AI 实现军事优势或深度监控。

Anthropic:Newsroom(网页)
16今日事件
11一手报道
2新模型
12信源
这周太忙没跟上?
AI 周报把整周大事浓缩成 5 分钟
读本周周报 →月报
前一日历史后一日
VOL.2026.07.28·16 STORIES·AI HOT DAILY

AIHOT日报

二〇二六年七月二十八日 星期二DAILY · 每早八时
今日看点16 篇报道 · 约 7 分钟
  1. 01模型发布/更新Kimi K3 开源:2.8T MoE 模型与技术报告2
  2. 02产品发布/更新Kimi 发布视觉感知基准 PerceptionBench2
  3. 03行业动态Google AI Overviews 搜索结果出现率升至43%3
  4. 04论文研究Apple 提出 GH-ESD:面向实例级视觉任务的假设驱动错误切片发现方法1
  5. 05技巧与观点用AI Skill自动生成可协作HTML PPT8
01

模型发布/更新

Model Releases
2 篇

Kimi K3 开源:2.8T MoE 模型与技术报告

官方·XX:Kimi.ai (@Kimi_Moonshot)

Kimi 发布其最强模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,具备原生视觉理解和 1M token 上下文窗口。新架构实现了每单位计算 2.5 倍的智能提升。除模型权重外,Kimi 还开源了高性能注意力内核、MoE 通信库及大规模智能体运行环境基础设施。

OpenRouter 新增图像生成模型专用 API 端点

OpenRouter 通过专用 /api/v1/images 端点提供图像生成模型服务,图像理解仍通过 /chat/completions 端点完成,两者共用同一 API Key 和计费体系。该平台同时公布了两种任务的完整接口合约,并修复了此前出现的“no endpoints found”错误。

OpenRouter:Announcements(RSS)

Kimi K3 上线 Modal,支持无损加速推理

官方·XX:Kimi.ai (@Kimi_Moonshot)

很高兴 @modal 成为 Kimi K3 的 Day 0 发布合作伙伴! 他们为 K3 的架构训练了自定义 DFlash 投机器,实现更快推理且无质量损失。

02

产品发布/更新

Product
2 篇

Kimi 发布视觉感知基准 PerceptionBench

官方·XX:Kimi.ai (@Kimi_Moonshot)

Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。

SGLang 和 Miles 为月之暗面 2.8T 参数 Kimi K3 模型提供发布当日支持

学术机构LMSYS:Blog(Chatbot Arena 团队)

SGLang 和 Miles 为月之暗面开源的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s。

03

行业动态

Industry
3 篇

Google AI Overviews 搜索结果出现率升至43%

综合资讯TechCrunch:AI(RSS)

Google AI Overviews 在搜索结果中的出现率一年内从15%升至43%,AI Mode月访问量从1.26亿增至2.79亿。用户搜索长度增加,正从短关键词转向更长的自然对话式查询。

NVIDIA 等多家行业领袖联合成立 Open Secure AI Alliance,推动 AI 安全与防御开源化

官方NVIDIA Blog(RSS)

NVIDIA、Microsoft、Hugging Face、IBM 等数十家机构联合成立 Open Secure AI Alliance,旨在通过开源模型、工具和框架构建可审查、可定制的 AI 安全防御体系。

Cognizant 与 Anthropic 扩大合作,成为 Claude Partner Network 全球首要合作伙伴

官方Anthropic:Newsroom(网页)

Cognizant 与 Anthropic 扩大合作,成为 Claude Partner Network 中的 Global Premier Partner,并将 Claude 嵌入其 Flowsource 等平台。已有超过 3 万名员工完成 Claude 培训,其为一家生物制药公司构建的智能合约系统将合同审核时间缩短最高 40%,提取准确率超过 88%。

04

论文研究

Research
1 篇

Apple 提出 GH-ESD:面向实例级视觉任务的假设驱动错误切片发现方法

学术机构Apple Machine Learning Research(RSS)

Apple 机器学习研究团队提出 GH-ESD(Grounded Hypothesis-Driven Error Slice Discovery),一种针对目标检测与分割等实例级视觉任务的错误切片发现方法。现有方法主要适用于图像级分类,难以捕捉由上下文关系和空间视觉模式导致的实例级失败。GH-ESD 通过基于假设的驱动方式,系统性地发现模型在语义连贯子集上的系统性失效。

05

技巧与观点

Tips & Takes
8 篇

用AI Skill自动生成可协作HTML PPT

X·KOLX:Vista (@vista8)

Vista 基于 bento PPT 改造了一个 Skill,输入内容或主题即可自动生成可编辑、在线演示并支持协作的 HTML PPT。安装指令为 npx skills add joeseesun/qiaomu-bento-ppt,推荐使用 Kimi K3 或 Opus 4.8+ 等前端审美好的模型。

GitHub Copilot 发布“Harness”工作流:用单一工具完成原型、规划、实现与代码审查

官方GitHub Blog

GitHub Copilot 推出“Harness”工作流,让开发者通过单一 AI 工具完成从原型设计、规划、实现到代码审查的完整软件开发流程,无需追逐多种新 AI 工具。该工作流强调实用性与集成性,旨在减少工具切换带来的效率损耗。

用Claude和Python构建技能驱动的金融分析智能体

综合资讯MarkTechPost(RSS)

本教程基于Anthropic的financial-services仓库,用纯Python复现其技能驱动架构。通过解析SKILL.md文件构建可搜索技能注册表,并创建可复用SkillAgent,将金融分析剧本注入Anthropic Messages API,支持迭代工具调用循环。

OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作

综合资讯The Decoder:AI News(RSS)

OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和工程任务交叉最多。用户用 AI 处理合同审查、数据分析、网站故障排查等原由专家负责的工作。OpenAI 认为这是岗位职责正在变化的早期信号,该趋势在缺乏专业团队的小公司尤为明显。

GitHub Copilot app 入门指南:多 Agent 会话工作区与 Canvas 预览

官方GitHub Blog

GitHub Copilot app 将 AI 编码工具升级为多 Agent 会话工作区,支持同时管理多个任务线程而不丢失进度。用户可为每个会话绑定项目上下文,通过 /create-canvas 命令在浏览器 Canvas 中预览 UI 并直接点选修改,还能启用 Agent Merge 自动处理 PR 审查反馈和合并冲突。

浪费20亿Token后,我开源了帮Agent定义目标的Leader.skill

公众号·媒体公众号:数字生命卡兹克

作者开源了Leader.skill,用于将模糊的人类需求转化为Agent可独立执行数小时的目标任务书。该Skill基于“目标七问”方法论,涵盖目的、完成态、反作弊、边界等维度,并推荐用Claude Fable 5或Kimi K3规划目标,再交由GPT-5.6 Sol或GLM-5.2等模型长程执行。项目已开源。

Anthropic 澄清立场:从未主张全面禁止开源权重模型,支持芯片出口管制与安全测试

官方Anthropic:Newsroom(网页)

Anthropic CEO Dario Amodei 明确表示公司从未主张禁止开源权重模型,并认为不具备危险能力的开源权重模型是公共产品。他提出三项实际措施:对华芯片出口管制、打击工业级知识蒸馏、对所有足够强大的模型进行强制性安全测试。Amodei 指出,保护主义禁令无法解决其最担忧的国家安全威胁,包括威权政府利用更强大 AI 实现军事优势或深度监控。

OpenRouter 新增图像生成模型专用 API 端点

官方OpenRouter:Announcements(RSS)

OpenRouter 通过专用 /api/v1/images 端点提供图像生成模型服务,图像理解仍通过 /chat/completions 端点完成,两者共用同一 API Key 和计费体系。该平台同时公布了两种任务的完整接口合约,并修复了此前出现的“no endpoints found”错误。

16
今日事件
11
一手报道
2
新模型
12
信源
这周太忙没跟上?
AI 周报把整周大事浓缩成 5 分钟 · 每周一更新
读本周周报 →月报
前一日查看历史后一日
AI HOT · 编辑系统自动生成
日报周报月报
2026 年 7 月28
  • 28 日Kimi K3 开源:2.8T MoE 模型与技术报告
  • 27 日xAI 发布 Grok CLI 并支持 /tutorial 命令
  • 26 日新报告揭示OpenAI在Hugging Face自主黑客事件中失控的严重程度
  • 25 日Anthropic 发布 Claude Opus 5
  • 24 日Cactus 发布 Gemma 4 E2B Hybrid:可在设备端为每个回答输出置信度分数,低分时自动路由至更大模型
  • 23 日腾讯设计Agent平台Miora全面开放
  • 22 日小红书 dots 模型获 IMO 2026 满分金牌
  • 21 日面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型
  • 20 日Qwen3.8 开源发布,2.4T 参数模型上线
  • 19 日Claude Code v2.1.214 发布:修复权限绕过、添加 EndConversation 工具与多项 Bash 权限检查改进
  • 18 日Kimi K3 登顶前端编码榜,开放权重挑战闭源双巨头
  • 17 日Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口
  • 16 日阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一
  • 15 日Bonsai 27B:首款可在手机上运行的27B级多模态模型
  • 14 日腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍
  • 13 日腾讯混元发布Hy3模型:295B参数MoE架构,Agent向LLM定位,已集成微信服务10亿+用户
  • 12 日蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型
  • 11 日百度搭子在成都AI Day发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟
  • 10 日OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体
  • 9 日推出 Grok 4.5
  • 8 日Meta Superintelligence Labs 推出 Muse Image 和 Muse Video
  • 7 日Fun-ASR-Realtime 发布:单模型支持30种语言与16种方言,识别准确率领先
  • 6 日美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码
  • 5 日我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片
  • 4 日生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代
  • 3 日AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验
  • 2 日美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型
  • 1 日Claude Sonnet 5 发布
2026 年 6 月30
  • 30 日美团LongCat Owl Alpha:OpenRouter最流行模型,1.6万亿MoE,国产ASIC训练
  • 29 日Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus
  • 28 日阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色
  • 27 日OpenAI 预览新一代模型 GPT-5.6 Sol
  • 26 日Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模
  • 25 日OpenAI ChatGPT 语音最大规模升级:双向AI语音模型 Bidi 1 已上线测试
  • 24 日FastWan-QAD:单卡5090上1.8秒生成5秒视频
  • 23 日PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M
  • 22 日美团tabbit国际版免费接入GPT-5.5/Claude Opus 4.8等旗舰模型
  • 21 日微软双向转售GPT与DeepSeek成全球最大AI中间商
  • 20 日阿里开源向量数据库Zvec,UCSD黄碧薇教授提出因果AI第四代范式
  • 19 日首个统一科学大模型 LOGOS 正式开源
  • 18 日MolmoMotion:语言引导的3D运动预测模型
  • 17 日Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型
  • 16 日MiniMax 开源 M3 模型权重及 MSA 技术论文
  • 15 日Anthropic 暂停新模型访问,印度辩论 AI 未来
  • 14 日智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源
  • 13 日MiniMax M3 开源权重模型发布,已上架 HuggingFace
  • 12 日Gemini Omni Flash 视频任务达 SOTA
  • 11 日DiffusionGemma:文本生成速度提升4倍的开源扩散模型
  • 10 日Claude Fable 5 和 Claude Mythos 5
  • 9 日小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型
  • 8 日Harness-1:基于强化学习训练的有状态搜索20B检索子智能体
  • 7 日GitHub 开源 Spec Kit 工具包,用产品规范引导 AI 编码
  • 6 日Riverflow 2.5:可控制评分标准的图像模型
  • 5 日Nemotron 3.5 Content Safety:面向全球企业AI的可定制多模态安全
  • 4 日Grok Imagine 1.5 预览版发布
  • 3 日微软首款高级推理AI模型MAI-Thinking-1发布
  • 2 日MiniMax M3:前沿编码、100万token上下文与原生多模态一体模型
  • 1 日OpenAI发布生物防御AI工具Rosalind
2026 年 5 月31
  • 31 日Nano Banana Pro与Nano Banana 2正式发布
  • 30 日OpenAI推出实时翻译模型,支持70+语言输入
  • 29 日Claude Opus 4.8 发布:在编码、智能体技能与推理方面实现全面升级
  • 28 日Runway 推出 Model Context Protocol 服务器
  • 27 日谷歌 AI 框架 AlphaProof Nexus 攻克 2 道悬置 56 年数学难题
  • 26 日面壁智能联合清华等开源中国首个基于华为昇腾训练的 1.58-bit 端侧大模型 BitCPM-CANN
  • 25 日Luma Agents 实现规模化真实 UGC 广告生成
  • 24 日StepAudio 2.5实时语音发布:副语言感知与人格化交互
  • 23 日首个基于华为昇腾910B NPU全栈训练的1.58比特开源大模型BitCPM-CANN发布
  • 22 日Aleph 2.0 与 Edit Studio
  • 21 日Qwen3.7:智能体前沿
  • 20 日I/O 2026: 欢迎来到自主的 Gemini 时代
  • 19 日阿里云推出HappyHorse视频生成模型
  • 18 日Grok Imagine图像生成功能正式发布
  • 17 日社区协作再创佳绩,vLLM支持万亿级模型
  • 16 日MiniMax M2.7模型上线OrcaRouter平台
  • 15 日SenseNova U1技术报告发布,基于MoE架构开放模型权重
  • 14 日Hy3预览版登陆GMI,开源最强模型领跑
  • 13 日Claude Opus 4.7快速模式开放研究预览
  • 12 日SenseNova U1图像生成模型登陆ComfyUI平台
  • 11 日OpenCode x Ring 2.6 1T限时免费开放
  • 10 日ERNIE 5.1发布,预训练成本仅需对标模型6%
  • 9 日Ring-2.6-1T发布:万亿参数思维模型专为复杂任务设计
  • 8 日通过 API 中的新模型推进语音智能
  • 7 日SenseNova-U1开源8步蒸馏LoRA,推理速度大幅提升
  • 6 日GPT-5.5 Instant:更智能、更清晰、更个性化
  • 5 日语音克隆技术上线 真假难辨
  • 4 日从单张图像构建实时视频智能体:Runway Characters技术解析
  • 3 日模型别名新增"-latest"指向最新版本
  • 2 日GPT-5.5发布一周创营收新高
  • 1 日AntLingAGI开源Ling-2.6-1T模型,登陆Hugging Face平台
2026 年 4 月9
  • 30 日旗舰指令模型快速高效执行的秘诀:可靠基础设施与优化
  • 29 日Mistral AI发布Mistral Medium 3.5模型及Vibe远程编程智能体
  • 28 日小米开源MiMo-V2.5双模型,支持百万上下文与商用
  • 27 日Mistral AI 发布 Workflows 公开预览版,为企业AI工作流提供编排支持
  • 26 日DeepSeek V4模型限时2.5折优惠
  • 25 日迈入百万上下文普惠时代:DeepSeek-V4 模型预览版正式上线并同步开源
  • 24 日OpenAI 最智能 AI 模型:GPT-5.5 登场,Token 成本降至 1/35、每兆瓦输出提升 50 倍
  • 23 日inclusionAI/LLaDA2.0-Uni
  • 22 日inclusionAI/DR-Venus-4B-RL 发布
全部日报