内容
精选全部 AI 动态热点榜AI 日报主题收藏
接入
Agent 接入
更多
关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态
来源全部一手资讯X
类型全部
全部模型产品行业论文教程观点
标签「教程/实践」清除

8月8日周六

12:31公众号:MiniMax(稀宇科技)53MiniMax H3 开源首周 AMA:技术团队回应稀疏注意力、长视频续写与推理优化
11:57Barret李靖54AI 测试应转向目标驱动的验收方式
09:00ginobefun41BestBlogs 早报:贾扬清新公司、RSI、Cursor GPU 优化
05:42MarkTechPost(RSS)68用 NVIDIA NeMo Retriever 构建多模态 RAG 流水线:托管 NIM、LanceDB、重排序与 grounded 生成
05:12Hacker News 热门(buzzing.cc 中文翻译)68Databricks 将 AI 编码支出降低 70%:规模化成本管理实践
04:39Every:最新文章(网页)10Designing With AI? Make a Jig.
01:31Databricks:Blog(RSS)62Databricks 如何规模化管控 AI 编程成本

8月7日周五

23:11Nathan Lambert57Nathan Lambert 发布后训练免费视频课程
17:11Hacker News 热门(buzzing.cc 中文翻译)51vLLM 内部解析:高吞吐量 LLM 推理系统的架构
16:08AYi72豆包生成治愈短片:逃亡的文件
16:01公众号:面壁智能(MiniCPM)41独立开发者用VoxCPM克隆网红声音实现实时对话,获百万播放
14:51公众号:面壁智能(MiniCPM)65精选独立开发者用 VoxCPM 克隆网红声音,让 AI 终于"会聊天"了
09:00ginobefun35BestBlogs 早报:个人 AGI 与多模型路由等 10 条 AI 精选
08:40OpenRouter:Announcements(RSS)58OpenRouter 如何管理团队 AI 支出:6 项控制措施详解
07:31Databricks:Blog(RSS)58Databricks 详解什么是 Tool Calling
07:31Databricks:Blog(RSS)40什么是智能体工作流?
05:15Google AI Developers30Antigravity CLI 命令使用指南
03:53GitHub Blog69精选GitHub Copilot 应用中的斜杠命令使用指南
03:11Rohan Paul39Claude 用蓝牙信号帮用户找回手机
02:41gabriel39Energy 发布:AI 代理接管电脑工作
02:31LangChain:Blog(RSS)49Deep Agents、LangChain 与 LangGraph 有何区别及如何选择
01:41MarkTechPost(RSS)50Meta 的 Ax 自适应实验实战编码指南

8月6日周四

23:41jason57Jason Liu 展示首席参谋线程 /visualize 用法
22:10Nathan Lambert43Nathan Lambert 课程终章:性格训练导论
21:11OpenBMB65精选面壁智能 AMNESIAC:反向图灵测试 AI 审讯游戏
16:10Artificial Analysis66Qwen3.8 Max 发布:开源前评测 56 分紧追 Kimi K3
16:10Microsoft Research19微软研究院发布包容性AI设计三手册
12:09Ethan Mollick43Codex 用电脑控制帮用户重开蓝牙
12:01公众号:卡尔的AI沃茨70精选分享10个能大幅提升vibe coding幸福感的开源App
12:01公众号:龙猫LongCat(美团)57Agent评测漫谈:从打分动作走向基础设施能力
09:30公众号:数字生命卡兹克80精选OpenAI 开源 Codex Security:Vibe Coding 产品必备的安全扫描插件
08:09Hacker News 热门(buzzing.cc 中文翻译)25构建一个先进的代理式测试框架
07:24Runway:News(网页)31Chime 如何用 Runway 制作最新全国电视广告
06:09MarkTechPost(RSS)71精选用 Google Meridian 构建端到端贝叶斯营销组合模型:媒体测量、ROI 分析与预算优化
05:09Nathan Lambert50Nathan Lambert 讲解 AI 评测演进与智能体评测
05:09Hacker News 热门(buzzing.cc 中文翻译)634B开源模型经Castform后训练,检索任务超越GPT-5.6 Sol且成本低100倍
03:55Simon Willison 博客70精选用 Claude Fable 5 一次性生成完整《Raccoon Heist》游戏
02:39OpenAI Developers34Codex 语音模式:边聊边构建新玩法
01:39Rohan Paul36Jeff Dean 详述谷歌 TPU 诞生始末
00:31ByteByteGo(RSS)46知识蒸馏:大模型如何教会小模型变聪明
已加载 40 条
全部 AI 动态
2026年8月9日星期日 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
标签「教程/实践」 · 1829 条清除

8月8日

星期六 · 7 条
12:31
公众号:MiniMax(稀宇科技)
53
MiniMax H3 开源首周 AMA:技术团队回应稀疏注意力、长视频续写与推理优化

MiniMax H3 技术团队在 Reddit AMA 和 ComfyUI 直播中回应开发者提问:模型不使用 MSA,稀疏注意力策略更接近 MoBA,默认仅对视频 token 做 3D sparsification,近期将发布保守版本。

多模态教程/实践视频
11:57
Barret李靖@Barret_China
54
AI 测试应转向目标驱动的验收方式

Barret 李靖认为 AI 完全有机会在验收测试上测得比人更完善,关键在于两点:完整理解需求(偏向 BDD 或 Goal Driven Verification,而非 TDD)和具备足够的手脚眼(编写 E2E 用例,通过 OCR、模拟点击、截图等丰富界面认知)。其团队实践为每次迭代让 AI 分析代码 diff、编写并自修正 E2E 测试,全程记录操作生成测试报告,再回头判断是否达成最初目标。

智能体教程/实践部署/工程
09:00
ginobefun@hongming731
41
BestBlogs 早报:贾扬清新公司、RSI、Cursor GPU 优化

BestBlogs 8 月 8 日早报精选 10 条 AI 动态:贾扬清官宣第二家创业公司 Intent Lab,其上一家 Lepton AI 被英伟达收购;田渊栋联合创立的 Recursive Superintelligence 估值超 46 亿美元。

ginobefun: http://x.com/i/article/2085881794776518656

Hugging FaceOpenAI大佬观点教程/实践
05:42
MarkTechPost(RSS)
68
用 NVIDIA NeMo Retriever 构建多模态 RAG 流水线:托管 NIM、LanceDB、重排序与 grounded 生成

本教程演示如何用 NVIDIA NeMo Retriever 构建多模态 RAG 流水线:先以 PDFium 离线提取 PDF 文本,再通过托管 NIM 端点检测页面元素、抽取表格/图表/信息图并生成稠密向量存入 LanceDB。随后实现稠密检索、视觉-语言重排序、元数据过滤搜索及带内联引用的 grounded 生成,并用 recall-at-k 评估检索质量。

检索增强多模态教程/实践部署/工程
05:12
Hacker News 热门(buzzing.cc 中文翻译)
68
Databricks 将 AI 编码支出降低 70%:规模化成本管理实践

Databricks 通过迁移至更高效模型、动态路由及元 harness 等策略,将 AI 编码支出降低 70%,同时保持每用户成本大致固定。该公司已开源其关键基础设施组件 Omnigent 与 Unity AI Gateway。Stripe 等企业发现 Opus 4.7 较 4.6 质量无提升且成本更高,因此未内部部署。

教程/实践编码部署/工程
04:39
Every:最新文章(网页)
10
Designing With AI? Make a Jig.
教程/实践
01:31
Databricks:Blog(RSS)
62
Databricks 如何规模化管控 AI 编程成本

Databricks 分享了规模化管控 AI 编程成本的方法,其智能体编程已带来可衡量的价值提升。文章重点探讨了在团队规模扩大时,如何通过成本追踪、工具选型与使用策略,在维持代码质量与开发效率的同时,控制 AI 编程工具带来的支出增长。

教程/实践编码

8月7日

星期五 · 15 条
23:11
Nathan Lambert@natolambert
57
Nathan Lambert 发布后训练免费视频课程

Nathan Lambert 完成其夏季项目:一套 20 个视频的免费后训练课程,约 12 小时内容,配套幻灯片可修改复用。课程覆盖核心基础及他认为重要性将上升的研究方向,并附有代码练习。为庆祝发布,其书籍在 Manning 平台使用代码 PBLambert 可享 50% 折扣。

教程/实践数据/训练
17:11
Hacker News 热门(buzzing.cc 中文翻译)
51
vLLM 内部解析:高吞吐量 LLM 推理系统的架构

vLLM 的 LLM 引擎是其核心构建块,支持离线高吞吐量推理,包含调度器、KV 缓存管理器(分页注意力核心)等组件。文章基于 commit 42172ad(2025 年 8 月 9 日),聚焦 V1 引擎,从单 GPU 离线场景逐步扩展到多 GPU、分布式及服务层,并涵盖分块预填充、前缀缓存、引导与推测解码等高级特性。

推理教程/实践部署/工程
16:08
AYi@AYi_AInotes
72
豆包生成治愈短片:逃亡的文件

阿易 AI Notes 用豆包制作了一支 15 秒治愈故事短片《逃亡的文件》:被清空回收站的小文件在键盘狂奔、躲进咖啡杯变小鱼、化纸鹤飞逃,最终钻进笔记本变成手写字被永久保存。视频将昏暗实拍与粗糙发光手绘帧动画融合,全程第一人称手持抖动视角,并附完整分镜提示词。

John: 创意玩法视频,非常有趣好玩😄 晚安,玛卡巴卡🌙 prompt 👇 15 秒,16:9 横屏视频。将昏暗室内的实拍画面与粗糙、发光的手绘帧动画融合。整体气质可爱、荒诞、轻快、治愈,表现一枚电脑光标突然决定提前下班,并在真实房间里完成一场...

教程/实践视频
16:01
公众号:面壁智能(MiniCPM)
41
独立开发者用VoxCPM克隆网红声音实现实时对话,获百万播放

独立开发者叶小叔用面壁智能开源的VoxCPM声音克隆模型,成功让AI克隆网红声音并实现实时对话,视频在抖音获100万播放、X上5.9万人围观。此前他尝试本地开源模型(TTS合成需14-40秒)和云端Cartesia Pro(中文效果不佳)均失败,最终租用RunPod L4 GPU($0.4/小时)部署VoxCPM,TTS首包延迟不到1秒,端到端体感2-3秒。

开源生态教程/实践语音
14:51
公众号:面壁智能(MiniCPM)精选
65
独立开发者用 VoxCPM 克隆网红声音,让 AI 终于"会聊天"了

独立开发者叶小叔用面壁智能开源的 VoxCPM 克隆千万粉丝网红声音,搭建 STT → LLM → VoxCPM(TTS)三段式实时对话管道,TTS 首包延迟不到 1 秒,端到端体感 2 到 3 秒。

Hugging Face开源生态教程/实践语音

推荐理由:案例的实践价值在于澄清了实时对话 TTS 环节的选择逻辑:中文原生支持与默认参数平衡往往优于盲目追求极致克隆,这一取舍对同类项目具直接参考。
09:00
ginobefun@hongming731
35
BestBlogs 早报:个人 AGI 与多模型路由等 10 条 AI 精选

BestBlogs 08-07 早报精选 10 条 AI 内容:Garry Tan 详解个人 AGI 基础设施;Cognition、NVIDIA 与 OpenRouter 探讨多模型路由生产级控制层。

ginobefun: http://x.com/i/article/2085515679424507904

教程/实践现象/趋势行业动态
08:40
OpenRouter:Announcements(RSS)
58
OpenRouter 如何管理团队 AI 支出:6 项控制措施详解

OpenRouter 提供 6 项控制措施来管理团队 AI 支出,涵盖预算、每密钥限额、模型/供应商白名单、Guardrails、工作区预算和 Activity 仪表盘。

教程/实践部署/工程
07:31
Databricks:Blog(RSS)
58
Databricks 详解什么是 Tool Calling

Tool calling 是 AI 模型调用外部工具和 API 的能力,让模型能突破自身局限、执行实时数据获取或具体操作。该机制通常涉及模型生成结构化请求、系统调度执行并将结果返回模型,从而完成更复杂的任务。Databricks 从概念、工作原理到应用场景对这一能力进行了系统说明。

智能体MCP/工具教程/实践
07:31
Databricks:Blog(RSS)
40
什么是智能体工作流?

智能体工作流正成为企业从单次提示词交互迈向多步骤自动化任务的关键范式。这类工作流让 AI 系统能够自主规划、调用工具并迭代执行复杂任务,而非仅生成单一回答。Databricks 从架构、应用场景与工程实践角度解析了智能体工作流的定义与落地路径。

智能体教程/实践
05:15
Google AI Developers@googleaidevs
30
使用这些 @Antigravity 命令来更高效地操作 CLI、管理后台任务、配置工具,以及运行研究子智能体。🚀
Google教程/实践部署/工程
03:53
GitHub Blog精选
69
GitHub Copilot 应用中的斜杠命令使用指南

GitHub Copilot 应用中的斜杠命令可帮助管理会话、导航项目和自定义 Copilot 工作流。与 CLI 版不同,应用版命令更侧重工作流,如 /plan 用于编码前规划、/spar 用于挑战方案假设、/autopilot 用于自动执行实现。/clear 和 /model 在 CLI 和应用中均可用。

智能体GitHub教程/实践编码

推荐理由:文章不是罗列命令,而是提供了可复用的场景模板,为 /plan、/spar 等命令配好了规划、评审和实现的具体提示词,省去从零组织任务描述的时间。
03:11
Rohan Paul@rohanpaul_ai
39
一个关于 Claude 的野生故事他在工作中丢失了手机,但因为公司禁用了"查找我的手机"功能,无法使用。于是 Claude 编写了一个小程序,通过测量蓝牙信号强度,让他循着信号找到了设备。
Anthropic教程/实践编码
02:41
gabriel@gabriel1
39
我用 Energy 运行所有任务我刚问了 Energy,所以它现在每 5 分钟查看一次发布帖的回复,并把任何新 bug 发到 Slack

gabriel: 3 months ago i resigned from @OpenAI. today we are launching Energy everyone will soon use AI for all work on their comp...

智能体教程/实践
02:31
LangChain:Blog(RSS)
49
Deep Agents、LangChain 与 LangGraph 有何区别及如何选择

LangChain 官方对比了 Deep Agents、LangChain 与 LangGraph 三种构建智能体的不同路径。文章梳理了三个开源框架的核心差异,并给出各自适用场景:LangChain 适合快速上手,LangGraph 适合精细控制,Deep Agents 则面向更自主的智能体设计。

智能体教程/实践
01:41
MarkTechPost(RSS)
50
Meta 的 Ax 自适应实验实战编码指南

本教程演示如何用 Meta 的 Ax 现代 Client API 进行自适应实验,在合成分类数据集上调优 RandomForest 模型,同时平衡预测准确率与模型体积。工作流从定义包含整数、浮点、对数缩放和类别参数的混合搜索空间开始,逐步展示完整调优流程。

Meta教程/实践

8月6日

星期四 · 18 条
23:41
jason@jxnlco
57
99% 的人不知道,你可以告诉你的首席参谋线程使用 /visualize我有一个置顶的旅行线程,它会告诉我我的旅行日程。@PhilippSpiess 在这方面做了非常出色的工作。
智能体教程/实践
22:10
Nathan Lambert@natolambert
43
Nathan Lambert 课程终章:性格训练导论

Nathan Lambert 在其课程最后一讲发布“性格训练”导论,称该主题已深耕约 18 个月,具备高现实影响力且被前沿实验室广泛使用,但相关实证文献几乎空白。讲座涵盖性格训练定义、模型规范与宪章差异、现实动机、推荐论文及开放问题,旨在吸引更多研究者进入该领域。

安全/对齐教程/实践数据/训练
21:11
OpenBMB@OpenBMB精选
65
面壁智能 AMNESIAC:反向图灵测试 AI 审讯游戏

面壁智能 OpenBMB 在 #BuildSmall 黑客松推出 AMNESIAC,一款反向图灵测试交互游戏:玩家需说服 AI 审讯官 A.M.N. 自己是人类。该游戏由 MiniCPM-o 4.5 驱动实时对话与推理,VoxCPM 生成审讯官语音,并结合摄像头面部表情、脉搏信号与响应计时进行多模态审讯。项目已开源至 HuggingFace。

多模态教程/实践语音

推荐理由:将摄像头面部信号、语音对话和LoRA角色塑形组合进一个可玩演示,为交互式AI角色提供了比常见聊天机器人更丰富的多模态模板。
16:10
Artificial Analysis@ArtificialAnlys
66
Qwen3.8 Max 发布:开源前评测 56 分紧追 Kimi K3

阿里发布 Qwen3.8 Max,在 Artificial Analysis 智能指数上得 56 分,较前代提升 10 分,落后开源权重领先者 Kimi K3(57 分)1 分,但每任务成本 $1.14 高于后者的 $0.86。

开源生态推理教程/实践
另有 5 家信源报道X:阿易 AI Notes (@AYi_AInotes)X:Testing Catalog (@testingcatalog)X:Artificial Analysis (@ArtificialAnlys)X:Kim (@kimmonismus)The Decoder:AI News(RSS)
16:10
Microsoft Research@MSFTResearch
19
最好的AI不仅会扩展规模,还会适应它所服务的语言、文化、人群和社区。探索三份手册,帮助团队在设计、部署和评估AI系统时将包容性纳入考量。
Microsoft教程/实践
12:09
Ethan Mollick@emollick
43
我不小心关掉了 Windows 电脑上的蓝牙,鼠标没法用了,结果发现用键盘很难重新打开蓝牙。于是我打开 Codex,告诉它打开蓝牙,它用电脑控制功能,打开设置,点了一下。挺傻但挺有用。
智能体OpenAI教程/实践
12:01
公众号:卡尔的AI沃茨精选
70
分享10个能大幅提升vibe coding幸福感的开源App

作者整理了10个提升vibe coding体验的开源App,涵盖Mac刘海屏改造(Atoll)、窗口预览(DockDoor)、极速启动器(Raycast)、彻底卸载(Pearcleaner)、菜单栏折叠(Thaw)等工具。这些工具均为免费开源,可将重复操作压缩为快捷指令,降低试错成本。作者还提到可用Codex随时为这些开源App添加自定义功能。

开源生态教程/实践

推荐理由:十个工具分别针对刘海利用、窗口预览、快捷启动等细分痛点,组合后可将编程前的准备步骤压缩为几次按键或悬停。
12:01
公众号:龙猫LongCat(美团)
57
Agent评测漫谈:从打分动作走向基础设施能力

美团图灵Agent评测团队公开内部博客,系统讲解Agent评测方法论。评测核心是回答“Agent好不好”,需覆盖结果、过程、效率、风险四层,并以观测为基石。团队提出“人人一致、人机一致”对齐法,通过指标下钻与Rubric二元化,使数字站长人机一致率达99%,Beam从62%提升至92%。文章还探讨了长程Agent(如Claude Code)对观测评测带来的演进。

智能体教程/实践评测/基准
09:30
公众号:数字生命卡兹克精选
80
OpenAI 开源 Codex Security:Vibe Coding 产品必备的安全扫描插件

OpenAI 将安全插件 Codex Security 开源,外部 Agent 均可调用,并已支持通过 OpenRouter 和 Fireworks 接入第三方模型。

智能体OpenAI安全/对齐开源/仓库

推荐理由:在非专业开发者大量借助 AI 构建产品的趋势下,这款插件把过去需安全专家执行的漏洞扫描转化为上线前的例行检查,让安全不再成为追速时的盲区。
08:09
Hacker News 热门(buzzing.cc 中文翻译)
25
构建一个先进的代理式测试框架

文章介绍如何构建一个先进的代理式测试框架(Agentic Harness),用于系统化评估和测试AI智能体。框架设计聚焦于可重复、可扩展的测试流程,以验证智能体在复杂任务中的表现。文中讨论了框架的核心架构、关键组件以及实际应用中的考量,为开发者提供了一套完整的测试解决方案参考。

智能体教程/实践
07:24
Runway:News(网页)
31
Chime 如何用 Runway 制作最新全国电视广告

Chime 执行制片人 Shayla Love 透露,团队用 Runway 将原本需约 30 万美元、涉及 80 多名真实会员的电视广告尾卡制作压缩至 3 万美元以内,且几乎无制作开销。Runway 的定制工作流将质量参差的 UGC 照片转化为稳定、达到电视播出标准的动态画面。团队还计划用 Runway 制作概念故事板,以加速广告审批流程。

图像生成教程/实践视频
06:09
MarkTechPost(RSS)精选
71
用 Google Meridian 构建端到端贝叶斯营销组合模型:媒体测量、ROI 分析与预算优化

本教程使用 Google Meridian 构建完整的贝叶斯营销组合建模工作流,涵盖数据加载、ROI 先验配置、NUTS 采样拟合及收敛性评估。通过 Analyzer API 提取渠道贡献、ROI、边际 ROI、adstock 与饱和曲线等后验指标,并计算渠道间 ROI 比较概率。最后用 BudgetOptimizer 优化固定与灵活预算,生成可分享的 HTML 报告并保存模型复用。

Google教程/实践数据/训练

推荐理由:完整工作流把先验设定、后验采样、诊断和预算优化串联为可执行步骤,让营销分析团队能自行量化渠道贡献与 ROI 不确定性。
05:09
Nathan Lambert@natolambert
50
Nathan Lambert 讲解 AI 评测演进与智能体评测

Nathan Lambert 发布评测讲座,梳理其亲历的评测时代变迁:从 GPT-3 提示词式“高级自动补全”,到如今复杂的智能体沙盒环境。讲座重点剖析智能体评测(借鉴 @xeophon 观点),并探讨评测如何被操纵及其真实用途,涵盖后训练评测时代、智能体评测入门及“数字能否可信”等章节。

教程/实践评测/基准
05:09
Hacker News 热门(buzzing.cc 中文翻译)
63
4B开源模型经Castform后训练,检索任务超越GPT-5.6 Sol且成本低100倍

一个4B开源模型经Castform后训练后,在检索任务中达到与GPT-5.6 Sol相当的准确率,而每次请求成本仅为后者的百分之一。典型多轮搜索请求调用gpt-5.6-sol耗时超10秒、端到端成本约0.03美元,而小规模开源权重模型便宜100倍。Castform通过RL后训练弥合差距,并利用Neon的Lakebase Search实现训练与推理。

智能体搜索教程/实践
另有 1 家信源报道IT之家(RSS)
03:55
Simon Willison 博客精选
70
用 Claude Fable 5 一次性生成完整《Raccoon Heist》游戏

Simon Willison 将 2022 年 GPT-3 和 DALL-E 生成的游戏概念与截图输入 Claude Fable 5(运行于 Claude Code for web),成功构建出可玩的 3D 浏览器游戏。

智能体AnthropicOpenAI教程/实践

推荐理由:给出从旧推文到可运行游戏的完整闭环:用 GitHub Pages 实时预览、Playwright 自动抓屏修复,使 agent 能在无人类干预下迭代出可用产物,适合探索 agent 编码游戏的开发者直接复用该流程。
02:39
OpenAI Developers@OpenAIDevs
34
OpenAI 开发者账号分享,开发者正用 Codex 语音模式探索"边聊边构建"的新方式。语音对话可随时开启新 Codex 会话执行任务,并像"管理器"一样检查其他线程进度。

Jason: Totally jamming with Codex voice mode. Talk in one chat, it's where you riffa and when you land on a solid outcome it wi...

智能体OpenAI教程/实践
01:39
Rohan Paul@rohanpaul_ai
36
Jeff Dean 详述谷歌 TPU 诞生始末

Jeff Dean 在访谈中回顾 TPU 的起源:2010 年代初他估算,若 1 亿人每天用语音识别 3 分钟且全跑在 CPU 上,谷歌需为此增加约一倍服务器,成本与功耗不可接受。他因此力排众议,放弃 FPGA,推动定制 ASIC 芯片 TPUv1(PCIe 卡上的推理芯片),并说服 CFO 在用例完全明确前先部署约 5000 万美元的该芯片。

Rohan Paul: Google's chief scientist is leaving after 27 years to build AI that can run its own research cycle with little human hel...

Google教程/实践部署/工程
00:31
ByteByteGo(RSS)
46
知识蒸馏:大模型如何教会小模型变聪明

知识蒸馏通过让一个较小的学生模型模仿大型教师模型的输出,训练出独立的新模型,而非像量化和剪枝那样压缩原模型。教师输出的软标签(如猫0.70、狗0.25、狐狸0.05)比单一硬标签携带更多类别关系信息,即“暗知识”,这是蒸馏效果优于直接学习原始标签的核心原因。Google的Gemma模型即在训练中利用Gemini家族的更大模型进行蒸馏,蒸馏后还可再量化以进一步缩小模型。

教程/实践数据/训练部署/工程
已加载 40 条