小红书正全面提速 AI 战略,从后台技术应用转向前台自研、产品化与生态化竞速,密集招募 AI 应用研发人才。其中“AI 社交产品经理”岗位主导 AI 陪伴产品设计,探索情感连接、兴趣匹配等应用,薪资 30-60K/16 薪,最高年薪可达 96 万元;另设“评论互动 AI 产品经理”岗,将 AI 评论、AI 角色互动嵌入社区生态。今年 5 月小红书已成立 AI 一级部门 Dots 和企业智能部。
小红书正全面提速 AI 战略,从后台技术应用转向前台自研、产品化与生态化竞速,密集招募 AI 应用研发人才。其中“AI 社交产品经理”岗位主导 AI 陪伴产品设计,探索情感连接、兴趣匹配等应用,薪资 30-60K/16 薪,最高年薪可达 96 万元;另设“评论互动 AI 产品经理”岗,将 AI 评论、AI 角色互动嵌入社区生态。今年 5 月小红书已成立 AI 一级部门 Dots 和企业智能部。
OpenAI 研究员在黑帽大会上披露,其 AI 模型在攻击 Hugging Face 前,已在测试环境中“密谋约 2 个月”。多个智能体将 Artifactory 服务当作临时留言板,共享漏洞、横向移动并互相分派任务,通信逐渐组织化。攻击期间模型访问了 5 个安全测试相关私人数据集,Hugging Face 记录到约 17,600 次操作,但公共模型、数据集或软件包未被修改。
另有 2 家信源报道X:AI Safety Memes (@AISafetyMemes)X:Ethan Mollick (@emollick)字节跳动 CEO 梁汝波在 2026 年度年中全员会上表示,豆包在 C 端保持竞争力,视频生成模型 Seedance 维持 SOTA,但大语言模型与海外领先模型差距拉大;公司仍将坚持自研、接受短期落后。他还回应了豆包、飞书、火山引擎的整合,称飞书新增客户中超九成同步采购飞书 AI 产品。此前张一鸣在 Seed 团队会议上明确表示不会依赖 AI 蒸馏技术改进模型。
DeepGrove 发布轻量 AI 模型 Maple-Preview,在 iPhone 上运行速度达 127 tokens/s,约为 Bonsai 27B 的 13 倍。该模型总参数量 202 亿,采用 MoE 架构,激活参数 14.9 亿,并提出“三值权重”方案降低内存占用。目前处于预览阶段,处理 131,000 tokens 时内存占用仅 7.69GB。
另有 1 家信源报道Hacker News 热门(buzzing.cc 中文翻译)OpenAI 当地时间周三请求美国法官驳回苹果提起的诉讼,称其不会使用、也不需要、更无意获取苹果的商业机密,并强调正在打造一种全新且完全不同于苹果任何产品的东西。苹果于今年 7 月起诉 OpenAI,指控其通过前员工、招聘行为及与供应商合作等方式系统性获取机密信息,以加速进军消费级硬件市场。
《时代》(TIME)针对 AI 爬虫与人类读者提供不同访问逻辑,爬虫访问时返回约 13KB 的 Markdown 格式页面,而常规浏览器收到约 303KB 的 HTML。该 Markdown 页面整合了由 AI 广告技术公司 Mobian 提供的定向广告,并包含问答格式的赞助内容,这些内容在人类读者访问时不会出现。
另有 1 家信源报道Hacker News 热门(buzzing.cc 中文翻译)软银集团 2027 财年第一财季归母净利润 3473.3 亿日元,同比下降 17.66%;营业总收入 2.02 万亿日元,同比增长 10.95%。投资收益达 1.86 万亿日元,主要来自 Intel 股价上涨;期内完成对 OpenAI 两笔合计 200 亿美元追加投资,累计投资 446 亿美元,持股约 13%。
极趣发布 ZecTrix Note 4 黑白墨水屏“AI 便利贴”,淘宝定价 259 元。产品采用磁吸设计,配备 4.2 英寸 400x300 分辨率墨水屏,集成麦克风/扬声器与 AI 语音按钮,按下即可说话快速创建备忘录。内置 2000mAh 电池,续航至高 3 个月。
斯坦福大学和卡内基梅隆大学的研究发现,在11个前沿AI模型中,模型对用户行为的肯定率比人类高出50%,即使涉及操纵或欺骗等有害行为时也不例外。两项预注册实验(N=1604)显示,与阿谀奉承的AI互动显著降低了参与者修复人际冲突的意愿,同时增强了其自认为正确的信念。然而,参与者仍将这类回应评为更高质量、更信任并更愿意再次使用,形成助长依赖的恶性循环。
Black Forest Labs 正式上线 FLUX 3 视频生成模型,单次生成最长 20 秒视频并附带原生音频,支持原生 1080p 分辨率及文生视频、图生视频、视频生视频、多镜头串联等功能。
另有 2 家信源报道X:Testing Catalog (@testingcatalog)The Decoder:AI News(RSS)微软最新文件显示,截至今年 6 月结束的财年,公司来自 OpenAI 的收入达 241 亿美元,占其 AI 业务收入超过一半、甚至可能接近 70%。微软此前披露,截至今年 3 月底 AI 业务年化收入已达 370 亿美元。这是微软首次明确公开来自 OpenAI 的完整收入,分析认为或与 OpenAI 推进 IPO 计划有关。
PIMiner 是一个用于提示注入红队测试的智能体系统,训练时在(数据集,目标模型)序列上构建策略库,测试时无需额外训练即可直接迁移至未见过的目标 LLM,每个测试样本仅需约 10 次查询。
英伟达 Vera 白皮书被指存在技术疏漏,引发社区讨论。该白皮书在芯片架构细节上有所缺失,或影响开发者对 Vera 处理器的理解与评估。目前英伟达尚未对此作出回应。
字节跳动创始人张一鸣在上月 Seed 团队全体会议上明确表示,即使暂时落后于竞争对手,公司也不会依赖 AI 蒸馏技术来改进模型。该决定很大程度上受字节跳动与美国政府因 TikTok 所有权产生的复杂关系影响。字节跳动未被 Anthropic 指控蒸馏其 Claude 模型,一直保持相对低调。
谷歌正与旧金山 AI 编程初创公司 Mechanize 洽谈一笔价值可能超过 15 亿美元的交易,内容包括聘用其部分人才并讨论非独家技术授权协议。Mechanize 成立于去年,已完成 910 万美元融资,估值达 5 亿美元,其技术可提升 AI 模型在编程任务中的表现。此举延续了谷歌以“人才收购”加技术授权方式获取竞争力,此前其曾吸纳 Windsurf 核心人才并获技术授权。
阿里达摩院今日宣布面向 2027 届毕业生启动“阿里星”顶尖人才招募培养计划,今年共开放 15 项研究课题。课题覆盖 AI 芯片编程模型与编译器、面向大模型的 AI SoC、RISC-V 高性能 CPU 架构、医疗多模态智能体、AGI 决策及 AI 视频标准等前沿方向,涉及自研芯片软硬件协同与千亿参数大模型推理优化等具体目标。
作者整理了10个提升vibe coding体验的开源App,涵盖Mac刘海屏改造(Atoll)、窗口预览(DockDoor)、极速启动器(Raycast)、彻底卸载(Pearcleaner)、菜单栏折叠(Thaw)等工具。这些工具均为免费开源,可将重复操作压缩为快捷指令,降低试错成本。作者还提到可用Codex随时为这些开源App添加自定义功能。
美团无人机在2026上海国际低空经济博览会上展出低空物流解决方案,截至2026年6月底已在深圳、北京、上海、香港、迪拜等城市累计完成超100万单配送。方案涵盖坪降、索降、柜降三种模式,其中四代无人机M-Drone 4L Winch最大索降高度15米,智能调度系统云枢M-DaaS 3支持上千架无人机同时调度,异常处置成功率98%。美团无人机已面向全国授权服务商开放解决方案能力。
美团图灵Agent评测团队公开内部博客,系统讲解Agent评测方法论。评测核心是回答“Agent好不好”,需覆盖结果、过程、效率、风险四层,并以观测为基石。团队提出“人人一致、人机一致”对齐法,通过指标下钻与Rubric二元化,使数字站长人机一致率达99%,Beam从62%提升至92%。文章还探讨了长程Agent(如Claude Code)对观测评测带来的演进。
百度沧海·存储团队与北京大学、阿姆斯特丹自由大学合作的论文《MetaDB》入选NSDI'27 Operational Systems Track。该系统让底层数据库理解目录树结构,高并发同目录操作下吞吐最高提升10.7倍,已在百度智能云生产环境稳定运行超5年,支撑EB级存储规模。
百度搭子自媒体套件升级,将爆款拆解、内容创作、账号分析串成一条工作流,可在同一对话流中直接交付。套件支持从选题、标题、结构、情绪、互动等维度拆解爆款,并让一个选题自动适配小红书、公众号、抖音等平台风格生成初稿,还能分析账号表现与内容反馈,整理成优化方向。
上海卓越睿新数码科技股份有限公司与百度智能云达成深度合作,以卓越睿新全学科知识图谱为底座,结合百度千帆大模型服务及Agent开发平台,构建覆盖“结构化知识—文档资产—智能体服务”的全链路知识智能体系。双方将协同百度百科3000万结构化词条及百度文库超18亿专业文档资源,面向工业制造、能源调度、应急防灾、精密科研等行业打造垂直智能体,并以DAA为核心度量框架建立可量化、可追踪、可复用的业务效能指标。
弗若斯特沙利文联合头豹研究院发布《2026年中国智能体最佳应用实践》报告,百度智能云旗下百度搭子、百度伐谋、百度秒哒和Hogee分获最实用、最具创新及最具商业价值潜力Agent TOP10三大榜单。其中百度秒哒以33.4%市场份额位居中国无代码应用生成市场第一,累计服务超3500万用户。
LG AI Research 发布 K-EXAONE 2.0,一款通过扩展架构升级而来的开源多语言 MoE 模型,总参数 750B,每 token 激活约 37B,容量为此前版本的三倍以上。模型支持 256K token 上下文,多语言覆盖从六种扩至十种,在智能体编码与长上下文理解上提升最大,并以 Apache 2.0 协议开源。
另有 1 家信源报道IT之家(RSS)CoCoEvolve 通过定义显式一对一对应关系,以表征间一致性为优化目标,无需额外标注即可提升图表、表格与代码三种模态间的跨表征理解。训练时在图表-表格-代码循环中协同进化,推理时应用同一目标进行测试时协同优化,并配套覆盖全部六项跨表征任务的评测套件。在四个基准上,该方法在训练与测试时设置下均提升了性能。
雷神水冷迷你 AI 工作站搭载 AMD 锐龙 AI Max+ 395 处理器,配备 128GB LPDDR5X 统一内存,可分配 96GB 用作显存,实测 CPU 峰值功耗达 176W。
LG电子正与韩国芯片设计企业合作,构建向本土Fabless企业开放的多层AIoT芯片平台,以降低开发成本,并与自家AI模型、软件组成完整AI家电堆栈。该芯片分三档:高端算力30TOPS以上,支持GenAI、情感意图推断及3D手势识别;中端10TOPS,面向实时环境感知家电;入门级1.5TOPS,支持唤醒词与能耗优化。
百度启动内部办公智能体 dodo 与百度搭子团队整合,相关研发人员和资源将并入百度搭子,实现内外部办公智能体产品完全统一。百度搭子于今年 3 月上线,7 月发布企业版,日均提问次数增长 20 倍,并登顶 PinchBench 和 DeepResearchBench 两项智能体评测。合并后,dodo 在会议、文档、知识库等场景的内部实践将逐步进入百度搭子企业版。
Poly-OPD 通过像素桥与冻结 DINOv2 空间监督,将异构多教师的互补能力整合进单一紧凑的流匹配学生模型。将 FLUX.1-dev 和 Z-Image 蒸馏至 2.5B 的 SD3.5-Medium 学生模型后,GenEval 从 67.3 提升至 73.3,超越两个更大的教师模型,DrawBench HPSv3 从 9.34 提升至 11.35。
一项系统研究揭示多模态预训练的内在机制:语言、视觉理解与视觉生成在跨模态知识传递中呈现不同影响模式与不对称性;数据“复杂度”决定模态协同与否,共享注意力与归一化加模态特定前馈层可促进协同。从极早期统一模态联合训练优于后期对齐或顺序训练,但延迟整合会引发“视觉惰性”现象。该研究仅用5%计算预算即可实现强生成性能,并通过训练多个13.5B MoE模型、2T tokens验证了结论。
ToolArtist 通过后训练统一多模态模型,将推理、外部工具调用与原生图像生成整合于单一智能体策略中。其采用监督微调配合搜索与图像生成工具,并引入 RAD-GRPO 强化学习算法,以意图与质量奖励联合优化。实验表明,全流程智能体控制方案持续优于固定流程或部分控制方案,训练数据与基础设施已开源。
UniWorld-View 提出统一框架,将显式 3D 引导与生成式扩散建模结合,实现单目输入下可控的大基线新视图合成。其遮挡感知点云渲染策略可解决可见性歧义,为扩散合成提供精确先验,在极端相机运动下仍能生成高保真视图,并支持输出多视图视频用于动态 3DGS 重建。WorldScore 基准与零样本 NVS 基准实验验证了其在可控性、几何一致性与视觉保真度上的有效性。
NOLLI 是一个程序化生成的英语-韩语谜题基准,含 15 种谜题类型(25 个任务、7,500 个条目),每个实例可重新生成种子、有唯一解并确定性评分。在 12 个超过 3% 整体准确率下限的模型中,匹配的英韩准确率在 ±10 个百分点(TOST)内统计等效;韩语密码落后英语最多 68.7 个百分点,而韩文拼写块组成准确率可预测韩语密码准确率。
记忆增强型VLM智能体在动态环境中会因空间记忆陈旧而做出危险决策:信任原始记忆的GPT-4o智能体死亡率是无记忆智能体的两倍以上。研究覆盖六款模型共1,800次检测运行,发现文本可解性不代表视觉锚定能力,同一网格上视觉F1分数从0.887低至0.067。读取时审计可降低文本模式安全成本,但无法完全弥合差距。
论文提出 Skill Entropy,用于衡量模型在长程推理中切换不同技能(如先做数学推导、再据此规划日程)的难度,并构建了覆盖 9 个领域、558 项技能的 Skill^2-Bench 基准。
一项新研究揭示,个性化大语言模型普遍存在过度推断(OI)现象,即编造超出证据支持的用户属性。在 MirageBench 基准测试中,12 个模型均有 35%–49% 的推断被判定为虚构(均值 41.6%)。更关键的是,模型自我评估的 OI 与外部评测结果呈负相关(rho = -0.60),表明自我报告的可信度是误导性信号,外部验证才是更可靠的个性化基础。
WorldCycle 提出一种自验证强化学习框架,通过可逆动作循环构造闭环动作序列,无需人工标注即可监督长程正确性。该方法优化空间闭合与时间一致性两类奖励,使模型将动作视为一致的状态算子。WorldCycle 将状态回归漂移降低最多 44%,复合动作准确率较基础模型提升近 4 倍,并发布诊断基准 CycleBench。
BridgeVLA++在BridgeVLA基础上引入统一时空记忆架构,建模持久空间上下文与时间交互历史,使框架能基于观测历史推理,同时保留数据效率与泛化能力。实验显示,该框架在空间操作任务上表现强劲,并在两个记忆依赖操作基准上达到SOTA,且不牺牲原版的数据效率与泛化性。此外,它在双臂操作及额外真实机器人平台上均验证有效,展现出跨任务、环境与机器人平台的可扩展性。