埃森哲内部数据显示,token 消耗的主要推手并非工程师,而是大量非工程人员。该公司智能体 AI 战略负责人透露,将 PDF 转为图片再转成 markdown 文件是最大的 token 消耗源之一。企业正因此争相控制 AI 相关支出。
埃森哲内部数据显示,token 消耗的主要推手并非工程师,而是大量非工程人员。该公司智能体 AI 战略负责人透露,将 PDF 转为图片再转成 markdown 文件是最大的 token 消耗源之一。企业正因此争相控制 AI 相关支出。
Databricks 发布 FILE 原生列类型,用于在 Lakehouse 中直接存储和管理多模态数据。该类型将文件作为一等公民纳入表结构,支持图像、音频、视频等非结构化数据与结构化数据统一处理,简化了多模态数据管线的构建与查询。
连续扩散与流匹配模型有望成为语言建模中自回归方法的有力替代,可解锁加速采样与倾斜等连续模态优势。近期研究通过高斯分布与one-hot编码数据分布间的简单流匹配过程,实现离散数据的连续生成,并借助分类流映射(CFMs)验证了加速采样的可行性,样本质量具有竞争力。
斯坦福大学研究人员利用Evo 2生成式AI模型产生的DNA序列,合成了近300种噬菌体,实验室测试筛选出16种对大肠杆菌具有特别强杀灭活性的噬菌体。该研究以噬菌体ΦX174(读作“FYE-ex-1-7-4”)为核心,由化学工程助理教授Brian Hie领导。
Nathan Lambert 完成其夏季项目:一套 20 个视频的免费后训练课程,约 12 小时内容,配套幻灯片可修改复用。课程覆盖核心基础及他认为重要性将上升的研究方向,并附有代码练习。为庆祝发布,其书籍在 Manning 平台使用代码 PBLambert 可享 50% 折扣。
Zero Train-Inference Mismatch - now for linear attention, and under async RL 🎯 We got bitwise-exact trainer/generator p...
寒武纪发布 2026 年上半年财报,营业总收入 59.96 亿元,同比增长 108.13%;归母净利润 23.11 亿元,同比增长 122.61%,扣非净利润 21.66 亿元,同比增长 137.3%,业绩大幅超出市场预期。基本每股收益 3.68 元,同比增长 119.05%。研发投入占营业收入比例降至 11.72%,同比减少 7.09 个百分点,主要得益于营收规模快速扩张。
MameLoshnLM 是首个专为意第绪语构建的开源 8B 参数语言模型,基于 Llama 3.1 8B 继续预训练而来。研究同时推出 Oytser 高质量意第绪语预训练语料库和 Kashes 多任务评测基准。在基准任务上,MameLoshnLM 优于同规模开源基线,且更好地捕捉了意第绪语特有的词汇与形态模式。
小红书联合浙江大学、复旦大学提出 CULTURE-MT,这是首个面向中英社媒笔记翻译、兼顾文化符号传递与情感共鸣的评测基准,并首次提出「文化有效性」评估标准与自动评估模型 JUDGER(准确率 86.03%)。
研究者提出任务条件流匹配(TCFM)框架,针对不同任务采用差异化训练目标:翻译任务使用流匹配,检索、分类等任务则用更契合其学习动态的目标,并结合教师引导与三阶段课程实现稳定适配。在 Indic Massive Text Embedding Benchmark 上,TCFM 取得新 SOTA,并泛化至不同嵌入模型家族,代码与数据集将在论文接收后公开。
持续学习正从参数中心机制转向系统级适应,涵盖训练策略、架构设计及权重适配之外的更广范畴。该综述提出When、How、Where三维框架:How涵盖off-policy、on-policy与超越梯度的优化,When覆盖预训练至推理阶段,Where区分内部参数与外部结构约束,并系统梳理了代表性方法及未来挑战。
SK 海力士董事会批准向龙仁 Y2、清州 M17 两座晶圆厂合计投资 54 万亿韩元(约合 2,567.16 亿元人民币)。其中 Y2 投资 35.2 万亿韩元,将作为 DRAM 生产基地,主要生产 HBM 等新一代产品,计划 2029 年 6 月启用首个无尘室;M17 投资 19.1 万亿韩元,扩展 NAND 闪存生产设施,计划 2028 年 12 月启用首个无尘室。
PaDoc 将预测布局视为共享页面表示上的分支结构,使布局流与区域内容分支并行推进,将解码深度降至最长布局-内容路径。在 OmniDocBench Full 上,PaDoc 取得 Overall 布局 F1 91.1,端到端解析器中 Overall 得分 94.24,Text Edit 0.038,Formula CDM 95.59。
EnvACE 提出一种智能体强化学习方法,用世界预演替代训练中的外部环境交互:策略先生成工具调用,再扮演环境生成响应,并基于预演结果继续决策,两端通过任务成功奖励端到端联合优化。
DyPES-VLA 提出一种跨具身视觉-语言-动作模型,通过未来预测目标训练 VLM 学习共享动力学先验,并利用具身特定的 MoE 动作头直接在原生动作空间生成控制,无需手动对齐异构动作。作为通用策略,它在 LIBERO 上达到 98.0% 成功率,在 RoboCasa-GR1 上为 59.25%,在 RoboTwin 2.0 上为 89.02%,在仿真和真实世界评估中均取得 SOTA 性能。
一项针对 Qwen3 的研究发现,On-Policy Delta Distillation(OPD2)在多语言数学推理中持续优于原始 OPD,尤其在韩语和日语上提升显著,并普遍缩小了英语与韩语的性能差距。研究还显示,仅用英语数据的 OPD 虽能提升韩语和日语表现,但常使回答偏向英语,凸显了多语言数据对保持目标语言回答的重要性。
AgentOPSD 提出一种免评论家的递归回合级信用分配方法,将 token 级师生对数概率差聚合为回合级证据,并在 log-odds 空间递归更新贝叶斯信念状态,将稀疏结果监督转化为回合级信用信号。
CalibForge 提出一种自主终端任务合成系统,通过多求解器校准和对比校准,将任务构建为受约束的对抗性作者-求解器循环,使候选任务处于可证明可解但未被统一求解的“可学习区”。
斯坦福大学研究人员使用 AI 技术首次成功设计出完整基因组,产出的 16 种新型噬菌体在实验室中可有效杀死大肠杆菌,不会对人类构成威胁。团队开发的 Evo1 和 Evo2 模型以病毒、细菌、植物和人类的遗传代码为训练数据,通过微调预测“生命语言”。研究被视为“非常重要的转折点”,或为抗生素耐药感染提供新治疗路径。
另有 2 家信源报道Ars Technica:AI(RSS)The Decoder:AI News(RSS)DeepSeek 发布公告,计划近期整体上调 API 服务定价,预计涨幅较大,当前 API 按输入输出 Token 分别计费,分缓存命中情况计价。OpenAI 宣布将 ChatGPT 免费用户默认模型升级为 GPT-5.6 Luna,并为 Plus 和 Pro 用户更新聊天界面至 GPT-5.6 Sol。
英伟达在 2026 年黑帽大会上宣布开源 cuFile API 及其底层存储软件栈,该技术可让 SSD 充当额外显存,改善游戏或 AI 场景运行表现。cuFile 依托 DMA 将 NVMe 硬盘数据直接送入 GPU 内存,绕过主内存中转,实现毫秒级低延迟,缓解分布式 GPU 阵列中的“GPU 饥饿”问题。
American companies should not be selling data to Chinese AI labs. @scale_AI doesn't do this work, and we have turned dow...
突发新闻:科学家首次利用人工智能创造出新病毒,这一进展既为医学进步带来希望,同时也引发了该技术未来某天可能被用于制造危险病原体的担忧。https://nyti.ms/4bxx7Wy
Apple 提出深度低秩残差蒸馏方法,在锁定预训练权重的同时实现模型压缩。该方法通过低秩残差结构蒸馏知识,避免直接修改原始权重,从而保留预训练模型的既有能力。研究展示了该方法在保持模型质量的同时,为开源权重模型的高效适配提供了新路径。
Nathan Lambert 在其课程最后一讲发布“性格训练”导论,称该主题已深耕约 18 个月,具备高现实影响力且被前沿实验室广泛使用,但相关实证文献几乎空白。讲座涵盖性格训练定义、模型规范与宪章差异、现实动机、推荐论文及开放问题,旨在吸引更多研究者进入该领域。
字节跳动正讨论训练参数规模超 5 万亿的模型,超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),为国内已知参数规模最大的模型,但计划仍处早期阶段。
张一鸣在字节Seed内部会上表态,不将蒸馏当作提升AI模型能力的捷径,即便模型表现暂时落后于竞争对手。Seed内部不仅禁止蒸馏美国模型,连中国开源模型也不允许,并设有硬检测机制。此举被解读为技术路线选择,判断蒸馏会干扰自身训练突破,不愿被一时榜单捆住手脚。
另有 1 家信源报道X:阿易 AI Notes (@AYi_AInotes)前 OpenAI 创始研究员 Naomi Bashkansky 已离职并加入 Conduit 担任创始研究员,该公司正训练模型以非侵入方式读取人类思维。她主张通过大幅扩展数据收集规模(比学术界大数个数量级)来实现“思想到文本”的脑机接口,并预测 2035 年前后可能出现类似心灵感应的应用。
Two weeks ago, I resigned from OpenAI to join Conduit as a founding researcher, where we're training models to non-invas...
研究提出答案回溯信用分配(ABC)框架,将稀疏的轨迹级结果转化为密集的步骤级奖励,以区分长程搜索智能体中的有效与错误动作。基于该框架训练的ABSeeker(Qwen3.5-4B,仅8.5k示例)在BrowseComp上达37.3%、BrowseComp-ZH上达39.1%;启用上下文管理后分别提升至55.3%和52.9%,超越同规模(4B)智能体并匹配约30B更大模型的性能。
Jeff Dean 在 Google 工作 27 年后离职,与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 共同创办新公司 Discovery Loop,Google 作为早期投资人提供云算力支持。
Tomorrow will be my last day at Google after 27 years, and watching it grow from 25 people to 190,000+ has been an amazi...
另有 4 家信源报道X:Kim (@kimmonismus)IT之家(RSS)X:Sundar Pichai (@sundarpichai)X:Elvis Saravia (@omarsar0, DAIR.AI)字节跳动创始人张一鸣在上月 Seed 团队全体会议上明确表示,即使暂时落后于竞争对手,公司也不会依赖 AI 蒸馏技术来改进模型。该决定很大程度上受字节跳动与美国政府因 TikTok 所有权产生的复杂关系影响。字节跳动未被 Anthropic 指控蒸馏其 Claude 模型,一直保持相对低调。
马斯克在SpaceX Q2财报会上称,内存供给年增20%,而AI需求年增超200%,价格只会涨不会跌。xAI本季度AI资本开支达158亿美元,2027年算力目标10GW;HBM建厂到量产需3-5年,2029年才能释放产能,景气度至少持续到2028年。定价权握在美光、海力士、三星手中,MU此前涨700%或只是开始。
大家都在刷SpaceX上市首份财报,没人注意Musk扔的王炸:@SpaceX 要把AI数据中心搬到太空去, 而且不是科幻和概念PPT, 明年就开始发射。 就在昨天的财报电话会上, Musk直接宣布: SpaceX未来所有的AI算力, 不管是...
百度沧海·存储团队与北京大学、阿姆斯特丹自由大学合作的论文《MetaDB》入选NSDI'27 Operational Systems Track。该系统让底层数据库理解目录树结构,高并发同目录操作下吞吐最高提升10.7倍,已在百度智能云生产环境稳定运行超5年,支撑EB级存储规模。
LG AI Research 发布 K-EXAONE 2.0,一款通过扩展架构升级而来的开源多语言 MoE 模型,总参数 750B,每 token 激活约 37B,容量为此前版本的三倍以上。模型支持 256K token 上下文,多语言覆盖从六种扩至十种,在智能体编码与长上下文理解上提升最大,并以 Apache 2.0 协议开源。
另有 1 家信源报道IT之家(RSS)Poly-OPD 通过像素桥与冻结 DINOv2 空间监督,将异构多教师的互补能力整合进单一紧凑的流匹配学生模型。将 FLUX.1-dev 和 Z-Image 蒸馏至 2.5B 的 SD3.5-Medium 学生模型后,GenEval 从 67.3 提升至 73.3,超越两个更大的教师模型,DrawBench HPSv3 从 9.34 提升至 11.35。
一项系统研究揭示多模态预训练的内在机制:语言、视觉理解与视觉生成在跨模态知识传递中呈现不同影响模式与不对称性;数据“复杂度”决定模态协同与否,共享注意力与归一化加模态特定前馈层可促进协同。从极早期统一模态联合训练优于后期对齐或顺序训练,但延迟整合会引发“视觉惰性”现象。该研究仅用5%计算预算即可实现强生成性能,并通过训练多个13.5B MoE模型、2T tokens验证了结论。