智谱开源GLM-5.2,OpenAI用GPT-5.4改进化学反应,MiniMax规划10T模型

ginobefun · @hongming731 · X·2026-06-18 07:24·68天前
AI 导读

智谱开源GLM-5.2,Code Arena盲测全球可用模型第一,专注Coding与长程任务,支持百万token无损上下文,单位token FLOPs降至2.9倍,MIT协议全开源。OpenAI将GPT-5.4接入Molecule.one自主改进Chan-Lam偶联反应,两轮10080次实验后平均产率从16.6%升至25.2%,14组底物中11组提升。MiniMax闫俊杰称M3目标无限制用Sonnet/Opus级别模型,计划攻克10T参数模型。

ginobefun@hongming731
47AI 编辑部评分,满分 100

智谱开源GLM-5.2,OpenAI用GPT-5.4改进化学反应,MiniMax规划10T模型

2026-06-18 07:24· 68天前
AI 导读

智谱开源GLM-5.2,Code Arena盲测全球可用模型第一,专注Coding与长程任务,支持百万token无损上下文,单位token FLOPs降至2.9倍,MIT协议全开源。OpenAI将GPT-5.4接入Molecule.one自主改进Chan-Lam偶联反应,两轮10080次实验后平均产率从16.6%升至25.2%,14组底物中11组提升。MiniMax闫俊杰称M3目标无限制用Sonnet/Opus级别模型,计划攻克10T参数模型。

BestBlogs 早报 · 06-18

GLM-5.2 / 智谱开源 / AI 化学家 / MiniMax 闫俊杰 / Chan-Lam 偶联反应

[1] ★ 精讲|GLM-5.2 上线并开源:专注 Coding 与长程任务 今天智谱上线并开源 GLM-5.2,在百万用户参与的 Code Arena 前端开发盲测中拿下全球可用模型第一。核心是 Solid 1M 无损上下文撑起长程任务:FrontierSWE 仅比 Opus 4.8 低 1%,超过 GPT-5.5 与 Opus 4.7;实测中模型用满近 88 万 tokens,一次性自主交付了一个覆盖 Web、移动端与小程序的多端应用。配合 IndexShare 稀疏注意力与改进投机解码,单位 token 的 FLOPs 降低至 2.9 倍。模型 Day 0 适配多家国产芯片,采用 MIT 协议全开源,无地域限制。 来源:智谱 https://www.bestblogs.dev/article/3b64e7b6

[2] ★ 精讲|近乎自主的 AI 化学家改进药物化学中的一项挑战性反应 OpenAI 将 GPT-5.4 接入 http://Molecule.one 的智能化学 AI Maria 及其高通量实验室,让其自主提出研究方案、设计并分析实验。系统聚焦改善药物合成常用的 Chan-Lam 偶联反应,提出用 TEMPO 等温和氧化剂提升一类历史上低产率的磺胺底物反应。两轮共完成 10080 次实验,平均产率从 16.6% 升至 25.2%,台架验证 14 组底物中 11 组产率提升、多数翻倍以上。全程三个月,化学家全程把关方案与实验,OpenAI 称这是近乎自主而非完全自主的科研协作范式。 来源:OpenAI News https://www.bestblogs.dev/article/54116bca

[3] ★ 精讲|对话 MiniMax 闫俊杰:M3、10X 计划、10T 模型、和智能的终局 MiniMax 创始人闫俊杰透露:M3 目标是让用户无限制、不计成本地用上 Sonnet/Opus 级别模型,已逼近临界点;上月启动的 10X 计划邀请网络安全、金融、法律等垂直专家深度合作;下一步要攻克 10T 参数模型——国内模型规模比美国小一个数量级,需先做实 3T 再迈向 10T,最大卡点是工程积累而非物理瓶颈。他认为智能的终局是端到端交付结果:让模型直接修复漏洞、做出金融决策。 来源:十字路口 Crossing https://www.bestblogs.dev/article/ed61bb66

[4] Claude Design 日常工作中更稳定地保持品牌一致性 | Claude Claude Design 现已集成你的设计系统、与 Claude Code 同步、支持直接画布编辑,并连接更多外部工具,使其在日常专业使用中更加稳定。 来源:Claude Blog https://www.bestblogs.dev/article/adc8d33b

[5] 更可靠的主播助理:淘宝主播 Agent 的 Harness 工程实战 本文以淘宝主播 Agent 为例,系统阐述在直播高压力场景下,如何通过 Harness 工程(执行循环、工具注册、上下文管理、状态存储、生命周期钩子、评估接口)将不确定的模型能力工程化为可用、可控、可演化的生产系统。 来源:阿里云开发者 https://www.bestblogs.dev/article/e75081f9

[6] NVIDIA GEAR 实验室发布 ENPIRE:AI 编程 Agent 自主操控真实机器人做实验 NVIDIA GEAR 实验室联合 CMU、UC Berkeley 发布了 ENPIRE 系统,首次让 AI 编程 agent 在真实物理世界中自主完成机器人实验的全流程,包括环境搭建、策略改进、实验执行和代码迭代,人类只需查看报告。 来源:宝玉(@dotey) https://www.bestblogs.dev/status/2067027033431875699

[7] A2UI + MCP Apps:融合声明式与自定义智能体 UI 的最佳实践 本文来自 Google Developers Blog,提出了三种架构模式,将 A2UI 声明式、原生渲染的 UI 与 MCP Apps 基于 iframe 的自定义界面相结合,以构建安全、高性能且视觉一致的智能体 UI。 来源:Google Developers Blog https://www.bestblogs.dev/article/e52759ce

[8] 当你的 AI 智能体扩展互相争斗时 本文解释了 AI 编程智能体扩展如何争夺上下文窗口空间和模型注意力,从而引发冲突并降低输出质量,同时提供了一个衡量和缓解这些组合问题的框架。 来源:Microsoft for Developers https://www.bestblogs.dev/article/c36b8ce8

[9] 独家:OpenAI 2025 年财报显示收入 130 亿美元,成本 340 亿美元 Ed Zitron 独家报道,OpenAI 2025 年的审计财报显示收入为 130.7 亿美元,成本为 340 亿美元,其中 8.67 亿美元来自软银,3.03 亿美元来自微软。 来源:Ed Zitron(@edzitron) https://www.bestblogs.dev/status/2066732330954478008

[10] 字节跳动的 AI 账本:豆包每天不足百万收入、Seedance 毛利 70% 本文独家披露字节跳动 AI 业务财务数据:豆包日活超 2 亿但日收入不足百万,而视频生成模型 Seedance 年化收入已达 20 亿美元、毛利率 70%,揭示 AI 商业化从 C 端免费转向 B 端付费的战略调整。 来源:晚点 LatePost https://www.bestblogs.dev/article/84815714

--- http://BestBlogs.dev · 发现真正适合你的高质量内容 BestBlogs 是 AI 驱动的私人阅读助手,帮助你建立稳定、可信、个性化的高质量信息输入。 关注你感兴趣的来源和主题,每天生成一份更适合自己的「我的早报」。 在线阅读:https://www.bestblogs.dev/explore/brief/2026-06-18

ginobefunhttp://x.com/i/article/2067387524339929088