Equity 节目解读 Meta 的 Glimmer 发布及其“AI for everyone”愿景,并讨论 AI 数据中心成本攀升与 Joby 的国防业务拓展。节目还剖析了一桩 2.5 亿美元收购最终演变为欺诈指控的崩盘事件。
Equity 节目解读 Meta 的 Glimmer 发布及其“AI for everyone”愿景,并讨论 AI 数据中心成本攀升与 Joby 的国防业务拓展。节目还剖析了一桩 2.5 亿美元收购最终演变为欺诈指控的崩盘事件。
Google 在 7 月推出三款新 Gemini 模型——Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,面向生产级 AI 智能体,主打更高 token 效率、更低延迟和更可靠性能。
微软 CEO 纳德拉表示,其自研 MAI 系列模型在多数常见 Excel 任务中性能与 GPT-5.6 相当,且因无需依赖最新 AI 加速器,可在英伟达 H100/A100 GPU 上运行,部署成本更低。MAI 模型已通过面向特定产品的强化学习环境(RLEs)在 GitHub Copilot 和 Excel 上取得显著进步。纳德拉强调,未来企业将根据任务编排模型,而非完全依赖单一前沿模型。
Kimi K3 has received far more love than we expected, and our GPUs are feeling it. Over the past 48 hours, demand has pus...
OpenAI 最新模型 GPT-5.6 Sol Ultra 利用 64 个子智能体,在不到一小时内独立完成了图论中悬而未决半个多世纪的“循环双覆盖猜想”的完整证明。该证明尚未经同行评审,数学界正保持谨慎并展开审查。
BREAKING: Meta jumps over 6% at the open as investors react to yesterday’s Muse Spark 1.1 release.
据《The Information》报道,特斯拉 CEO 埃隆·马斯克在一份备忘录中要求员工在可能的情况下改用 Grok 4.5,理由是其 Token 成本低于竞争对手。特斯拉本周早些时候规定员工每周 AI 使用支出上限为 200 美元,该限制适用于 Anthropic、OpenAI 和谷歌产品,但 xAI 的 Grok 不受限。xAI 于本周三发布 Grok 4.5,定位“Opus 级”模型,但在综合多领域排行榜中得分为 76.3 分,排名第九,编程能力得分仅 68.6 分,为榜单最低。马斯克承认 Fable 更优秀,但称大多数任务不需要其能力。
OpenAI 于 7 月 10 日发布 GPT-5.6 系列模型,已在 ChatGPT、Codex 及 API 中上线。微软 CEO 纳德拉称 Copilot 将同步接入该系列模型。
本期AI周报涵盖多项动态:Meta推出首款图像模型;DeepSeek正研发推理芯片以减少对Nvidia和华为依赖,瞄准中国500亿美元AI芯片市场;据The Information,智谱AI在GLM-5.2使用量一周暴涨27倍后,也探索定制ASIC;谷歌Gemini为生产级AI智能体提供更强开发工具;有开发者构建Claude Code工作流,整合个人资料、职位和申请草稿,获5.7K GitHub星;Yann LeCun在采访中解释LLM在真实世界智能方面的局限;1X Technologies将展示超越人手指控制的机械手。
SpaceXAI 与 Cursor 联合推出首个编程智能体模型 Grok 4.5,专为真实工程场景设计,擅长处理大型代码库与长时间任务。其 Token 消耗仅为同类领先模型的一半,价格大幅降低,即日起可通过多个平台免费开始使用。
🚨 SCOOP(s): - GPT-5.6 will be the final model in the 5.x series. GPT-6 is slated to launch in about a month, earlier th...
Meta is expected to release an Opus model in the very near future. Reportedly, Mark Zuckerberg’s disappointment with Age...
Google在6月发布多项AI更新:推出Gemini 3.5 Live Translate实时语音翻译;
We’ve received notice that the Department of Commerce has lifted export controls on Claude Fable 5 and Mythos 5. We'll b...
6月27日,OpenAI发布GPT-5.6系列模型,编程跑分超Claude Mythos 5,应美国政府要求现阶段仅向少数“可信合作伙伴”提供预览。美团CEO王兴称个人从公司成立至今一股未卖,且无卖股计划。微信回应互删好友后,对方的点赞和评论从朋友圈消失,自己的回复保留。消息称苹果iPhone 18 Pro系列及首款折叠屏Ultra均万元起售。B站预计明年视频播客日均播放时长达3亿分钟。大疆Osmo Pocket 4系列首批备货较前代提升近10倍,已锁定部分黄牛团伙。
Good new first: Sol is a smart, efficient, and a significant step forward. It is the same price as GPT-5.5. Also launchi...
智谱港股总市值首次突破1万亿港元,年内涨超2000%,6月22日盘中涨超35%至1.27万亿港元。公司6月17日开源GLM-5.2,该模型在全球百万用户盲测的前端开发评估系统Code Arena上取得可用模型第一。特斯拉CEO马斯克6月19日预测中国大模型可能要到2027年第一季度达到Anthropic Fable水平,智谱联合创始人唐杰回应称“不需要那么久”。
智谱开源GLM-5.2,Code Arena盲测全球可用模型第一,专注Coding与长程任务,支持百万token无损上下文,单位token FLOPs降至2.9倍,MIT协议全开源。OpenAI将GPT-5.4接入Molecule.one自主改进Chan-Lam偶联反应,两轮10080次实验后平均产率从16.6%升至25.2%,14组底物中11组提升。MiniMax闫俊杰称M3目标无限制用Sonnet/Opus级别模型,计划攻克10T参数模型。
http://x.com/i/article/2067387524339929088
Z.ai 推出 GLM 5.2 模型,1M 上下文窗口、MIT 许可开源权重,面向长周期编码智能体。Tensordyne 宣布推理系统,机架吞吐量达 NVIDIA NVL72 GB300 的 13 倍。MIT 研究显示代码量激增 300% 但产出仅增 30%。Google 发布 DiffusionGemma,26B MoE 仅激活 3.8B。Anthropic CEO Dario Amodei 呼吁紧急政策改革。OpenAI 收购 Ona,为 Codex 智能体提供安全云桌面。美国商务部长致信 Anthropic,就禁止外国用户使用 Mythos 和 Fable 做出说明。
智谱 GLM-5.2 将面向 GLM Coding Plan 全量用户开放,模型下周正式开源。GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,并在长程任务中继续保持领先。
OpenAI CEO 萨姆·奥尔特曼本周在致员工内部邮件中预估公司“明年内”上市,此前已向美国证券交易委员会秘密提交 IPO 申请。奥尔特曼表示,技术发展速度可能影响 IPO 时间,尤其指出递归自我改进(RSI)若加速,推迟 IPO 会更有利。OpenAI 同时正筹备全新模型,代号 5.6,据首席科学家 Jakub Pachocki 称,该模型将比当前旗舰系统 GPT-5.5 有“显著改进”。
Anthropic 发布 Claude Fable 5 与 Claude Mythos 5 两款 AI 模型。小米 MiMo 发布 V2.5-Pro-UltraSpeed,在 1 万亿参数模型上实现超过 1,000 tokens/秒的输出速度,为业内首次。
Meta 公司 AI 模型 Muse Spark 多次推迟向开发者发布 API 调用计划。该模型是 Meta 超级智能实验室(Meta Superintelligence Labs)的首款产品,由汪滔(Alexandr Wang)掌管。内部评测称 Muse Spark 可与 OpenAI、Anthropic 竞争,并在多数测试中领先 xAI 的 Grok。原计划 4 月发布 API,后推迟至 5 月,又推迟至 6 月,原因包括测试漏洞和基础设施扩建。目前仅少数第三方评测机构能验证其能力。
Jensen Huang 在 Computex 主题演讲中引用 Artificial Analysis 的 Intelligence Index vs. Output Speed 图表,介绍 NVIDIA 新模型 Nemotron 3 Ultra 的性能。演讲还提及 GDPval-AA——Artificial Analysis 基于 OpenAI 的 GDPval 数据集评估模型在经济价值任务上的基准。NVIDIA 同时用 Artificial Analysis 的文生图和图生视频 Arena Elo 评分推广 Cosmos 3 模型族。
Anthropic 同日发布三项重要进展。旗舰模型 Claude Opus 4.8 在代码与诚实度方面提升显著,代码能力与回答诚实度提升四倍。公司完成 650 亿美元 H 轮融资,估值逼近万亿美元。此外,Claude Code 推出动态工作流,支持在单次会话中调度数百个并行子智能体以处理超大规模任务。
同一事件,精选展示《Claude Opus 4.8 发布:在编码、智能体技能与推理方面实现全面升级》MiniMax在X平台预告即将推出M3系列AI模型,并关联到一篇回顾M2.x系列的论文。论文指出,M2.x系列总参数229.9B,但每个词元仅激活9.8B参数,配备192K上下文窗口,预训练数据规模达29.2T词元。模型采用62层Transformer架构和256个专家(每词元激活8个),其训练系统是基于智能体的强化学习系统Forge。论文还披露,M2.7已展现出“自我进化”雏形,能自主排查训练错误并修改代码,已吸收团队30%至50%的日常迭代工作量。
多名开发者在 OpenAI Codex 后端日志中发现未官宣的 GPT-5.6 模型,内部代号 iris-alpha。该模型将支持 150 万 token 的上下文窗口,较当前 GPT-5.5 的 105 万 token 提升约 43%,有望于今年 6 月发布。测试显示,在输入达到 90 万 token 时仍能流畅响应。同系列还发现了 ember-alpha 与 beacon-alpha 版本。此外,GPT-5.6 在前端界面生成能力上也有所提升。基于爆料信息,Anthropic Claude、Google Gemini 及 xAI Grok 也可能瞄准同期发布新模型。
小米YU7 GT以7分34秒931刷新纽北SUV圈速纪录,车手任周灿成为首个获官方认证的中国车手。特斯拉宣布放弃在印度建厂的计划。谷歌发布Gemini 3.5 Flash模型,称其输出速度是GPT-5.5的4倍。DeepSeek就“”字符触发模型异常回应,称属于幻觉,不涉及安全或隐私。此外,月之暗面Kimi获国资机构入股,浙江联通将于6月15日全面退出3G服务。
„Progress towards AGI“: Gemini Omni - world models -Gemini Omni official!! It can create anything from any input!!!
Gemini 3.2 Flash-lite-live has been spotted on the Google Cloud Console We might be getting the Gemini 3.2 series instea...
索尼公布《GTA 6》解锁时间,新西兰玩家可率先体验。小米YU7 GT“车厘子红”实车图曝光,将于5月底发布。英伟达市值首次突破5.5万亿美元,超越德国GDP。腾讯微信为适配鸿蒙系统成立了800多人团队,约占其客户端开发人员一半。比亚迪确认正与Stellantis等谈判收购欧洲闲置工厂,并计划未来三年推出多款欧洲专属车型。此外,小米17 Max手机将搭载徕卡2亿像素主摄及8000mAh电池,而ChatGPT网页端流量份额一年内大幅下滑。
据知情人士消息,DeepSeek正寻求首轮融资,目标高达500亿元人民币,若成功将成中国AI公司迄今最大规模融资。创始人兼CEO梁文锋计划提供最大一笔资金。融资推动公司加快商业化节奏,计划提高模型发布频率以接近行业标准。同时,DeepSeek将于6月发布V4模型的更新版本V4.1。
Gemini 3.2 Flash Spotted
小米MiMo-V2.5-Pro模型在最新Arena排行榜中表现卓越。在Text Arena(Expert)榜单中,它位列全球第六,同时是开源模型与中文模型的双料第一,其所属实验室全球排名第三。该模型在Text Arena(Overall)总榜中排名开源全球第二,在Code Arena(WebDev)前端开发榜单中位列开源全球第三。此外,它在Text Arena的四个关键子类别(Hard Prompts、英文Hard Prompts、指令遵循与长查询)中均获得开源全球第一。这些成绩均基于真实用户偏好与社区盲投评估,体现了模型在复杂任务上的强大综合能力。