AIHOT周报
超级应用与模型军备竞赛
本周AI行业主线是两大趋势的交汇:一是OpenAI、苹果等巨头加速将AI从聊天工具升级为跨平台超级应用/智能体平台,ChatGPT计划整合编程、图像生成与第三方服务,苹果则在WWDC推出第三代AFM模型与Apple Intelligence;二是模型性能竞赛白热化,Anthropic发布Claude Fable 5/Mythos 5实现全面SOTA,小米MiMo突破1T模型1000 tokens/s推理速度,Google推出Gemma 4 12B与Gemini 3.5 Live Translate。同时,AI智能体在编程、视频编辑、科研等场景的实用化加速,但安全与监管议题(如OpenAI IPO、欧盟DMA影响Siri上线)也持续升温。
超级应用与智能体平台化
OpenAI正筹备ChatGPT自2022年以来最大改版,从聊天机器人转向超级应用/Agent平台,整合Codex、图像生成及第三方应用,高管称“聊天已死”,目标成为跨平台个人AI助手。苹果在WWDC推出第三代AFM模型与Apple Intelligence,将AI深度集成到操作系统。微信AI内测两种接入模式,允许开发者授权AI直接操作小程序。这些动作标志着AI产品从单一对话向全能助手的范式转变。
模型性能竞赛:SOTA与推理效率双突破
Anthropic发布Claude Fable 5和Mythos 5,在软件工程、科研等几乎所有基准上达到SOTA,价格较预览版大幅下降。小米MiMo联合TileRT实现1T参数MoE模型单节点超1000 tokens/s推理速度,采用FP4混合量化与并行推测解码。Google推出Gemma 4 12B无编码器多模态模型,性能接近26B MoE但内存减半,可在消费级笔记本运行。Cohere发布North Mini Code,30B MoE模型在编码基准上超越同类。模型竞争从单纯追求能力转向同时兼顾效率与成本。
AI智能体实用化:编程、视频与科研
AI智能体在多个垂直领域加速落地。Kimi Code开源Coding Agent升级,新增视频理解与权威数据源集成。Runway Aleph 2.0编辑模型可一键适配任意视频格式。Perplexity与哈佛研究表明,自主智能体比搜索快87%、成本低94%。生物学领域,Anthropic实验指出当前AI智能体在科研数据检索中准确率不足,需确定性检索层辅助。Harness-1作为20B检索子智能体,通过强化学习在8个基准上达到SOTA。
AI治理与商业:IPO、监管与公共财富
OpenAI向SEC机密提交S-1草案,上市时间未定,同时宣布进入第三发展阶段,目标让AI普及、易用且安全。特朗普政府探讨通过公共财富基金让政府入股AI初创公司。欧盟DMA导致苹果Siri AI在欧盟延迟上线。OpenAI推出Economic Research Exchange研究AI经济影响。这些事件凸显AI行业在快速扩张的同时,正面临日益复杂的治理与商业挑战。
AI赋能创意与行业应用
AI在创意产业与垂直行业展现新可能。Luma AI Ray3.2 API提供电影级渲染集成,生数科技与华策影视共建AI视听创制中心。高德发布全球首个3D原生城市世界模型ABot-Earth0.5,10分钟生成公里级3D城市。NVIDIA与LG、KRAFTON等合作推进AI工厂与游戏适配。日本农民用ChatGPT和Codex解决农场实际问题,展示了AI在传统行业的低成本自动化潜力。