AIHOT周报
开源模型与智能体基建加速
本周AI行业主线是开源模型的密集发布与智能体基础设施的快速演进。Qwen3.8-Max以2.4T参数开源最强编码模型,商汤、蚂蚁、腾讯混元等也相继推出开源模型,推动前沿能力平民化。与此同时,Cloudflare Agents Week、微软Orchard、Google Agent Skills等事件标志着智能体开发与部署的底层工具链日趋成熟。欧盟AI法案透明度规则生效,为行业划定了合规红线。此外,Anthropic与Volta的百亿算力协议、Palantir CEO对前沿实验室的批评,折射出算力军备竞赛与产业话语权争夺的加剧。
开源模型密集发布,前沿能力走向平民化
本周多家机构发布开源模型,显著降低前沿AI的使用门槛。Qwen3.8-Max以2.4T参数成为Qwen家族最强模型,并首次开源Max级权重;商汤SenseNova U1及U1.5-Lite-Preview实现统一推理与图像生成;蚂蚁百灵Ling-3.0-flash、NVIDIA Alpamayo 2 Super等也开放商用。这些发布意味着开源模型在编码、多模态等领域的性能已逼近闭源,推动AI能力民主化。
智能体基础设施爆发,开发与部署工具链成型
Cloudflare开启Agents Week,推出面向智能体的运行时、入站TCP支持及本地追踪调试;微软开源Orchard训练框架;Google发布Agent Skills治理流程;OpenRouter推出ori CLI简化配置。这些进展表明智能体开发正从零散实践走向标准化、平台化,为大规模部署奠定基础。
模型效率与端侧部署成为竞争焦点
多款模型通过架构创新或量化技术实现在消费级硬件上运行:Swiftlet在Mac上运行80B模型、AirLLM在4GB GPU上运行70B模型、Soup在4GB显存微调8B模型、DeepSeek V4 Flash在单颗MI300X上高效推理。同时,GPT-5.6 Luna降价80%永久生效,反映效率提升带来的成本下降。这些进展意味着AI推理成本正快速降低,端侧部署成为现实。
AI安全与合规:监管落地与产业自律并行
欧盟《人工智能法案》透明度规则正式生效,违规最高罚1500万欧元,为AI披露设定强制性标准;工信部发布L3/L4自动驾驶安全强制性国标,2027年实施;OpenAI公布第三方评估新保障措施;Linux基金会发布SAFE指南强化智能体网络安全。这些事件表明,AI治理正从原则讨论走向具体法规与工程实践。
算力军备竞赛与产业话语权争夺
Anthropic与成立仅数月的Volta签署100亿美元算力协议,凸显算力需求紧迫与交易对手风险;Palantir CEO批评前沿实验室“马克思主义”,主张企业掌控数据;EA与Paramount高管则强调AI在游戏与媒体中的务实应用。这些动态反映AI产业链上下游在算力、数据与价值分配上的博弈加剧。