Google AI 发布 WeatherNext 气旋预测模型,可同时预测风暴路径、强度和规模,比现有系统多提供一整天的预警时间。该模型在 2025 飓风季实战测试中,提前五天预测飓风 Melissa 在牙买加的五级登陆,系美国国家飓风中心首次实时使用 AI 模型。模型单场风暴可生成多达 1000 次模拟,代码与权重已开源。
Google AI 发布 WeatherNext 气旋预测模型,可同时预测风暴路径、强度和规模,比现有系统多提供一整天的预警时间。该模型在 2025 飓风季实战测试中,提前五天预测飓风 Melissa 在牙买加的五级登陆,系美国国家飓风中心首次实时使用 AI 模型。模型单场风暴可生成多达 1000 次模拟,代码与权重已开源。
wow,刚发布的 Apodex 1.1 把一整套开箱即用的多 Agent 架构(35B 权重 + 单机 harness)全开源了,支持本地单机部署!!! 大家都在看它跑分,我直接拿它做了一次AI副业赚钱项目真实长任务实测: 2000 块启动...
阿里千问将于北京时间 08 月 26 日 23:00 在魔搭社区开源 Qwen3.8-Flash-Next 及 Qwen3.8-Flash-Next-FP8 两个版本。该模型是基于下一代 Qwen4 架构构建的多模态 MoE 模型,官方提前发布架构改进,以便社区为完整 Qwen4 模型家族做好准备。
商汤 SenseNova U1.5 Lite 已开源并上线 Token 计划,提供免费公开测试版,每 5 小时可享 1,500 次请求。该模型支持图像生成与编辑一体化,具备参考图驱动创作、复杂指令跟随、原生 2K/4K 输出及自动提示词优化等能力。
The next-gen architecture powering Qwen4 is now here! ✨ Get ready for the open release of Qwen3.8-Flash-Next 🚀 The coun...
汤森路透发布其首个自研大语言模型Thomson,基于开源基础投入4000万美元训练,成本远低于同类前沿模型,且完全由公司自有和控制。早期评估显示Thomson在多项任务上与最新前沿模型持平,尤其在指令遵循和密集专业内容推理上提升显著。公司已向学术机构开放评估,并在Hugging Face发布“small”版本开源权重供学术与非商业使用。
另有 3 家信源报道The Decoder:AI News(RSS)X:X.PIN (@thexpin)IT之家(RSS)Apodex 1.1 模型家族发布,主打异步 Agent Team 功能,可并行协调多智能体拆解复杂任务并持续整合结果。同步开源 FrontierAgent 本地研究工具台及 Apodex 1.1 mini 开放权重模型,后者支持本地运行复杂工作。
Meet Apodex 1.1: Scaling Agentic Intelligence for Complex Work Open Source Harness: https://github.com/ApodexAI/Frontier...
Fastino 发布 GLiNER2.5,以边界预测取代跨度枚举,移除最大实体宽度限制,支持 4096 词上下文,计算量随序列长度线性增长。多语言检查点在 16 个零样本基准上整体 macro F1 达 56.17(GLiNER2 为 56.09),XNLI 提升 24.75 分。
LongCat-2.0 now available in Go 1.6T/48B · 1M context · fully open source
🚢 Marin 535B-A23B started training this week! As usual, the whole process is open. Voyage plan: pretraining (80%) + mid...
面壁智能 OpenBMB 推出 MathForm,一个面向 Lean 4 数学自动形式化的开源框架、数据集与模型。其 FormalVerse 数据集含 367K+ 已验证示例;在匹配 100K 预算下,基于其训练的模型 Consistency Check 达 60.32%,优于 FineLeanCorpus(46.53%)与 NuminaMath-LEAN(41.49%)。
商汤科技今日宣布开源轻量级原生统一多模态大模型 SenseNova U1.5 Lite,该模型拥有 8B 参数,原生支持 3-4k 上下文长度和 4K 高分辨率图像输出。模型支持 Bounding Box、Visual Marker 及多图参考等精细视觉控制,在指令遵循与图像编辑保持度上超越同量级模型,文字渲染与复杂布局能力媲美超大规模商业模型。
蚂蚁百灵正式开源 Ling-3.0-tiny-base 与 Ling-3.0-flash-base,除最终 Base checkpoint 外,还同步开放预训练和中期训练的权重 checkpoint,共计 6 个。
Superwhisper 推出 S1 系列,其中 S1-mini 以开源权重发布在 Hugging Face 上。这是一款 0.6B 参数的文本规范化模型,基于 Qwen3-0.6B 微调,用于清理语音识别后的转录文本,去除填充词并应用标点与大小写。
Google DeepMind 推出 DiffusionGemma,一个基于 Gemma 4 26B A4B MoE 模型微调而来的实验性开放权重文本扩散模型。
SenseNova 发布 U1.5 Lite,一个 8B 参数的开源轻量级原生统一多模态模型,可同时完成视觉理解、生成与编辑。该模型通过 OPD 将任务专家能力蒸馏进单一模型,推理时无需路由或切换专家,并支持原生 4K 生成、复杂指令遵循及本地编辑。其在指令遵循和编辑保持上超越同尺寸模型,文本渲染与复杂布局上可媲美大型商业模型。
𝗦𝗲𝗻𝘀𝗲𝗡𝗼𝘃𝗮 𝗨𝟭.𝟱 𝗟𝗶𝘁𝗲 — 𝗦𝗵𝗮𝗿𝗽𝗲𝗿. 𝗠𝗼𝗿𝗲 𝗖𝗼𝗻𝘁𝗿𝗼𝗹𝗹𝗮𝗯𝗹𝗲. 𝗠𝗼𝗿𝗲 𝗖𝗼𝘀𝘁-𝗘𝗳𝗳𝗶𝗰𝗶�...
商汤发布开源轻量级原生统一多模态模型 SenseNova U1.5 Lite,仅 8B 参数,支持视觉理解、生成与编辑。该模型主打原生 4K 生成、复杂指令跟随、中英文文本渲染及多图参考编辑,在指令跟随和编辑保持上超越同尺寸模型,文本渲染与复杂布局上比肩大型商业模型。
DeepReinforce 推出 Ornith-1.5 系列开源模型,训练中引入“自我改进循环”机制。其中最大 Ornith-1.5-397B 采用 MoE 架构,总参数 3970 亿,性能媲美并在部分测试中超过 Claude Opus 4.8;另有 35B-A3B 与 9B 两个规模,9B 的量化版 Ornith-1.5-9B-Mobile 可在安卓手机及 iPhone 17 上运行。
另有 1 家信源报道Hacker News 热门(buzzing.cc 中文翻译)Introducing S1-mini ✨ Our first open-weights language model. A 0.6B parameter model that processes transcripts entirely ...
蚂蚁百灵开源 Ling-3.0-tiny 与 Ling-3.0-flash 的 6 个 Base Model 检查点,覆盖预训练、中期训练及 WSM 合并阶段,均未经过后训练。其用 WSM 替代 LR 衰减进行加权检查点合并,支持持续预训练与离线策略探索;社区可在 tiny-base 上验证策略后扩展至 flash-base。
Ornith-1.5 开源 LLM 家族发布,含 9B Dense、35B MoE 和 397B MoE 三档,其中 397B 在 Terminal-Bench 2.1(86.1)、SWE-bench Verified(86)、WideSearch(80.8)和 BrowseComp(86.6)上均超越 Claude Opus 4.8。
Aloha! 🌺Introducing Ornith-1.5, a family of open-source LLMs spanning 9B Dense, 35B MoE, and 397B MoE, trained with sel...
另有 1 家信源报道Hacker News 热门(buzzing.cc 中文翻译)智谱 GLM-5.3 在 Artificial Analysis Intelligence Index 上得 60 分,与 Kimi K3 并列开源模型第一,领先前代 GLM-5.2 七分。
同一事件,精选展示《GLM-5.3上线:AA智能指数60分并列开源第一,成本更低》Synthefy 推出面向结构化数值数据的基础模型平台,其开源模型 Nori 无需训练或微调,通过将标注行作为上下文存储,即可在前向传播中预测新行。仅 30M 参数的 Nori-30M 在公共回归基准上媲美 Google 1.6B 参数的 TabFM,开启思考模式后更以约 2% 的规模超越后者。
It's official: Qwen3.8-27B just scored 52 on the @ArtificialAnlys Intelligence Index. We now have an open-weight model t...
MiniMax 发布开源权重文本转音乐模型 MiniMax-Music3,输入带段落标签的歌词和详细音乐描述,单次生成最长五分钟的 32 kHz、16-bit 立体声 WAV 歌曲。
soon 10k
UI-Mate 是一个开源基础 GUI 智能体,结合环境接地训练栈与上下文演示学习,并推出含 100 个长程办公任务的 OSWorkerBench 基准。
国家超算互联网于 8 月 14 日上线 DeepSeek V4 Pro 正式版(DeepSeek-V4-Pro-0813)及智能体框架 DeepSeek Harness。该模型增强了 Agent 能力,生产环境性能提升显著,整体性能可与 Claude Fable 5、Opus-4.8 相媲美。DeepSeek Harness 开发者预览版(v0.1)已面向全球开放测试,并以 MIT 协议开源。
另有 1 家信源报道Hacker News 热门(buzzing.cc 中文翻译)MOSS-VL是一个将实时交互(边感知边说话)作为一等能力的开源视觉语言模型家族,通过门控交叉注意力让语言解码器在生成时同步处理视觉输入。MOSS-VL-Realtime在四个流式基准中平均成绩居开源模型之首(三项第一、一项第二),在OmniMMI Proactive Alerting上以66.0分大幅领先最佳基线(37.5分)。
Google AI 发布本周回顾:Gemini 3.7 Flash 作为最强编码与智能体模型,已上线 Gemini API 及 Google Workspace 等平台。
小红书(RedNote)开源大语言模型 dots3-note preview,主打长时程生活智能体场景。该模型为 280B MoE、16B 激活参数,512K 上下文窗口,支持文本、视觉、音频多模态,并引入针对长时任务 RL 训练的新方法 TEMPO。模型权重与两个生活智能体基准 VibeSearchBench、VibeLifeBench 已在 Hugging Face 开源。
Introducing dots3-note preview — a small but mighty step toward long-horizon agency in real life. 🔹 280B MoE with 16B a...
阿里 Qwen 团队发布 Qwen3.8 系列开源权重模型。核心模型 Qwen3.8-27B 为 270 亿参数多模态稠密模型,在编程和办公任务上超越更大的 Qwen3.7-Plus,原生支持 262,000 token 上下文,可用 YaRN 扩展至一百万。权重以 Apache 2.0 协议发布,两款模型均已在 Hugging Face 和 ModelScope 上线。
另有 5 家信源报道X:Testing Catalog (@testingcatalog)Hacker News 热门(buzzing.cc 中文翻译)X:阿里云 / Alibaba Cloud (@alibaba_cloud)X:通义千问 / Qwen (@Alibaba_Qwen)Simon Willison 博客