OpenAI 据报已完成代号“Bel”的下一代预训练模型,总参数超 10T,规模接近 GPT-4.5,预计成为 Astra 与 GPT-6 的基础。Anthropic 因算力受限,被认为今年内难以应对 Astra 的公开推出,但预计明年初可重回领先。
🚨 SCOOP: OpenAI recently finished its next pretrain, codename "Bel" - the successor to "Doug", which is expected to be ...
OpenAI 据报已完成代号“Bel”的下一代预训练模型,总参数超 10T,规模接近 GPT-4.5,预计成为 Astra 与 GPT-6 的基础。Anthropic 因算力受限,被认为今年内难以应对 Astra 的公开推出,但预计明年初可重回领先。
🚨 SCOOP: OpenAI recently finished its next pretrain, codename "Bel" - the successor to "Doug", which is expected to be ...
Skild 发布机器人基础模型 S1,用视频演示替代语言指令来定义任务。只需提供 1 段人类视频,S1 即可直接执行长达 10 分钟的多步骤新任务,无需重新训练或微调。若规模化,基础模型训练的高昂数据成本可摊薄至数千个新任务,有望改变机器人学习的经济性。
Introducing S1, our new foundation model that learns from one example. It can be taught 10-minute long tasks that it has...
PixVerse 在混战 7 个月后推出第二张牌,新功能支持召唤老虎、伪装成巡逻兵、与三星堆青铜器用四川话对话等场景。该更新延续了其在世界模型领域的竞争布局,具体模型版本、参数规模及可用性细节原文未披露。
Microsoft's MAI-Image-2.6-Preview lands at #1 on the Artificial Analysis Image Editing Leaderboard and takes #2 in Text ...
Google AI 发布 WeatherNext 气旋预测模型,可同时预测风暴路径、强度和规模,比现有系统多提供一整天的预警时间。该模型在 2025 飓风季实战测试中,提前五天预测飓风 Melissa 在牙买加的五级登陆,系美国国家飓风中心首次实时使用 AI 模型。模型单场风暴可生成多达 1000 次模拟,代码与权重已开源。
wow,刚发布的 Apodex 1.1 把一整套开箱即用的多 Agent 架构(35B 权重 + 单机 harness)全开源了,支持本地单机部署!!! 大家都在看它跑分,我直接拿它做了一次AI副业赚钱项目真实长任务实测: 2000 块启动...
阿里千问将于北京时间 08 月 26 日 23:00 在魔搭社区开源 Qwen3.8-Flash-Next 及 Qwen3.8-Flash-Next-FP8 两个版本。该模型是基于下一代 Qwen4 架构构建的多模态 MoE 模型,官方提前发布架构改进,以便社区为完整 Qwen4 模型家族做好准备。
通义千问(Qwen)宣布 Qwen 3.8-Flash-Next 将于明天发布,该模型参数规模为 125B a6B。模型页面已上线 ModelScope 平台,引发 Hacker News 社区关注,目前获得 103 个 HN 点赞。
商汤 SenseNova U1.5 Lite 已开源并上线 Token 计划,提供免费公开测试版,每 5 小时可享 1,500 次请求。该模型支持图像生成与编辑一体化,具备参考图驱动创作、复杂指令跟随、原生 2K/4K 输出及自动提示词优化等能力。
另有 1 家信源报道X:商汤 SenseTime (@SenseTime_AI)The next-gen architecture powering Qwen4 is now here! ✨ Get ready for the open release of Qwen3.8-Flash-Next 🚀 The coun...
汤森路透发布其首个自研大语言模型Thomson,基于开源基础投入4000万美元训练,成本远低于同类前沿模型,且完全由公司自有和控制。早期评估显示Thomson在多项任务上与最新前沿模型持平,尤其在指令遵循和密集专业内容推理上提升显著。公司已向学术机构开放评估,并在Hugging Face发布“small”版本开源权重供学术与非商业使用。
另有 1 家信源报道The Decoder:AI News(RSS)Wan3.0 beta is now available on VivaReel. ⚡️ To put it to the test, we created STILL HERE — a cinematic sci-fi short set...
Testing emotional storytelling with Wan 3.0 beta. What if broken hearts had a repair shop? ❤️🩹 She walks in carrying a ...
汤森路透推出其首个大语言模型 Thomson,基于阿里 Qwen3.5-397B 构建,总研发投入约 4000 万美元。该模型与帝国理工学院联合重训以保障安全与政治中立,并用自有内容进一步训练。Thomson 在斯坦福 LegalBench 得分 0.823,在 Harvey 法律智能体基准上接近 Opus 4.8。
另有 1 家信源报道The Decoder:AI News(RSS)Alibaba's Wan 3.0 from @Alibaba_Wan and @alibaba_cloud is now live on OpenRouter. Generate 2-30 second videos from text,...
Wan 3.0 is now live on Comfy! It generates what earlier versions couldn't: a full 30-second scene in one take, as low as...
The wait is over. WAN 3.0 is here—20 references, enhanced visual and audio realism, and 30-second generations. In fact, ...
WAN 3.0 is now on Runway. Generate state-of-the-art video and audio with multiple image, video and audio reference input...
PHANOS | A Flick Original. Official Trailer.🔥 As one of the early internal testers for Wan 3.0, we made this trailer wi...
WAN 3.0 is live on Picsart! 🔊🔥 Complete 30-second videos in one take, and a lot more 🤩 🎬 Full scenes, not fragments:...
Wan 3.0 is live on OpenArt 🔊 • Native 30-second generation in a single pass — no stitching • Consistent motion, lightin...
阿里云发布 Wan3.0 视频生成模型,被评测者评价为“质量持续高水准,而非偶发”,相较 Wan2.7 堪称全新模型。该模型支持文生视频(T2V)、图生视频(I2V)和参考生视频(R2V),现已上线 fal 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)Apodex 1.1 模型家族发布,主打异步 Agent Team 功能,可并行协调多智能体拆解复杂任务并持续整合结果。同步开源 FrontierAgent 本地研究工具台及 Apodex 1.1 mini 开放权重模型,后者支持本地运行复杂工作。
Meet Apodex 1.1: Scaling Agentic Intelligence for Complex Work Open Source Harness: https://github.com/ApodexAI/Frontier...
Wan 3.0 is now live on Pixmax Effortless input. Cinema-grade output. Highlights: - Flawless visual consistency across an...
小鹏汽车宣布第二代 VLA 630 版首次重大升级,端侧模型参数量提高 3.5 倍,为行业主流 VLA 模型的 15 倍;端到端响应速度提升 300%。小鹏 G9L 将全球首发搭载第二代 VLA 全新版本,体验日活动定于 8 月 27 日举行。
Fastino 发布 GLiNER2.5,以边界预测取代跨度枚举,移除最大实体宽度限制,支持 4096 词上下文,计算量随序列长度线性增长。多语言检查点在 16 个零样本基准上整体 macro F1 达 56.17(GLiNER2 为 56.09),XNLI 提升 24.75 分。
GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。
I feel Ox Alpha has continual learning and is modifying itself each day coz how else does it keep improving on it's own?...
阿里巴巴视频生成模型 Wan3.0 现已开放测试,可基于文本、PDF、网页和 PowerPoint 输入生成最长 30 秒的视频,时长较前代 Wan2.5 翻倍。
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)Ox Alpha is currently the most popular model on @OpenRouter and is free to use! A reasoning model designed for coding, s...
Generalist AI 发布机器人基础模型 GEN-1.5,将 3–12 秒的传感器运动数据放入 30 秒上下文窗口即可执行任务,无需梯度更新或微调。在 10 项操作任务中,单次上下文提示平均成功率达 59%(±10%),每任务用 5 分钟数据做 10 步梯度更新后提升至 83%(±9%)。该能力并非显式训练,而是从超八个月预训练中涌现;目前无公开权重、API 或定价,属研究发布。
汤森路透发布首款大语言模型Thomson,基于阿里千问Qwen3.5-397B构建,研发成本约4000万美元,外界流传的45万美元仅为最后一次训练成本。该模型在Stanford LegalBench得分0.823,落后于Gemini 3.1 Pro和GPT-5.5。汤森路透称不采用闭源模型是因外部模型长期成本较高且无法高自由度调整。
另有 1 家信源报道The Decoder:AI News(RSS)LongCat-2.0 now available in Go 1.6T/48B · 1M context · fully open source