名为 Ox Alpha 的神秘新 AI 模型在 OpenRouter 上线,被描述为面向编程、持续智能体工作和生产负载的推理模型,Stripe CEO Patrick Collison 称其“非常出色”。该模型由匿名第三方提供,引发关于其背后开发者的广泛猜测,焦点集中在中国的 Z.ai(GLM 模型)或微软未发布的 MAI 版本上。
名为 Ox Alpha 的神秘新 AI 模型在 OpenRouter 上线,被描述为面向编程、持续智能体工作和生产负载的推理模型,Stripe CEO Patrick Collison 称其“非常出色”。该模型由匿名第三方提供,引发关于其背后开发者的广泛猜测,焦点集中在中国的 Z.ai(GLM 模型)或微软未发布的 MAI 版本上。
Harvey 发布其首个后训练模型 Tenet 研究预览版,基于 Kimi K3 基座,针对长时程法律工作训练。相比基座,Tenet 在 LAB 上完成近两倍保留任务,在 LAB: Contracts 上多 20%,全通过率分别提升 9 和 2 个百分点。目前未公开权重或 API,仅限企业通过 Harvey 平台使用。
OpenRouter 于 8 月 20 日上线匿名 AI 模型 Ox Alpha,免费开放 1 周。该模型在 DeepSWE 十项测试任务中得分约 80%,超过 Claude Fable 5 的 65% 和 GPT-5.6 Sol 的 52%。其上下文窗口达 1,048,576 个 token,支持文本、图像和视频多模态输入,分词器指纹与 GLM-5.3 高度吻合,线索指向智谱。
SITUATION EXPLAINED: A stealth model on OpenRouter is beating Fable and Sol on coding, and nobody knows who made it. • O...
Gemini 3.7 Flash from @Google on ARC-AGI (Verified): - ARC-AGI-2: 84.6%, $0.25/task - ARC-AGI-1: 95.5%, $0.12/task Gemin...
Ox Alpha 在一次提示下生成 64,745 个输出 token,单次响应产出完整 Three.js dreamcore 3D 场景的全部程序化代码,无需外部素材。该模型支持 1M 上下文窗口、约 131k 最大输出 token,可处理文本+图像+视频输入并输出文本,定位为面向编码、长程智能体软件工程及生产负载的推理模型。aimlapi 正免费提供 Ox Alpha。
NEW OX ALPHA FEELS CRAZY 🤯 We asked Ox Alpha to build a dreamcore 3D world in three.js — one prompt, one shot. No asset...
🚢 Marin 535B-A23B started training this week! As usual, the whole process is open. Voyage plan: pretraining (80%) + mid...
Excited to bring the Muse Spark 1.2 Contributor tier to @openrouter today. We can't wait to see what developers build wi...
DeepSeek 发布实验性多模态模型 V4-Flash-Vision-Exp,在图像理解基础上保持文本推理能力,其内部智能体基准测试成绩接近 Opus 4.8。该模型兼容 OpenAI 与 Anthropic API,支持 Base64、URL(32 MiB)及免费 Files API(64 MiB)三种传图方式,单图成本最高 384 tokens,单次请求最多 600 张图片。
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》No way! @synthwavedd says that the secret Model "Ox Alpha" on OpenRouter is the upcoming GLM 5.3 Flash A Flash model (!!...
TARS 推出具身原生基础模型 AWE 3.5,采用“Born as One”架构,将动作、感知、几何与触觉整合进单一模型,而非后期拼接。该模型支持数分钟长时程闭环推理,任务执行效率约为 PI0.5 的 2 倍,并通过预训练双先验与后训练世界引擎滚动预测来优化决策。
A new Kimi model, likely K3.1, is now being tested on the Code @arena under the name "korrine" K3 was tested on the Aren...
DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...
Ox Alpha (stealth model) is free for the next week - 1M Context - Multi-modal - Zero Data Retention Generous rate limits...
面壁智能 OpenBMB 推出 MathForm,一个面向 Lean 4 数学自动形式化的开源框架、数据集与模型。其 FormalVerse 数据集含 367K+ 已验证示例;在匹配 100K 预算下,基于其训练的模型 Consistency Check 达 60.32%,优于 FineLeanCorpus(46.53%)与 NuminaMath-LEAN(41.49%)。
DeepSeek 推出 DeepSeek-v4-flash-vision-exp 模型,可同时接受图像与文本输入。用户能要求模型描述图片、从截图中读取文字、分析图表等。该实验版本扩展了 DeepSeek 的多模态能力。
DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...
DeepSeek 发布实验性多模态模型 deepseek-v4-flash-vision-exp,文本能力对齐 V4-Flash,多模态 Agent 性能逼近 Opus-4.8,Agents Last Exam 27.3 对 25.7、ZeroBench 35.0 对 34.0。
DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for billing: up to 384 tok...
DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...
DeepSeek 推出实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp,文本能力与 V4-Flash 持平,涵盖智能体、推理与世界知识。
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...
DeepSeek 上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,可通过设置 model='deepseek-v4-flash-vision-exp' 在 API 平台访问。
深度求索发布多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,已上线 API 平台。该模型纯文本能力与 V4-Flash 正式版持平,视觉理解 Agent Benchmark 表现大幅跃升,接近 Opus-4.8。API 按 token 计费,单张图片最多占 384 tokens,价格与 V4-Flash 一致,支持三种调用格式及三种图片传入方式。
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》Ox Alpha (stealth model) is free for the next week - 1M Context - Multi-modal - Zero Data Retention Generous rate limits...
Ox Alpha 是一款面向编码、持续性智能体工作和生产负载的推理模型,现已免费开放使用。该模型支持 1,048,576 token 的上下文窗口,最大输出 131,072 token。
商汤科技今日宣布开源轻量级原生统一多模态大模型 SenseNova U1.5 Lite,该模型拥有 8B 参数,原生支持 3-4k 上下文长度和 4K 高分辨率图像输出。模型支持 Bounding Box、Visual Marker 及多图参考等精细视觉控制,在指令遵循与图像编辑保持度上超越同量级模型,文字渲染与复杂布局能力媲美超大规模商业模型。
蚂蚁百灵正式开源 Ling-3.0-tiny-base 与 Ling-3.0-flash-base,除最终 Base checkpoint 外,还同步开放预训练和中期训练的权重 checkpoint,共计 6 个。
另有 1 家信源报道X:蚂蚁百灵 (@AntLingAGI)Superwhisper 推出 S1 系列,其中 S1-mini 以开源权重发布在 Hugging Face 上。这是一款 0.6B 参数的文本规范化模型,基于 Qwen3-0.6B 微调,用于清理语音识别后的转录文本,去除填充词并应用标点与大小写。
阿里发布第三代图像模型 Qwen-Image-3.0 系列,旗舰版 Pro 在 Artificial Analysis 图像编辑榜位列第六、文生图榜第九,较上代分别提升 83 和 48 Elo 分。该系列支持 4.5k token 提示词、10 像素级精确文字渲染及 12 种语言,Pro 版定价 $0.04/张(1K 分辨率),已在阿里云 Model Studio 上线。
Liquid AI 为 LFM2.5 系列三款模型(1.2B-Instruct、2.6B、8B-A1B)发布 DSpark 草稿模型检查点,通过约 300M 参数的草稿模型一次提出 9 个候选 token,由目标模型单次前向验证,在 H100 上解码速度最高提升 3.18 倍,M4 Max MacBook Pro 上最高 2.87 倍。
Google DeepMind 推出 DiffusionGemma,一个基于 Gemma 4 26B A4B MoE 模型微调而来的实验性开放权重文本扩散模型。