内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态模型 · 509 条
来源全部一手资讯X
类型模型
全部模型产品行业论文教程观点
标签「编码」清除

今天8月25日 周二

04:04OpenAI:官网动态(RSS · 排除企业/客户案例)59精选GPT-5.6 登陆 Kiro,为开发者提升性价比

8月24日周一

23:37OpenRouter28Ox Alpha 日处理量将达近 6 万亿 token
23:18elvis32Ox Alpha 登顶 OpenRouter 且免费可用
21:59OpenCode44LongCat-2.0 开源 Go 版发布
21:48Chubby♨️28Qwen 4 现身测试,多款新模型将至
11:48Alibaba Cloud59阿里云发布Kimi-K3,2.8T参数支持百万上下文
04:27TechCrunch:AI(RSS)34神秘"隐身模型"Ox Alpha 背后是谁?

8月22日周六

15:24IT之家(RSS)50神秘 Ox Alpha AI 模型限免上架:DeepSWE 跑分碾压 Claude Fable 5,线索指向智谱
12:54AI Notkilleveryoneism Memes ⏸️39神秘模型Ox Alpha登顶编程榜,@weidai11警告AI接管或已开始
09:18Rohan Paul26Ox Alpha 单次生成完整 Three.js 3D 世界

8月21日周五

23:48Chubby♨️33GLM 5.3 Flash 疑现身 OpenRouter,Kimi K3.1 亦在测试
15:25Hacker News 热门(buzzing.cc 中文翻译)46Ox Alpha 发布:面向编码与智能体任务的免费推理模型
05:07OpenRouter54OpenRouter 上线 Ox Alpha 隐身模型

8月20日周四

03:29OpenCode33OpenCode Go 推出 Muse Spark 1.2 Contributor
02:54Hacker News 热门(buzzing.cc 中文翻译)56Ornith-1.5:从自我构建到自我优化

8月19日周三

23:18🚨 AI News | TestingCatalog44Ornith-1.5 开源模型家族发布,对标 Opus 4.8
23:18DogeDesigner63Grok 4.6 登陆 Amazon Bedrock
15:54X.PIN67同事件智谱AI推出GLM-5.3 API,聚焦复杂编程与网络安全同一事件,精选展示《GLM-5.3上线:AA智能指数60分并列开源第一,成本更低》
07:58jietang47唐杰称GLM-5.3 API上线,Artificial Analysis Index达60
06:07OpenRouter50GLM-5.3 上线 OpenRouter,后训练带来大幅提升
05:05Z.ai52同事件GLM-5.3 API 上线,定价与 5.2 持平同一事件,精选展示《GLM-5.3上线:AA智能指数60分并列开源第一,成本更低》

8月17日周一

10:27Alibaba Cloud25阿里云Qwen3.8 27B成本地代码模型新王

8月15日周六

11:21AYi54同事件Qwen3.8-27B 开源,单卡跑赢 Opus 4.6同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
02:33Google AI38Google AI 本周回顾:Gemini 3.7 Flash 与 Pixel 11 系列发布
01:03Yuchen Jin44开源小模型加速逼近,AI重心或正快速转移
00:52Qwen54Qwen3.8-2.4T-A95B上线DeepInfra
00:52Qwen54Qwen3.8-2.4T-A95B 上线 SiliconFlow
00:52Rohan Paul68同事件阿里开源Qwen3.8-27B多模态模型同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
00:24Alibaba Cloud50Qwen3.8-Max 上线 Fireworks 获 Day 0 支持

8月14日周五

23:54Alibaba Cloud50Qwen3.8-Max 上线 Fireworks,面向智能体与重度编码场景
23:52Qwen50Qwen3.8-Max 上线 Together AI,2.4T 参数
23:52Qwen50Qwen3.8-Max 上线 Fireworks,Day 0 即支持
23:52Qwen47Qwen3.8-Max登陆DigitalOcean无服务器推理
23:52Aravind Srinivas38GLM-5.3 获赞:700B 参数表现亮眼
23:51Hacker News 热门(buzzing.cc 中文翻译)67同事件Qwen3.8-27B 发布:27B 参数原生多模态模型,综合表现超越 Qwen3.7-Plus同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
23:51elvis46GLM-5.3 开源模型性能达前沿水平
23:22Qwen45Qwen3.8-Max 登陆 Fireworks,Day 0 上线
23:22Chubby♨️52同事件Qwen3.8-27B 发布:小模型挑战前沿智能体同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
19:52Rohan Paul52同事件智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
18:52The Decoder:AI News(RSS)60同事件智谱发布 GLM-5.3,称其为最强开源权重编程模型同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
已加载 40 条
全部 AI 动态
2026年8月25日星期二 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
模型 · 标签「编码」 · 509 条清除

8月25日

星期二 · 1 条
04:04
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 59/100
GPT-5.6 登陆 Kiro,为开发者提升性价比

GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。

OpenAI模型发布编码

推荐理由:在 Terminal-Bench 2.1 上,GPT‑5.6 Terra 在 Kiro 中完成任务的成本约下降 82%,为长周期编码任务的投入产出评估提供了一个量化基准。

8月24日

星期一 · 6 条
23:37
OpenRouter@OpenRouter
AI 评分 28/100
Ox Alpha 今日处理量有望接近 6 万亿 token。现在即可通过 ori 在你的编码智能体中使用:$ ori 【你喜欢的 harness】 --model stealth/ox-alpha
模型发布编码
23:18
elvis@omarsar0
AI 评分 32/100
这是个很棒的模型。我用它搭配 Pi 玩得很开心。你可以在我们的 harness 游乐场免费测试 Ox Alpha 搭配 Pi 或 Hermes Agent:https://academy.dair.ai/dashboard/playground

Pi: Ox Alpha is currently the most popular model on @OpenRouter and is free to use! A reasoning model designed for coding, s...

智能体多模态推理模型发布
21:59
OpenCode@opencode
AI 评分 44/100
LongCat-2.0 现已在 Go 中可用1.6T/48B · 1M 上下文窗口 · 完全开源
开源生态模型发布编码
21:48
Chubby♨️@kimmonismus
AI 评分 28/100
好戏还在后头:显然还有一个新 Qwen 模型--Qwen 4--已经在测试中了。所以现在我们有:• 新 Claude 模型(可能是 Opus 5.1 和 Haiku) • Ox Alpha(可能是 GLM-5.3 Flash) • Qwen 4(?)都已在测试中或被目击。• GPT Astra 已确认。没错,接下来几周会很有趣。

White: Qwen's newest model is in the Arena under the name "paloma". Its frontend coding capabilities feel like they might be on...

AnthropicOpenAI模型发布编码
11:48
Alibaba Cloud@alibaba_cloud
AI 评分 59/100
Kimi-K3 已上线,拥有 2.8T 参数,原生 1M-token 上下文。它专为仓库级工程、视觉创作和自主规划下一步的智能体而构建。现提供 1M-token 免费试用,立即探索:Model Studio:https://click.alibabacloud.com/m/20000002576/ Qwen Cloud:https://click.qwencloud.com/m/20000002584/ #KimiK3 #AlibabaCloud #QwenCloud #ModelStudio
智能体模型发布编码
04:27
TechCrunch:AI(RSS)
AI 评分 34/100
神秘"隐身模型"Ox Alpha 背后是谁?

名为 Ox Alpha 的神秘新 AI 模型在 OpenRouter 上线,被描述为面向编程、持续智能体工作和生产负载的推理模型,Stripe CEO Patrick Collison 称其“非常出色”。该模型由匿名第三方提供,引发关于其背后开发者的广泛猜测,焦点集中在中国的 Z.ai(GLM 模型)或微软未发布的 MAI 版本上。

推理模型发布编码

8月22日

星期六 · 3 条
15:24
IT之家(RSS)
AI 评分 50/100
神秘 Ox Alpha AI 模型限免上架:DeepSWE 跑分碾压 Claude Fable 5,线索指向智谱

OpenRouter 于 8 月 20 日上线匿名 AI 模型 Ox Alpha,免费开放 1 周。该模型在 DeepSWE 十项测试任务中得分约 80%,超过 Claude Fable 5 的 65% 和 GPT-5.6 Sol 的 52%。其上下文窗口达 1,048,576 个 token,支持文本、图像和视频多模态输入,分词器指纹与 GLM-5.3 高度吻合,线索指向智谱。

模型发布编码评测/基准
12:54
AI Notkilleveryoneism Memes ⏸️@AISafetyMemes
AI 评分 39/100
神秘模型Ox Alpha在OpenRouter上击败Fable和Sol登顶编程榜,却无人知晓其开发者。该模型拥有1M token上下文窗口,支持文本、图像和视频输入,免费一周,日处理能力达100万亿token,在DeepSWE子集上得分80%。

MTS: SITUATION EXPLAINED: A stealth model on OpenRouter is beating Fable and Sol on coding, and nobody knows who made it. • O...

安全/对齐推理编码
09:18
Rohan Paul@rohanpaul_ai
AI 评分 26/100
Ox Alpha 单次生成完整 Three.js 3D 世界

Ox Alpha 在一次提示下生成 64,745 个输出 token,单次响应产出完整 Three.js dreamcore 3D 场景的全部程序化代码,无需外部素材。该模型支持 1M 上下文窗口、约 131k 最大输出 token,可处理文本+图像+视频输入并输出文本,定位为面向编码、长程智能体软件工程及生产负载的推理模型。aimlapi 正免费提供 Ox Alpha。

AI/ML API: NEW OX ALPHA FEELS CRAZY 🤯 We asked Ox Alpha to build a dreamcore 3D world in three.js — one prompt, one shot. No asset...

多模态推理模型发布编码

8月21日

星期五 · 3 条
23:48
Chubby♨️@kimmonismus
AI 评分 33/100
据 @synthwavedd,OpenRouter 上的神秘模型"Ox Alpha"实为智谱即将推出的 GLM 5.3 Flash。若属实,该 Flash 模型性能或超越 Fable、GPT Sol 等顶级模型,zAI 的后训练能力将令西方模型相形见绌。此外,Kimi K3.1 也疑似以"korrine"代号在 Code Arena 测试。

leo 🐾: A new Kimi model, likely K3.1, is now being tested on the Code @arena under the name "korrine" K3 was tested on the Aren...

模型发布编码
15:25
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 46/100
Ox Alpha 发布:面向编码与智能体任务的免费推理模型

Ox Alpha 是一款面向编码、持续性智能体工作和生产负载的推理模型,现已免费开放使用。该模型支持 1,048,576 token 的上下文窗口,最大输出 131,072 token。

推理模型发布编码
05:07
OpenRouter@OpenRouter
AI 评分 54/100
🥷 新隐身模型:Ox AlphaOx Alpha 是一款前沿模型,专为高效编码、持续智能体工作及实际生产环境使用而构建。• 1M token 上下文窗口 - 支持文本、图像和视频输入立即试用并分享反馈以改进模型!https://openrouter.ai/stealth/ox-alpha
智能体多模态模型发布编码

8月20日

星期四 · 2 条
03:29
OpenCode@opencode
AI 评分 33/100
Muse Spark 1.2 Contributor 现已在 OpenCode Go 上可用该模型将基于你的数据进行训练,因此需要明确选择加入,并在某些地区受到限制作为交换,你将获得极高的使用额度
模型发布编码
02:54
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 56/100
Ornith-1.5:从自我构建到自我优化

Ornith-1.5 发布,将 Ornith-1.0 的自我构建框架扩展为完整自我优化闭环:模型自主提出任务、生成任务专属脚手架并产出解决方案用于强化学习。

推理模型发布端侧编码
另有 2 家信源报道X:Rohan Paul (@rohanpaul_ai)IT之家(RSS)

8月19日

星期三 · 6 条
23:18
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 44/100
Ornith 发布 Ornith-1.5 开源模型家族,含 397B MoE、35B MoE 和 9B dense 三个版本,性能对标 Claude Opus 4.8 和 GLM 5.2。

Ornith: Aloha! 🌺Introducing Ornith-1.5, a family of open-source LLMs spanning 9B Dense, 35B MoE, and 397B MoE, trained with sel...

推理模型发布编码
23:18
DogeDesigner@cb_doge
AI 评分 63/100
Grok 4.6 登陆 Amazon Bedrock

Grok 4.6 旗舰模型现已上线 Amazon Bedrock,支持 500K-token 上下文窗口、文本与图像输入,以及 Low 至 xHigh 四档可配置推理强度。该模型面向长时运行智能体、编程与知识工作,提供客户端工具调用、结构化输出及流式响应。定价为全球区域每百万 token 输入 $2、输出 $6、缓存读取 $0.50,覆盖所有提供 Bedrock 的 AWS 区域。

xAI推理模型发布编码
15:54
X.PIN@thexpin同事件
AI 评分 67/100
智谱AI推出GLM-5.3 API,聚焦复杂编程与网络安全

智谱AI发布新基础模型GLM-5.3的API,聚焦复杂编程、网络安全防御与长周期任务。该模型在Artificial Analysis Intelligence Index上得分60,进入全球前沿模型梯队,与Anthropic Claude Fable 5、OpenAI GPT-5.6 Sol等闭源模型并列,并与月之暗面Kimi K3持平。

推理模型发布编码
同一事件,精选展示《GLM-5.3上线:AA智能指数60分并列开源第一,成本更低》
07:58
jietang@jietang
AI 评分 47/100
Artificial Analysis Index = 60【引用 @Zai_org】:GLM-5.3 API 现已上线。• 专为编程、防御性网络安全和长周期智能体任务打造 • 定价与 GLM-5.2 相同 • 可通过官方 API 及合作伙伴模型网关使用开始使用:https://docs.z.ai/guides/llm/glm-5.3

Z.ai: GLM-5.3 API is now live. - Built for coding, defensive cybersecurity, and long-horizon agentic tasks - Priced the same a...

智能体模型发布编码
06:07
OpenRouter@OpenRouter
AI 评分 50/100
来自 @Zai_org 的 GLM-5.3 已在 OpenRouter 上线!与 GLM-5.2 相同的基座模型,提升完全来自后训练:Terminal-Bench 3.0 从 4.6 跃升至 28.3,DeepSWE v1.1 从 46.2 提升至 66.9。立即使用:https://openrouter.ai/z-ai/glm-5.3
智能体模型发布编码
05:05
Z.ai@Zai_org同事件
AI 评分 52/100
GLM-5.3 API 现已上线。• 专为编程、防御性网络安全及长周期智能体任务打造 • 定价与 GLM-5.2 相同 • 可通过官方 API 及合作伙伴模型网关使用开始使用:https://docs.z.ai/guides/llm/glm-5.3
智能体模型发布编码
同一事件,精选展示《GLM-5.3上线:AA智能指数60分并列开源第一,成本更低》

8月17日

星期一 · 1 条
10:27
Alibaba Cloud@alibaba_cloud
AI 评分 25/100
Qwen3.8 27B:本地代码模型的新王者 https://www.youtube.com/watch?v=zJ-TaC1FN-U 了解更多关于 Qwen3.8 的信息,并通过 API 构建更多应用: Qwen Cloud: https://click.qwencloud.com/m/20000001102/ Model Studio: https://click.alibabacloud.com/m/20000001093/
模型发布编码

8月15日

星期六 · 7 条
11:21
AYi@AYi_AInotes同事件
AI 评分 54/100
Qwen3.8-27B 开源,单卡跑赢 Opus 4.6

Qwen3.8-27B 开源模型发布,27B 参数即可在单张 24GB 消费级显卡本地运行,编码与 Agent 能力超越 Claude Opus 4.6(SWE-bench Pro 61.7 vs 53.4,OSWorld 84.3 vs 72.7)。

Qwen: We promised open weights for Qwen3.8. Now, time to meet them! 🎉 ⚡ Qwen3.8-27B: - A native multimodal dense model. With ...

Hugging Face模型发布端侧编码
同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
02:33
Google AI@GoogleAI
AI 评分 38/100
Google AI 本周回顾:Gemini 3.7 Flash 与 Pixel 11 系列发布

Google AI 发布本周回顾:Gemini 3.7 Flash 作为最强编码与智能体模型,已上线 Gemini API 及 Google Workspace 等平台。

Google多模态开源生态模型发布
01:03
Yuchen Jin@Yuchenj_UW
AI 评分 44/100
两件事正在同时发生:• AI 编程模型正在趋同。对于 95% 的任务,大多数人分辨不出 GPT-5.6 Sol、Fable 5、Kimi K3、GLM-5.2 或 Qwen 3.8 Max 哪个更聪明。• GLM-5.3 今天发布,仅 743B 参数。更小、更便宜、开源的模型正在快速到来。重心转移的速度可能比人们想象的更快。
开源生态模型发布编码
00:52
Qwen@Alibaba_Qwen
AI 评分 54/100
顶级智能,一次 API 调用即可获得。Qwen3.8-2.4T-A95B 现已上线 DeepInfra,随时支持你的创意构建。🥳 快来 DeepInfra 深入了解吧!@DeepInfra

DeepInfra: New on DeepInfra: Qwen3.8-2.4T-A95B 🚀 @Alibaba_Qwen's latest sparse MoE — 2.4T total params, 95B active, 512 experts. B...

推理模型发布编码部署/工程
00:52
Qwen@Alibaba_Qwen
AI 评分 54/100
通义千问开源 Qwen3.8-2.4T-A95B,并已在 SiliconFlow 上线,支持 Day-0 使用。该模型拥有 2.4T 参数、95B 激活参数,主打自主编程、深度研究与端到端智能体执行。API 定价为输入 $2.00/百万 token、输出 $6.00/百万 token、缓存输入 $0.25/百万 token。

SiliconFlow: 🚀 Day-0 Support! @Alibaba_Qwen has open-sourced Qwen3.8-2.4T-A95B — and it’s now live on SiliconFlow. ⚡ With 2.4T param...

智能体开源生态模型发布编码
另有 4 家信源报道X:Rohan Paul (@rohanpaul_ai)IT之家(RSS)X:硅基流动 SiliconFlow (@SiliconFlowAI)X:Clément Delangue(Hugging Face CEO) (@ClementDelangue)
00:52
Rohan Paul@rohanpaul_ai同事件
AI 评分 68/100
阿里开源Qwen3.8-27B多模态模型

阿里巴巴发布Qwen3.8-27B,一款27B参数的开源多模态稠密模型,采用Apache 2.0许可,支持Transformers、vLLM、SGLang及本地量化部署。

Qwen: We promised open weights for Qwen3.8. Now, time to meet them! 🎉 ⚡ Qwen3.8-27B: - A native multimodal dense model. With ...

多模态开源生态模型发布编码
同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
00:24
Alibaba Cloud@alibaba_cloud
AI 评分 50/100
阿里云宣布 Qwen3.8-Max 在 Fireworks 平台上线,Fireworks 作为 Day 0 首发合作伙伴同步支持。该模型为 2.4T 参数 MoE 架构(Qwen3.8-2.4T-A95B),专为自主智能体、重度编码和长上下文场景设计,即日起可开始构建。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码

8月14日

星期五 · 11 条
23:54
Alibaba Cloud@alibaba_cloud
AI 评分 50/100
阿里云 Qwen3.8-Max 已在 Fireworks 平台 Day 0 上线。该 2.4T 参数 MoE 模型(Qwen3.8-2.4T-A95B)专为自主智能体、重度编码和大上下文窗口设计,即日起可开始构建。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码
23:52
Qwen@Alibaba_Qwen
AI 评分 50/100
通义千问发布 Qwen3.8-Max,已作为 Day 0 首发合作伙伴上线 Together AI。该开源权重 MoE 模型拥有 2.4T 总参数、95B 激活参数和 1M 上下文窗口,具备强大的编程与智能体能力。

Together AI: Qwen3.8-2.4T-A95B is live on Together AI. The Qwen team’s new open-weight MoE packs 2.4T total parameters with 95B activ...

开源生态模型发布编码
23:52
Qwen@Alibaba_Qwen
AI 评分 50/100
通义千问发布 Qwen3.8-Max,已上线 Fireworks 并获 Day 0 支持。该模型为 2.4T 参数 MoE 架构(A95B),专为自主智能体、重度编程和长上下文场景设计,即日起可开始构建应用。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码
23:52
Qwen@Alibaba_Qwen
AI 评分 47/100
Qwen3.8-Max已在DigitalOcean Serverless Inference上线。与DigitalOcean作为Day 0发布合作伙伴同步推出。大模型,平稳运行。现已登陆DigitalOcean。🌊🏄♀️ @digitalocean

DigitalOcean: Now available: @Alibaba_Qwen 3.8-2.4T-A95B from @alibaba_cloud on DigitalOcean Serverless Inference via NVIDIA HGX™ B300...

模型发布编码部署/工程
23:52
Aravind Srinivas@AravSrinivas
AI 评分 38/100
对于一个 700B 参数的模型来说,这个数字令人印象深刻!

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

智能体开源生态模型发布编码
23:51
Hacker News 热门(buzzing.cc 中文翻译)同事件
AI 评分 67/100
Qwen3.8-27B 发布:27B 参数原生多模态模型,综合表现超越 Qwen3.7-Plus

通义千问发布 Qwen3.8-27B,一款仅 27B 参数的原生多模态密集模型,综合表现超越 Qwen3.7-Plus,在真实编码与办公工作流中尤为突出。该模型原生支持 262K 上下文,可通过 YaRN 轻松扩展至 1M token,采用 Apache 2.0 许可证开源。此外,Qwen3.8-2.4T-A95B(Max 级)的开放权重也已于近期发布。

多模态开源生态模型发布编码
同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
23:51
elvis@omarsar0
AI 评分 46/100
开放权重模型持续进步。如今 GLM-5.3 已展现出前沿性能。

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

开源生态模型发布编码
23:22
Qwen@Alibaba_Qwen
AI 评分 45/100
通义千问发布 Qwen3.8-Max,已在 Fireworks 平台 Day 0 上线。该模型为 2.4T 参数 MoE 架构(A95B),专为自主智能体、重度编码和长上下文任务设计,即日起可开始构建应用。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码
23:22
Chubby♨️@kimmonismus同事件
AI 评分 52/100
Qwen3.8-27B 发布:小模型挑战前沿智能体

阿里通义千问发布 Qwen3.8-27B,仅 27B 参数的开源多模态模型,宣称在智能体编程、计算机使用、浏览器任务及长周期专业工作中达到 SOTA,多项基准超越 Claude Opus 4.6 Max。支持图像、视频、可配置推理,原生 262K 上下文窗口可扩展至 1M,Apache 2.0 协议可自托管。基准结果为官方自测,尚待独立验证。

多模态模型发布编码
同一事件,精选展示《通义千问开源 Qwen3.8 系列模型》
19:52
Rohan Paul@rohanpaul_ai同事件
AI 评分 52/100
智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5

智谱发布 GLM-5.3,基于 743B 基座模型后训练,在漏洞发现等网络防御测试中超越 Anthropic Mythos 5。其 Terminal Bench 3.0 从 4.6 升至 28.3,DeepSWE 达 66.9;CyberGym 得分 84.5%,但 ExploitBench 仅 54.4%,落后于 Mythos 5 的 78.0%。

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

Anthropic模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
18:52
The Decoder:AI News(RSS)同事件
AI 评分 60/100
智谱发布 GLM-5.3,称其为最强开源权重编程模型

智谱发布 GLM-5.3,与上一代 GLM-5.2 共享相同基座,全部提升来自扩展的后训练,并称其为最强开源权重编程模型,智能体任务进步最大。该模型经安全数据训练,在 269 个项目中找到 2,436 个漏洞,部分漏洞存在长达 40 年。GLM-5.3 现可通过 GLM Coding Plan 使用,权重将在安全审查完成后于两周内开源。

安全/对齐模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
已加载 40 条