Topic · 主题全部主题 →

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

3,825条收录
636条精选

精选归档 · 第 31 页

601620 条 · 共 636

8月21日

星期四 · 1 条
00:00
DeepSeek:API 更新日志精选
AI 评分 71/100
DeepSeek-V3.1 发布,升级 chat 与 reasoner 双模式

DeepSeek-V3.1 正式发布,deepseek-chat 与 deepseek-reasoner 分别对应其非思考与思考模式。新模型采用混合推理架构,思考效率较 DeepSeek-R1-0528 更高,并通过 Post-Training 优化提升工具使用与智能体任务表现。


推荐理由:DeepSeek 把推理和非思考模式合并到一个模型,解决了之前切模型的体验割裂,Agent 能力提升对做工具调用的开发者是直接利好。

8月7日

星期四 · 3 条
08:00
OpenRouter:Announcements(RSS)精选
AI 评分 68/100
GPT-5 已在 OpenRouter 上线

GPT-5 现已登陆 OpenRouter 平台,具备长上下文能力,专为复杂推理和代码工作流设计。

另有 1 家信源报道X:ChatGPT (@ChatGPTapp)
推荐理由:GPT-5 是 AI 史上的分水岭,长上下文和推理能力直接催生了一整代 agent 工具,哪怕过了快一年回头看,仍然值得搞清楚它改变了什么。
08:00
OpenRouter:Announcements(RSS)精选
AI 评分 68/100
GPT-5 现已上线

OpenRouter 平台已发布 GPT-5,该模型支持长上下文,专为复杂推理与代码工作流构建。

另有 1 家信源报道X:ChatGPT (@ChatGPTapp)
推荐理由:这是 GPT-5 首次以大上下文和推理能力亮相,1M token 上下文让 code agent 直接从 demo 变成可用,现在看虽是旧闻,但节点意义不减。

8月6日

星期三 · 1 条
01:06

8月5日

星期二 · 2 条
08:00
Claude Platform:开发者版本说明(RSS)精选
AI 评分 61/100
Claude Opus 4.1 发布:性能增强的增量更新

Anthropic 推出 Claude Opus 4.1,作为 Claude Opus 4 的增量更新,具备增强的能力和性能改进。该版本不允许同时指定 temperature 和 top_p 参数,用户应仅使用其中一个。


推荐理由:Claude Opus 4.1 是 Opus 4 的增量升级,官方发布无夸张数据,但参数限制这个细节对开发者是实操提醒,用高端模型的团队值得重新评估一下效果。
05:25
Hao AI Lab@haoailab精选
AI 评分 67/100
FastWan视频生成模型实现70倍加速,5秒出片Try FastWan at https://fastwan.fastvideo.org/!FastVideo团队推出FastWan系列快速视频生成模型。该模型采用名为"稀疏蒸馏"的新训练方法,能将视频去噪速度提升70倍。在单块H200 GPU上,仅需5秒即可生成一段5秒的视频。团队提供了在线演示,并依据Apache-2.0许可证完全开源了模型、代码和数据。

Hao AI Lab: (1/n) 🚀 With FastVideo, you can now generate a 5-second video in 5 seconds on a single H200 GPU! Introducing FastWan se...


推荐理由:视频生成终于从「等一分钟」进化到「实时出片」,FastWan 用稀疏蒸馏把去噪压了 70 倍,单卡 H200 五秒出五秒视频,做短视频工具和实时交互产品的团队该认真看看这个开源方案。

7月31日

星期四 · 1 条
00:00
LMSYS:Blog(Chatbot Arena 团队)精选
智谱发布 GLM-4.5 系列模型并原生支持 SGLang

智谱发布旗舰模型 GLM-4.5(355B/32B 激活)与 GLM-4.5-Air(106B/12B 激活),含 FP8 量化版本,即日起原生支持 SGLang 框架。采用 MoE 架构与 128k 上下文,在 12 项基准测试中分列第 3 与第 6。GLM-4.5 在 BrowseComp 网页浏览任务中以 26.4% 准确率超越 Claude 4 Opus,工具调用成功率达 90.6%,编程与数学推理能力突出。


推荐理由:国产大模型Agent与编码能力跻身第一梯队,为开发者提供Claude/GPT之外的高性价比替代方案

7月11日

星期五 · 1 条
00:00
Moonshot AI:Kimi Blog精选
Kimi 发布 K2 模型

Kimi K2 采用混合专家(MoE)架构,拥有 320 亿激活参数和 1 万亿总参数,在非推理模型的前沿知识、数学和编程任务上达到 SOTA 性能。

另有 1 家信源报道Moonshot AI:Kimi Blog
推荐理由:月之暗面发布 Kimi K2,万亿参数 MoE 架构,多基准 SOTA

7月9日

星期三 · 1 条
08:00
xAI:News(网页)精选
Grok 4

xAI 正式发布 Grok 4,新一代大模型在数学推理和代码生成能力上大幅提升,延续实时获取 X 平台信息的特色。该版本支持更长上下文窗口和图像理解,即日起向 X Premium+ 订阅者开放。

另有 1 家信源报道xAI:News(网页)
推荐理由:xAI正式发布Grok 4旗舰大模型,重要版本更新值得关注

7月1日

星期二 · 1 条
08:00
OpenRouter:Announcements(RSS)精选
AI 评分 55/100
OpenRouter 发布新隐身模型 Cypher Alpha

OpenRouter 宣布推出 Cypher Alpha,这是一款免费、通用型隐身模型,内置工具调用功能,用户可直接尝试。


推荐理由:OpenRouter 自家出的免费通用模型,带工具调用,去年夏天发的,现在看只能算个入门级 Agent 玩具,但免费试不亏。

6月24日

星期二 · 1 条
22:00

5月29日

星期四 · 2 条
20:07
公众号:DeepSeek(深度求索)精选
AI 评分 85/100
DeepSeek-R1 更新至 0528 版本,推理能力显著增强

DeepSeek 发布 R1 模型小版本升级 DeepSeek-R1-0528,在数学、编程与通用逻辑等基准测评中取得当前国内所有模型中首屈一指的成绩,整体表现接近 o3 与 Gemini-2.5-Pro。


推荐理由:后训练投入增加带来的推理提升幅度,为开源社区提供了可蒸馏的高质量思维链,小模型也能接近大模型表现。

5月28日

星期三 · 1 条
00:00
DeepSeek:API 更新日志精选
AI 评分 71/100
DeepSeek 将 deepseek-reasoner 升级为 DeepSeek-R1-0528

DeepSeek 将 deepseek-reasoner 模型升级为 DeepSeek-R1-0528,推理能力显著增强,AIME 2025 得分从 70.0 升至 87.5,GPQA 从 71.5 升至 81.0。新版本优化了 Web 前端开发能力,并极大抑制了老版本 R1 的幻觉问题,同时支持 Json Output 与 Function Calling。


推荐理由:DeepSeek 把 R1 的推理能力又拉高了一大截,AIME 涨 17 分、Aider 涨 14 分,JSON Output 和 Function Calling 的加入让它在 agent 场景里更实用了,做复杂推理产品的人应该第一时间切过去试试。

5月20日

星期二 · 2 条
17:45
17:45

5月6日

星期二 · 1 条
23:06

3月25日

星期二 · 1 条
21:24
公众号:DeepSeek(深度求索)精选
AI 评分 74/100
DeepSeek-V3-0324 发布:推理、代码与中文写作能力全面升级

DeepSeek 发布小版本升级 DeepSeek-V3-0324,在数学、代码类评测集上得分超过 GPT-4.5,并增强了前端代码生成、中文写作与联网搜索能力。模型参数约 660B,开源版本上下文长度为 128K,网页端、App 和 API 提供 64K 上下文。权重已开源,采用 MIT License,允许蒸馏训练其他模型。


推荐理由:推理能力提升至超越 GPT-4.5 的同时保持 MIT 开源许可,让低成本部署强推理模型的门槛进一步降低。