内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态一手 · 83 条
来源全部一手资讯X
类型全部
全部模型产品行业论文教程观点
标签「DeepSeek」清除

8月15日周六

12:01公众号:百度智能云(文心)46百度千帆 Token Plan 权益升级:夜间调用 2 折,DeepSeek-V4-Flash-0731 上线

8月13日周四

19:20公众号:DeepSeek(深度求索)73同事件DeepSeek-V4-Pro 正式版上线同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:16DeepSeek:API 更新日志81精选DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强

8月2日周日

21:56Nathan Lambert:Interconnects(RSS)45最新开源模型盘点(#23):Laguna S2.1、Inkling 与 Kimi K3 展现开源模型在帕累托前沿的价值

7月31日周五

00:00DeepSeek:API 更新日志72精选DeepSeek-V4-Flash 正式版 API 上线公测

7月21日周二

01:43Tomer Tunguz 博客(VC 分析)50开源权重模型逼近前沿,闭源仍领先

7月14日周二

13:35OpenRouter:Announcements(RSS)52为什么通过 OpenRouter 使用 DeepSeek:16 家供应商的价格与吞吐量差异达 4 倍与 14 倍

7月13日周一

01:35Nathan Lambert:Interconnects(RSS)58开源模型面临未来6个月的生存考验

7月11日周六

01:19LMSYS:Blog(Chatbot Arena 团队)61精选DeepSeek-V4 Flash 强化学习训练登陆 AMD Instinct MI355X GPU,由 Miles 框架支持

6月29日周一

18:10公众号:蚂蚁百灵(Ling)51如何优雅地给 MLA 加上 QK-Norm?

6月25日周四

22:30公众号:DeepSeek(深度求索)38DeepSeek 寻找闪亮发光的你
21:35公众号:DeepSeek(深度求索)26DeepSeek 寻找闪亮发光的你

6月19日周五

08:00OpenRouter:Announcements(RSS)73精选DeepSeek V4 智能体 token 份额持续增长

6月16日周二

22:01Nathan Lambert:Interconnects(RSS)52前沿大模型后训练配方回顾:与 Finbarr Timbers 对谈

6月14日周日

00:17OpenRouter:Announcements(RSS)73精选OpenRouter融合预算模型面板超越GPT-5.5和Claude Opus 4.8

6月9日周二

00:41Tomer Tunguz 博客(VC 分析)56精选AI 替代浪潮:三大力量重塑成本结构

6月8日周一

19:12公众号:火山引擎28火山方舟Coding Plan与Agent Plan升级,限时2.5折

5月21日周四

16:08公众号:火山引擎46Agent Plan、Coding Plan上新:新增DeepSeek V4

5月17日周日

01:32Nathan Lambert:Interconnects(RSS)53最新开源成果(#21):开源模型盛宴!Gemma 4、DeepSeek V4、Kimi K2.6、MiMo 2.5、GLM-5.1 等。基于CAISI的V4评估。

4月26日周日

04:29LMSYS:Blog(Chatbot Arena 团队)54SGLang与Miles在发布首日为DeepSeek-V4提供全栈支持

4月24日周五

10:56公众号:DeepSeek(深度求索)85精选DeepSeek-V4 预览版上线,百万上下文成标配
10:55公众号:DeepSeek(深度求索)59DeepSeek-V4 预览版:迈入百万上下文普惠时代
08:00Hugging Face:Blog(RSS)78精选DeepSeek-V4:智能体可实际使用的百万token上下文

3月25日周三

00:00LMSYS:Blog(Chatbot Arena 团队)Elastic EP:实现DeepSeek MoE部署的部分故障容忍

2月19日周四

00:00LMSYS:Blog(Chatbot Arena 团队)GB300 NVL72部署DeepSeek R1优化方案:长上下文推理性能突破

2月16日周一

18:00公众号:DeepSeek(深度求索)10骏骥迎春,同驰新境 | DeepSeek 丙午新年春节 AI 贺词

2月3日周二

23:03Hugging Face:Blog(RSS)80精选全球开源AI生态系统的未来:从 DeepSeek 到 AI+

1月27日周二

23:01Hugging Face:Blog(RSS)83精选中国开源AI生态中的架构选择:构建超越DeepSeek的未来

1月20日周二

23:02Hugging Face:Blog(RSS)58"DeepSeek时刻"一周年

12月10日周三

00:00LMSYS:Blog(Chatbot Arena 团队)让张量飞起来 -- 用 R-Fork 加速大模型权重加载

12月1日周一

18:52公众号:DeepSeek(深度求索)84精选DeepSeek V3.2 正式版发布:强化 Agent 能力,融入思考推理
18:52公众号:DeepSeek(深度求索)66精选DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理
00:00DeepSeek:API 更新日志85精选DeepSeek-V3.2 及 DeepSeek-V3.2-Speciale 发布

10月22日周三

00:00LMSYS:Blog(Chatbot Arena 团队)SGLang集成KTransformers:基于AMX优化与专家延迟的MoE混合推理加速

10月14日周二

00:00LMSYS:Blog(Chatbot Arena 团队)SGLang与NVIDIA携手加速SemiAnalysis InferenceMAX及GB200优化

9月29日周一

18:07公众号:DeepSeek(深度求索)79精选DeepSeek-V3.2-Exp 发布,引入稀疏注意力提升长文本效率,API 降价超 50%
18:01公众号:DeepSeek(深度求索)59DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价
00:00DeepSeek:API 更新日志51DeepSeek-V3.2-Exp 发布:deepseek-chat 与 deepseek-reasoner 同步升级
00:00LMSYS:Blog(Chatbot Arena 团队)SGLang 发布首日支持 DeepSeek-V3.2:集成稀疏注意力机制

9月26日周五

00:00LMSYS:Blog(Chatbot Arena 团队)蚂蚁集团联合SGLang:H20-96G部署DeepSeek-R1最佳实践
已加载 40 条
全部 AI 动态
2026年8月17日星期一 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
一手信源 · 标签「DeepSeek」 · 83 条清除

8月15日

星期六 · 1 条
12:01
公众号:百度智能云(文心)
AI 评分 46/100
百度千帆 Token Plan 权益升级:夜间调用 2 折,DeepSeek-V4-Flash-0731 上线

8月14日起,百度千帆 Token Plan 个人版与企业版推出「夜享Tokens加赠计划」,每日21:00至次日08:00调用 GLM-5.2、DeepSeek-V4-Flash-0731 等模型按2折计费,约节省80%成本,订阅即享。

智能体DeepSeek产品更新推理

8月13日

星期四 · 2 条
19:20
公众号:DeepSeek(深度求索)同事件
AI 评分 73/100
DeepSeek-V4-Pro 正式版上线

DeepSeek 发布 V4 Pro 正式版,已同步在 APP、网页端和 API 更新上线,用户可在 APP 或网页端选择“专家模式”使用。正式版增强 Agent 能力,API 原生支持 OpenAI Responses API 格式并适配 Codex。

智能体DeepSeek推理模型发布
同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:16
DeepSeek:API 更新日志精选
AI 评分 81/100
DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强

DeepSeek-V4-Pro 正式版已在 APP、网页端和 API 同步上线,模型名设为 deepseek-v4-pro 即可使用。其 Agent 能力显著提升,HLE (wo/w tools) 达 42.7/60.0,Terminal Bench 2.1 为 87.9。

智能体DeepSeek模型发布
另有 10 家信源报道IT之家(RSS)X:X.PIN (@thexpin)Hacker News 热门(buzzing.cc 中文翻译)X:阿易 AI Notes (@AYi_AInotes)X:DeepSeek (@deepseek_ai)X:Kim (@kimmonismus)X:Rohan Paul (@rohanpaul_ai)X:SemiAnalysis (@SemiAnalysis_)The Decoder:AI News(RSS)X:Testing Catalog (@testingcatalog)
推荐理由:峰谷定价把闲时成本降至高峰一半,适合批量推理、评估任务等可延迟工作负载调整执行时间,为降低 API 支出提供空间。

8月2日

星期日 · 1 条
21:56
Nathan Lambert:Interconnects(RSS)
AI 评分 45/100
最新开源模型盘点(#23):Laguna S2.1、Inkling 与 Kimi K3 展现开源模型在帕累托前沿的价值

Thinking Machines 发布首个模型 Inkling,为 975B-A41B 多模态 MoE,支持文本、图像和音频输入,并推出 276B-A12B 小版本。

DeepSeek多模态开源生态现象/趋势

7月31日

星期五 · 1 条
00:00
DeepSeek:API 更新日志精选
AI 评分 72/100
DeepSeek-V4-Flash 正式版 API 上线公测

DeepSeek-V4-Flash 正式版 API 上线公测,模型名设为 deepseek-v4-flash 即可使用,调用方式不变。其 Agent 能力大幅增强,Terminal Bench 2.1 得分 82.7,NL2Repo 54.2,Toolathlon verified 70.3,DSBench-Hard 59.6,多项基准远超 V4-Pro-Preview。

智能体DeepSeek模型发布编码
另有 5 家信源报道IT之家(RSS)X:Emad Mostaque (@EMostaque)X:阿易 AI Notes (@AYi_AInotes)X:DeepSeek (@deepseek_ai)X:Rohan Paul (@rohanpaul_ai)
推荐理由:DeepSeek V4-Flash 正式版 Agent 能力大幅跃升,多个编码 agent 基准分数翻倍,对做代码助手的团队是个高性价比的生产力入口。虽然是 Flash 版,但后训练打磨的成果让人更期待 Pro 正式版。

7月21日

星期二 · 1 条
01:43
Tomer Tunguz 博客(VC 分析)
AI 评分 50/100
开源权重模型逼近前沿,闭源仍领先

开源权重模型已多次达到与闭源前沿模型相当的水平,但闭源模型如 GPT-5.2 仍持续创造阶跃式突破。Kimi K3 为 2.8T 参数开源模型,Qwen 3.8 为 2.4T 参数模型。按 90/10 输入输出比例计算,开源前沿模型价格中位数比 GPT-5.2 便宜约 15%,最便宜的 DeepSeek V4 Flash 便宜约 90%。

DeepSeekOpenAI大佬观点开源生态

7月14日

星期二 · 1 条
13:35
OpenRouter:Announcements(RSS)
AI 评分 52/100
为什么通过 OpenRouter 使用 DeepSeek:16 家供应商的价格与吞吐量差异达 4 倍与 14 倍

DeepSeek 由 16 家供应商提供服务,价格差异约 4 倍,吞吐量从 4 到 57 tokens/秒不等。通过 OpenRouter 统一路由可自动选择最优供应商,避免用户逐一对比价格与速度。当对延迟或成本有特定要求时,直接调用特定供应商可能更合适。

DeepSeek推理教程/实践部署/工程

7月13日

星期一 · 1 条
01:35
Nathan Lambert:Interconnects(RSS)
AI 评分 58/100
开源模型面临未来6个月的生存考验

美国白宫正讨论通过新行政令管理开源模型,最可能在未来6个月内禁止或无限期延迟能力接近GPT 5.5、Claude Opus 4.8或GLM-5.2水平的开源权重模型发布。Anthropic主导的反中国模型政治运动以知识蒸馏为由推动监管,实质是监管捕获。Reflection AI代表在相关会议上主张开源模型应基于能力获得豁免,但该公司尚未发布公开模型。

AnthropicDeepSeek大佬观点开源生态
另有 1 家信源报道X:Nathan Lambert (@natolambert)

7月11日

星期六 · 1 条
01:19
LMSYS:Blog(Chatbot Arena 团队)精选
AI 评分 61/100
DeepSeek-V4 Flash 强化学习训练登陆 AMD Instinct MI355X GPU,由 Miles 框架支持

DeepSeek-V4 Flash 的强化学习训练现已在 AMD Instinct MI355X GPU 上通过 Miles 框架获得支持,基于 ROCm 软件栈运行。该 2840 亿参数 MoE 模型(每 token 激活 130 亿参数)需 SGLang 进行 rollout 生成、Megatron 进行策略更新,Miles 负责异步循环与权重同步。团队解决了 SGLang 与 Megatron 间模型对齐、量化状态在线更新及多节点并行稳定性三大挑战,最终在四个八 GPU 节点上完成端到端验证:超过 100 个优化器步骤中训练-rollout 对数概率差可控,在线奖励持续提升,离线 AIME-2024 基准分数同步上涨。

DeepSeek推理论文/研究部署/工程

推荐理由:把 DeepSeek-V4 Flash 的 RL 训练完整搬到 AMD MI355X 上,不是画饼,而是给了实测数据和可跑的配置。想用非 NVIDIA 卡做 RL 训练的,可以照着踩坑。

6月29日

星期一 · 1 条
18:10
公众号:蚂蚁百灵(Ling)
AI 评分 51/100
如何优雅地给 MLA 加上 QK-Norm?

DeepSeek 的 MLA 通过只缓存低维潜向量压缩 KV Cache,但 QK-Norm 需归一化高维 Key,若缓存归一化结果则打破低维优势。文章提出数学等效变换:将 QK-Norm 中动态逆 RMS 标量和静态仿射权重合并到 Query 侧,推理时每个 token 只需额外缓存一个逆 RMS 标量,即可严格等价实现 QK-Norm,不牺牲显存效率。在 400M/1B 模型训练 100B tokens 实验中,QK-Normed MLA 相比 QK-clipping loss 更低(1B 模型 gap ~0.02),训练更稳定且收敛更快。

DeepSeek推理教程/实践数据/训练

6月25日

星期四 · 2 条
22:30
公众号:DeepSeek(深度求索)
AI 评分 38/100
DeepSeek 寻找闪亮发光的你
DeepSeek行业动态
21:35
公众号:DeepSeek(深度求索)
AI 评分 26/100
DeepSeek 寻找闪亮发光的你
DeepSeek行业动态

6月19日

星期五 · 1 条
08:00
OpenRouter:Announcements(RSS)精选
AI 评分 73/100
DeepSeek V4 智能体 token 份额持续增长

DeepSeek 于4月24日发布新一代旗舰模型 V4 系列。OpenRouter 数据显示,V4 发布后其 token 份额从年初的9%增长至6月初的18%,自5月中旬起成为 OpenRouter 最受欢迎模型。V4 是首个足以胜任智能体工作负载的 DeepSeek 模型,到5月底 V4-Flash 已占 DeepSeek 智能体 token 流量的70%。V4-Flash 最便宜端点价格为每百万 token 输入 $0.09、输出 $0.18,远低于 GPT-5.5 的 $5/$30。中国模型整体 token 份额于6月初超过美国模型,DeepSeek 是主要驱动力。

智能体DeepSeek开源生态现象/趋势

推荐理由:OpenRouter 独家数据展示了代际转折:DeepSeek V4 靠性价比吃下代理负载,中国模型 token 份额首次超过美国,这个信号比任何 benchmark 排名都真实,做应用选型的人该重新算账了。

6月16日

星期二 · 1 条
22:01
Nathan Lambert:Interconnects(RSS)
AI 评分 52/100
前沿大模型后训练配方回顾:与 Finbarr Timbers 对谈

Interconnects 播客邀请 Finbarr Timbers 回顾后训练配方的演变:从 InstructGPT 的 SFT→奖励模型→RL 三阶段,到 Llama 3 / Tülu 3 的 SFT→DPO→可验证奖励 RL,再至 DeepSeek R1 以大规模 RL 为核心。2026 年配方分化为多个领域专家模型再合并回统一模型。新出现模式为 Multi-teacher On-Policy Distillation(MOPD):训练 N 个领域专家(经 SFT 和领域 RL),再通过在线采样、逐 token 最小化反向 KL 散度训练通用学生模型。MiMo Flash V2 率先引入,DeepSeek V4 与 Nemotron 3 Ultra 扩展至超过 10 个教师。MOPD 兴起源于单一 RL 流程在多领域间产生能力冲突,而专家模型易于并行训练,在线蒸馏技术日趋成熟。

DeepSeek大佬观点开源生态推理

6月14日

星期日 · 1 条
00:17
OpenRouter:Announcements(RSS)精选
AI 评分 73/100
OpenRouter融合预算模型面板超越GPT-5.5和Claude Opus 4.8

通过OpenRouter融合的一组预算模型,在100个复杂研究任务上得分超过GPT-5.5和Claude Opus 4.8。

AnthropicDeepSeekOpenAI产品更新

推荐理由:OpenRouter 的 Fusion API 用多个模型合成输出,基准测试里预算模型组合能接近前沿,这个思路对有质量要求又在意成本的开发者挺实用。

6月9日

星期二 · 1 条
00:41
Tomer Tunguz 博客(VC 分析)精选
AI 评分 56/100
AI 替代浪潮:三大力量重塑成本结构

三大力量重塑 AI 成本:前沿闭源模型持续涨价,开源模型在多数场景已足够好,买家开始替代。Coinbase 将提示词路由至更便宜模型,成本持平但 token 用量指数增长。Lindy 全切至 DeepSeek v4,节省数百万美元且多项核心性能提升。Harvey 在 Legal Agent Benchmark 上通过 SFT 使 Kimi 2.6 all-pass 率达 15%,超越 Opus 的 14%,同一 100 任务成本 $84 vs $954(约 11 倍价差)。Cursor 后训练 Kimi K2.5 得到 Composer 2.5,称其“性能优异且效率高达同类模型 10 倍”。闭源越来越贵,开源平价且性能接近,选择决定企业单位经济学的斜率。

AnthropicDeepSeek开源生态推理

推荐理由:Tunguz 用 Coinbase、Lindy 等真实案例,把「用开源/便宜模型替代昂贵前沿模型」的趋势讲透了,做 AI 应用的人该重新算一下单位经济账。

6月8日

星期一 · 1 条
19:12
公众号:火山引擎
AI 评分 28/100
火山方舟Coding Plan与Agent Plan升级,限时2.5折

火山方舟Coding Plan与Agent Plan升级,集成MiniMax M3、DeepSeek V4系列、GLM-5.1等多款三方模型。即日起至2026年8月7日,新购/升级/续费40元、200元档位可享首两月2.5折(9.9元/月、49.9元/月)。MiniMax M3为新一代旗舰,支持100万token上下文窗口及原生多模态理解。Agent Plan为业界首个Agent套餐包,整合字节自研Seed系列模型与Harness工具,免费提供联网搜索和Embedding记忆能力,可配合Claude Code、OpenClaw、TRAE等工具使用。

智能体DeepSeek产品更新多模态

5月21日

星期四 · 1 条
16:08
公众号:火山引擎
AI 评分 46/100
Agent Plan、Coding Plan上新:新增DeepSeek V4

火山引擎的Agent Plan和Coding Plan产品新增支持DeepSeek V4模型,用户可在相关计划中调用该模型进行开发与部署。

智能体DeepSeek产品更新编码

5月17日

星期日 · 1 条
01:32
Nathan Lambert:Interconnects(RSS)
AI 评分 53/100
最新开源成果(#21):开源模型盛宴!Gemma 4、DeepSeek V4、Kimi K2.6、MiMo 2.5、GLM-5.1 等。基于CAISI的V4评估。

本月开源AI模型领域迎来密集发布,包括Gemma 4、DeepSeek V4、Kimi K2.6、MiMo 2.5和GLM-5.1等一系列重要新版本。这些模型均在CAISI的V4评估框架下进行了性能评测。多个团队几乎同期推出旗舰级更新,反映出开源社区当前高速迭代的竞争态势。

DeepSeekGoogle大佬观点开源生态

4月26日

星期日 · 1 条
04:29
LMSYS:Blog(Chatbot Arena 团队)
AI 评分 54/100
SGLang与Miles在发布首日为DeepSeek-V4提供全栈支持

SGLang团队宣布,在DeepSeek-V4发布首日即通过SGLang推理引擎和Miles训练框架为其提供全栈支持。该开源技术栈针对DeepSeek-V4的混合稀疏注意力、流形约束超连接和FP4专家权重等新架构特性进行了系统优化。在推理侧,推出了ShadowRadix前缀缓存、HiSparse分层内存加速、多令牌预测推测解码等关键技术。在强化学习训练侧,Miles支持包括DP/TP/SP/EP/PP/CP在内的全并行策略、TileLang注意力及FP8训练,显著提升了训练稳定性。该技术栈支持多种主流硬件平台。

DeepSeek开源/仓库推理部署/工程

4月24日

星期五 · 3 条
10:56
公众号:DeepSeek(深度求索)精选
AI 评分 85/100
DeepSeek-V4 预览版上线,百万上下文成标配

DeepSeek-V4 预览版正式上线并开源,拥有 1M 超长上下文,Agent 能力、世界知识和推理性能均达国内与开源领先水平。模型分 V4-Pro 与 V4-Flash 两版,API 已同步更新,支持 OpenAI 与 Anthropic 接口,最大上下文均为 1M,并支持思考模式与 reasoning_effort 参数。

智能体DeepSeek推理模型发布

推荐理由:百万上下文成为标配,长文档处理与多步 Agent 任务从实验走向生产,原先受限于输入长度的应用有了新的落地空间。
10:55
公众号:DeepSeek(深度求索)
AI 评分 59/100
DeepSeek-V4 预览版:迈入百万上下文普惠时代

DeepSeek-V4 预览版发布,支持百万级上下文窗口,提供顶级长文本记忆能力,模型配置选择更灵活。

DeepSeek模型发布
08:00
Hugging Face:Blog(RSS)精选
AI 评分 78/100
DeepSeek-V4:智能体可实际使用的百万token上下文

DeepSeek发布新一代模型DeepSeek-V4,其核心突破在于实现了长达百万token的上下文窗口,并确保智能体能够有效利用这一扩展的上下文能力。该模型延续了通过开源与开放科学推动人工智能发展与普及的使命,标志着大模型在长上下文理解和实际应用方面迈出重要一步。

智能体DeepSeek开源生态模型发布
另有 3 家信源报道IT之家(RSS)Hacker News 热门(buzzing.cc 中文翻译)Simon Willison 博客
推荐理由:DeepSeek 把上下文窗口推到百万 token 不稀奇,关键是「agent 能实际用」这六个字。如果实测成立,RAG 的很多工程妥协可以扔掉了,做长文档和复杂 agent 的人该第一时间跑一遍。

3月25日

星期三 · 1 条
00:00
LMSYS:Blog(Chatbot Arena 团队)
Elastic EP:实现DeepSeek MoE部署的部分故障容忍

Mooncake团队与Volcano Engine在SGLang框架中推出Elastic EP功能,解决大规模DeepSeek MoE模型"宽"专家并行部署的可靠性瓶颈。该技术通过解耦专家与GPU的刚性绑定并维护冗余副本,可在32 GPU集群中容忍最多16个rank故障,将服务恢复时间从2-3分钟缩短至10秒以内,降幅达90%。基准测试显示,该方案在实现极端韧性的同时,吞吐量、TTFT和TPOT等关键指标与标准DeepEP持平,实现零静态性能损耗。

DeepSeek开源/仓库部署/工程

2月19日

星期四 · 1 条
00:00
LMSYS:Blog(Chatbot Arena 团队)
GB300 NVL72部署DeepSeek R1优化方案:长上下文推理性能突破

NVIDIA与SGLang团队发布DeepSeek R1-NVFP4在GB300 NVL72上的优化部署方案,针对128K/8K长上下文推理实现显著性能提升。通过PD分离、分块流水线并行、宽专家并行及多Token预测(MTP)等技术,系统在GB300上达226 TPS/GPU峰值吞吐量,较GB200提升1.53倍;相同延迟下性能领先1.4–1.6倍。MTP可再提升每用户TPS达1.87倍,128K预填充首Token延迟降至8.6秒。

DeepSeek开源/仓库推理部署/工程

2月16日

星期一 · 1 条
18:00
公众号:DeepSeek(深度求索)
AI 评分 10/100
骏骥迎春,同驰新境 | DeepSeek 丙午新年春节 AI 贺词
DeepSeek其他

2月3日

星期二 · 1 条
23:03
Hugging Face:Blog(RSS)精选
AI 评分 80/100
全球开源AI生态系统的未来:从 DeepSeek 到 AI+

Hugging Face 在其官方博客发布文章,展望了全球开源人工智能生态系统的发展路径与未来趋势。文章以 DeepSeek 等代表性开源模型为例,探讨了开源社区如何推动技术民主化与创新加速。核心观点指向一个更加开放、协作的“AI+”未来生态,其中开源框架、模型和工具将深度融入各行各业,降低开发门槛并促进多样化应用场景的涌现。

DeepSeekHugging Face开源生态现象/趋势

推荐理由:开源AI核心平台对生态走向的判断,直接影响开发者技术选型和投资方向

1月27日

星期二 · 1 条
23:01
Hugging Face:Blog(RSS)精选
AI 评分 83/100
中国开源AI生态中的架构选择:构建超越DeepSeek的未来

Hugging Face发布博客文章,探讨中国开源人工智能生态系统的核心架构选择与发展路径。文章聚焦于如何构建一个超越现有模型(如DeepSeek)的可持续技术体系,分析了中国开发者在模型架构、训练框架、部署工具和社区协作等方面的关键决策。文中指出,中国开源社区正致力于打造独立且互操作的技术栈,以应对大规模模型训练与推理的独特挑战,并推动全球AI生态的多元化发展。

DeepSeek开源生态现象/趋势

推荐理由:揭示中国开源AI架构演进,帮助开发者把握生态趋势与选型方向。

1月20日

星期二 · 1 条
23:02
Hugging Face:Blog(RSS)
AI 评分 58/100
"DeepSeek时刻"一周年

Hugging Face在其官方博客发布文章,回顾“DeepSeek时刻”过去一年的影响。文章指出,自DeepSeek系列模型发布以来,开源大模型生态发生了显著变化。模型能力快速逼近甚至在某些任务上超越了闭源模型,社区参与度和模型下载量均创下新高。这一趋势降低了AI技术的使用门槛,并推动了更多商业化应用的探索。开源与闭源模型的竞争格局正在被重塑。

DeepSeekHugging Face现象/趋势

12月10日

星期三 · 1 条
00:00
LMSYS:Blog(Chatbot Arena 团队)
让张量飞起来 -- 用 R-Fork 加速大模型权重加载

蚂蚁集团 DeepXPU 团队与 SGLang 团队联合发布 Tensor R-Fork(Tensor Remote Fork)技术,通过 GPU-Direct RDMA 实现节点间设备到设备的零拷贝权重传输。该技术可将 Deepseek-R1 模型的加载时间从数分钟缩短至数秒,减少约 600GB 的本地磁盘与 DRAM 存储占用,并提供 NCCL 和 TransferEngine 两种后端方案,后者可在不干扰线上推理服务的情况下完成权重迁移。

DeepSeek开源/仓库开源生态部署/工程

12月1日

星期一 · 3 条
18:52
公众号:DeepSeek(深度求索)精选
AI 评分 84/100
DeepSeek V3.2 正式版发布:强化 Agent 能力,融入思考推理

DeepSeek 发布正式版 DeepSeek-V3.2 和长思考增强版 V3.2-Speciale,网页端、App 和 API 均已更新。

智能体DeepSeek开源生态推理

推荐理由:V3.2将思考融入工具调用,在Agent评测中达到开源最高水平,泛化性提升可能改变复杂工具调用应用的模型选型。
18:52
公众号:DeepSeek(深度求索)精选
AI 评分 66/100
DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理
智能体DeepSeek推理模型发布
另有 1 家信源报道公众号:DeepSeek(深度求索)
推荐理由:半年前的这版更新,把 Agent 和思考推理揉进了开源模型,回头看算是 DeepSeek 在智能体能力上的关键一刀,做 Agent 开发的至今绕不开它。
00:00
DeepSeek:API 更新日志精选
AI 评分 85/100
DeepSeek-V3.2 及 DeepSeek-V3.2-Speciale 发布

DeepSeek 将 deepseek-chat 和 deepseek-reasoner 均升级为 DeepSeek-V3.2,分别对应非思考模式与思考模式。同时非正式部署 DeepSeek-V3.2-Speciale 的 API 服务,价格不变,仅支持思考模式对话,不支持工具调用,最大输出长度默认 128K,服务截止至北京时间 2025-12-15 23:59。

DeepSeek推理模型发布

推荐理由:我觉得DeepSeek V3.2的亮点不是参数,而是思考模式正式接入主力API,意味着推理能力常态化,Speciale那个128K输出更像压力测试,做长文档的可以抓住窗口期探上限。

10月22日

星期三 · 1 条
00:00
LMSYS:Blog(Chatbot Arena 团队)
SGLang集成KTransformers:基于AMX优化与专家延迟的MoE混合推理加速

SGLang现已集成KTransformers后端,为DeepSeek-V3等稀疏MoE模型提供CPU/GPU混合推理加速。该技术采用Intel AMX优化内核,使单路Xeon算力达21.3 TFLOPS,较PyTorch原生实现快3.9倍;通过NUMA感知张量并行和CUDA Graph调度,双路服务器解码吞吐量提升63%,GPU内核启动开销从20%降至接近零;专家延迟机制支持跨层重排计算以重叠CPU与GPU执行,在精度变化低于0.5%的情况下使解码吞吐量再提高1.45倍。

DeepSeek开源/仓库推理部署/工程

10月14日

星期二 · 1 条
00:00
LMSYS:Blog(Chatbot Arena 团队)
SGLang与NVIDIA携手加速SemiAnalysis InferenceMAX及GB200优化

SGLang与NVIDIA针对Blackwell架构(GB200 NVL72)深度优化,在DeepSeek R1模型上实现每GPU 26k输入与13k输出tokens/秒的高吞吐。通过Prefill-Decode分离架构、大规模专家并行及FP8/NVFP4内核优化,SGLang在SemiAnalysis InferenceMAX基准测试中较Hopper代际获得4倍性能提升,并被选为该基准在NVIDIA与AMD硬件上运行DeepSeek模型的默认推理引擎。

DeepSeek开源/仓库部署/工程

9月29日

星期一 · 4 条
18:07
公众号:DeepSeek(深度求索)精选
AI 评分 79/100
DeepSeek-V3.2-Exp 发布,引入稀疏注意力提升长文本效率,API 降价超 50%

DeepSeek 发布实验性模型 DeepSeek-V3.2-Exp,在 V3.1-Terminus 基础上引入 DeepSeek Sparse Attention(DSA)稀疏注意力机制,在几乎不影响输出效果的前提下大幅提升长文本训练和推理效率,公开评测表现与 V3.1-Terminus 基本持平。

DeepSeek推理模型发布

推荐理由:稀疏注意力在几乎不影响效果的前提下大幅降低长文本成本,API 降价 50% 让依赖长上下文的应用获得了更现实的部署条件。
18:01
公众号:DeepSeek(深度求索)
AI 评分 59/100
DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价
DeepSeek推理模型发布
00:00
DeepSeek:API 更新日志
AI 评分 51/100
DeepSeek-V3.2-Exp 发布:deepseek-chat 与 deepseek-reasoner 同步升级

DeepSeek 将 deepseek-chat 和 deepseek-reasoner 均升级为 DeepSeek-V3.2-Exp。其中 deepseek-chat 对应非思考模式,deepseek-reasoner 对应思考模式,详细更新内容见官方文档。

DeepSeek推理模型发布
00:00
LMSYS:Blog(Chatbot Arena 团队)
SGLang 发布首日支持 DeepSeek-V3.2:集成稀疏注意力机制

SGLang 在发布首日即支持 DeepSeek-V3.2,该模型基于 DeepSeek-V3.1-Terminus 引入 DeepSeek Sparse Attention (DSA) 机制。DSA 通过 Lightning Indexer 和 Top-k Token Selection 将注意力复杂度从 O(L²) 降至 O(Lk),在 128K 长上下文下实现训练与推理效率大幅提升且质量损失可忽略。SGLang 实现了专用缓存与 Native Sparse Attention 后端,并提供了面向 NVIDIA、AMD MI350X/MI355X 及 NPU 的部署方案与容器镜像。

DeepSeek开源/仓库开源生态部署/工程

9月26日

星期五 · 1 条
00:00
LMSYS:Blog(Chatbot Arena 团队)
蚂蚁集团联合SGLang:H20-96G部署DeepSeek-R1最佳实践

蚂蚁集团联合SGLang提出H20-96G部署DeepSeek-R1的工业级方案。针对H20高内存带宽、低计算吞吐特性,采用硬件感知策略:单节点TP-8处理prefill,小规模EP-16处理decode。结合FlashMLA-FP8、DeepGEMM swapAB内核优化与异步Expert Affinity负载均衡技术,在4096 token序列上实现单节点16.5k输入/5.7k输出token/秒的吞吐,达H20平台SOTA性能。

DeepSeek推理论文/研究部署/工程
已加载 40 条