Topic · 主题全部主题 →

DeepSeek

DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。

548条收录
70条精选

精选归档 · 第 2 页

2140 条 · 共 70

6月19日

星期五 · 1 条
08:00
OpenRouter:Announcements(RSS)精选
AI 评分 73/100
DeepSeek V4 智能体 token 份额持续增长

DeepSeek 于4月24日发布新一代旗舰模型 V4 系列。OpenRouter 数据显示,V4 发布后其 token 份额从年初的9%增长至6月初的18%,自5月中旬起成为 OpenRouter 最受欢迎模型。V4 是首个足以胜任智能体工作负载的 DeepSeek 模型,到5月底 V4-Flash 已占 DeepSeek 智能体 token 流量的70%。V4-Flash 最便宜端点价格为每百万 token 输入 $0.09、输出 $0.18,远低于 GPT-5.5 的 $5/$30。中国模型整体 token 份额于6月初超过美国模型,DeepSeek 是主要驱动力。


推荐理由:OpenRouter 独家数据展示了代际转折:DeepSeek V4 靠性价比吃下代理负载,中国模型 token 份额首次超过美国,这个信号比任何 benchmark 排名都真实,做应用选型的人该重新算账了。

6月18日

星期四 · 1 条
16:14
IT之家(RSS)精选
AI 评分 72/100
DeepSeek 识图模式正式上线 App 和网页端

DeepSeek 识图模式于6月18日在网页和 App 端正式上线,与快速模式、专家模式并列。开启后用户可直接上传图片让 DeepSeek 识别图像,能力超越简单文字提取。目前 App 端仍显示“图片理解功能内测中”,网页端无此提示。该模式背后的多模态模型技术细节于今年4月公开,核心框架为“Thinking with Visual Primitives(以视觉原语思考)”。


推荐理由:DeepSeek的识图模式终于从内测进了正式版,虽然是补课而非破圈,但对中文用户来说,让AI直接看图比打字描述常用太多,日常工作和内容处理都更顺手了。

6月17日

星期三 · 1 条
02:24
Chubby♨️@kimmonismus精选
AI 评分 75/100
微软考虑为 Copilot Cowork 集成 DeepSeek V4Axios reports that Microsoft is considering a Microsoft-hosted version of DeepSeek V4 as a cheaper model option for Copilot Cowork.Microsoft says Copilot Cowork can’t work on unlimited pricing.“We have users who do hundreds of tasks a week… but the consequence is the costs can go very high,” Charles Lamanna told Axios.So Microsoft is moving Copilot Cowork to usage-based pricing, and exploring cheaper open-source model options.If Microsoft really goes with DeepSeek, it would be optional, fine-tuned, safeguarded, and hosted fully on Azure.Still: Microsoft adding a Chinese AI model to an enterprise Copilot product would be huge.微软正考虑为 Copilot Cowork 提供微软托管的 DeepSeek V4 版本,作为更便宜的模型选项。Copilot Cowork 将放弃无限定价,转向按使用量计费,原因是成本过高(用户每周执行数百项任务导致费用激增)。若采用 DeepSeek,该模型将是可选的、经过微调与安全防护,并完全托管于 Azure。Axios 报道称微软已微调了一个可用模型,最终决定待定。

Ina Fried: 新消息 @axios:微软正考虑将 DeepSeek 用于 Copilot Cowork,同时也在转向基于使用量的定价模式。消息称最终决定尚未确定,但微软已经微调了一个可供使用的模型。


推荐理由:微软考虑在 Copilot Cowork 中引入 DeepSeek V4 作为便宜选项,同时转向按用量计价。如果落地,这不仅是成本策略的转向,更可能打破企业 AI 对开源模型的信任壁垒,定价变革也会给全行业施加压力。

6月16日

星期二 · 1 条
17:57
The Decoder:AI News(RSS)精选
AI 评分 72/100
DeepSeek 完成首轮外部融资,估值超 500 亿美元

中国 AI 初创公司 DeepSeek 完成首轮外部融资,募资超 500 亿元人民币(约 74 亿美元),估值超 500 亿美元。投资结构特殊:多数投资者将资金投入 CEO 梁文锋管理的有限合伙企业,无投票权且锁定期五年;仅国资 AI 基金直接投资并保留投票权。创始人梁文锋个人投入约 200 亿元,腾讯和宁德时代为主要外部投资者。梁文锋表示优先基础 AI 研究与 AGI 开发,将继续开源。DeepSeek 去年初凭 V3、R1 模型获全球关注,今年 4 月发布运行于华为芯片的最大开源权重模型 V4,并将 V4 Pro 永久折扣 75%,输入价格约为 OpenAI GPT-5.5 的 1/11,输出价格约为 1/35。

另有 1 家信源报道IT之家(RSS)
推荐理由:DeepSeek 首次外部融资估值冲到 500 亿美元,交易结构却排除了投资人话语权,看得出梁文锋仍把控制权抓得很紧,开源路线和极致性价比是最大的筹码。

6月12日

星期五 · 1 条
01:17
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 72/100
DeepSeek-R1 的开源实现

DeepSeek-R1 的开源复现项目已在 GitHub 发布,在 Hacker News 上获得 101 个积分。该项目旨在以开源方式复现 DeepSeek-R1 模型。


推荐理由:Hugging Face 把 DeepSeek-R1 的完整训练管线拆解得清清楚楚,从数据蒸馏到 GRPO 强化学习都开源了,还放出了复现的模型和数据集。想理解或自己训练推理模型的开发者,这大概是目前最实用的路线图。

6月3日

星期三 · 1 条
13:09
IT之家(RSS)精选
AI 评分 70/100
消息称 DeepSeek 首轮融资拟筹集 500 亿元,腾讯、宁德时代等参投

DeepSeek 计划在首轮融资中从腾讯、宁德时代等投资方处筹集约 500 亿元人民币。融资落地后,其投后估值预计在 3500 亿至 4000 亿元。创始人梁文峰将出资 200 亿元,腾讯和宁德时代分别拟投资 100 亿元和 50 亿元,成为最大外部投资者。DeepSeek 去年凭借 V3 大模型与 R1 推理模型获得广泛认可。此次融资凸显了中国正打造从大模型到算力能源基建的全链条 AI 产业。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:DeepSeek 第一轮就 500 亿、估值直奔 4000 亿,腾讯和宁德时代入局,这已经不是一家公司的融资,而是中国 AI 产业链上下游的一次正式组队。

5月29日

星期五 · 1 条
08:21
IT之家(RSS)精选
AI 评分 71/100
IT早报 0529:估值 450 亿美元,曝大基金领投 DeepSeek 首轮融资;比亚迪发 4nm 璇玑 A3 芯片并推城市领航兜底;京沪联手指导美团、淘宝、京东三大外卖平台…

DeepSeek 获国家集成电路产业投资基金(国家大基金)领投的首轮融资,投前估值 450 亿美元。豆包官方就“新手父母听建议每顿只喂60ml奶”一事作出回应,称其建议符合国家喂养指南,指出原报道存在上下文缺失。微信 Win / Mac 4.1.10 正式版发布,新增“边写边译”功能。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:国家大基金领投DeepSeek首轮融资,估值450亿美元,这既是政治背书也是资本对国产大模型商业化的真金白银投票,意味着DeepSeek将加速从开源挑战者转向平台化扩张。

5月27日

星期三 · 1 条
03:33

5月25日

星期一 · 1 条
02:27

5月22日

星期五 · 2 条
14:08
13:09
IT之家(RSS)精选
AI 评分 78/100
DeepSeek 推进 700 亿元融资,梁文锋承诺坚持开发开源 AI 模型而非追求短期商业化目标

DeepSeek正推进700亿元人民币的巨额融资,估值约450亿美元。创始人梁文锋承诺将继续开源开发AI模型,不追求短期商业化,目标是技术升级与通用人工智能。腾讯、IDG资本等接近参投,梁文锋个人可能注资200亿元。若成功将创下中国科技初创公司首轮融资纪录。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:700 亿元首轮融资创下纪录,梁文锋明确表态不追求短期商业化、继续死磕开源,国家队和腾讯都在这轮里,对国内开源生态是个强心针。

5月8日

星期五 · 1 条
03:06
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 74/100
DeepSeek 4:适用于 Metal 的 Flash 本地推理引擎

DeepSeek 4 Flash 本地推理引擎正式发布,这是一个专为苹果 Metal 框架优化的开源项目。它允许开发者在配备 Apple Silicon 芯片的 Mac 上高效运行 DeepSeek 4 模型,实现本地离线推理。引擎通过 Metal Performance Shaders 显著提升了计算性能,降低了延迟与内存占用。该项目已在 GitHub 开源,并在 Hacker News 上获得了关注。


推荐理由:antirez 写的引擎让 DeepSeek 4 在 Mac 本地跑出近乎 Flash 的速度,而且代码极其精简,做本地推理的开发者应该立刻克隆下来跑一下。

5月2日

星期六 · 1 条
17:49
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 74/100
DeepSeek V4--性能几乎达到前沿水平,价格却仅为其一小部分

DeepSeek发布了V4版本模型,其性能已接近行业最前沿水平,但在价格上具有显著优势,仅为主要竞争对手的一小部分。该模型在多项基准测试中表现出色,能以极低的成本提供顶级的AI能力,有望大幅降低企业和开发者的使用门槛,推动AI技术的更广泛普及。


推荐理由:Simon Willison 实测结论很直白,DeepSeek V4 性能几乎摸到前沿,价格却便宜一个量级,对预算卡死的团队是重大利好。

4月30日

星期四 · 1 条
23:10
IT之家(RSS)精选
AI 评分 72/100
DeepSeek 公布多模态模型技术报告

DeepSeek发布了多模态大模型及技术报告,提出创新的“基于视觉原语的思考”框架。该框架将点、边界框等视觉元素作为推理的基本单元,旨在解决多模态模型在空间参照任务中存在的“参照鸿沟”核心问题,使模型能将抽象认知锚定到图像的具体坐标上。尽管模型规模紧凑且图像标记预算较低,其在多项挑战性计数和空间推理基准测试上的性能,可与GPT-5.4等前沿模型相媲美。


推荐理由:DeepSeek 把视觉概念直接变成推理单元,绕开了语言描述空间的先天模糊,在空间推理上把自家紧凑模型拉到和 GPT-5.4 一个水平,做多模态应用的人值得细读。

4月24日

星期五 · 1 条
10:56
公众号:DeepSeek(深度求索)精选
AI 评分 85/100
DeepSeek-V4 预览版上线,百万上下文成标配

DeepSeek-V4 预览版正式上线并开源,拥有 1M 超长上下文,Agent 能力、世界知识和推理性能均达国内与开源领先水平。模型分 V4-Pro 与 V4-Flash 两版,API 已同步更新,支持 OpenAI 与 Anthropic 接口,最大上下文均为 1M,并支持思考模式与 reasoning_effort 参数。


推荐理由:百万上下文成为标配,长文档处理与多步 Agent 任务从实验走向生产,原先受限于输入长度的应用有了新的落地空间。