内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态观点 · 165 条
来源全部一手资讯X
类型观点
全部模型产品行业论文教程观点
标签「DeepSeek」清除

8月25日周二

13:25IT之家(RSS)51美媒分析中国 AI 追赶速度:清华人才网络与开源技术是关键
12:16elsewhere:文章(RSS)39DeepSeek Harness 之后,重读最早定义开源的一群人
11:37Qwen32通义千问回应:中国开源模型已成研究默认选择

8月24日周一

22:54Nathan Lambert64中国开源模型成AI研究默认选择
01:29Yuchen Jin36游戏PC本地运行大模型速度三年提升12倍

8月22日周六

08:44ginobefun34Anthropic 发布 AI 原生 SDLC 手册,DeepSeek 开放视觉 API
04:18Chubby♨️43GPT-5.6 降价 20%,OpenAI 施压 Anthropic
02:44AYi40池建强停掉两年客户端,全面迁移DeepSeek Harness

8月18日周二

15:54karminski-牙医24求推荐中文写作能力评测基准

8月17日周一

06:03Dongxi 东锡 NLP37中英AI圈关注点差异与DGX Spark融合趋势

8月16日周日

16:53Rohan Paul53西门子测试Qwen与DeepSeek,欧洲企业转向中国开源模型
14:03Dongxi 东锡 NLP56DeepSeek Harness 开源:把边界写成契约
05:03Dongxi 东锡 NLP31DeepSeek Harness 架构:事实存于可验证处
03:03Dongxi 东锡 NLP63DeepSeek Harness:让智能体状态有明确归属

8月15日周六

21:18elsewhere:文章(RSS)27DeepSeek Harness 发布 45 小时,我们听到了 8 种不同的声音
06:52Chubby♨️332026开源本地AI三大里程碑
00:52swyx23DeepSeek 回应迅速引热议

8月14日周五

19:02Emad41GLM-5.3 后训练跃升,登顶网络防御基准
17:21IT之家(RSS)5170 天超 10 款模型:CNBC 称美国限制反而催化中国 AI 创新,加速进入全球企业业务体系
13:47elsewhere:文章(RSS)14DeepSeek Harness 很妙:这不是一个产品,而是一个战略
12:02赵纯想43DeepSeek 插件生态被指"智子"式技术封锁
08:04ginobefun38DeepSeek Harness 智能体,GPT-5.6 Sol 压缩推理等待,多智能体实验暴露协作失灵
04:22Chubby♨️50数日间AI价格战剧变:DeepSeek涨价、Grok崛起
00:02赵纯想44DeepSeek Harness:可热插拔的Agent内核架构

8月13日周四

23:02Frank Wang 玉伯9玉伯评DeepSeek Harness似foobar2000
22:02赵纯想46DeepSeek Harness:技术人员主导的产品灾难
18:21Rohan Paul43Kimi K3 领先 DeepSeek-V4-Pro 67 分但贵 13.8 倍
18:02赵纯想14DeepSeek 发错版本引热议
15:15AYi26豆包现身美国毕业帽与樟宜机场
10:15AYi38广东AI三杰:杨植麟、何凯明、梁文峰
10:15AYi32央视年度AGI人物引热议:梁文峰杨植麟落选?
07:30公众号:数字生命卡兹克69精选DeepSeek V4 Pro与Grok 4.6同日发布,双双逼近Claude Fable 5体验
02:20Chubby♨️39Grok 4.6与DeepSeek 4 Pro GA价格战白热化
01:18karminski-牙医13DeepSeek V4 Pro 发布引担忧

8月12日周三

17:48X.PIN50DeepSeek 推理模式会给用户起昵称

8月11日周二

14:10AYi33DeepSeek 思考链自曝用户昵称,官方回应

8月9日周日

01:12SemiAnalysis19DeepSeek稀疏注意力挑战主流范式

8月8日周六

21:12Rohan Paul51中国10T参数MoE模型预训练或需约3万块Blackwell GPU
09:00ginobefun38贾扬清官宣 Intent Lab,回溯 AI 二十年创业路
05:57Dongxi 东锡 NLP52DeepSeek V4 Flash 低推理预算下仍近满分
已加载 40 条
全部 AI 动态
2026年8月26日星期三 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
观点 · 标签「DeepSeek」 · 165 条清除

8月25日

星期二 · 3 条
13:25
IT之家(RSS)
AI 评分 51/100
美媒分析中国 AI 追赶速度:清华人才网络与开源技术是关键

《华尔街日报》报道称,中国 AI 模型与美国头部模型的差距已缩小至数月,背后是清华等高校长期形成的人才网络、开源技术、人才回流及更高算力效率共同推动。智谱 AI 唐杰、月之暗面杨植麟、DeepSeek 梁文锋等研究者构成重要力量。报道还指出,DeepSeek 通过 MLA 与 MoE 技术降低算力需求,但高端芯片数量仅为 OpenAI、谷歌同行的五分之一。

DeepSeek开源生态现象/趋势
12:16
elsewhere:文章(RSS)
AI 评分 39/100
DeepSeek Harness 之后,重读最早定义开源的一群人
DeepSeek开源生态现象/趋势
11:37
Qwen@Alibaba_Qwen
AI 评分 32/100
一项基于50万篇arXiv论文的分析显示,约40%论文提及中国开源LLM,美国开源模型降至25-30%,中国模型已成研究默认选择。通义千问(Qwen)持续增长,如今提及任何LLM的论文中1/3提到Qwen;Llama在2025年4月达30%峰值后持续下滑。

Nathan Lambert: Over the weekend I had Codex parse 500K arXiv AI/ML papers since ChatGPT to understand which open models are used for re...

DeepSeek开源生态现象/趋势

8月24日

星期一 · 2 条
22:54
Nathan Lambert@natolambert
AI 评分 64/100
中国开源模型成AI研究默认选择

Nathan Lambert用Codex分析50万篇arXiv论文发现,中国开源LLM在AI研究中的提及率从2024年的10%升至如今的约40%,而美国开源模型从30%降至25-30%。Qwen被1/3提及LLM的论文引用,DeepSeek在R1发布后明显跃升;Llama于2025年4月达30%峰值后持续下滑。

DeepSeekMetaOpenAI开源生态
01:29
Yuchen Jin@Yuchenj_UW
AI 评分 36/100
2024年:一台搭载RTX 4090的游戏PC以4-bit量化运行Llama 3 70B,速度约为2 tok/s。2026年:一台搭载RTX 5090的游戏PC以原生mxfp4格式运行DeepSeek-V4-Flash 284B,速度约为24 tok/s。预测:到2027年底,一台游戏PC将以可观的速度在本地运行Fable 5级别的智能。
DeepSeek大佬观点端侧

8月22日

星期六 · 3 条
08:44
ginobefun@hongming731
AI 评分 34/100
Anthropic 发布 AI 原生 SDLC 手册,DeepSeek 开放视觉 API

Anthropic 发布覆盖 Plan 至 Maintain 六阶段的 AI 原生 SDLC 手册,以版本化工件串联各环节,并区分建议性与强制性控制。DeepSeek 上线实验模型 deepseek-v4-flash-vision-exp API,支持图文混合输入,单张图片最多占 384 tokens,价格与 V4-Flash 相同,Files API 免费开放。

智能体AnthropicDeepSeek多模态
04:18
Chubby♨️@kimmonismus
AI 评分 43/100
GPT-5.6 降价 20%,OpenAI 施压 Anthropic

OpenAI 将 GPT-5.6 Sol 的 API 和额度价格下调超 20%,为期三个月,被视为对 Anthropic 的施压信号。此举也得益于其算力基建投资和效率优化,同时面临 DeepSeek 4 Flash 等低价中国模型的竞争压力。推理成本逐年下降,SOTA 模型正被推向更低价格,最终受益的是用户。

OpenAI: As we continue to push the frontier of capabilities while improving efficiency, we're dropping API and credit pricing of...

AnthropicDeepSeekOpenAI现象/趋势
02:44
AYi@AYi_AInotes
AI 评分 40/100
池建强停掉两年客户端,全面迁移DeepSeek Harness

墨问西东创始人池建强体验DeepSeek Harness(DSH)一天后,停掉开发两年的客户端并论证全面迁移。DSH是MIT开源的插件化Agent底座,模型无关,支持DeepSeek、OpenAI、Anthropic、Gemini,8月13日发布后GitHub一周约18万星。他判断模型能力已不卡,卡在工程化运行时,DSH相当于开放了Agent的操作系统层。

池建强: 突破性的:体验完DeepSeek Harness,我打算放弃开发了两年的客户端。 今天下午,我把核心研发叫到一起开了个会:停掉现有客户端的继续开发,开始论证并全面迁移到DeepSeek Harness。 而这个客户端,我们持续开发了两年,并...

智能体DeepSeek开源生态现象/趋势

8月18日

星期二 · 1 条
15:54
karminski-牙医@karminski3
AI 评分 24/100
有网友好奇目前是否有针对模型写作能力的测试基准,尚未见到,求推荐。引用推文指出DeepSeek V4系列表现反常:更便宜的V4 Flash强于Pro,推理强度更低的V4 Pro High强于Pro Max;写作文风上V4 Pro仍优于其他版本,但与Opus 4.6差距悬殊。

Orange AI: DeepSeek V4 Pro 果然是训歪了 便宜好几倍的 V4 Flash 比 Pro 强 推理强度更低的 V4 Pro High 比 Pro Max 强 不过目前写作能力方面文风还是 V4 Pro 好一些 但也跟 Opus 4.6 天壤...

AnthropicDeepSeek评测/基准

8月17日

星期一 · 1 条
06:03
Dongxi 东锡 NLP@dongxi_nlp
AI 评分 37/100
中英AI圈关注点差异与DGX Spark融合趋势

博主断开中文信息流两周后观察发现,中英文AI圈普通用户关注点呈两种模式:中文圈聚焦DeepSeek,英文圈聚焦DGX Spark。他预计两者将出现融合趋势,即“DGX Spark + DeepSeek”的组合将受到广泛关注。

DeepSeek现象/趋势

8月16日

星期日 · 4 条
16:53
Rohan Paul@rohanpaul_ai
AI 评分 53/100
西门子测试Qwen与DeepSeek,欧洲企业转向中国开源模型

中国开源模型正获欧洲企业青睐,西门子已公开测试Qwen和DeepSeek,在自托管LLM平台配合vLLM运行。本地推理可规避GDPR跨境数据传输限制,但自托管仅在服务器持续满载时优于租用API,且中国是西门子最大市场之一,采用中国模型有助于维持在华业务资格。

DeepSeek开源生态现象/趋势部署/工程
14:03
Dongxi 东锡 NLP@dongxi_nlp
AI 评分 56/100
DeepSeek Harness 开源:把边界写成契约

DeepSeek Harness 开源,设计哲学是“事实有据,权限有度”。它拒绝将 agent state 写成模糊目标,让每份重要 state 由能验证它的 owner 持有,并通过 atomic comparison 关闭 time-of-check/time-of-use gap。

智能体DeepSeek教程/实践部署/工程
另有 3 家信源报道X:阿易 AI Notes (@AYi_AInotes)公众号:卡尔的AI沃茨X:Rohan Paul (@rohanpaul_ai)
05:03
Dongxi 东锡 NLP@dongxi_nlp
AI 评分 31/100
DeepSeek harness 具有清晰的架构个性:每个重要事实都存在于可被验证或强制执行之处。

Dongxi 东锡 NLP: https://x.com/i/article/2088681782606536704

DeepSeek大佬观点
03:03
Dongxi 东锡 NLP@dongxi_nlp
AI 评分 63/100
DeepSeek Harness:让智能体状态有明确归属

DeepSeek Harness 的核心设计是拒绝将“智能体状态”视为单一模糊对象,而是让每个关键事实归属于有权验证它的组件。例如文件读取会记录版本号,仅在版本匹配时才允许修改,以消除检查与使用之间的时间差。工具调用则作为事件管道,包含身份验证、模式校验、执行钩子等环节,子智能体也需独立决策上下文、生命周期与权限。

智能体DeepSeek现象/趋势部署/工程

8月15日

星期六 · 3 条
21:18
elsewhere:文章(RSS)
AI 评分 27/100
DeepSeek Harness 发布 45 小时,我们听到了 8 种不同的声音

DeepSeek Harness 发布 45 小时后,社区涌现出 8 种不同声音,围绕其将全世界变成分布式 Harness 团队的愿景展开讨论。各方观点聚焦于该项目的协作模式、技术潜力与落地挑战,但原文未披露具体参数、性能数据或可用性细节。

DeepSeek现象/趋势
06:52
Chubby♨️@kimmonismus
AI 评分 33/100
2026开源本地AI三大里程碑

2026年将成为开源与本地AI的里程碑之年。智谱GLM-5.3仅通过后训练提升,在CyberGym得分84.5%,超越Mythos 5的83.8%;Qwen3.8-27B可本地运行,多项关键基准超越Opus 4.6 Max;DeepSeek V4 Flash API价格低至每百万未缓存输入token $0.14、输出$0.28,接近“便宜到无法计量”。

Chubby♨️: So yeah, you can now run Opus 4.6 max locally. Just let that sink in.

AnthropicDeepSeek开源生态现象/趋势
00:52
swyx@swyx
AI 评分 23/100
天哪,DeepSeek 对 Roon 推文的回应真快。

roon: the major ai companies should commit to a real time priced API product. ai demand varies wildly over a day/night curve a...

DeepSeek现象/趋势

8月14日

星期五 · 7 条
19:02
Emad@EMostaque
AI 评分 41/100
智谱发布 GLM-5.3,基于 743B 基座模型后训练,编码与智能体能力达顶级。Emad Mostaque 指出,该模型与 DeepSeek flash 的更新显示,仅靠后训练即可将性能提升至前沿水平,无法用 logit 蒸馏等解释。GLM-5.3 现已在 cyberdefense 与 GDPval 等硬基准上登顶。

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

DeepSeek大佬观点开源生态数据/训练
17:21
IT之家(RSS)
AI 评分 51/100
70 天超 10 款模型:CNBC 称美国限制反而催化中国 AI 创新,加速进入全球企业业务体系

自今年 6 月以来,9 家中国 AI 公司已推出 10 款模型,在推理、编程和智能体等关键领域正逐步逼近美国顶尖闭源模型。CNBC 报道称,美国持续收紧限制,但中国技术正加速进入全球大型企业业务体系,IDC 调查显示安全合规与性能优势是企业采用中国 AI 模型的最主要原因。

DeepSeek开源生态现象/趋势
13:47
elsewhere:文章(RSS)
AI 评分 14/100
DeepSeek Harness 很妙:这不是一个产品,而是一个战略
DeepSeek现象/趋势
12:02
赵纯想@chunxiangai
AI 评分 43/100
DeepSeek 插件生态被指"智子"式技术封锁

作者将 DeepSeek 插件生态(DSH)比作“智子”,认为其以迷人形态吸引技术型天才,锁住约 6 个月时间,使其沉迷插件开发与黑客松,拔高对 Agent 架构的阈值,导致对打包好的产品失去兴趣。作者类比 70 年代穹顶屋运动,呼吁天才们回归解决用户真实问题。

智能体DeepSeek大佬观点
08:04
ginobefun@hongming731
AI 评分 38/100
DeepSeek Harness 智能体,GPT-5.6 Sol 压缩推理等待,多智能体实验暴露协作失灵

DeepSeek Harness v0.1 以 MIT 协议开源,将模型、工具、沙箱等能力拆为可替换插件,并支持仅追加会话日志回放。Cerebras 与 OpenAI 推出 GPT-5.6 Sol Ultrafast 限量预览,输出速度最高 750 token/秒,HLE 测试较 Claude Fable 5 快近 7 倍。

智能体DeepSeekOpenAI行业动态
04:22
Chubby♨️@kimmonismus
AI 评分 50/100
数日间AI价格战剧变:DeepSeek涨价、Grok崛起

DeepSeek V4 Pro高峰时段缓存命中输入价格从$0.003625涨至$0.044/百万token,涨幅1,114%。Gemini 3.7 Flash定价较3.6 Flash低50%,折扣延续至2026年底。xAI Grok 4.6以$2/$6每百万token输入/输出价格提供近前沿智能,GPT-5.6 Luna仍为性价比之王,Anthropic掉队。

AnthropicDeepSeekGoogleOpenAI
00:02
赵纯想@chunxiangai
AI 评分 44/100
DeepSeek Harness:可热插拔的Agent内核架构

DeepSeek Harness 采用极小的 Cordis 内核加插件化设计,让模型供应、工具、Agent Loop、上下文、存储、沙箱等核心组件均可随时插拔,甚至 Agent 自身也能抽插自己。团队提出“时间可组合性”特性,插件在添加时即铺好退路,消失时干净退出不弄崩程序;插件还声明依赖服务,被拔开时变为不可用而非报错,等待新提供者后自动自愈。

智能体DeepSeek大佬观点开源生态

8月13日

星期四 · 10 条
23:02
Frank Wang 玉伯@lifesinger
AI 评分 9/100
看完 deepseek harness 让我想起了 foobar2000能看懂的可以转个发 看不懂的可以点个赞
DeepSeek其他
22:02
赵纯想@chunxiangai
AI 评分 46/100
DeepSeek Harness:技术人员主导的产品灾难

DeepSeek Harness 被指为技术人员主导下的产品层面灾难,团队沉迷开发而忽视用户体验。妄图靠插件生态形成差异化优势,与 Obsidian 同类,只能吸引小众极客用户,与 AGI 目标相去甚远。

DeepSeek大佬观点开源生态
18:21
Rohan Paul@rohanpaul_ai
AI 评分 43/100
Kimi K3 领先 DeepSeek-V4-Pro 67 分但贵 13.8 倍

Kimi K3 (Max) 在 Code Arena: WebDev 中以 1674 分领先 DeepSeek-V4-Pro (Max) 的 1607 分,但后者输入/输出价格分别便宜约 6.9 倍和 17.2 倍。

Arena.ai: Big news: DeepSeek-V4-Pro (Max) by @deepseek_ai is coming in around ~#8 overall (#2 among open models) in the Code Arena...

DeepSeek编码评测/基准
18:02
赵纯想@chunxiangai
AI 评分 14/100
DeepSeek 发错版本了,这你敢相信吗。
DeepSeek行业动态
15:15
AYi@AYi_AInotes
AI 评分 26/100
豆包现身美国毕业帽与樟宜机场

美国毕业帽上出现豆包等 AI 应用创意设计,且使用者并非华人面孔。同时,豆包已在新加坡樟宜机场替吉祥航空播报登机,字节跳动或正进军新加坡市场,其播报体验被认为优于航司人工播报。

AYi: 字节牛逼啊, 豆包已经开始在樟宜机场替吉祥航空报登机了, 字节跳动这是已经进军新加坡市场了吗?! 有一说一,豆包的这个播报比航司的空姐播报的舒服多了🤣

DeepSeek现象/趋势
10:15
AYi@AYi_AInotes
AI 评分 38/100
广东AI三杰:杨植麟、何凯明、梁文峰

广东籍AI人才辈出:潮汕杨植麟、广州何凯明、湛江梁文峰,三人分别为广东省信息学竞赛一等奖、广东省高考状元、湛江市高考状元。梁文峰26岁独自驾车深入西藏阿里无人区400公里,被困一周后走出,车留在原地。其敢赌敢输、极致利用资源的性格,与DeepSeek不融资、不社交、以十分之一成本做出匹敌成果的打法一脉相承。

AYi: 我翻完梁文锋26岁写的微博才明白DeepSeek的成功,跟技术路线半毛钱关系都没有。 梁文锋26岁那年,一个人开着菲亚特进了西藏阿里无人区。 深入400公里, 被困了一周, 人走出来了, 车永远留在了那里。 12年后他做了DeepSeek,...

DeepSeek现象/趋势
10:15
AYi@AYi_AInotes
AI 评分 32/100
央视评选2026中国年度AGI人物,名单未见DeepSeek创始人梁文峰与Kimi创始人杨植麟,引发讨论。两人均出身广东,与何凯明并称当地AI人才代表,分别以湛江高考状元和广东省信息学竞赛一等奖、自主招生清华的背景进入AI领域。

AYi: 广东真是AI人才辈出, 潮汕杨植麟,广州何凯明,湛江梁文峰, 都是典型的中国理工科精英标配形象:细框眼镜 + 深色上衣 + 短发。 三个人分别是 广东省信息学竞赛一等奖,自主招生清华 广东省高考状元 广东省湛江市高考状元…

DeepSeek行业动态
07:30
公众号:数字生命卡兹克精选
AI 评分 69/100
DeepSeek V4 Pro与Grok 4.6同日发布,双双逼近Claude Fable 5体验

DeepSeek V4 Pro正式版与Grok 4.6在2小时内先后发布,均为1.6T/1.5T参数模型,逼近Claude Fable 5体验。

智能体DeepSeekxAI模型发布
另有 5 家信源报道X:SemiAnalysis (@SemiAnalysis_)公众号:DeepSeek(深度求索)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)X:X.PIN (@thexpin)
推荐理由:把准 Fable 级 Agent 能力压到输出百万 token 0.87 美元,与 50 美元的 Fable 5 形成数量级差距,团队对自动化任务的成本核算可能因此改变。
02:20
Chubby♨️@kimmonismus
AI 评分 39/100
性能与价格正成为AI模型竞争核心。Grok 4.6已跻身顶级行列,但价格显著优于对手;DeepSeek 4 Pro GA定价更低,$0.435/M输入、$0.87/M输出,支持1M-token上下文,性价比优势愈发关键。

Chubby♨️: The DeepSeek 4 Pro GA is a very good model. But holy sh*t, the pricing is so damn good! $0.435/M input and $0.87/M outpu...

DeepSeekxAI大佬观点
01:18
karminski-牙医@karminski3
AI 评分 13/100
咋感觉要拉啊………别啊…. 😇#deepseekv4pro0813 #deepseekv4pro正式版
DeepSeek大佬观点

8月12日

星期三 · 1 条
17:48
X.PIN@thexpin
AI 评分 50/100
DeepSeek 推理模式会给用户起昵称

DeepSeek 推理模式被发现会给用户起临时昵称,如“Momo”和“追问英雄”,用于追踪对话特征并调整回复。这些昵称不会跨会话存储。用户能看到它们,是因为 DeepSeek 比其他模型暴露了更多原始推理草稿,包括其他系统可能过滤掉的拟人化简写。

DeepSeek推理现象/趋势

8月11日

星期二 · 1 条
14:10
AYi@AYi_AInotes
AI 评分 33/100
DeepSeek 思考链自曝用户昵称,官方回应

DeepSeek 深度思考模式下,灰色思考链会临时给用户打“墨墨”“人间加湿器”等标签,官方解释称这只是推理时的上下文占位符,关闭对话框即删、不存储。引用推文指出,DeepSeek V4 完成同一 Agent 任务仅需 3 美分,比 Anthropic Fable 5 的 3.15 美元便宜 105 倍,称其为“DeepSeek 2.0 时刻”。

AYi: DeepSeek V4这波绝对称得上DeepSeek 2.0时刻了, 难怪大家都叫梁文峰梁圣, 还有说梁圣的恩情还不完, 以及最近有DeepSeek斩杀线的说法, 之前还有点不太理解,现在想想好像有点意思, 完成同样一个完整的Agent任务...

DeepSeek现象/趋势

8月9日

星期日 · 1 条
01:12
SemiAnalysis@SemiAnalysis_
AI 评分 19/100
DSA 挑战了主流范式。在有限资源下,DSA 倾向于选择性再分配,将资源导向最关键的领域,同时减少浪费。我们说的是 DeepSeek 稀疏注意力。配图无关。
DeepSeek其他数据/训练

8月8日

星期六 · 3 条
21:12
Rohan Paul@rohanpaul_ai
AI 评分 51/100
中国10T参数MoE模型预训练或需约3万块Blackwell GPU

Rohan Paul估算,中国传闻中10T总参数MoE模型预训练约需3万块Blackwell GPU,但参数量只是内存账单而非算力账单。前沿模型稀疏度持续下降,10T规模下激活参数约200–500B。字节跳动已通过马来西亚云运营商租用3.6万块Blackwell GPU(500个GB200机架,$2.5B),预训练窗口为3–6个月。

Zijing Wu: Was told it takes only about 30K GPUs to pre train a mega model. Inference compute is the real monster. But then most li...

DeepSeek大佬观点推理数据/训练
09:00
ginobefun@hongming731
AI 评分 38/100
贾扬清官宣 Intent Lab,回溯 AI 二十年创业路

贾扬清官宣第二家创业公司 Intent Lab,并在《声东击西》访谈中回溯从 2005 年读研到 Google Brain、Meta、阿里的亲历路径。其上一家公司 Lepton AI 第二年盈利后被英伟达收购,新公司聚焦多 Agent 协同,判断单个 Agent 已足够聪明但一群 Agent 尚不能像团队一样协作。

DeepSeekOpenAI现象/趋势行业动态
05:57
Dongxi 东锡 NLP@dongxi_nlp
AI 评分 52/100
DeepSeek V4 Flash 在 ARC-AGI-1 上以低推理预算即得约 84 分,最高约 89 分,额外推理仅多解 5 题,表明其后训练产生了异常高效的抽象推理。该模型 ARC-AGI-2 得分 61.4%($0.04/任务),ARC-AGI-1 得分 89.0%($0.02/任务),树立了性价比帕累托前沿新标准。

ARC Prize: DeepSeek V4 Flash from @deepseek_ai on ARC-AGI (Verified): - ARC-AGI-2: 61.4%, $0.04/task - ARC-AGI-1: 89.0%, $0.02/task...

DeepSeek推理评测/基准
已加载 40 条