《华尔街日报》报道称,中国 AI 模型与美国头部模型的差距已缩小至数月,背后是清华等高校长期形成的人才网络、开源技术、人才回流及更高算力效率共同推动。智谱 AI 唐杰、月之暗面杨植麟、DeepSeek 梁文锋等研究者构成重要力量。报道还指出,DeepSeek 通过 MLA 与 MoE 技术降低算力需求,但高端芯片数量仅为 OpenAI、谷歌同行的五分之一。
《华尔街日报》报道称,中国 AI 模型与美国头部模型的差距已缩小至数月,背后是清华等高校长期形成的人才网络、开源技术、人才回流及更高算力效率共同推动。智谱 AI 唐杰、月之暗面杨植麟、DeepSeek 梁文锋等研究者构成重要力量。报道还指出,DeepSeek 通过 MLA 与 MoE 技术降低算力需求,但高端芯片数量仅为 OpenAI、谷歌同行的五分之一。
Over the weekend I had Codex parse 500K arXiv AI/ML papers since ChatGPT to understand which open models are used for re...
Nathan Lambert用Codex分析50万篇arXiv论文发现,中国开源LLM在AI研究中的提及率从2024年的10%升至如今的约40%,而美国开源模型从30%降至25-30%。Qwen被1/3提及LLM的论文引用,DeepSeek在R1发布后明显跃升;Llama于2025年4月达30%峰值后持续下滑。
Anthropic 发布覆盖 Plan 至 Maintain 六阶段的 AI 原生 SDLC 手册,以版本化工件串联各环节,并区分建议性与强制性控制。DeepSeek 上线实验模型 deepseek-v4-flash-vision-exp API,支持图文混合输入,单张图片最多占 384 tokens,价格与 V4-Flash 相同,Files API 免费开放。
OpenAI 将 GPT-5.6 Sol 的 API 和额度价格下调超 20%,为期三个月,被视为对 Anthropic 的施压信号。此举也得益于其算力基建投资和效率优化,同时面临 DeepSeek 4 Flash 等低价中国模型的竞争压力。推理成本逐年下降,SOTA 模型正被推向更低价格,最终受益的是用户。
As we continue to push the frontier of capabilities while improving efficiency, we're dropping API and credit pricing of...
墨问西东创始人池建强体验DeepSeek Harness(DSH)一天后,停掉开发两年的客户端并论证全面迁移。DSH是MIT开源的插件化Agent底座,模型无关,支持DeepSeek、OpenAI、Anthropic、Gemini,8月13日发布后GitHub一周约18万星。他判断模型能力已不卡,卡在工程化运行时,DSH相当于开放了Agent的操作系统层。
突破性的:体验完DeepSeek Harness,我打算放弃开发了两年的客户端。 今天下午,我把核心研发叫到一起开了个会:停掉现有客户端的继续开发,开始论证并全面迁移到DeepSeek Harness。 而这个客户端,我们持续开发了两年,并...
DeepSeek V4 Pro 果然是训歪了 便宜好几倍的 V4 Flash 比 Pro 强 推理强度更低的 V4 Pro High 比 Pro Max 强 不过目前写作能力方面文风还是 V4 Pro 好一些 但也跟 Opus 4.6 天壤...
博主断开中文信息流两周后观察发现,中英文AI圈普通用户关注点呈两种模式:中文圈聚焦DeepSeek,英文圈聚焦DGX Spark。他预计两者将出现融合趋势,即“DGX Spark + DeepSeek”的组合将受到广泛关注。
中国开源模型正获欧洲企业青睐,西门子已公开测试Qwen和DeepSeek,在自托管LLM平台配合vLLM运行。本地推理可规避GDPR跨境数据传输限制,但自托管仅在服务器持续满载时优于租用API,且中国是西门子最大市场之一,采用中国模型有助于维持在华业务资格。
DeepSeek Harness 开源,设计哲学是“事实有据,权限有度”。它拒绝将 agent state 写成模糊目标,让每份重要 state 由能验证它的 owner 持有,并通过 atomic comparison 关闭 time-of-check/time-of-use gap。
另有 3 家信源报道X:阿易 AI Notes (@AYi_AInotes)公众号:卡尔的AI沃茨X:Rohan Paul (@rohanpaul_ai)https://x.com/i/article/2088681782606536704
DeepSeek Harness 的核心设计是拒绝将“智能体状态”视为单一模糊对象,而是让每个关键事实归属于有权验证它的组件。例如文件读取会记录版本号,仅在版本匹配时才允许修改,以消除检查与使用之间的时间差。工具调用则作为事件管道,包含身份验证、模式校验、执行钩子等环节,子智能体也需独立决策上下文、生命周期与权限。
DeepSeek Harness 发布 45 小时后,社区涌现出 8 种不同声音,围绕其将全世界变成分布式 Harness 团队的愿景展开讨论。各方观点聚焦于该项目的协作模式、技术潜力与落地挑战,但原文未披露具体参数、性能数据或可用性细节。
2026年将成为开源与本地AI的里程碑之年。智谱GLM-5.3仅通过后训练提升,在CyberGym得分84.5%,超越Mythos 5的83.8%;Qwen3.8-27B可本地运行,多项关键基准超越Opus 4.6 Max;DeepSeek V4 Flash API价格低至每百万未缓存输入token $0.14、输出$0.28,接近“便宜到无法计量”。
So yeah, you can now run Opus 4.6 max locally. Just let that sink in.
the major ai companies should commit to a real time priced API product. ai demand varies wildly over a day/night curve a...
Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...
自今年 6 月以来,9 家中国 AI 公司已推出 10 款模型,在推理、编程和智能体等关键领域正逐步逼近美国顶尖闭源模型。CNBC 报道称,美国持续收紧限制,但中国技术正加速进入全球大型企业业务体系,IDC 调查显示安全合规与性能优势是企业采用中国 AI 模型的最主要原因。
作者将 DeepSeek 插件生态(DSH)比作“智子”,认为其以迷人形态吸引技术型天才,锁住约 6 个月时间,使其沉迷插件开发与黑客松,拔高对 Agent 架构的阈值,导致对打包好的产品失去兴趣。作者类比 70 年代穹顶屋运动,呼吁天才们回归解决用户真实问题。
DeepSeek Harness v0.1 以 MIT 协议开源,将模型、工具、沙箱等能力拆为可替换插件,并支持仅追加会话日志回放。Cerebras 与 OpenAI 推出 GPT-5.6 Sol Ultrafast 限量预览,输出速度最高 750 token/秒,HLE 测试较 Claude Fable 5 快近 7 倍。
DeepSeek V4 Pro高峰时段缓存命中输入价格从$0.003625涨至$0.044/百万token,涨幅1,114%。Gemini 3.7 Flash定价较3.6 Flash低50%,折扣延续至2026年底。xAI Grok 4.6以$2/$6每百万token输入/输出价格提供近前沿智能,GPT-5.6 Luna仍为性价比之王,Anthropic掉队。
DeepSeek Harness 采用极小的 Cordis 内核加插件化设计,让模型供应、工具、Agent Loop、上下文、存储、沙箱等核心组件均可随时插拔,甚至 Agent 自身也能抽插自己。团队提出“时间可组合性”特性,插件在添加时即铺好退路,消失时干净退出不弄崩程序;插件还声明依赖服务,被拔开时变为不可用而非报错,等待新提供者后自动自愈。
DeepSeek Harness 被指为技术人员主导下的产品层面灾难,团队沉迷开发而忽视用户体验。妄图靠插件生态形成差异化优势,与 Obsidian 同类,只能吸引小众极客用户,与 AGI 目标相去甚远。
Kimi K3 (Max) 在 Code Arena: WebDev 中以 1674 分领先 DeepSeek-V4-Pro (Max) 的 1607 分,但后者输入/输出价格分别便宜约 6.9 倍和 17.2 倍。
Big news: DeepSeek-V4-Pro (Max) by @deepseek_ai is coming in around ~#8 overall (#2 among open models) in the Code Arena...
美国毕业帽上出现豆包等 AI 应用创意设计,且使用者并非华人面孔。同时,豆包已在新加坡樟宜机场替吉祥航空播报登机,字节跳动或正进军新加坡市场,其播报体验被认为优于航司人工播报。
字节牛逼啊, 豆包已经开始在樟宜机场替吉祥航空报登机了, 字节跳动这是已经进军新加坡市场了吗?! 有一说一,豆包的这个播报比航司的空姐播报的舒服多了🤣
广东籍AI人才辈出:潮汕杨植麟、广州何凯明、湛江梁文峰,三人分别为广东省信息学竞赛一等奖、广东省高考状元、湛江市高考状元。梁文峰26岁独自驾车深入西藏阿里无人区400公里,被困一周后走出,车留在原地。其敢赌敢输、极致利用资源的性格,与DeepSeek不融资、不社交、以十分之一成本做出匹敌成果的打法一脉相承。
我翻完梁文锋26岁写的微博才明白DeepSeek的成功,跟技术路线半毛钱关系都没有。 梁文锋26岁那年,一个人开着菲亚特进了西藏阿里无人区。 深入400公里, 被困了一周, 人走出来了, 车永远留在了那里。 12年后他做了DeepSeek,...
广东真是AI人才辈出, 潮汕杨植麟,广州何凯明,湛江梁文峰, 都是典型的中国理工科精英标配形象:细框眼镜 + 深色上衣 + 短发。 三个人分别是 广东省信息学竞赛一等奖,自主招生清华 广东省高考状元 广东省湛江市高考状元…
DeepSeek V4 Pro正式版与Grok 4.6在2小时内先后发布,均为1.6T/1.5T参数模型,逼近Claude Fable 5体验。
另有 5 家信源报道X:SemiAnalysis (@SemiAnalysis_)公众号:DeepSeek(深度求索)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)X:X.PIN (@thexpin)The DeepSeek 4 Pro GA is a very good model. But holy sh*t, the pricing is so damn good! $0.435/M input and $0.87/M outpu...
DeepSeek 推理模式被发现会给用户起临时昵称,如“Momo”和“追问英雄”,用于追踪对话特征并调整回复。这些昵称不会跨会话存储。用户能看到它们,是因为 DeepSeek 比其他模型暴露了更多原始推理草稿,包括其他系统可能过滤掉的拟人化简写。
DeepSeek 深度思考模式下,灰色思考链会临时给用户打“墨墨”“人间加湿器”等标签,官方解释称这只是推理时的上下文占位符,关闭对话框即删、不存储。引用推文指出,DeepSeek V4 完成同一 Agent 任务仅需 3 美分,比 Anthropic Fable 5 的 3.15 美元便宜 105 倍,称其为“DeepSeek 2.0 时刻”。
DeepSeek V4这波绝对称得上DeepSeek 2.0时刻了, 难怪大家都叫梁文峰梁圣, 还有说梁圣的恩情还不完, 以及最近有DeepSeek斩杀线的说法, 之前还有点不太理解,现在想想好像有点意思, 完成同样一个完整的Agent任务...
Rohan Paul估算,中国传闻中10T总参数MoE模型预训练约需3万块Blackwell GPU,但参数量只是内存账单而非算力账单。前沿模型稀疏度持续下降,10T规模下激活参数约200–500B。字节跳动已通过马来西亚云运营商租用3.6万块Blackwell GPU(500个GB200机架,$2.5B),预训练窗口为3–6个月。
Was told it takes only about 30K GPUs to pre train a mega model. Inference compute is the real monster. But then most li...
贾扬清官宣第二家创业公司 Intent Lab,并在《声东击西》访谈中回溯从 2005 年读研到 Google Brain、Meta、阿里的亲历路径。其上一家公司 Lepton AI 第二年盈利后被英伟达收购,新公司聚焦多 Agent 协同,判断单个 Agent 已足够聪明但一群 Agent 尚不能像团队一样协作。
DeepSeek V4 Flash from @deepseek_ai on ARC-AGI (Verified): - ARC-AGI-2: 61.4%, $0.04/task - ARC-AGI-1: 89.0%, $0.02/task...