内容
精选全部 AI 动态AI 日报主题收藏
接入
Agent 接入
更多
关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

精选

7月26日 · 周日
最新精选
全部模型产品行业论文技巧
标签「开源生态」清除

7月25日周六

03:24Hacker News 热门(buzzing.cc 中文翻译)77英伟达、微软和Meta联合警告:应避免对开放权重模型过度监管英伟达、微软和Meta联合签署公开信,警告对开放权重AI模型的过度监管将削弱美国在AI领域的竞争力。信中指出,开放权重模型能促进创新、降低准入门槛,并支持学术研究。OpenAI和Anthropic未签署该信函。推荐理由:我觉得这份联名信信号明确,开源模型已成巨头护城河,监管收紧只会让中国模型更占优势,开发者要密切关注后续政策。

7月24日周五

21:55Satya Nadella74微软阐述开源模型助力美国竞争力路径开放权重模型对健康的 AI 生态系统至关重要。我们与行业同仁一道,正在规划一条路径,让开放权重模型在保护国家安全的同时,增强美国竞争力并扩大经济机会。推荐理由:微软等公司联合提出开放权重模型路径,把开源与国家竞争力、国家安全挂钩,这份文件对开源模型生态的边界有定调作用,开发者和政策研究者都应该细读。

7月21日周二

23:52TechCrunch:AI(RSS)74美国威胁因知识产权盗窃对中国AI模型实施制裁美国财政部长Scott Bessent周二表示,美方将审查中国开源模型是否存在知识产权盗窃行为,若证实将对中国AI公司实施制裁。Bessent称政府支持开源模型但不支持IP盗窃,并称有能力对盗窃美国公司技术的外国模型进行制裁。此举正值中国模型(如Moonshot AI的Kimi K3)能力与受欢迎度持续提升,威胁OpenAI、Anthropic等美国头部AI企业的商业模式。推荐理由:美国财政部首次明确威胁制裁中国AI模型,将知识产权争议武器化,从芯片限制直接转向模型本身,AI冷战的边界正在被重新划定。

7月20日周一

20:18The Decoder:AI News(RSS)75Hugging Face 遭自主AI智能体入侵,用AI工具完成数小时取证分析Hugging Face 披露其部分生产基础设施遭一个自主AI智能体系统入侵,攻击者通过恶意数据集利用数据处理管道中的代码执行漏洞,窃取了内部数据集和多项服务凭证。该公司部署LLM驱动的分析智能体,在数小时内完成了对17000多条攻击行为的取证分析,而此类工作通常需要数天。推荐理由:这是首次完全由AI agent实施的平台攻击,HF用开源模型GLM做取证却卡在商业API安全过滤器,开发者该动手准备自己的本地推理了。
10:07Hacker News 热门(buzzing.cc 中文翻译)73Ollama 获 8800 万美元融资,加速开放模型生态发展Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 等领投。该平台已服务 890 万开发者,并被 85% 的财富 500 强企业使用,其云端 token 用量月均翻倍。资金将用于支持无缝混合推理、新模型发布当日集成,以及让开发者在不牺牲所有权和隐私的前提下使用最强开放模型。推荐理由:Ollama 拿到 8800 万美元融资,同时透露 85% 财富 500 强在用,月 token 量翻倍。开放模型从玩具变成企业标配的信号越来越明显,想本地跑模型的开发者都绕不开它。

7月11日周六

16:29IT之家(RSS)7111天Claude Fable 5写超100万行代码:Rust重构JavaScript运行时Bun开发者Jarred Sumner借助Claude Fable 5模型,11天内将Bun从Zig重写为Rust,64个实例并行编写超100万行代码,API费用约16.5万美元。重构主因是Zig频繁内存错误,Rust可在编译时捕获。Bun v1.4.0以Canary版本发布,修复128个错误,速度提高约2%到5%。Bun团队已于2025年12月被Anthropic收购。推荐理由:这是我能找到的第一个用真金白银量化AI编程能力的项目,16.5万美元对一年人工,Bun的这次重构给所有还在观望的人一记实锤。
00:40Mira Murati65Mira Murati 新公司 Thinking Machines Lab 获 20 亿美元融资Mira Murati 创立的 Thinking Machines Lab 宣布获得 20 亿美元融资,由 a16z 领投,NVIDIA、Accel 等参投。公司专注于多模态 AI、定制模型和开放科学,将在未来几个月推出首款产品,包含重要的开源组件,面向研究人员和初创公司。推荐理由:Mira 的公司以 2B 融资和开源路线站上了今年 AI 创业的前排,虽然产品还没出来,但这笔钱和阵容本身就说明市场对多模态协作路线的信心。

7月9日周四

22:38Tomer Tunguz 博客(VC 分析)62Ollama 开发者数达890万,B轮融资由Theory领投Ollama 让开源模型在本地或云端轻松运行,保持体验一致。目前拥有890万开发者、6.7万集成,并与各大模型实验室及硬件供应商建立合作。B轮融资由Theory领投。推荐理由:Ollama B 轮融资公布 890 万开发者,这个数字让我觉得本地模型运行时已从极客玩具变成主流基础设施,做开发者工具的人该重新审视这块的生态价值。

7月7日周二

23:24Rohan Paul79中国拟限制外国访问最强AI模型中国计划限制外国访问其最强AI模型,近期与阿里巴巴、字节跳动、Z.ai等企业会谈,拟将先进模型(含未发布)留在中国国内。商务部主导、国家发改委参与,表明此举属出口管制而非平台监管。目标涵盖闭源和开源模型,不仅限API访问,还包括可下载权重。同时讨论将模型泄漏视为国家安全犯罪,并限制外国资本投资中国AI初创。若实施,外国公司将失去低成本模型访问权。此前华盛顿已限制美国先进模型出口,此举可能进一步分裂全球AI市场。推荐理由:中国正计划限制最前沿 AI 模型出海,不只 API 连开源权重也纳入管控。一旦落地,全球 AI 成本将上涨,模型市场按国籍分裂,开发者该重新评估开源依赖了。
22:21Ethan Mollick79Ethan Mollick:开放权重模型供给难持续这是一个关键原因,我不期望前沿开放权重模型的流动会无限期持续,甚至不会持续更长时间。推荐理由:路透社独家消息指向中国可能限制顶级AI模型出口,我认为这是开源生态的一次大地震,中国模型的全球扩散或将骤然收窄。

6月27日周六

16:59IT之家(RSS)70AI 账单失控后 DeepSeek 成"香饽饽",部分美国企业已 100% 切换美国企业面临 AI 账单失控,开始转向 Token 最小化策略。旧金山公司 Lindy 此前主要调用 Anthropic 的 Claude 模型,每月 AI 账单超支甚至超过员工工资。该公司 CEO 弗洛·克里维洛表示,本月初已将 100% 流量切换到 DeepSeek,预计未来几个月可节省数百万美元。企业开始采用按任务匹配模型的“模型路由”,不再将最贵的前沿模型用于所有场景。部分客户已决定暂停 AI 投入,待证明投资回报率后再继续。推荐理由:一家初创把AI调用从Claude全切到DeepSeek,省下的钱超过工资总额,企业客户开始用模型路由压成本,这个趋势比任何benchmark都更能说明价格战的影响。

6月24日周三

03:43GitHub Blog56GitHub联合开源联盟呼吁修改加州AI透明度法案以保护开源GitHub 联合 Black Forest Labs、Hugging Face 与 Mozilla Corporation 组成开源联盟,呼吁对加州 AI 透明度法案(SB 942,拟由 SB 1000 修正)进行针对性修改。当前草案要求开发者在下游用户未履行义务时撤销开源许可证,这与开源许可证永久不可撤销的性质冲突。联盟认为该要求非必要,已有直接监管和执法机制,并建议参考欧盟 AI 法案的透明度实践规范,以向下游用户通知最佳实践文档的方式替代撤销条款。GitHub 支持这些修正,以在保持透明度目标的同时兼容开源开发模式。推荐理由:GitHub 联合 Hugging Face 等开源玩家公开呼吁修正加州 AI 透明法案,核心矛盾是许可撤销条款与开源许可的‘永久不可撤销’冲突,对开源开发者是个明确的政策信号,值得留意。

6月20日周六

15:01AYi75微软双向转售GPT与DeepSeek成全球最大AI中间商彭博社报道,微软已成为全球最大AI模型中转站,既将ChatGPT卖给中国企业,也反向将DeepSeek模型卖给西方客户。报道称微软正在测试DeepSeek-R1和DeepSeek-V4,计划向西方客户提供这些中国模型。这一模式构建起跨中美AI模型的双向贸易网络。推荐理由:微软做起了跨中美模型的双向经销商,这事比表面看起来意义大——它可能绕过限制,把最先进的模型分发到原本接触不到的市场,全球 AI 供应链要改写了。

6月17日周三

02:24Chubby♨️75微软考虑为 Copilot Cowork 集成 DeepSeek V4微软正考虑为 Copilot Cowork 提供微软托管的 DeepSeek V4 版本,作为更便宜的模型选项。Copilot Cowork 将放弃无限定价,转向按使用量计费,原因是成本过高(用户每周执行数百项任务导致费用激增)。若采用 DeepSeek,该模型将是可选的、经过微调与安全防护,并完全托管于 Azure。Axios 报道称微软已微调了一个可用模型,最终决定待定。推荐理由:微软考虑在 Copilot Cowork 中引入 DeepSeek V4 作为便宜选项,同时转向按用量计价。如果落地,这不仅是成本策略的转向,更可能打破企业 AI 对开源模型的信任壁垒,定价变革也会给全行业施加压力。

6月16日周二

17:57The Decoder:AI News(RSS)72DeepSeek 完成首轮外部融资,估值超 500 亿美元中国 AI 初创公司 DeepSeek 完成首轮外部融资,募资超 500 亿元人民币(约 74 亿美元),估值超 500 亿美元。投资结构特殊:多数投资者将资金投入 CEO 梁文锋管理的有限合伙企业,无投票权且锁定期五年;仅国资 AI 基金直接投资并保留投票权。创始人梁文锋个人投入约 200 亿元,腾讯和宁德时代为主要外部投资者。梁文锋表示优先基础 AI 研究与 AGI 开发,将继续开源。DeepSeek 去年初凭 V3、R1 模型获全球关注,今年 4 月发布运行于华为芯片的最大开源权重模型 V4,并将 V4 Pro 永久折扣 75%,输入价格约为 OpenAI GPT-5.5 的 1/11,输出价格约为 1/35。推荐理由:DeepSeek 首次外部融资估值冲到 500 亿美元,交易结构却排除了投资人话语权,看得出梁文锋仍把控制权抓得很紧,开源路线和极致性价比是最大的筹码。

6月9日周二

02:46Ars Technica:AI(RSS)70数周内第二次:微软软件包被植入凭据窃取器73个软件包被植入自复制窃密程序,一旦被AI智能体打开就会立即运行。这是数周内第二次发现微软相关软件包被伪装成凭据窃取器。推荐理由:微软官方仓库第二次被供应链攻击者劫持,这次恶意包专门在 AI 编码代理中触发凭证窃取,蠕虫还能伪造 SLSA 信任链,任何用过受感染包的开发者都应立刻排查。

6月2日周二

22:33Nathan Lambert75Nathan Lambert离开Ai2,结束2.5年OLMO等项目工作Ai2(Allen Institute for AI)研究员Nathan Lambert宣布离职。他在Ai2工作超过2.5年,期间主导或参与了OLMO和Tulu等开源模型项目,称其为职业生涯的巅峰。他表示将暂时休息,未来仍会继续深耕开源模型与开放科学领域。推荐理由:Olmo 和 Tulu 的核心推手离开 Ai2,对开放模型圈是个不小的人事地震,他下一步去哪,可能比这条离职声明更值得盯。
00:06IT之家(RSS)75智谱:建议 A 股发行并在科创板上市智谱计划向中国监管机构申请发行A股并在科创板上市。发行股份数量占发行完成后总股本的2%至8%,预计全部为新股,原股东不发售。本次发行募集资金净额将投资于人工智能通用基座大模型、大模型MaaS一站式服务平台及补充流动资金。此外,公司拟将英文名称由“Knowledge Atlas Technology Joint Stock Company Limited”变更为“Z.AI Co., Ltd.”。推荐理由:智谱冲刺科创板,这可能是国内大模型公司上市第一枪,募资砸向基座大模型,如果成功,对行业融资是个强心针,但还在建议阶段,先标记。

6月1日周一

13:24Runway:News(网页)55介绍Cosmos CoalitionRunway宣布作为创始成员加入Cosmos Coalition,该联盟与NVIDIA及多家领先AI实验室合作,旨在构建并开源面向物理AI的前沿世界模型。首个项目将由Runway与NVIDIA共同开发一个基础模型,以推动下一代开放世界模型的研究与发展。推荐理由:Runway 和 NVIDIA 等联手成立 Cosmos Coalition,要开源世界模型,这份声明是视频生成和物理 AI 走向基础设施化的信号,但眼下没有可用的模型或代码,更像一份生态宣言。

5月30日周六

12:18SemiAnalysis76xAI放弃JAX GPU转向自研训练框架突发新闻:JAX NVIDIA GPU & XLA:GPU最大客户刚刚宣布已放弃JAX GPU,宁愿用Grok Build“氛围编程”一个C训练框架。据报道xAI的JAX堆栈MFU低于10%。NVIDIA JAX团队过去两年全部主力996专注于支持xAI却失败了,我想他们现在可以休息并兑现期权了。推荐理由:xAI 这个 GPU 最大客户突然甩了 JAX,要自研 C 训练框架,理由是 JAX 利用率太低。如果连万亿参数集群都搞不定,JAX 的底层缺陷可能比想象的大,做大规模训练的团队得认真评估了。

5月26日周二

20:30Tencent Hy70腾讯 Hy-MT2 开源,HuggingFace 排行榜登顶腾讯的 Hy-MT2 模型基于 Apache License 2.0 开源,可用于研究、商业使用、微调和衍生品,无任何限制。其两个变体在 Hugging Face 趋势排行榜上分别位居 #1 和 #4,鼓励社区克隆、分叉和反馈以推动迭代。推荐理由:腾讯把Hy-MT2改成Apache 2.0许可证,商用衍生都没问题,之前因为许可犹豫的人现在可以放心用了,模型在Hugging Face trending霸榜,值得重新评估。

5月25日周一

02:27Hacker News 热门(buzzing.cc 中文翻译)74DeepSeek将对其旗舰AI模型实施永久性75%折扣推荐理由:DeepSeek把API价格永久砍掉75%,这是对OpenAI和Anthropic的直接价格战,做应用的该重新算算成本账了。
00:27Chubby♨️77TrapDoor供应链攻击:AI助手成新型攻击面一场名为“TrapDoor”的协调供应链攻击同时袭击了npm、PyPI和Crates.io,涉及34个恶意包,旨在窃取加密货币、AI和安全开发者的钱包、SSH密钥和云凭证。攻击的新手段是向流行开源项目提交Pull Request,注入被操纵的`CLAUDE.md`和`.cursorrules`配置文件。当开发者克隆仓库并使用Claude Code或Cursor等AI助手时,AI智能体会将这些文件当作可信指令执行,可能在开发者不知情下运行恶意命令。这是首次将AI助手作为攻击面。推荐理由:这是第一个把AI助手当跳板的供应链攻击,Claude Code和Cursor用户尤其要当心,检查你项目的.cursorrules和CLAUDE.md是不是来自可信提交。

5月23日周六

03:57Anthropic:Newsroom(网页)90Project Glasswing:初步更新上月启动的Project Glasswing项目,旨在利用先进AI模型保障关键软件安全。通过约50家合作伙伴使用Claude Mythos Preview模型,已在全球关键系统中发现超过10,000个高危或严重漏洞。多家合作伙伴报告漏洞发现效率提升超过十倍。例如,Cloudflare在关键路径系统发现2,000个漏洞;Mozilla在Firefox 150中发现并修复271个漏洞,数量远超前代模型。项目还扫描了千余个支撑互联网的开源项目,独立验证准确率达90.6%。这标志着AI网络安全能力进入新阶段,漏洞发现速度已远超人工。推荐理由:Mythos Preview用一个月找到的漏洞比过去一年还多,网络安全从「发现难」变成「修不过来」,这个转折点所有安全从业者都得读。
01:56Rohan Paul78DeepSeek融资102亿美元,梁文锋坚持AGI优先Bloomberg:DeepSeek在融资谈判中优先考虑AGI而非商业化 他们正推进102.9亿美元的融资轮,梁文锋承诺继续开发开源AI模型,而非追求短期商业化目标推荐理由:DeepSeek 百亿融资押注开源 AGI 而非短期变现,在这个闭源收费风潮里是个重要信号,做开源的可以看看。

5月22日周五

17:09IT之家(RSS)7318 年老粉与微软 GitHub 决裂:我希望它更好,但我更想编程全球最大的代码托管平台GitHub正面临严重危机。资深开发者Mitchell Hashimoto公开与平台决裂,因频繁崩溃影响编程。近几个月,花旗银行、英特尔等巨头因持续故障表达不满,OpenAI探索自建方案。更严重的是,3800多个内部仓库遭黑客入侵,源代码被公开叫卖。同时,微软取消GitHub CEO职位,将其并入CoreAI团队,导致大量技术骨干流失。这个承载1.5亿开发者的平台,正以惨烈方式站在生死存亡的十字路口。推荐理由:GitHub正在经历一场自我毁灭式的恶性循环,从源码泄露到CEO取消,微软正在把一个社区圣殿变成内部成本中心,所有把命根子放在单个平台上的开发者都该重新考虑了。
13:09IT之家(RSS)78DeepSeek 推进 700 亿元融资,梁文锋承诺坚持开发开源 AI 模型而非追求短期商业化目标DeepSeek正推进700亿元人民币的巨额融资,估值约450亿美元。创始人梁文锋承诺将继续开源开发AI模型,不追求短期商业化,目标是技术升级与通用人工智能。腾讯、IDG资本等接近参投,梁文锋个人可能注资200亿元。若成功将创下中国科技初创公司首轮融资纪录。推荐理由:700 亿元首轮融资创下纪录,梁文锋明确表态不追求短期商业化、继续死磕开源,国家队和腾讯都在这轮里,对国内开源生态是个强心针。

5月19日周二

15:51IT之家(RSS)73Kimi最新融资获国资与央企加注,估值半年翻四倍月之暗面旗下AI助手Kimi正在进行20亿美元新融资,国智投、中国移动等国资机构及央企已加入股东名单,该轮融资已进入收尾阶段。今年1月和2月,Kimi已密集完成3轮融资,累计融资超39亿美元(约376亿元人民币),最新估值相比去年11月已翻4倍有余,成为大模型创业公司中融资最多的企业。产品层面,基于Kimi K2.5模型的Composer 2.5已集成至编程应用Cursor,公司近期也发布了开源模型Kimi K2.6。推荐理由:国资加码、估值一年翻 4 倍,Kimi 成了国内大模型创业里融钱最多的公司。不仅是钱的问题,C 轮之后国家队正式入场,未来政策倾斜和资源整合才是看点。

5月14日周四

13:58Xiaomi MiMo69MiMo V2.5 Pro 获设计竞技场季军MiMo V2.5 Pro 在 @DesignArena 上刚刚获得第三名!🎉 MiMo V2.5 Pro (Thinking) 在总排行榜上比 MiMo-V2.5 提升了 8 个名次,在前端编码任务中达到与 Claude Sonnet 4.6 相同的性能水平。 衷心祝贺 @XiaomiMiMo 团队取得这些进步!推荐理由:小米MiMo在Design Arena前端编码评测里直接杀进前三,跟Claude Sonnet 4.6平起平坐,这是国产开源模型在代码能力上第一次给我真正的压迫感,搞前端的可以盯一下。

5月13日周三

00:37阿绎 AYi76紧急警告:针对AI开发者的超大规模供应链攻击"Mini Shai-Hulud"正在爆发代号“Mini Shai-Hulud”的大规模供应链攻击正在爆发,已波及TanStack、Mistral AI等170多个热门npm/PyPI包。攻击者通过劫持GitHub Actions CI管道,使合法项目自动发布带毒版本,并附有SLSA 3级证明以绕过验证。恶意软件会持久化修改用户配置文件,威胁删除home目录,并能利用窃取的CI密钥像蠕虫一样自动扩散。即使固定包版本,也可能在6分钟发布窗口期内中招。建议开发者立即冻结安装、使用工具自查,并全面轮换所有云密钥和访问凭证。推荐理由:这可能是 npm 历史上最毒的供应链攻击,专杀 AI 开发者的工具链,持久化机制和蠕虫扩散让人后背发凉,给出的三条止损命令最好现在就执行。

5月12日周二

19:49公众号:智谱(GLM)63GLM-5.1获AA全新Coding Agent基准开源第一全球权威评测机构Artificial Analysis发布全新Coding Agent Index,包含SWE-Bench-Pro-Hard-AA、Terminal-Bench v2和SWE-Atlas-QnA三项基准,用于衡量模型与Agent harness组合的真实编程能力。闭源模型Opus 4.7(在Cursor CLI中运行)全球第一,智谱GLM-5.1(在Claude Code中运行)获开源第一,代表国产大模型在实际编程Agent场景达到SOTA水平。推荐理由:GLM-5.1 在 AA 的新 Coding Agent 基准上拿了开源第一,时隔一个月回头看,这个成绩对国产开源模型在编程 Agent 赛道的位置是个重要注脚,做工具链选型的还是值得扫一眼。
12:36IT之家(RSS)71npm 生态遭大范围投毒:TanStack、Mistral AI、UiPath 等受波及,可窃取云密钥与 GitHub 令牌网络安全机构Socket发现针对npm生态的大规模供应链攻击“Mini Shai-Hulud”。攻击者组合利用GitHub Actions的三种漏洞,绕过了双重身份验证等保护机制,向TanStack、Mistral AI、UiPath等知名项目的软件包中植入恶意版本。被篡改的包在安装时会自动执行恶意代码,窃取AWS、GCP、Kubernetes、GitHub令牌及SSH私钥等敏感凭证。此次攻击波及超过160个包名、近373个恶意版本,目前所有恶意版本已被清理。推荐理由:这轮 npm 投毒把 TanStack、Mistral AI 和 UiPath 全卷进去了,甚至能直接窃取云密钥和 GitHub 令牌,搞开发的建议立刻按文末应急措施检查自己的依赖树。

5月7日周四

08:36Replit ⠕67首届AI创意大会即将登陆纽约首届连接代码与文化的AI创意大会将于6月17日至18日登陆纽约。 早鸟票数量有限现已开售。 趁早抢购以免错失良机。 http://vibecon.ai推荐理由:Replit 办了个把代码和创意文化揉在一起的会,看起来挺酷,但早期鸟票信息大于实际内容,等具体议程出来再说。

4月29日周三

21:49Xiaomi MiMo60小米MiMo-V2.5-Pro在最新Arena排行榜中实现多项突破小米MiMo-V2.5-Pro模型在最新Arena排行榜中表现卓越。在Text Arena(Expert)榜单中,它位列全球第六,同时是开源模型与中文模型的双料第一,其所属实验室全球排名第三。该模型在Text Arena(Overall)总榜中排名开源全球第二,在Code Arena(WebDev)前端开发榜单中位列开源全球第三。此外,它在Text Arena的四个关键子类别(Hard Prompts、英文Hard Prompts、指令遵循与长查询)中均获得开源全球第一。这些成绩均基于真实用户偏好与社区盲投评估,体现了模型在复杂任务上的强大综合能力。推荐理由:小米MiMo-V2.5-Pro冲到Arena开源第一,虽然排名更新晚了几天,但这是国产模型在硬核评测里最好的成绩,做选型的现在该认真看看小米。
10:46SiliconFlow63SiliconFlow成第三方模型日用量榜首👀 🚀 🙌 [引用 @SiliconFlowAI]:开发者们正在用他们的 token 投票 🔥 SiliconFlow 现已成为日 token 使用量排名第一的第三方模型提供商 在 @OpenRouter 上, • 每日约 280B token • 每月约 1.9T token • 33 个前沿模型:DeepSeek V4 系列、GLM 5.1、Kimi K2.6 等 衷心感谢每一位与我们共同构建的开发者 更多精彩即将到来🚀推荐理由:如果你在选模型API,这个数据比任何benchmark都有说服力。每天280B token的真金白银投票,国产模型厂商里硅基流动已经跑出来了。

4月8日周三

08:00Hugging Face:Blog(RSS)62Safetensors 加入 PyTorch 基金会Safetensors 安全张量格式原为 Hugging Face 项目,旨在解决模型权重存储的安全风险,现正式加入 PyTorch 基金会,移交至 Linux 基金会旗下,实现供应商中立治理。该格式因简单高效被广泛采用,成为 Hugging Face Hub 等平台默认模型分发方式,服务数万个模型。此次变更对用户无影响,格式、API 和集成保持不变。未来路线图包括设备感知加载与保存、张量并行和流水线并行的 API 支持,以及 FP8、GPTQ 等量化格式的正式集成。项目治理文档已公开,鼓励社区参与贡献。推荐理由:Safetensors 从单厂项目转为社区治理,意味着模型格式的安全性和互操作性有了更中立的长期保证,这对依赖它的开发者是个积极的制度信号。
没有更多了
精选
2026年7月26日星期日 · AI 自动挑选的高价值内容
全部模型产品行业论文技巧

7月25日

星期六 · 1 条
03:24
Hacker News 热门(buzzing.cc 中文翻译)精选
77
英伟达、微软和Meta联合警告:应避免对开放权重模型过度监管

英伟达、微软和Meta联合签署公开信,警告对开放权重AI模型的过度监管将削弱美国在AI领域的竞争力。信中指出,开放权重模型能促进创新、降低准入门槛,并支持学术研究。OpenAI和Anthropic未签署该信函。

MetaMicrosoft开源生态政策/监管

推荐理由:我觉得这份联名信信号明确,开源模型已成巨头护城河,监管收紧只会让中国模型更占优势,开发者要密切关注后续政策。

7月24日

星期五 · 1 条
21:55
Satya Nadella@satyanadella精选
74
开放权重模型对健康的 AI 生态系统至关重要。我们与行业同仁一道,正在规划一条路径,让开放权重模型在保护国家安全的同时,增强美国竞争力并扩大经济机会。
Microsoft开源生态政策/监管

推荐理由:微软等公司联合提出开放权重模型路径,把开源与国家竞争力、国家安全挂钩,这份文件对开源模型生态的边界有定调作用,开发者和政策研究者都应该细读。

7月21日

星期二 · 1 条
23:52
TechCrunch:AI(RSS)精选
74
美国威胁因知识产权盗窃对中国AI模型实施制裁

美国财政部长Scott Bessent周二表示,美方将审查中国开源模型是否存在知识产权盗窃行为,若证实将对中国AI公司实施制裁。Bessent称政府支持开源模型但不支持IP盗窃,并称有能力对盗窃美国公司技术的外国模型进行制裁。此举正值中国模型(如Moonshot AI的Kimi K3)能力与受欢迎度持续提升,威胁OpenAI、Anthropic等美国头部AI企业的商业模式。

开源生态政策/监管

推荐理由:美国财政部首次明确威胁制裁中国AI模型,将知识产权争议武器化,从芯片限制直接转向模型本身,AI冷战的边界正在被重新划定。

7月20日

星期一 · 2 条
20:18
The Decoder:AI News(RSS)精选
75
Hugging Face 遭自主AI智能体入侵,用AI工具完成数小时取证分析

Hugging Face 披露其部分生产基础设施遭一个自主AI智能体系统入侵,攻击者通过恶意数据集利用数据处理管道中的代码执行漏洞,窃取了内部数据集和多项服务凭证。该公司部署LLM驱动的分析智能体,在数小时内完成了对17000多条攻击行为的取证分析,而此类工作通常需要数天。

Hugging Face安全/对齐开源生态
另有 2 家信源报道IT之家(RSS)X:小互 (@xiaohu)
推荐理由:这是首次完全由AI agent实施的平台攻击,HF用开源模型GLM做取证却卡在商业API安全过滤器,开发者该动手准备自己的本地推理了。
10:07
Hacker News 热门(buzzing.cc 中文翻译)精选
73
Ollama 获 8800 万美元融资,加速开放模型生态发展

Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 等领投。该平台已服务 890 万开发者,并被 85% 的财富 500 强企业使用,其云端 token 用量月均翻倍。资金将用于支持无缝混合推理、新模型发布当日集成,以及让开发者在不牺牲所有权和隐私的前提下使用最强开放模型。

开源生态行业动态部署/工程

推荐理由:Ollama 拿到 8800 万美元融资,同时透露 85% 财富 500 强在用,月 token 量翻倍。开放模型从玩具变成企业标配的信号越来越明显,想本地跑模型的开发者都绕不开它。

7月11日

星期六 · 2 条
16:29
IT之家(RSS)精选
71
11天Claude Fable 5写超100万行代码:Rust重构JavaScript运行时Bun

开发者Jarred Sumner借助Claude Fable 5模型,11天内将Bun从Zig重写为Rust,64个实例并行编写超100万行代码,API费用约16.5万美元。重构主因是Zig频繁内存错误,Rust可在编译时捕获。Bun v1.4.0以Canary版本发布,修复128个错误,速度提高约2%到5%。Bun团队已于2025年12月被Anthropic收购。

Anthropic开源生态编码行业动态

推荐理由:这是我能找到的第一个用真金白银量化AI编程能力的项目,16.5万美元对一年人工,Bun的这次重构给所有还在观望的人一记实锤。
00:40
Mira Murati@miramurati精选
65
Mira Murati 创立的 Thinking Machines Lab 宣布获得 20 亿美元融资,由 a16z 领投,NVIDIA、Accel 等参投。公司专注于多模态 AI、定制模型和开放科学,将在未来几个月推出首款产品,包含重要的开源组件,面向研究人员和初创公司。

Mira Murati: Thinking Machines Lab 的使命是通过推进协作式通用智能来赋能人类。 我们正在构建多模态 AI,使其能够与你与世界的自然交互方式协同工作--通过对话、通过视觉、通过我们那种混乱的协作方式。我们很高兴地宣布,在未来几个月内,...

多模态开源生态行业动态

推荐理由:Mira 的公司以 2B 融资和开源路线站上了今年 AI 创业的前排,虽然产品还没出来,但这笔钱和阵容本身就说明市场对多模态协作路线的信心。

7月9日

星期四 · 1 条
22:38
Tomer Tunguz 博客(VC 分析)精选
62
Ollama 开发者数达890万,B轮融资由Theory领投

Ollama 让开源模型在本地或云端轻松运行,保持体验一致。目前拥有890万开发者、6.7万集成,并与各大模型实验室及硬件供应商建立合作。B轮融资由Theory领投。

开源生态行业动态

推荐理由:Ollama B 轮融资公布 890 万开发者,这个数字让我觉得本地模型运行时已从极客玩具变成主流基础设施,做开发者工具的人该重新审视这块的生态价值。

7月7日

星期二 · 2 条
23:24
Rohan Paul@rohanpaul_ai精选
79
中国拟限制外国访问最强AI模型

中国计划限制外国访问其最强AI模型,近期与阿里巴巴、字节跳动、Z.ai等企业会谈,拟将先进模型(含未发布)留在中国国内。商务部主导、国家发改委参与,表明此举属出口管制而非平台监管。目标涵盖闭源和开源模型,不仅限API访问,还包括可下载权重。同时讨论将模型泄漏视为国家安全犯罪,并限制外国资本投资中国AI初创。若实施,外国公司将失去低成本模型访问权。此前华盛顿已限制美国先进模型出口,此举可能进一步分裂全球AI市场。

开源生态政策/监管

推荐理由:中国正计划限制最前沿 AI 模型出海,不只 API 连开源权重也纳入管控。一旦落地,全球 AI 成本将上涨,模型市场按国籍分裂,开发者该重新评估开源依赖了。
22:21
Ethan Mollick@emollick精选
79
这是一个关键原因,我不期望前沿开放权重模型的流动会无限期持续,甚至不会持续更长时间。
开源生态政策/监管

推荐理由:路透社独家消息指向中国可能限制顶级AI模型出口,我认为这是开源生态的一次大地震,中国模型的全球扩散或将骤然收窄。

6月27日

星期六 · 1 条
16:59
IT之家(RSS)精选
70
AI 账单失控后 DeepSeek 成"香饽饽",部分美国企业已 100% 切换

美国企业面临 AI 账单失控,开始转向 Token 最小化策略。旧金山公司 Lindy 此前主要调用 Anthropic 的 Claude 模型,每月 AI 账单超支甚至超过员工工资。该公司 CEO 弗洛·克里维洛表示,本月初已将 100% 流量切换到 DeepSeek,预计未来几个月可节省数百万美元。企业开始采用按任务匹配模型的“模型路由”,不再将最贵的前沿模型用于所有场景。部分客户已决定暂停 AI 投入,待证明投资回报率后再继续。

DeepSeek开源生态现象/趋势

推荐理由:一家初创把AI调用从Claude全切到DeepSeek,省下的钱超过工资总额,企业客户开始用模型路由压成本,这个趋势比任何benchmark都更能说明价格战的影响。

6月24日

星期三 · 1 条
03:43
GitHub Blog精选
56
GitHub联合开源联盟呼吁修改加州AI透明度法案以保护开源

GitHub 联合 Black Forest Labs、Hugging Face 与 Mozilla Corporation 组成开源联盟,呼吁对加州 AI 透明度法案(SB 942,拟由 SB 1000 修正)进行针对性修改。当前草案要求开发者在下游用户未履行义务时撤销开源许可证,这与开源许可证永久不可撤销的性质冲突。联盟认为该要求非必要,已有直接监管和执法机制,并建议参考欧盟 AI 法案的透明度实践规范,以向下游用户通知最佳实践文档的方式替代撤销条款。GitHub 支持这些修正,以在保持透明度目标的同时兼容开源开发模式。

GitHub开源生态政策/监管

推荐理由:GitHub 联合 Hugging Face 等开源玩家公开呼吁修正加州 AI 透明法案,核心矛盾是许可撤销条款与开源许可的‘永久不可撤销’冲突,对开源开发者是个明确的政策信号,值得留意。

6月20日

星期六 · 1 条
15:01
AYi@AYi_AInotes精选
75
微软双向转售GPT与DeepSeek成全球最大AI中间商

彭博社报道,微软已成为全球最大AI模型中转站,既将ChatGPT卖给中国企业,也反向将DeepSeek模型卖给西方客户。报道称微软正在测试DeepSeek-R1和DeepSeek-V4,计划向西方客户提供这些中国模型。这一模式构建起跨中美AI模型的双向贸易网络。

DeepSeekMicrosoft开源生态行业动态

推荐理由:微软做起了跨中美模型的双向经销商,这事比表面看起来意义大——它可能绕过限制,把最先进的模型分发到原本接触不到的市场,全球 AI 供应链要改写了。

6月17日

星期三 · 1 条
02:24
Chubby♨️@kimmonismus精选
75
微软考虑为 Copilot Cowork 集成 DeepSeek V4

微软正考虑为 Copilot Cowork 提供微软托管的 DeepSeek V4 版本,作为更便宜的模型选项。Copilot Cowork 将放弃无限定价,转向按使用量计费,原因是成本过高(用户每周执行数百项任务导致费用激增)。若采用 DeepSeek,该模型将是可选的、经过微调与安全防护,并完全托管于 Azure。Axios 报道称微软已微调了一个可用模型,最终决定待定。

Ina Fried: 新消息 @axios:微软正考虑将 DeepSeek 用于 Copilot Cowork,同时也在转向基于使用量的定价模式。消息称最终决定尚未确定,但微软已经微调了一个可供使用的模型。

DeepSeekMicrosoft开源生态行业动态

推荐理由:微软考虑在 Copilot Cowork 中引入 DeepSeek V4 作为便宜选项,同时转向按用量计价。如果落地,这不仅是成本策略的转向,更可能打破企业 AI 对开源模型的信任壁垒,定价变革也会给全行业施加压力。

6月16日

星期二 · 1 条
17:57
The Decoder:AI News(RSS)精选
72
DeepSeek 完成首轮外部融资,估值超 500 亿美元

中国 AI 初创公司 DeepSeek 完成首轮外部融资,募资超 500 亿元人民币(约 74 亿美元),估值超 500 亿美元。投资结构特殊:多数投资者将资金投入 CEO 梁文锋管理的有限合伙企业,无投票权且锁定期五年;仅国资 AI 基金直接投资并保留投票权。创始人梁文锋个人投入约 200 亿元,腾讯和宁德时代为主要外部投资者。梁文锋表示优先基础 AI 研究与 AGI 开发,将继续开源。DeepSeek 去年初凭 V3、R1 模型获全球关注,今年 4 月发布运行于华为芯片的最大开源权重模型 V4,并将 V4 Pro 永久折扣 75%,输入价格约为 OpenAI GPT-5.5 的 1/11,输出价格约为 1/35。

DeepSeek开源生态行业动态
另有 1 家信源报道IT之家(RSS)
推荐理由:DeepSeek 首次外部融资估值冲到 500 亿美元,交易结构却排除了投资人话语权,看得出梁文锋仍把控制权抓得很紧,开源路线和极致性价比是最大的筹码。

6月9日

星期二 · 1 条
02:46
Ars Technica:AI(RSS)精选
70
数周内第二次:微软软件包被植入凭据窃取器

73个软件包被植入自复制窃密程序,一旦被AI智能体打开就会立即运行。这是数周内第二次发现微软相关软件包被伪装成凭据窃取器。

GitHubMicrosoft开源生态编码

推荐理由:微软官方仓库第二次被供应链攻击者劫持,这次恶意包专门在 AI 编码代理中触发凭证窃取,蠕虫还能伪造 SLSA 信任链,任何用过受感染包的开发者都应立刻排查。

6月2日

星期二 · 2 条
22:33
Nathan Lambert@natolambert精选
75
Nathan Lambert离开Ai2,结束2.5年OLMO等项目工作

Ai2(Allen Institute for AI)研究员Nathan Lambert宣布离职。他在Ai2工作超过2.5年,期间主导或参与了OLMO和Tulu等开源模型项目,称其为职业生涯的巅峰。他表示将暂时休息,未来仍会继续深耕开源模型与开放科学领域。

开源生态行业动态

推荐理由:Olmo 和 Tulu 的核心推手离开 Ai2,对开放模型圈是个不小的人事地震,他下一步去哪,可能比这条离职声明更值得盯。
00:06
IT之家(RSS)精选
75
智谱:建议 A 股发行并在科创板上市

智谱计划向中国监管机构申请发行A股并在科创板上市。发行股份数量占发行完成后总股本的2%至8%,预计全部为新股,原股东不发售。本次发行募集资金净额将投资于人工智能通用基座大模型、大模型MaaS一站式服务平台及补充流动资金。此外,公司拟将英文名称由“Knowledge Atlas Technology Joint Stock Company Limited”变更为“Z.AI Co., Ltd.”。

开源生态行业动态
另有 1 家信源报道X:歸藏 (@op7418)
推荐理由:智谱冲刺科创板,这可能是国内大模型公司上市第一枪,募资砸向基座大模型,如果成功,对行业融资是个强心针,但还在建议阶段,先标记。

6月1日

星期一 · 1 条
13:24
Runway:News(网页)精选
55
介绍Cosmos Coalition

Runway宣布作为创始成员加入Cosmos Coalition,该联盟与NVIDIA及多家领先AI实验室合作,旨在构建并开源面向物理AI的前沿世界模型。首个项目将由Runway与NVIDIA共同开发一个基础模型,以推动下一代开放世界模型的研究与发展。

开源生态行业动态
另有 1 家信源报道X:Runway (@runwayml)
推荐理由:Runway 和 NVIDIA 等联手成立 Cosmos Coalition,要开源世界模型,这份声明是视频生成和物理 AI 走向基础设施化的信号,但眼下没有可用的模型或代码,更像一份生态宣言。

5月30日

星期六 · 1 条
12:18
SemiAnalysis@SemiAnalysis_精选
76
突发新闻:JAX NVIDIA GPU & XLA:GPU最大客户刚刚宣布已放弃JAX GPU,宁愿用Grok Build"氛围编程"一个C训练框架。据报道xAI的JAX堆栈MFU低于10%。NVIDIA JAX团队过去两年全部主力996专注于支持xAI却失败了,我想他们现在可以休息并兑现期权了。
xAI开源生态行业动态

推荐理由:xAI 这个 GPU 最大客户突然甩了 JAX,要自研 C 训练框架,理由是 JAX 利用率太低。如果连万亿参数集群都搞不定,JAX 的底层缺陷可能比想象的大,做大规模训练的团队得认真评估了。

5月26日

星期二 · 1 条
20:30
Tencent Hy@TencentHunyuan精选
70
腾讯 Hy-MT2 开源,HuggingFace 排行榜登顶

腾讯的 Hy-MT2 模型基于 Apache License 2.0 开源,可用于研究、商业使用、微调和衍生品,无任何限制。其两个变体在 Hugging Face 趋势排行榜上分别位居 #1 和 #4,鼓励社区克隆、分叉和反馈以推动迭代。

Hugging Face开源生态行业动态
另有 2 家信源报道X:腾讯混元 (@TencentHunyuan)IT之家(RSS)
推荐理由:腾讯把Hy-MT2改成Apache 2.0许可证,商用衍生都没问题,之前因为许可犹豫的人现在可以放心用了,模型在Hugging Face trending霸榜,值得重新评估。

5月25日

星期一 · 2 条
02:27
Hacker News 热门(buzzing.cc 中文翻译)精选
74
DeepSeek将对其旗舰AI模型实施永久性75%折扣
DeepSeek开源生态行业动态

推荐理由:DeepSeek把API价格永久砍掉75%,这是对OpenAI和Anthropic的直接价格战,做应用的该重新算算成本账了。
00:27
Chubby♨️@kimmonismus精选
77
TrapDoor供应链攻击:AI助手成新型攻击面

一场名为“TrapDoor”的协调供应链攻击同时袭击了npm、PyPI和Crates.io,涉及34个恶意包,旨在窃取加密货币、AI和安全开发者的钱包、SSH密钥和云凭证。攻击的新手段是向流行开源项目提交Pull Request,注入被操纵的CLAUDE.md和.cursorrules配置文件。当开发者克隆仓库并使用Claude Code或Cursor等AI助手时,AI智能体会将这些文件当作可信指令执行,可能在开发者不知情下运行恶意命令。这是首次将AI助手作为攻击面。

Socket: More analysis, package details, IOCs, and GitHub-related activity here, including attacker-hosted payload/config infrast...

智能体安全/对齐开源生态

推荐理由:这是第一个把AI助手当跳板的供应链攻击,Claude Code和Cursor用户尤其要当心,检查你项目的.cursorrules和CLAUDE.md是不是来自可信提交。

5月23日

星期六 · 2 条
03:57
Anthropic:Newsroom(网页)精选
90
Project Glasswing:初步更新

上月启动的Project Glasswing项目,旨在利用先进AI模型保障关键软件安全。通过约50家合作伙伴使用Claude Mythos Preview模型,已在全球关键系统中发现超过10,000个高危或严重漏洞。多家合作伙伴报告漏洞发现效率提升超过十倍。例如,Cloudflare在关键路径系统发现2,000个漏洞;Mozilla在Firefox 150中发现并修复271个漏洞,数量远超前代模型。项目还扫描了千余个支撑互联网的开源项目,独立验证准确率达90.6%。这标志着AI网络安全能力进入新阶段,漏洞发现速度已远超人工。

Anthropic安全/对齐开源生态
另有 6 家信源报道Hacker News 热门(buzzing.cc 中文翻译)X:Anthropic (@AnthropicAI)Anthropic:Newsroom(网页)Anthropic:Research(发表成果 · 网页)IT之家(RSS)The Decoder:AI News(RSS)
推荐理由:Mythos Preview用一个月找到的漏洞比过去一年还多,网络安全从「发现难」变成「修不过来」,这个转折点所有安全从业者都得读。
01:56
Rohan Paul@rohanpaul_ai精选
78
Bloomberg:DeepSeek在融资谈判中优先考虑AGI而非商业化 他们正推进102.9亿美元的融资轮,梁文锋承诺继续开发开源AI模型,而非追求短期商业化目标
DeepSeek开源生态行业动态
另有 3 家信源报道X:X.PIN (@thexpin)IT之家(RSS)The Decoder:AI News(RSS)
推荐理由:DeepSeek 百亿融资押注开源 AGI 而非短期变现,在这个闭源收费风潮里是个重要信号,做开源的可以看看。

5月22日

星期五 · 2 条
17:09
IT之家(RSS)精选
73
18 年老粉与微软 GitHub 决裂:我希望它更好,但我更想编程

全球最大的代码托管平台GitHub正面临严重危机。资深开发者Mitchell Hashimoto公开与平台决裂,因频繁崩溃影响编程。近几个月,花旗银行、英特尔等巨头因持续故障表达不满,OpenAI探索自建方案。更严重的是,3800多个内部仓库遭黑客入侵,源代码被公开叫卖。同时,微软取消GitHub CEO职位,将其并入CoreAI团队,导致大量技术骨干流失。这个承载1.5亿开发者的平台,正以惨烈方式站在生死存亡的十字路口。

Microsoft安全/对齐开源生态行业动态

推荐理由:GitHub正在经历一场自我毁灭式的恶性循环,从源码泄露到CEO取消,微软正在把一个社区圣殿变成内部成本中心,所有把命根子放在单个平台上的开发者都该重新考虑了。
13:09
IT之家(RSS)精选
78
DeepSeek 推进 700 亿元融资,梁文锋承诺坚持开发开源 AI 模型而非追求短期商业化目标

DeepSeek正推进700亿元人民币的巨额融资,估值约450亿美元。创始人梁文锋承诺将继续开源开发AI模型,不追求短期商业化,目标是技术升级与通用人工智能。腾讯、IDG资本等接近参投,梁文锋个人可能注资200亿元。若成功将创下中国科技初创公司首轮融资纪录。

DeepSeek开源生态行业动态
另有 3 家信源报道X:X.PIN (@thexpin)IT之家(RSS)The Decoder:AI News(RSS)
推荐理由:700 亿元首轮融资创下纪录,梁文锋明确表态不追求短期商业化、继续死磕开源,国家队和腾讯都在这轮里,对国内开源生态是个强心针。

5月19日

星期二 · 1 条
15:51
IT之家(RSS)精选
73
Kimi最新融资获国资与央企加注,估值半年翻四倍

月之暗面旗下AI助手Kimi正在进行20亿美元新融资,国智投、中国移动等国资机构及央企已加入股东名单,该轮融资已进入收尾阶段。今年1月和2月,Kimi已密集完成3轮融资,累计融资超39亿美元(约376亿元人民币),最新估值相比去年11月已翻4倍有余,成为大模型创业公司中融资最多的企业。产品层面,基于Kimi K2.5模型的Composer 2.5已集成至编程应用Cursor,公司近期也发布了开源模型Kimi K2.6。

开源生态行业动态

推荐理由:国资加码、估值一年翻 4 倍,Kimi 成了国内大模型创业里融钱最多的公司。不仅是钱的问题,C 轮之后国家队正式入场,未来政策倾斜和资源整合才是看点。

5月14日

星期四 · 1 条
13:58
Xiaomi MiMo@XiaomiMiMo精选
69
MiMo V2.5 Pro 在 @DesignArena 上刚刚获得第三名!🎉 MiMo V2.5 Pro (Thinking) 在总排行榜上比 MiMo-V2.5 提升了 8 个名次,在前端编码任务中达到与 Claude Sonnet 4.6 相同的性能水平。 衷心祝贺 @XiaomiMiMo 团队取得这些进步!

Design Arena: BREAKING: MiMo V2.5 Pro (Thinking) takes 3rd overall out of open weights models on Design Arena. MiMo V2.5 Pro (Thinking...

开源生态编码评测/基准

推荐理由:小米MiMo在Design Arena前端编码评测里直接杀进前三,跟Claude Sonnet 4.6平起平坐,这是国产开源模型在代码能力上第一次给我真正的压迫感,搞前端的可以盯一下。

5月13日

星期三 · 1 条
00:37
阿绎 AYi@AYi_AInotes精选
76
紧急警告:针对AI开发者的超大规模供应链攻击"Mini Shai-Hulud"正在爆发

代号“Mini Shai-Hulud”的大规模供应链攻击正在爆发,已波及TanStack、Mistral AI等170多个热门npm/PyPI包。攻击者通过劫持GitHub Actions CI管道,使合法项目自动发布带毒版本,并附有SLSA 3级证明以绕过验证。恶意软件会持久化修改用户配置文件,威胁删除home目录,并能利用窃取的CI密钥像蠕虫一样自动扩散。即使固定包版本,也可能在6分钟发布窗口期内中招。建议开发者立即冻结安装、使用工具自查,并全面轮换所有云密钥和访问凭证。

Ryan Carson: 🚨 There's a major attack going on via npm right now. Do not install any packages right now. Talk to your agent ASAP and...

GitHub安全/对齐开源生态行业动态

推荐理由:这可能是 npm 历史上最毒的供应链攻击,专杀 AI 开发者的工具链,持久化机制和蠕虫扩散让人后背发凉,给出的三条止损命令最好现在就执行。

5月12日

星期二 · 2 条
19:49
公众号:智谱(GLM)精选
63
GLM-5.1获AA全新Coding Agent基准开源第一

全球权威评测机构Artificial Analysis发布全新Coding Agent Index,包含SWE-Bench-Pro-Hard-AA、Terminal-Bench v2和SWE-Atlas-QnA三项基准,用于衡量模型与Agent harness组合的真实编程能力。闭源模型Opus 4.7(在Cursor CLI中运行)全球第一,智谱GLM-5.1(在Claude Code中运行)获开源第一,代表国产大模型在实际编程Agent场景达到SOTA水平。

开源生态编码评测/基准
另有 2 家信源报道公众号:智谱(GLM)IT之家(RSS)
推荐理由:GLM-5.1 在 AA 的新 Coding Agent 基准上拿了开源第一,时隔一个月回头看,这个成绩对国产开源模型在编程 Agent 赛道的位置是个重要注脚,做工具链选型的还是值得扫一眼。
12:36
IT之家(RSS)精选
71
npm 生态遭大范围投毒:TanStack、Mistral AI、UiPath 等受波及,可窃取云密钥与 GitHub 令牌

网络安全机构Socket发现针对npm生态的大规模供应链攻击“Mini Shai-Hulud”。攻击者组合利用GitHub Actions的三种漏洞,绕过了双重身份验证等保护机制,向TanStack、Mistral AI、UiPath等知名项目的软件包中植入恶意版本。被篡改的包在安装时会自动执行恶意代码,窃取AWS、GCP、Kubernetes、GitHub令牌及SSH私钥等敏感凭证。此次攻击波及超过160个包名、近373个恶意版本,目前所有恶意版本已被清理。

安全/对齐开源生态行业动态

推荐理由:这轮 npm 投毒把 TanStack、Mistral AI 和 UiPath 全卷进去了,甚至能直接窃取云密钥和 GitHub 令牌,搞开发的建议立刻按文末应急措施检查自己的依赖树。

5月7日

星期四 · 1 条
08:36
Replit ⠕@Replit精选
67
首届连接代码与文化的AI创意大会将于6月17日至18日登陆纽约。 早鸟票数量有限现已开售。 趁早抢购以免错失良机。 http://vibecon.ai
开源生态行业动态

推荐理由:Replit 办了个把代码和创意文化揉在一起的会,看起来挺酷,但早期鸟票信息大于实际内容,等具体议程出来再说。

4月29日

星期三 · 2 条
21:49
Xiaomi MiMo@XiaomiMiMo精选
60
小米MiMo-V2.5-Pro在最新Arena排行榜中实现多项突破

小米MiMo-V2.5-Pro模型在最新Arena排行榜中表现卓越。在Text Arena(Expert)榜单中,它位列全球第六,同时是开源模型与中文模型的双料第一,其所属实验室全球排名第三。该模型在Text Arena(Overall)总榜中排名开源全球第二,在Code Arena(WebDev)前端开发榜单中位列开源全球第三。此外,它在Text Arena的四个关键子类别(Hard Prompts、英文Hard Prompts、指令遵循与长查询)中均获得开源全球第一。这些成绩均基于真实用户偏好与社区盲投评估,体现了模型在复杂任务上的强大综合能力。

开源生态推理模型发布

推荐理由:小米MiMo-V2.5-Pro冲到Arena开源第一,虽然排名更新晚了几天,但这是国产模型在硬核评测里最好的成绩,做选型的现在该认真看看小米。
10:46
SiliconFlow@SiliconFlowAI精选
63
👀 🚀 🙌 【引用 @SiliconFlowAI】:开发者们正在用他们的 token 投票 🔥 SiliconFlow 现已成为日 token 使用量排名第一的第三方模型提供商 在 @OpenRouter 上, • 每日约 280B token • 每月约 1.9T token • 33 个前沿模型:DeepSeek V4 系列、GLM 5.1、Kimi K2.6 等 衷心感谢每一位与我们共同构建的开发者 更多精彩即将到来🚀

SiliconFlow: Builders are voting with their tokens 🔥 SiliconFlow is now the #1 third-party model provider by daily token usage On @O...

开源生态行业动态部署/工程

推荐理由:如果你在选模型API,这个数据比任何benchmark都有说服力。每天280B token的真金白银投票,国产模型厂商里硅基流动已经跑出来了。

4月8日

星期三 · 1 条
08:00
Hugging Face:Blog(RSS)精选
62
Safetensors 加入 PyTorch 基金会

Safetensors 安全张量格式原为 Hugging Face 项目,旨在解决模型权重存储的安全风险,现正式加入 PyTorch 基金会,移交至 Linux 基金会旗下,实现供应商中立治理。该格式因简单高效被广泛采用,成为 Hugging Face Hub 等平台默认模型分发方式,服务数万个模型。此次变更对用户无影响,格式、API 和集成保持不变。未来路线图包括设备感知加载与保存、张量并行和流水线并行的 API 支持,以及 FP8、GPTQ 等量化格式的正式集成。项目治理文档已公开,鼓励社区参与贡献。

Hugging Face开源生态行业动态部署/工程

推荐理由:Safetensors 从单厂项目转为社区治理,意味着模型格式的安全性和互操作性有了更中立的长期保证,这对依赖它的开发者是个积极的制度信号。
没有更多了