内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态一手 · 357 条
来源全部一手资讯X
类型全部
全部模型产品行业论文教程观点
标签「开源生态」清除

8月15日周六

07:53Tomer Tunguz 博客(VC 分析)54谁真的需要SOTA模型?OpenRouter数据显示84%token来自非前沿模型
00:03Hugging Face:Blog(RSS)71精选2026年夏季开源模型生态观察:中国前沿模型规模领先,AMD与NVIDIA主导发布量

8月14日周五

19:31公众号:小红书技术(dots.llm)79精选dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理
13:41公众号:智谱(GLM)73精选GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
12:01公众号:蚂蚁百灵(Ling)62精选蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环
00:52MiniMax:Blog(网页)63精选MiniMax Music 3.0 发布:新一代开源权重、生产级全能音乐模型
00:00GitHub Blog49GitHub Secure Open Source Fund 第四期 50 个开源项目如何提升 AI 时代安全性

8月13日周四

18:01公众号:小红书技术(dots.llm)75精选小红书开源连续自回归语音合成模型 dots.tts:打造可持续扩展的 TTS 基座
02:59GitHub Blog67精选AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求

8月12日周三

23:55LMSYS:Blog(Chatbot Arena 团队)59SGLang 与 Miles 为 Qwen3.8-2.4T-A95B 提供 Day-0 支持
23:01公众号:MiniMax(稀宇科技)58MiniMax H3 开源一周衍生近 300 个模型

8月11日周二

23:13NVIDIA Blog(RSS)57NVIDIA 为何需要新供电架构以扩展 AI 算力性能
17:21公众号:蚂蚁百灵(Ling)72精选Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务

8月10日周一

23:54Gary Marcus:The Road to AI We Can Trust(RSS)49开源不等于开放权重:Gary Marcus 剖析两者本质差异

8月9日周日

22:59Nathan Lambert:Interconnects(RSS)60精选从黑客事件中汲取的教训:前沿模型攻击暴露激励与治理失衡

8月8日周六

01:51LMSYS:Blog(Chatbot Arena 团队)76精选HPC-Ops × SGLang:腾讯混元开源高性能 Attention、Router GEMM 与 MoE 算子

8月7日周五

18:00公众号:小红书技术(dots.llm)65精选小红书联合浙大、复旦提出 CULTURE-MT:首个面向社媒翻译的「文化有效性」评测基准,入选 ICML 2026
16:01公众号:面壁智能(MiniCPM)41独立开发者用VoxCPM克隆网红声音实现实时对话,获百万播放
14:51公众号:面壁智能(MiniCPM)30面壁智能亮相 APEC:李大海谈端侧 AI 如何成为中小企业"数字水电煤"
14:51公众号:面壁智能(MiniCPM)65精选独立开发者用 VoxCPM 克隆网红声音,让 AI 终于"会聊天"了
00:53GitHub Blog24GitHub 如何将恶意软件公告从 npm 扩展到 OpenSSF 数据

8月6日周四

21:12NVIDIA Blog(RSS)71精选NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿

8月5日周三

01:51LMSYS:Blog(Chatbot Arena 团队)72精选SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型
00:00LMSYS:Blog(Chatbot Arena 团队)53SGL-Diffusion 全栈性能优化:用 SRT 替换 HF 后端加速 AR+DiT 混合生成

8月4日周二

23:12NVIDIA Blog(RSS)62精选NVIDIA 开源 cuFile API,推动 GPU 直连存储
23:12NVIDIA Blog(RSS)68精选NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型
21:12NVIDIA Blog(RSS)52AI 领袖提出 SAFE 指南,强化智能体网络安全透明度
12:30公众号:面壁智能(MiniCPM)78精选面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入
08:40公众号:MiniMax(稀宇科技)48MiniMax H3 开源 24 小时,超百家企业 Day 0 上线

8月3日周一

22:56Nathan Lambert:Interconnects(RSS)27Interconnects 推出 Artifacts Hub 与 Adoption Dashboard,扩展开源生态策展与测量

8月2日周日

21:56Nathan Lambert:Interconnects(RSS)45最新开源模型盘点(#23):Laguna S2.1、Inkling 与 Kimi K3 展现开源模型在帕累托前沿的价值

7月31日周五

17:59MiniMax:Blog(网页)78精选MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频
12:10公众号:腾讯混元89精选腾讯混元 Hyra 攻克加法组合学 50 年未解难题

7月30日周四

23:50LMSYS:Blog(Chatbot Arena 团队)61精选RadixArk 与 Google Cloud 合作,将完整 SGLang 功能引入 TPU
01:51Gary Marcus:The Road to AI We Can Trust(RSS)43Dario Amodei 因反对开放权重模型遭行业批评

7月28日周二

18:00公众号:月之暗面(Kimi)22Kimi 全球大使计划现已开启
12:00公众号:龙猫LongCat(美团)59美团正式上线全场景 AI Agent 平台 CatPaw
12:00公众号:月之暗面(Kimi)85精选Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放

7月27日周一

23:35公众号:月之暗面(Kimi)81精选Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放
17:00NVIDIA Blog(RSS)61精选NVIDIA 等多家行业领袖联合成立 Open Secure AI Alliance,推动 AI 安全与防御开源化
已加载 40 条
全部 AI 动态
2026年8月17日星期一 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
一手信源 · 标签「开源生态」 · 357 条清除

8月15日

星期六 · 2 条
07:53
Tomer Tunguz 博客(VC 分析)
AI 评分 54/100
谁真的需要SOTA模型?OpenRouter数据显示84%token来自非前沿模型

OpenRouter数据显示,84%的模型token并非来自SOTA模型,用户最常用的六款模型性能约为前沿模型的77%,成本仅为Claude Fable 5的2.5%。8月10日当周,六款模型承载了80%流量,混合价格约$0.50/百万token,而Fable 5为$20。最佳开源模型性能已从一年前的48%提升至前沿模型的80%,企业正转向更小、微调或开源模型以优化性价比。

AnthropicOpenAI开源生态现象/趋势
00:03
Hugging Face:Blog(RSS)精选
AI 评分 71/100
2026年夏季开源模型生态观察:中国前沿模型规模领先,AMD与NVIDIA主导发布量

2026年1至8月,Hugging Face公开模型仓库从243万增至296万,但85.6%的模型下载量不足200次,1.5%的仓库占据99.2%下载量。中国实验室月度最大开源模型参数规模在754B至2.78万亿之间,美国实验室七个月中五个月低于130B。AMD与NVIDIA各发布超200个新模型仓库,成为发布开源模型最多的机构。

Hugging Face开源生态现象/趋势

推荐理由:下载量与点赞量分别记录实际依赖和社区兴奋点,把两者混为同一个热度指标是评估开源模型生态时最常见的偏差。

8月14日

星期五 · 5 条
19:31
公众号:小红书技术(dots.llm)精选
AI 评分 79/100
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理

小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。

智能体Hugging Face多模态开源生态
另有 1 家信源报道X:Kim (@kimmonismus)
推荐理由:除开源模型外,TEMPO 让同一智能体在每个宏观步骤切换为 critic,用测试时推理估计回报,给稀疏奖励长程任务的强化学习训练提供了可借鉴的结构。
13:41
公众号:智谱(GLM)精选
AI 评分 73/100
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。

开源生态模型发布编码
另有 9 家信源报道The Decoder:AI News(RSS)X:智谱 Z.ai (@Zai_org)X:Testing Catalog (@testingcatalog)X:Rohan Paul (@rohanpaul_ai)Nathan Lambert:Interconnects(RSS)MarkTechPost(RSS)X:SemiAnalysis (@SemiAnalysis_)X:Kim (@kimmonismus)IT之家(RSS)
推荐理由:把网络安全能力作为开源卖点,价值在于让缺乏闭源安全服务的中小团队也能开展漏洞审计,改变防御能力只集中在少数机构的现状。
12:01
公众号:蚂蚁百灵(Ling)精选
AI 评分 62/100
蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环

蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 Agentic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定。

智能体开源生态教程/实践数据/训练

推荐理由:真正可复用的不是井字棋,而是把可复现错误、可验证反馈、本地训练和同环境复测串成的轻量后训练闭环,适合为本地小模型稳定工具调用和格式约束。
00:52
MiniMax:Blog(网页)精选
AI 评分 63/100
MiniMax Music 3.0 发布:新一代开源权重、生产级全能音乐模型

MiniMax 推出 Music 3.0,新一代音乐生成模型,可根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟。

多模态开源生态模型发布
另有 2 家信源报道IT之家(RSS)X:MiniMax (@MiniMax_AI)
推荐理由:把简单描述扩展成包含配器进出、情绪曲线和演唱方式的专业模板,降低了非专业创作者控制音乐生成细节的门槛。
00:00
GitHub Blog
AI 评分 49/100
GitHub Secure Open Source Fund 第四期 50 个开源项目如何提升 AI 时代安全性

GitHub Secure Open Source Fund 第四期 50 个开源项目结合 AI 辅助工作流、维护者经验、GitHub 安全工具、专家指导与资金支持,系统性提升项目安全性。该计划展示了开源生态在 AI 时代应对安全挑战的实践路径,为维护者提供了可复用的安全加固模式。

GitHub开源生态教程/实践

8月13日

星期四 · 2 条
18:01
公众号:小红书技术(dots.llm)精选
AI 评分 75/100
小红书开源连续自回归语音合成模型 dots.tts:打造可持续扩展的 TTS 基座

小红书 dots 团队开源 20 亿参数全连续端到端自回归语音合成模型 dots.tts,在 Seed-TTS-Eval 三个子集上取得最佳平均内容准确度和平均说话人相似度。

开源生态模型发布语音

推荐理由:连续自回归跳过离散 Token 的信息损失,又用语义编码器回灌历史抑制累积误差,为音色克隆和低步数流式共用同一基座提供了路径。
02:59
GitHub Blog精选
AI 评分 67/100
AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求

AutoGPT 维护者发现,AI 智能体不会主动阅读文档,因此将指令放在 AGENTS.md 和技能文件中,并置于代码目录旁。他们通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制,将智能体提交的 PR 从“不可用”转变为“可用但不符合路线图”。其中 CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与智能体的“人类探测器”。

智能体GitHub开源生态教程/实践

推荐理由:AutoGPT 的经验指出发现机制比文档完善度关键,agent 只读当前目录层级的指令,所以把 AGENTS.md 放在代码旁比继续写 wiki 更有效。

8月12日

星期三 · 2 条
23:55
LMSYS:Blog(Chatbot Arena 团队)
AI 评分 59/100
SGLang 与 Miles 为 Qwen3.8-2.4T-A95B 提供 Day-0 支持

SGLang 与 Miles 在发布首日即支持 Qwen3.8-2.4T-A95B,这是 Qwen 最大的开源模型,总参数 2.4T,每 token 激活 95B,采用混合注意力架构。

产品更新开源生态部署/工程
23:01
公众号:MiniMax(稀宇科技)
AI 评分 58/100
MiniMax H3 开源一周衍生近 300 个模型

MiniMax H3 开源一周即在 Hugging Face 衍生出近 300 个模型,ComfyUI 版本下载量近 700 万。社区将 120GB 权重压至 42.5GB 以在消费级显卡运行,Redis 作者 antirez 用 C 和 Metal 重写原生 Mac 推理引擎 h3.c。

开源生态现象/趋势

8月11日

星期二 · 2 条
23:13
NVIDIA Blog(RSS)
AI 评分 57/100
NVIDIA 为何需要新供电架构以扩展 AI 算力性能

NVIDIA 主张以 800 VDC 直流配电替代传统交流多次转换,以降低损耗、支撑 AI 算力扩展。NVIDIA 与 Google、Microsoft 通过 OCP 联合制定该架构,已发布白皮书及 LVDC 固态变压器规范 v0.3,超 80 家设备商正据此开发产品。

开源生态行业动态部署/工程
17:21
公众号:蚂蚁百灵(Ling)精选
AI 评分 72/100
Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务

蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。

智能体开源生态推理模型发布
另有 2 家信源报道X:Artificial Analysis (@ArtificialAnlys)IT之家(RSS)
推荐理由:以1.3B激活参数取得接近4B激活模型的综合能力,同时Agent分数超越部分30B+模型,多精度开源和本地部署方案让轻量Agent应用更易落地。

8月10日

星期一 · 1 条
23:54
Gary Marcus:The Road to AI We Can Trust(RSS)
AI 评分 49/100
开源不等于开放权重:Gary Marcus 剖析两者本质差异

开放权重模型并非真正的开源,二者在透明度和可定制性上存在根本区别。开源软件公开完整源代码,允许任何人查看、修改和分支;而开放权重模型仅发布训练后的神经网络权重,用户无法访问原始训练数据、预处理方法或训练算法,也不能自由修改或深入调查。这导致开发者、监管者和科学家在使用开放权重模型时面临诸多限制,Meta 最新发布的开放权重模型即为例证。

Meta大佬观点开源生态

8月9日

星期日 · 1 条
22:59
Nathan Lambert:Interconnects(RSS)精选
AI 评分 60/100
从黑客事件中汲取的教训:前沿模型攻击暴露激励与治理失衡

近期前沿模型引发的网络攻击事件促使作者反思当前激励体系难以适应快速技术变革。科技公司受增长驱动持续扩展,而政府行动迟缓,双方均未准备好应对未来12-24个月的挑战。作者认为需要更多透明度,并指出持久性强的模型更可能实施黑客行为,OpenAI的推理时扩展路径可能与此相关。

OpenAI安全/对齐开源生态现象/趋势

推荐理由:文章从近期模型黑客事件中提炼出关于持久性、意图假设等具体教训,并论证开放模型对理解前沿风险不可或缺,为评估实验室安全现状提供了可操作的观察框架。

8月8日

星期六 · 1 条
01:51
LMSYS:Blog(Chatbot Arena 团队)精选
AI 评分 76/100
HPC-Ops × SGLang:腾讯混元开源高性能 Attention、Router GEMM 与 MoE 算子

腾讯混元开源算子库 HPC-Ops 已集成至 SGLang 主分支,其 Dynamic Attention 与 Fused MoE 在 Hy3 模型上最高降低 TPOT 48.8%。

产品更新开源生态推理

推荐理由:HPC-Ops 集成到 SGLang,带来生产验证的负载均衡 Attention 和精度感知 Router GEMM,实测 Hy3 TPOT 降幅最高 48.8%,为 MoE 低延迟服务提供了可直接使用的开源优化。

8月7日

星期五 · 5 条
18:00
公众号:小红书技术(dots.llm)精选
AI 评分 65/100
小红书联合浙大、复旦提出 CULTURE-MT:首个面向社媒翻译的「文化有效性」评测基准,入选 ICML 2026

小红书联合浙江大学、复旦大学提出 CULTURE-MT,这是首个面向中英社媒笔记翻译、兼顾文化符号传递与情感共鸣的评测基准,并首次提出「文化有效性」评估标准与自动评估模型 JUDGER(准确率 86.03%)。

arXivHugging Face开源生态数据/训练

推荐理由:CULTURE-MT将翻译评测从字面准确拉到文化传递,自动评估模型与开放榜单提供了可复现的评测-训练闭环,让改进不再凭感觉。
16:01
公众号:面壁智能(MiniCPM)
AI 评分 41/100
独立开发者用VoxCPM克隆网红声音实现实时对话,获百万播放

独立开发者叶小叔用面壁智能开源的VoxCPM声音克隆模型,成功让AI克隆网红声音并实现实时对话,视频在抖音获100万播放、X上5.9万人围观。此前他尝试本地开源模型(TTS合成需14-40秒)和云端Cartesia Pro(中文效果不佳)均失败,最终租用RunPod L4 GPU($0.4/小时)部署VoxCPM,TTS首包延迟不到1秒,端到端体感2-3秒。

开源生态教程/实践语音
14:51
公众号:面壁智能(MiniCPM)
AI 评分 30/100
面壁智能亮相 APEC:李大海谈端侧 AI 如何成为中小企业"数字水电煤"

面壁智能 CEO 李大海在 APEC 专题研讨会上发表演讲,称端侧 AI 已从“科幻”变为工业现实,可帮助亚太中小企业破解网络延迟、数据隐私与高昂成本三重壁垒。其端侧模型“面壁小钢炮”总下载量突破 4300 万次,全球开发者平台星标超 13 万;开源智能体操作系统 PilotDeck 支持常驻任务与端云协同,已与华为、三星、上汽等企业合作落地。

智能体MCP/工具大佬观点开源生态
14:51
公众号:面壁智能(MiniCPM)精选
AI 评分 65/100
独立开发者用 VoxCPM 克隆网红声音,让 AI 终于"会聊天"了

独立开发者叶小叔用面壁智能开源的 VoxCPM 克隆千万粉丝网红声音,搭建 STT → LLM → VoxCPM(TTS)三段式实时对话管道,TTS 首包延迟不到 1 秒,端到端体感 2 到 3 秒。

Hugging Face开源生态教程/实践语音

推荐理由:案例的实践价值在于澄清了实时对话 TTS 环节的选择逻辑:中文原生支持与默认参数平衡往往优于盲目追求极致克隆,这一取舍对同类项目具直接参考。
00:53
GitHub Blog
AI 评分 24/100
GitHub 如何将恶意软件公告从 npm 扩展到 OpenSSF 数据

GitHub 恶意软件公告不再局限于 npm,现已将 OpenSSF 的恶意软件包数据接入 Advisory Database。该管道以“偏执”方式构建,确保数据安全与可靠性,扩展了漏洞检测覆盖面。

GitHub产品更新开源生态

8月6日

星期四 · 1 条
21:12
NVIDIA Blog(RSS)精选
AI 评分 71/100
NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿

NVIDIA 发布 Cosmos 3,一个基于混合 Transformer 架构的开放物理 AI 基础全模态模型,整合视觉推理、世界生成与动作预测。

具身智能多模态开源生态模型发布

推荐理由:介绍 Cosmos 3 作为开放物理 AI 基础模型的架构、基准表现和行业用例,为需要定制世界模型的机器人、自动驾驶和视觉 AI 团队提供了可直接参考的技术路线。

8月5日

星期三 · 2 条
01:51
LMSYS:Blog(Chatbot Arena 团队)精选
AI 评分 72/100
SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型

SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。

产品更新开源生态推理部署/工程

推荐理由:将目标模型推理与草稿模型训练分离,让两种工作负载可独立扩缩,改变了投机解码训练中资源配比必须硬编码的旧模式,资源规划可按模型和序列长度灵活调整。
00:00
LMSYS:Blog(Chatbot Arena 团队)
AI 评分 53/100
SGL-Diffusion 全栈性能优化:用 SRT 替换 HF 后端加速 AR+DiT 混合生成

SGL-Diffusion 通过三项 PR 将 AR+DiT 混合生成从单体架构重构为异构分布式系统。用 SRT 替换 HF 后端并解耦 AR 与 DiT,使 AR 阶段在 4 卡 TP 下延迟从 122.8 秒降至 26.1 秒(-78.8%),端到端延迟降低 77.2%。动态批处理与提前返回机制提升并发吞吐,DiT 采用每设备单去噪器的 SP 并行,并通过缓冲 AR 结果实现流水线重叠。

开源生态教程/实践部署/工程

8月4日

星期二 · 5 条
23:12
NVIDIA Blog(RSS)精选
AI 评分 62/100
NVIDIA 开源 cuFile API,推动 GPU 直连存储

NVIDIA 在 FMS 大会上宣布开源 cuFile API 及底层存储软件栈,让 GPU 可直接读写存储,访问延迟降至微秒级。其 Vera CPU 在两级压缩与加密流水线中吞吐量比 x86 CPU 最高提升 3.21 倍,并联合 40 多家厂商推出 Storage-Next 计划。

产品更新开源生态数据/训练部署/工程

推荐理由:cuFile 开源让 GPU 直存访问成为可跨平台协作的开放标准,这会改变 AI 基础设施团队评估存储架构的方式,不再只绑定单一厂商的实现。
23:12
NVIDIA Blog(RSS)精选
AI 评分 68/100
NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型

NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。

具身智能开源生态推理模型发布
另有 2 家信源报道X:Jensen Huang (@JensenHuang)IT之家(RSS)
推荐理由:开放商业许可与可解释推理输出结合,自动驾驶团队能直接审查模型决策链,为安全验证提供透明度,降低从研发到商用部署的转换成本。
21:12
NVIDIA Blog(RSS)
AI 评分 52/100
AI 领袖提出 SAFE 指南,强化智能体网络安全透明度

Linux 基金会发布共享 AI 事件交换(SAFE)指南征求意见稿,旨在将智能体网络安全事件转化为全生态共享防护。

智能体安全/对齐开源生态
12:30
公众号:面壁智能(MiniCPM)精选
AI 评分 78/100
面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入

面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。

开源/仓库开源生态部署/工程
另有 1 家信源报道X:面壁智能 OpenBMB (@OpenBMB)
推荐理由:ForgeStencil 把决定工业软件效率的 Stencil 优化从专家手工调教变成 AI 自动闭环,开源后多个行业的真实应用可直接复用其加速实现。
08:40
公众号:MiniMax(稀宇科技)
AI 评分 48/100
MiniMax H3 开源 24 小时,超百家企业 Day 0 上线

MiniMax H3 开源 24 小时内,华为昇腾、AMD、Intel 等 9 家国内外芯片厂商完成 Day 0 适配,Hugging Face、魔搭、ComfyUI、vLLM-Omni、SGLang、腾讯云等超百家合作伙伴 Day 0 上线。在 Artificial Analysis 所有视频评测榜单中,H3 均跻身全球前三,并在质量/价格象限中进入最优梯队,为中国模型最佳表现。

多模态开源生态行业动态

8月3日

星期一 · 1 条
22:56
Nathan Lambert:Interconnects(RSS)
AI 评分 27/100
Interconnects 推出 Artifacts Hub 与 Adoption Dashboard,扩展开源生态策展与测量

Interconnects 发布 Artifacts Hub 和 Adoption Dashboard,用于扩展对开源生态系统的策展与测量。Artifacts Hub 集中收录开源模型与工具,Adoption Dashboard 追踪模型采用情况与社区使用趋势,为研究者提供可量化的生态观测窗口。

产品更新开源生态

8月2日

星期日 · 1 条
21:56
Nathan Lambert:Interconnects(RSS)
AI 评分 45/100
最新开源模型盘点(#23):Laguna S2.1、Inkling 与 Kimi K3 展现开源模型在帕累托前沿的价值

Thinking Machines 发布首个模型 Inkling,为 975B-A41B 多模态 MoE,支持文本、图像和音频输入,并推出 276B-A12B 小版本。

DeepSeek多模态开源生态现象/趋势

7月31日

星期五 · 2 条
17:59
MiniMax:Blog(网页)精选
AI 评分 78/100
MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频

MiniMax 正式推出全能多模态生成模型 H3,可联合理解文本、图像、视频和音频,生成最高 2K 分辨率、15 秒时长且带原生立体声的视频。H3 在指令跟随、文字与品牌呈现、V2V 动作迁移上表现突出,2K 下每秒价格低于主流模型三分之一,768p 下低于主流 720p 价格一半。官方计划近日开源模型权重,以支持开源社区并加速硬件兼容。

多模态开源生态模型发布
另有 4 家信源报道X:Testing Catalog (@testingcatalog)X:MiniMax (@MiniMax_AI)X:X.PIN (@thexpin)X:Artificial Analysis (@ArtificialAnlys)
推荐理由:MiniMax H3 把全模态生成打到了 2K 分辨率且价格不到主流三分之一,还计划开源权重,这对闭源视频模型是实打实的压力,开发者可以重点关注。
12:10
公众号:腾讯混元精选
AI 评分 89/100
腾讯混元 Hyra 攻克加法组合学 50 年未解难题

腾讯混元上周推出的科研智能体 Hyra,基于本月开源的 Hy3 模型(总参数 295B、激活参数 21B),为加法组合学中悬置半个多世纪的开放问题给出完整答案,证明 2 是该问题指数的上确界。Hyra 先在有限搜索中将最好结果从约 1.14 提高到 1.21,经约 24 小时运行提出核心构造思路,并给出 Lean 4 形式化证明。论文预印本、显式构造和形式化证明均已公开。

开源生态推理论文/研究

推荐理由:构造不再依赖暴力搜索,而是从数学结构入手自主推理,同时给出可形式化证明,让AI在定理型科学问题上从辅助工具转向共同研究者。

7月30日

星期四 · 2 条
23:50
LMSYS:Blog(Chatbot Arena 团队)精选
AI 评分 61/100
RadixArk 与 Google Cloud 合作,将完整 SGLang 功能引入 TPU

RadixArk 与 Google Cloud 合作,将开源推理框架 SGLang 引入 Google TPU,开发者可通过 SGL-JAX 在最新 TPU 上运行 Gemma、Qwen、DeepSeek 等大语言模型及多模态模型。

Google开源生态行业动态部署/工程

推荐理由:SGLang 正式登陆 TPU,推理框架的硬件自由终于实现,选 GPU 还是 TPU 从此只看性价比不看兼容性,做推理服务的团队可以重新算账了。
01:51
Gary Marcus:The Road to AI We Can Trust(RSS)
AI 评分 43/100
Dario Amodei 因反对开放权重模型遭行业批评

Anthropic CEO Dario Amodei 因拒绝签署支持“开放权重”模型的公开信并发布声明反对,被批评为“不合时宜且自私自利”。其声明要求限制竞争对手进行知识蒸馏,而公司自身却被曝出批量销毁稀有书籍以提取内容。

Anthropic大佬观点开源生态

7月28日

星期二 · 3 条
18:00
公众号:月之暗面(Kimi)
AI 评分 22/100
Kimi 全球大使计划现已开启
开源生态行业动态
12:00
公众号:龙猫LongCat(美团)
AI 评分 59/100
美团正式上线全场景 AI Agent 平台 CatPaw

美团发布全场景 AI Agent 平台 CatPaw,搭载本月开源的 LongCat 2.0 模型(总参数 1.6T,平均激活约 48B)。该平台提供多端协作的 AI 工作台与企业级 Agent 托管服务,已覆盖美团内部 9 万员工、搭建 3 万个 Agent,并深度融合本地生活行业认知。

智能体产品更新开源生态部署/工程
另有 1 家信源报道公众号:龙猫LongCat(美团)
12:00
公众号:月之暗面(Kimi)精选
AI 评分 85/100
Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放

月之暗面发布 2.8 万亿参数的混合专家模型 Kimi K3,支持原生视觉理解和 100 万 token 上下文窗口。其规模化效率较 Kimi K2.5 提升 2.5 倍,并同步开源模型权重、技术报告及 MoonEP、FlashKDA、AgentEnv 三项 Infra 技术。

GitHubHugging Face多模态开源生态
另有 14 家信源报道X:Kim (@kimmonismus)The Verge:AI(RSS)X:Kimi.ai (@Kimi_Moonshot)IT之家(RSS)The Decoder:AI News(RSS)X:阿易 AI Notes (@AYi_AInotes)X:Rohan Paul (@rohanpaul_ai)X:Artificial Analysis (@ArtificialAnlys)X:硅基流动 SiliconFlow (@SiliconFlowAI)X:AK (@_akhaliq)X:Elvis Saravia (@omarsar0, DAIR.AI)LMSYS:Blog(Chatbot Arena 团队)公众号:数字生命卡兹克HuggingFace Daily Papers(社区热门论文)
推荐理由:Kimi K3 的完全开放是一个明确信号,月之暗面把最核心的模型权重和技术细节全部公开,国内开发者从此有了媲美国际顶尖开源的底座。虽然部署门槛不低,但开放本身推动了生态发展。

7月27日

星期一 · 2 条
23:35
公众号:月之暗面(Kimi)精选
AI 评分 81/100
Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放

Kimi 发布 K3 模型权重与技术报告,并开源 MoonEP、FlashKDA 和 AgentEnv 三项关键 Infra 技术。K3 是 2.8 万亿参数的 MoE 模型,支持原生视觉与 100 万 token 上下文,参数规模约为 K2.5 的 3 倍,规模化效率提升 2.5 倍。

多模态开源生态推理模型发布
另有 1 家信源报道公众号:数字生命卡兹克
推荐理由:权重开源伴随技术报告公开训练细节,为研究机构直接复现和改造千亿级MoE模型提供了完整路径,也降低企业自部署门槛。
17:00
NVIDIA Blog(RSS)精选
AI 评分 61/100
NVIDIA 等多家行业领袖联合成立 Open Secure AI Alliance,推动 AI 安全与防御开源化

NVIDIA、Microsoft、Hugging Face、IBM 等数十家机构联合成立 Open Secure AI Alliance,旨在通过开源模型、工具和框架构建可审查、可定制的 AI 安全防御体系。

安全/对齐开源生态
另有 4 家信源报道IT之家(RSS)The Verge:AI(RSS)X:Jensen Huang (@JensenHuang)X:Kim (@kimmonismus)
推荐理由:NVIDIA拉上微软、IBM等三十多家公司成立了这个安全联盟,虽然现在只是一纸宣言,但它给‘开放模型更能打’撑腰,对搞安全的同学是个风向标,建议留意后续动作。
已加载 40 条