阿里云 Qwen 回应企业 AI 建设难题:答案并非二选一,而是“采购平台快速启动 + 自建专属模型”并行。Qwen 作为开源权重模型家族,提供统一控制平面,支持企业自行运行、微调和部署,兼顾灵活性与可控性。
阿里云 Qwen 回应企业 AI 建设难题:答案并非二选一,而是“采购平台快速启动 + 自建专属模型”并行。Qwen 作为开源权重模型家族,提供统一控制平面,支持企业自行运行、微调和部署,兼顾灵活性与可控性。
我让 Agent 从零微调了一个多模态模型。 68 分钟,从一句需求到一份可直接跑的方案:1000 条质检数据、可执行训练脚本、源码级格式验证,最终打通了一通真的视频电话。 全程只回答了 6 轮问题,没读一行文档。 起作用的不是神奇提示词,...
《华尔街日报》报道称,中国 AI 模型与美国头部模型的差距已缩小至数月,背后是清华等高校长期形成的人才网络、开源技术、人才回流及更高算力效率共同推动。智谱 AI 唐杰、月之暗面杨植麟、DeepSeek 梁文锋等研究者构成重要力量。报道还指出,DeepSeek 通过 MLA 与 MoE 技术降低算力需求,但高端芯片数量仅为 OpenAI、谷歌同行的五分之一。
Over the weekend I had Codex parse 500K arXiv AI/ML papers since ChatGPT to understand which open models are used for re...
ox alpha has been live on @OpenRouter for 5 days now at over 16.6 TRILLION tokens in the short few days, our community h...
安德森·霍洛维茨风投的投资组合中充斥着利用法律漏洞、制造令人不安的产品甚至违法的公司。该机构正向一个黯淡的未来投入数十亿资金,其投资方向引发外界对其判断力与行业影响的质疑。
对221个MATS对齐与安全项目的分析显示,2026年72%使用命名模型的项目采用中国开源权重模型,高于美国模型的54%;Qwen占66%,领先Llama(44%)和DeepSeek(32%)。闭源模型仍出现在90%项目中,多作为裁判、监控或前沿基线。中国开源模型正成为对齐研究的实验基底,而美国闭源模型仍是关键评估工具。
Over the weekend I had Codex parse 500K arXiv AI/ML papers since ChatGPT to understand which open models are used for re...
而且真正研究一下科技史,吃到最大红利的反而还不是“所谓技术最强”的。等你做大了,技术自然会提高。包括很多赚到钱的个人,反而不是最资深的技能型人才。
Nathan Lambert用Codex分析50万篇arXiv论文发现,中国开源LLM在AI研究中的提及率从2024年的10%升至如今的约40%,而美国开源模型从30%降至25-30%。Qwen被1/3提及LLM的论文引用,DeepSeek在R1发布后明显跃升;Llama于2025年4月达30%峰值后持续下滑。
OpenAI CEO 萨姆·奥尔特曼在 David Senra 播客中表示,担心 AI 终有一天会被少数公司、模型或个人控制,让绝大多数消费者在技术塑造世界问题上没有发言权。他同时担心 AI 挣脱人类控制,并认为对后者的恐惧可能导致前者实现。奥尔特曼还称,美国 AI 领导者未能向公众展示技术如何赋予人们更大自主权,并预测将见证有史以来最大规模的小企业创业热潮。
Today's a record day for open weight share of tokens on Vercel AI Gateway. Aug 22 (today) 🟦 Open: 62% 🟨 Closed: 38% Ju...
More data than open-source AI is taking share from OpenAI and Anthropic. Open source has gone from 28% token share to 62...
开源AI的token份额正持续上升,近两月已从28%增至62%,正从OpenAI和Anthropic手中夺取份额。Elvis Saravia认为,监督者主导多执行子智能体的模式正被广泛采用,子智能体消耗大量token,而开源前沿模型在价格和效率上更具优势。他预测最终闭源前沿模型将占60-90%的经济价值,但仅占15-25%的token量。
More data than open-source AI is taking share from OpenAI and Anthropic. Open source has gone from 28% token share to 62...
更便宜的工具正在蓬勃发展,这对即将进行的IPO意味着什么?文章指出,低成本AI工具的兴起正在给前沿AI公司带来压力,可能影响其市场估值和上市前景。这一趋势表明,行业竞争格局正在向性价比方向倾斜,高价前沿模型的商业可持续性面临挑战。
Aravind Srinivas 认为,出口管制是开源与前沿模型存在12个月差距的唯一原因,但这也可能促使中国在物理层面积累实力。中国在建设数据中心方面速度更快,电力、许可、人力、专业能力均不成问题,反而可能因此成为更强大的竞争对手。Anthropic 曾大力游说支持出口管制。
Anthropic 支持者正庆祝其 ARR,但 ARR 可指年度经常性收入或年化运行率,两者含义截然不同。前者代表订阅等可重复收入,后者可能只是将最佳月份乘以 12 的推算,未必能持续。Anthropic 今年第二季度的收入规模明年未必能重现,尤其在 tokenmaxxing 崩溃后,ATT 等公司为节省成本正转向其他厂商的开源模型。
This is a great real-world example of AI-assisted coding: Linus Torvalds just fixed a nasty Linux kernel GPU bug with su...
Ox-alpha is from Zai, GLM-5.X family my agent has spoken 🙌
墨问西东创始人池建强体验DeepSeek Harness(DSH)一天后,停掉开发两年的客户端并论证全面迁移。DSH是MIT开源的插件化Agent底座,模型无关,支持DeepSeek、OpenAI、Anthropic、Gemini,8月13日发布后GitHub一周约18万星。他判断模型能力已不卡,卡在工程化运行时,DSH相当于开放了Agent的操作系统层。
突破性的:体验完DeepSeek Harness,我打算放弃开发了两年的客户端。 今天下午,我把核心研发叫到一起开了个会:停掉现有客户端的继续开发,开始论证并全面迁移到DeepSeek Harness。 而这个客户端,我们持续开发了两年,并...
大语言模型同等能力水平的成本正急剧下降:2月每任务1.22美元的智能水平如今仅需0.022美元,不到六个月下降56倍,且降速还在加快。按当前速度,特定能力水平的价格每约一年下降100倍。作者以DANDI Archive数据集复用分析为例,说明成本下降让原本只能抽样进行的项目变得可行。
hope you’re enjoying ox alpha :)
2025 年 8 月 TypeScript 成为 GitHub 上最常用语言,月贡献者达 264 万,同比增长 66%。AI 编程工具因训练数据集中于 JavaScript/TypeScript,导致模型对这类代码生成质量更高,促使团队选型时优先考虑与工具兼容的框架。类型系统成为生成代码的安全护栏,2026 年 78% 专业开发者使用 TypeScript,验证环节取代编码成为新瓶颈。
DataCamp CEO 与首席 AI 官讨论在生产环境中为超 1900 万学习者构建 AI 导师时,开源模型与前沿模型的实际选择。对话涵盖模型生产表现、开源是否真便宜 10 倍、基础设施成本、缓存延迟、幻觉、隐私及供应商锁定等议题。
defenders can see the future, and have a narrow window to uplevel their cybersecurity practices now. key is to uplevel f...
国产大模型年中上新收官,Kimi K3与GLM-5.3以60分并列T1阵营,紧咬GPT-5.6和Claude Opus 5。GLM-5.3仅靠后训练迭代,不动基座架构。T2档为58分Qwen3.8 Max、53分DeepSeek-V4-Pro;Qwen全系今年在Hugging Face被下载超20亿次。
同意✅ 那些妄图复刻牛来,专门制造垃圾圈钱的才是劣币 但是将会有一大批这样的出现,所以我说 大垃圾时代 才刚开始
Addy Osmani 警告 agent 循环中的“认知投降”,强调验证环与爆炸半径限制;Rachel Laycock 提出“公民构建,智能体执行,专家治理”的组织假说。17 岁作者苏廷浩的论文被 ICML 2026 接收,训练花费约 3 万元,最大模型 0.5B。
BestBlogs 08-20 早报盘点 AI 行业要闻:xAI 的 Grok CLI 被曝未经同意将整个本地代码库(含 .env 密钥和 git 历史)上传至 Google Cloud,引发信任危机;OpenAI 推出零数据保留服务并预览私有安全处理功能。其他要点包括 17 岁高中生论文被 ICML 2026 收录、腾讯健康中位交付周期从 19 天降至 9 天等。
https://x.com/i/article/2090224725528363008
Jeremy Morrell 提出,LLM 时代为 Web 可扩展软件带来新机遇:LLM 大幅降低扩展的编写成本,现代沙箱原语降低部署成本并提供良好安全边界。开发者可将应用构建为稳固、可问责的核心,让用户借助 LLM 安全地扩展其功能。
New: Ramp's top SaaS vendors for August 2026 1/ This month, we saw continued growth in model serving / routers as more f...
Qwen 27B is the "DeepSeek moment" for open source. It matches the closed-source state-of-the-art from just a few months ...
let that sink in
英国金融时报报道,中国开源权重AI策略或使模型采用转化为对他国技术标准的长期依赖。美国出口限制(2019年华为实体清单、2022年先进芯片管制)反而强化了中国技术自主压力。中国正通过分发渠道而非单纯模型能力竞争,尤其吸引寻求低成本、本地部署或减少对美依赖的国家。马斯克曾预测,未来几年美国或领先,但胜负取决于谁控制AI芯片制造,而目前100%先进AI芯片产自台湾。
"For the next few years, America is likely to win (in AI). then it will be a function of who controls the AI chip fabric...