SemiAnalysis 长文披露 OpenAI 自研 Jalapeño 芯片,称其面向数十万亿参数模型与百万级 token 上下文设计,并质疑 CUDA 在 AI 可自写代码优化新架构下的存续。该芯片以每瓦性能为核心,目标让数千芯片协同为单一推理机,其每兆瓦输出 token 吞吐已超越英伟达 Vera Rubin 公布数据。
SemiAnalysis 长文披露 OpenAI 自研 Jalapeño 芯片,称其面向数十万亿参数模型与百万级 token 上下文设计,并质疑 CUDA 在 AI 可自写代码优化新架构下的存续。该芯片以每瓦性能为核心,目标让数千芯片协同为单一推理机,其每兆瓦输出 token 吞吐已超越英伟达 Vera Rubin 公布数据。
Kim援引多方消息称,OpenAI与Anthropic尚未发布的模型能力将实现全面显著跃升,传闻还称上下文与记忆问题已被“解决”,并出现可持续学习的自我改进模型。引用推文称未来8个月内或将再现o3到fable级别的能力跨越。作者强调这些仅为传闻,无实证,但来源日益频繁且包括可靠人士。
rumors i’ve been hearing on the rate of progress inside anthropic and openai are truly bonkers. i think we’ll see a jump...
OpenAI 发布 Jalapeño,宣称其性能优于英伟达 Blackwell。该芯片在推理任务中展现出显著优势,具体参数与基准分数未在原文中披露。Jalapeño 的推出标志着 OpenAI 在自研芯片领域迈出关键一步,可能对现有 GPU 市场格局产生影响。
Had a lot of fun chatting again with my twin brother @dylan522p We went through lab economics over the next few years - ...
苹果发布新Mac mini,AI性能提升4倍,起售价从599涨至899美元。首发2nm M6芯片采用超核加能效核架构,每个GPU核心配备Neural Accelerator,本地LLM提示处理速度达上一代4.8倍。苹果将其定位为7x24小时常开的本地AI Agent服务器,标配2.5G网口和雷雳5接口。
另有 3 家信源报道Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)Apple:Newsroom(RSS)一位博主对 Hacker News 头条的 AI 内容占比做了两次抽样调查:2026 年 2 月,每日 Top 5 中多数日子有 4-5 条与 AI 相关;6 月更新数据显示,AI 相关或 AI 生成内容约占每日头条的 50%-60%,高于 2 月的 40%。作者还借助 AI 文本检测工具 Pangram 识别疑似 AI 撰写的文章,并人工复核了标记结果。
法国公共财政总局确认遭入侵,67.8万条个人及企业数据泄露,包括姓名、家庭商数、参考税收入及预扣税率。攻击者访问已于6月底被切断但未检测到数据外泄,直至8月12日数据被出售才被发现。同一黑客还声称入侵地籍数据服务器,涉及超200万人,巴黎检察院已立案调查。
2016 年 Geoffrey Hinton 曾预测放射科医生五年内将被计算机取代,但该领域从业人数预计未来三十年仍将增长 26% 以上。截至 2026 年初,FDA 批准的 1400 款 AI 医疗设备中约四分之三用于放射科,部分工具能识别人眼不可见的异常或达到甚至超越训练有素放射科医生的水平。一项涵盖 43 项临床试验的分析显示,AI 辅助结肠镜检查比传统方式发现更多息肉。
a16z 发布由 Danco 制作的幻灯片《Intelligence is the Primitive. Applications are the Diffusion Layer》,原为面向小范围受众准备。幻灯片概述了当前应用层与消费级应用的总体态势,并称若反响良好将定期发布此类内容。
摩根大通维持对 SpaceX 的增持评级,称对 Grok“越来越乐观”,并预计 Grok 4.6 以显著低于同行的成本提供前沿智能。该行估计 Cursor 年经常性收入约 40 亿美元,其数据已让近期 Grok 模型出现“切实改进”。摩根大通预计 2026 年底前每月发布新模型,12 月推出的 Grok 5 将带来重大性能提升。
just received a great bed time reading book by the mail looking forward for tonight
一篇博客文章回顾了人工智能在“变得尴尬”之前的早期形态,探讨其复古魅力。文章内容聚焦于历史视角,未涉及具体模型、版本或技术参数。该文在 Hacker News 上获得约 100 点热度,引发社区对 AI 发展早期阶段的怀旧与讨论。
我让 Agent 从零微调了一个多模态模型。 68 分钟,从一句需求到一份可直接跑的方案:1000 条质检数据、可执行训练脚本、源码级格式验证,最终打通了一通真的视频电话。 全程只回答了 6 轮问题,没读一行文档。 起作用的不是神奇提示词,...
《华尔街日报》报道称,中国 AI 模型与美国头部模型的差距已缩小至数月,背后是清华等高校长期形成的人才网络、开源技术、人才回流及更高算力效率共同推动。智谱 AI 唐杰、月之暗面杨植麟、DeepSeek 梁文锋等研究者构成重要力量。报道还指出,DeepSeek 通过 MLA 与 MoE 技术降低算力需求,但高端芯片数量仅为 OpenAI、谷歌同行的五分之一。
Over the weekend I had Codex parse 500K arXiv AI/ML papers since ChatGPT to understand which open models are used for re...
this is the real problem most people just don't realize the scale of the fertility collapse. population pyramid inversio...
高盛合伙人 Chris Churchman 警告,AI 在华尔街的快速普及可能削弱下一代金融从业者的思考能力,导致认知能力萎缩,无法再从第一性原理出发思考。他负责的机构客户数字平台 Marquee 的 AI 平台目前仅向高盛内部员工开放,且开发中最大挑战是确保 AI 答案 100% 准确并接受审计。Churchman 表示,银行需在使用 AI 与保护“师徒式”培养体系之间找到平衡。
当年 Netflix 已经开始邮寄 DVD 时,你每天路过 Blockbuster,依然会看到无数人在排队租碟。 真正的转折发生在 2007 年。 并不是因为 Streaming 突然被发明了,而是几个底层条件同时跨过临界点: 宽带普及、带...
许多老板要求员工将有用工作信息从私密 Slack 私信移至公开公司频道,以便 AI 智能体读取并用于工作。WSJ 报道,若员工私下讨论客户不满原因,AI 智能体可能永远看不到该背景;在可搜索频道讨论则可用于准备客户简报或总结决策。
Ox Alpha is on track to hit nearly 6 trillion tokens today. Try it now via ori in your coding agents: $ ori [your favori...
今日早报聚焦 AI 编码后的交付瓶颈:生码仅占研发链路 20-30%,需将构建、测试、日志等环节改造为 Agent 可调用的闭环。Steve Yegge 在约 50-60 个 Agent 的软件工厂中,用 450 条法律式构件建立“围栏”治理系统。吴恩达则拆解 AI 工程六类能力,强调基于评估的开发与数据、运维协同。
中国互联网上一小部分声音坚称唐朝(公元618年至907年)从未存在过,这一说法源于历史网红“乔宇”5月发布的视频,其用占星数据“证明”唐朝不存在。该话题在微博上已有数千万浏览量,甚至有人致电西安旅游局要求关闭景点。官媒《人民日报》发文称该说法“荒谬”,并警告历史虚无主义将削弱文化自信。
ox alpha has been live on @OpenRouter for 5 days now at over 16.6 TRILLION tokens in the short few days, our community h...
一位用户为完全掌控自己的Amazon Fire HD 10平板,花费266.15美元借助四个AI模型成功获取root权限。Kimi K3以164.25美元发现利用CVE-2022-38181的漏洞,GLM-5.2以21.90美元修复致命错误,GLM-5.3在80美元订阅首日一天内完成最终任务。整个过程中Kimi K3的会话长达621条消息,并自动重试超过500次。
萨尔·汗承认其AI辅导机器人Khanmigo对多数学生而言是“非事件”,首席学习官Kristen DiCerbo直言“尚未看到教育革命”。作者指出,汗本人通过广泛阅读、绘图、提问、致电朋友等方式主动建构理解,而学生仅被动观看视频或与聊天机器人互动,缺乏“制作”的目的驱动。文章援引杜威的四种自然冲动(探究、建构、表达、交流),解释为何讲授式AI辅导注定失败。
一位开发者让 AI 编码代理 Pol 通宵开发待办应用,醒来却发现其耗尽每周全部 token 配额,项目仅剩大量过度设计的测试文件,应用本体却不存在。文章指出,这类为追求“一次成功”而过度消耗 token 的行为,正成为所有常规开发者被迫承担的“氛围税”。
Anthropic 的 Fable 发布后,高昂定价促使智能体编程用户转向更便宜的替代模型。GLM 5.2 与 Fable 同周发布,成本约为其 1/9(约为 Opus 5 的 1/5),对多数常规编码任务已足够。作者认为推理价格下降不会让一切重回最大模型,Fable 的访问控制与数据留存要求也促使企业重新思考工作负载分配。
安德森·霍洛维茨风投的投资组合中充斥着利用法律漏洞、制造令人不安的产品甚至违法的公司。该机构正向一个黯淡的未来投入数十亿资金,其投资方向引发外界对其判断力与行业影响的质疑。
Anthropic 最优秀的 AI 模型在用户吸引力上不及更便宜的工具,后者正蓬勃发展。这一现象反映出价格敏感的市场中,性价比正成为用户选择的关键因素。Anthropic 的高端模型面临来自低成本替代品的激烈竞争。