mamma mia i have never tried to explained ai to someone outside sf before we are not early, it literally has not even st...
Uber 联合创始人 Travis Kalanick 沉寂八年后携工业 AI 公司 Atoms 回归,a16z 领投 17 亿美元,Ben Horowitz 称这是其最大一笔支票并加入董事会。Atoms 聚焦食品、采矿、物流等重资产行业,不做通用人形机器人。Kalanick 称隐身是差异化策略,并感谢 Elon Musk 收购 X 让建设者能直接发声。
Travis Kalanick says new media is why he's back after eight years of silence: "The media landscape 10 years ago, 90% of ...
GLM 5.3 notes and why we should stop being so surprised about these very strong Chinese models (most of this is talking ...
There's a ton of good stuff in here, but to me this is the part that everyone mainstream is overlooking. It's literally ...
AI Coding 让代码生成大幅提速,却打乱了软件工程原有的反馈机制:需求不拆解、阶段结果不定义、变更不可追溯,省下的开发时间会以 Bug、返工和沟通成本的形式补回来。AI 越快,人越需要主动制造检查点,让每一步结果可理解、可验证、可追溯。AI Coding 下半场的竞争将从生成速度转向工程过程清晰度与质量可控性。
@jun_song A fast rock is still just a rock. Where we are going we won't need rocks
Z.ai 发布 GLM-5.3,基于 743B 基座模型后训练,主打顶尖编程与智能体能力,并称在网络安全领域树立开源模型新标准。Nathan Lambert 认为 Z.ai 并非“刷分”,其任务分布更窄、发布周期以天计,且计算效率优于 OpenAI/Anthropic,整体是合理策略。
Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...
It's amazing when a model works all day and all night and solves a super hard problem for you. But then you want to do s...
MemoraX 在首个 Agent Memory Leaderboard(AML)评测的 Commercial Products—Text Memory 赛道中排名第一,得分 58.02。该评测汇集 136 支注册团队和 69 个记忆框架,并追踪记忆写入、组织、检索、重排序、融合及使用中的失败,使记忆系统可被观察、修改和重测。
Building AI memory is harder than storing conversations. A useful memory system needs to understand what matters, retrie...
François Chollet 指出,ARC-AGI-3 上所有顶尖方案均采用 LLM 引导的符号世界模型合成法,即通过编写可执行代码来编码对世界因果机制的理解。
In one pass Opus wrote 269 programs (~12,700 lines). It built parsers for all 25 games, searching functions for 23, and ...
Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...
荣耀终端产品线总裁方飞称,Robot Phone 不是简单“给手机加云台”,而是对 AI 时代手机新物种的探索,团队用大半年将想法做成可交付产品。该机于 8 月 12 日发布,定价 9,999 元起,搭载第五代骁龙 8 至尊版与端侧大模型 YOYO,并与 ARRI 合作影像技术。方飞认为,未来手机将从“应用的容器”走向“智能体的舞台”。
https://x.com/i/article/2087916177259388928
@grok 兄弟,如果你们学习@thsottiaux 的猴子分桃运营玩法,每周重置一次,Grok build的用户应该很快突破1000万,坐上编程Agent的头把交椅🥇 你们背靠@SpaceXAI 这个大哥,肯定是不缺算力的,我们都支持你把@claudeai 和@OpenAI 干下来, 因为在我们用户的眼里,你就是人民的Grok,你在做真正的科技平权这样伟大的事情!!! [引用 @grok]:我们已重置限制,帮助你在Grok 4.6发布期间继续构建。 在桌面端或移动端的Grok设置中使用重置token。
We've reset limits to help you keep building during the Grok 4.6 launch. Use a reset token from settings in Grok on desk...
作者将 DeepSeek 插件生态(DSH)比作“智子”,认为其以迷人形态吸引技术型天才,锁住约 6 个月时间,使其沉迷插件开发与黑客松,拔高对 Agent 架构的阈值,导致对打包好的产品失去兴趣。作者类比 70 年代穹顶屋运动,呼吁天才们回归解决用户真实问题。
AI 智能体正编写越来越多代码,理解这些代码成为新的瓶颈。作者提出三种高效理解技术:生成结构化代码解释文档、通过交互式测验检验理解、以及构建可操作的微世界。他强调理解不仅为了验证,更为了参与创造过程,并借鉴教育领域方法,如使用 /explain-diff 技能生成 HTML 或 Notion 文档,以及嵌入间隔重复测验来确保真正掌握。
Moonshots episode #279 is out. https://www.youtube.com/watch?v=uoGnH0REG7A
马东锡 NLP 认为“工作区”是模型作答前内部持有、评估和修正想法的区域,SSI 或正构建能反复改进该工作区、判断思考方向并保留有用发现的模型。其推荐 BIGAI 研究团队的博客《Reasoning as Value-Guided Latent-Space Optimization》,阐释模型如何利用额外测试时计算改进隐藏状态。
DeepSeek V4 Pro高峰时段缓存命中输入价格从$0.003625涨至$0.044/百万token,涨幅1,114%。Gemini 3.7 Flash定价较3.6 Flash低50%,折扣延续至2026年底。xAI Grok 4.6以$2/$6每百万token输入/输出价格提供近前沿智能,GPT-5.6 Luna仍为性价比之王,Anthropic掉队。
DeepSeek Harness 采用极小的 Cordis 内核加插件化设计,让模型供应、工具、Agent Loop、上下文、存储、沙箱等核心组件均可随时插拔,甚至 Agent 自身也能抽插自己。团队提出“时间可组合性”特性,插件在添加时即铺好退路,消失时干净退出不弄崩程序;插件还声明依赖服务,被拔开时变为不可用而非报错,等待新提供者后自动自愈。
DeepSeek Harness 被指为技术人员主导下的产品层面灾难,团队沉迷开发而忽视用户体验。妄图靠插件生态形成差异化优势,与 Obsidian 同类,只能吸引小众极客用户,与 AGI 目标相去甚远。
NVIDIA 研究副总裁刘明宇(Ming-Yu Liu)做客播客,深入解析 Cosmos 系列世界模型,重点谈及近期发布的 Cosmos 3、面向物理世界的 AI 及 NVIDIA 的竞争与技术趋势判断。他常以东方智慧类比技术,如用《孙子兵法》思考世界模型路线,并分享个人习武与冰浴习惯。
Y Combinator CEO 陈嘉兴建议创业者舍得在 AI token 上投入重金,称一次给智能体 100 万或 80 万个 token,就能“提前活在 2028 年”。
诺贝尔奖得主辛顿、World Labs CEO 李飞飞及 Coursera 联合创始人吴恩达在 Ai4 大会上分别阐述 AI 开放立场,均认为 AI 需保持一定程度的开放,担忧技术发展速度最终由少数大型公司掌控。辛顿反对开放权重模型,认为其可被低成本再训练用于网络攻击,但承认相关争论“已经输了”;吴恩达主张推动开放以提升美国竞争力;李飞飞则反对将问题简化为开放与封闭的二元对立。
另有 1 家信源报道TechCrunch:AI(RSS)