BestBlogs 早报 · 07-23
OpenAI Presence / 软件工厂 / 产品意图 / NVIDIA Rubin / Agent 授权
【1】 ★ 精讲|软件工厂的光与暗 这篇长文把软件工厂拆成 loop、harness 与 factory 三层,并指出生成能力扩张后,稀缺资源变成了可验证的判断。作者以连续四个月无人读代码的自动化实验为警示:测试全绿也可能积累理解债务;更可靠的做法是把人类判断前移到产品、架构和高风险审查节点。 来源:Elevate https://www.bestblogs.dev/article/af0c1e1da0
【2】 ★ 精讲|为什么宏大的创业构想反而更容易推销:PostHog 谈 AI 原生公司 【视频】 PostHog 在 YC 对谈中把目标从产品分析推进到自驱软件:综合工单、日志、错误和会话记录发现问题,部分场景已能生成修复 PR。访谈同时给出关键约束--Agent 必须理解产品意图、用户与规则,否则只会堆叠局部功能;宏大叙事也要建立在清晰的上行空间和真实用户反馈上。 来源:Y Combinator https://www.bestblogs.dev/video/91cc2b65b
【3】 ★ 精讲|OpenAI Presence:面向企业的受控 AI Agent 平台 OpenAI 推出的 Presence 面向企业语音与聊天 Agent,把策略、护栏、升级规则、模拟评测和 Codex 改进闭环组合成可控部署系统。其自有电话支持已能独立解决 75% 的来电问题,并在 10 天内把人工转接率降低 15 个百分点,但目前仅向符合条件的企业限量开放。 来源:OpenAI News https://www.bestblogs.dev/article/2d0bc261e9
【4】 TMAP 平台图生视频推理加速实践 TMAP 平台通过多卡并行、SageAttention 量化、混合精度线性层量化及自研 DPCache 缓存,在无损视频质量前提下实现 4.87× 推理加速,单次成本低于 0.15 元/秒。 来源:大淘宝技术 https://www.bestblogs.dev/article/6e0d73424c
【5】 http://monday.com 如何在 Amazon Bedrock 上运行生产级 AI Agent 对 http://monday.com 生产级 AI 代理架构的技术深度剖析,详细说明他们如何使用 Amazon Bedrock 和自定义工程 'harness' 来实现自主软件开发。 来源:AWS Artificial Intelligence https://www.bestblogs.dev/article/52d606a18b
【6】 更好的智能体授权:交付权限,而非你的凭证 【视频】 本次分享将智能体授权定义为委托:为每个 AI 智能体赋予独立身份和严格限定的能力,而不是把用户凭证直接交给它。 来源:AI Engineer https://www.bestblogs.dev/video/b089a049a
【7】 3 年的 LangGraph 图工程经验 本文总结了三年构建 LangGraph 的经验,阐述了如何将智能体系统表示为图,在确定性控制与 LLM 灵活性之间取得平衡,并分享了实际教训。 来源:LangChain Blog https://www.bestblogs.dev/article/c7b5af918f
【8】 深入解析 NVIDIA Rubin GPU 架构:赋能智能体 AI 时代 本文详解 NVIDIA Rubin GPU 架构,旨在每单位能耗提供多达 Blackwell 10x 的智能体 AI 推理吞吐量,采用 HBM4 内存、高级 Tensor Cores 以及面向长上下文和可扩展推理的创新技术。 来源:NVIDIA Technical Blog https://www.bestblogs.dev/article/9d00575753