Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

4,695条收录
554条精选

精选归档 · 第 21 页

401420 条 · 共 554

4月29日

星期三 · 4 条
20:00
Cursor Blog精选
AI 评分 75/100
使用 Cursor SDK 构建可编程智能体

Cursor 正式推出 SDK 公开测试版,开发者仅需几行 TypeScript 代码即可构建和部署智能体。该 SDK 提供与 Cursor 应用相同的运行时、框架及前沿模型(如 GPT-5.5)支持,并允许将智能体部署于本地或 Cursor 云的专用虚拟机。借助其生产级云基础设施,如安全沙箱和持久状态管理,智能体正从个人工具演变为组织的可编程基础设施。许多团队已将其集成至 CI/CD 流水线、工作流自动化及核心产品中。


推荐理由:Cursor 把自家产线拆出来给外部用,对于想把 AI 代理嵌入 CI/CD 或产品的团队,省掉了自建完整 agent 栈的麻烦,对做自动化编码的开发者是个必看的更新。
00:36
Claude:Blog(网页)精选
AI 评分 72/100
像培训新开发者一样引导Claude Code:来自17年开发的经验教训

华盛顿大学MacCoss实验室的Brendan MacLean将培训新开发者的方法论应用于Claude Code,以管理拥有70万行C#代码、持续开发17年的开源蛋白质分析软件Skyline。他通过创建独立的AI上下文仓库、编写CLAUDE.md引导文件以及设计“技能”模块(如调试技能),为Claude Code建立项目认知。该方法显著提升了开发效率:搁置一年的文件视图面板功能在两周内完成;CSS布局更新从依赖设计师变为不到一天实现。此外,Claude Code还自动化了2000多张教程图片的截图比对和每日测试报告生成,团队现在主要依靠它生成代码和脚本。


推荐理由:这不是又一篇 Claude Code 安利文,而是一个维护了 17 年 70 万行 C# 代码库的人,把带新人的方法论原封不动搬给了 AI,结果真管用。做 legacy 项目的人应该认真看他的 context 管理和 skill 库设计。

4月28日

星期二 · 8 条
23:35
阿绎 AYi@AYi_AInotes精选
AI 评分 71/100
优化CLAUDE.md:聚焦关键规则以提升AI协作效率这篇文章很顶很硬,墙裂推荐! 90%的人写CLAUDE.md的方式, 从第一行就错了。你写了三百行人格指令, 塞满了要做高级工程师, 要一步步思考这种废话, 结果Claude还是会猜错构建命令, 还是会重写整个文件,还是会犯你纠正过一百次的错误。真正有效的CLAUDE.md,从来都不是提示词垃圾桶。 它是项目级的绝对真理, 是给资深工程师的技术简报, 控制在六十到八十行以内, 多一个字都不要有。最核心的逻辑只有一个, Claude的注意力是稀缺资源。 系统提示本身已经占了五十条指令,你最多只剩一百条有效空间。超过两百行,后面的内容等于白写。正确的结构永远是这五部分, 缺一不可。第一,关键命令,明确写死build test lint用什么,避免它瞎猜浪费三轮对话。第二,架构地图,不用贴完整目录树,只要告诉它文件该往哪放。第三,硬性规则,这是最重要的一节。每条规则都要能回答,删掉这行Claude会不会犯错。多用大写的IMPORTANT和YOU MUST,负向规则永远比正向要求有用十倍。第四,工作流偏好,明确告诉它不要重写整个文件,不要生成多余的注释。第五,永远不要写Claude已经记住的东西,它有自己的项目记忆,重复只会稀释注意力。这可不是啥提示词技巧兄弟们, 叫LLM时代的注意力经济学更合适!你越聚焦,越具体,越明确什么不能做,Claude的输出就越精准。一个好的CLAUDE.md, 会随着项目复利增长, 第一个月帮你省重复沟通的时间, 第六个月它会自动防住所有历史上踩过的坑。它不是在调教一个助手,是在把你的技术品味和工程规范,固化成一个永远不会忘的资深搭档。兄弟们,赶紧去把你的CLAUDE.md砍到八十行以内,用每条规则能不能防止一个具体错误来审计一遍,效果会立竿见影。多数人编写的CLAUDE.md冗长无效,常因添加过多人格指令导致Claude仍会猜错命令或重写文件。有效的CLAUDE.md应是精炼的项目技术简报,控制在60-80行内。核心在于认识到Claude的注意力是稀缺资源,系统提示已占用部分容量。正确结构应包含:明确的关键命令、简洁的架构地图、强调禁止事项的硬性规则、清晰的工作流偏好,并避免重复AI已记忆的内容。这本质上是LLM时代的注意力经济学,通过具体、负向的规则能显著提升输出精准度。一份好的CLAUDE.md能随项目积累价值,节省沟通成本并固化工程规范。

darkzodchi: http://x.com/i/article/2048669343156781056


推荐理由:CLAUDE.md 写法这事门槛低但坑极多,这篇把「注意力稀缺」当核心逻辑来讲,比大多数 prompt 教程都更接近工程真相,用 Claude Code 的人读完直接砍文件就行。
20:35
阿绎 AYi@AYi_AInotes精选
AI 评分 75/100
OpenAI开源Symphony,Agent编排颠覆程序员工作方式OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn!全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。所有验证全过了,才会出现在你的Human Review队列里。以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。这可不是啥实验室概念,OpenAI自己已经这么干了。三个工程师,五个月,写了一百万行代码,0行人工写的。产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。GitHub地址评论区自取👇OpenAI开源代理编排器Symphony,将Linear、GitHub Issues等任务跟踪器转化为始终在线的Codex Agent调度系统。它突破了人类同时有效监督仅3-5个编码Agent的瓶颈,允许管理几十个Agent,实现自动编码、测试、交叉审查,并提交包含CI全绿和安全审查的证据包。所有验证通过后,任务才进入Human Review队列,使人类角色从微观监督转变为结果审查与指导。OpenAI内部已实践此模式,三名工程师五个月生成一百万行代码且零人工编写。未来核心竞争力在于设计让Agent可靠自主工作的环境,而非模型本身。Symphony是一个17k token的SPEC,可喂给任何编码Agent生成定制版本。

OpenAI Developers: 📣 What if every open issue had a Codex agent? That’s the idea behind Symphony, an open-source agent orchestrator for Co...


推荐理由:Symphony 把编码 Agent 从「你盯一个」变成「你管一群」,瓶颈从写代码转移到了设计规则和反馈回路,做工程管理的人该认真想想这个范式了。
12:33
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 70/100
一个用于编排的开源规范:Symphony

Symphony 是一个用于 Codex 编排的开源规范,能够将问题跟踪器转化为持续运行的智能体系统。该系统通过自动化任务协调与执行,显著提升工程团队的产出效率,同时减少开发者在不同任务间频繁切换带来的认知负担。其核心在于以标准化、可扩展的方式,将日常开发流程转化为由智能体持续驱动的工作流。


推荐理由:OpenAI 把 Codex 的编排层抽成开源规范,等于告诉所有做 coding agent 的团队,底层调度逻辑不用自己造轮子了。做 AI 编程工具的值得花半小时看架构思路。
08:31
Claude Code:GitHub Releases(RSS)精选
AI 评分 60/100
Claude Code v2.1.121 更新:新增功能、体验优化与内存泄漏修复

本次更新为 Claude Code 带来多项增强与修复。新增功能包括 MCP 服务器的 alwaysLoad 配置、claude plugin prune 命令以及 /skills 界面搜索框。用户体验方面,优化了全屏模式滚动、对话框键盘滚动和长 URL 点击体验。重点修复了处理多张图片或使用 /usage 命令时可能出现的数 GB 内存泄漏问题,并解决了 Bash 工具在工作目录被删除后失效等稳定性缺陷。此外,还改进了 MCP 服务器的错误重试机制和终端会话标题的本地化显示。


推荐理由:Claude Code 这版修了一堆让人抓狂的内存泄漏和崩溃问题,加上 alwaysLoad 和 plugin prune 两个实用功能,重度用户值得立刻升级,但对非用户来说只是例行迭代。
01:48
Xiaomi MiMo@XiaomiMiMo精选
AI 评分 71/100
小米开源MiMo-V2.5双模型,支持百万上下文与商用Xiaomi MiMo-V2.5 is now officially open-sourced! MIT License, supporting commercial deployment, continued training, and fine-tuning - no additional authorization required. Two models, both supporting a 1M-token context window : • MiMo-V2.5-Pro: built for complex agent and coding tasks, ranking No.1 among open-source models on GDPVal-AA and ClawEval • MiMo-V2.5: a native omni-modal model with strong agent capabilities A model's value isn't measured by rankings alone — it's measured by the problems it solves. Let's build with MiMo now! 🤗 Weights: https://huggingface.co/collections/XiaomiMiMo/mimo-v25 📄 Blog: https://mimo.xiaomi.com/index#blog小米正式开源MiMo-V2.5系列模型,采用MIT许可,支持商业部署、继续训练与微调。该系列包含两个支持100万令牌上下文窗口的模型:MiMo-V2.5-Pro专为复杂智能体和编码任务设计,在GDPVal-AA和ClawEval基准测试中位列开源模型第一;MiMo-V2.5则是具备强大智能体能力的原生全模态模型。官方强调,模型的价值不仅在于排名,更在于其解决实际问题的能力,并已公开模型权重与技术博客。

推荐理由:小米把 MiMo-V2.5 直接 MIT 开源且支持商用,1M 上下文 + Agent 能力在开源阵营里确实能打,做 Agent 产品的团队值得花半小时跑一下 benchmark 看看真实水平。

4月27日

星期一 · 2 条
23:58
GitHub Blog精选
AI 评分 79/100
GitHub Copilot 将转向基于使用量的计费模式

自6月1日起,GitHub Copilot 的使用将开始消耗 GitHub AI Credits,计费模式正式从固定订阅制转变为基于实际使用量的计费。这一变化意味着用户的费用将与 AI 助手的具体调用量直接挂钩,而非统一的月费或年费。


推荐理由:GitHub Copilot 从订阅制转向按量计费,这是 AI 编程工具定价范式的标志性拐点,所有重度用户和竞品都得重新算账。
01:54
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 71/100
为什么 SWE-bench Verified 不再衡量前沿编码能力

OpenAI宣布停止使用SWE-bench Verified基准评估前沿编码能力。该基准基于GitHub历史问题构建,其任务分布已无法准确反映当前AI编码助手需解决的实际问题类型。随着模型性能提升,基准测试集趋于饱和,区分度下降,现有模型表现已接近人类水平。因此,团队将转向更具挑战性和现实复杂度的新评估方法。


推荐理由:OpenAI 亲自给 SWE-bench Verified 判了死刑,这比任何第三方评测都有说服力。做 coding agent 选型的人该认真想想,你的 benchmark 体系是不是也该换了。

4月25日

星期六 · 2 条
03:12
Greg Brockman@gdb精选
AI 评分 75/100
GPT-5.5正式登陆GitHub Copilotgpt-5.5 is now in GitHub Copilot!gpt-5.5 现已登陆 GitHub Copilot! 【引用 @github】:🆕 @OpenAIDevs GPT-5.5 现已全面推出,并正在 GitHub Copilot 中逐步上线。 我们的早期测试显示 ➡️ 它在复杂的智能体编码任务上表现出最强的性能 ➡️ 它解决了以往 GPT 模型无法应对的实际编码挑战 请在 Copilot CLI 或 @code 中试用。👇 https://github.blog/changelog/2026-04-24-gpt-5-5-is-generally-available-for-github-copilot/

GitHub: 🆕 @OpenAIDevs GPT-5.5 is now generally available and rolling out in GitHub Copilot. Our early testing shows ➡️ It deliv...


推荐理由:GPT-5.5 进 Copilot 不是模型发布那么简单,它意味着最强编码模型第一次以默认选项塞进每个开发者的 IDE 里,做 coding agent 的团队该重新跑一遍自己的 benchmark 了。
03:12
Greg Brockman@gdb精选
AI 评分 72/100
GPT-5.5性能大幅提升正式推出gpt-5.5 is a big step up in performance, give it a try:gpt-5.5 在性能上实现大幅提升,试试看吧:

Satya Nadella: Super excited GPT-5.5 is rolling out to GitHub Copilot, M365 Copilot, Copilot Studio, and Foundry today. With deeper rea...


推荐理由:GPT-5.5 本身是代际级更新,但这条推文只是转发 Nadella 的官宣,没有新数据或新角度。真正值得关注的是它已经铺进 Copilot 全线,做编码和办公场景的人今天就能摸到。

4月24日

星期五 · 3 条
20:00
OpenRouter:Announcements(RSS)精选
AI 评分 67/100
使用Agent SDK搭建自定义编码智能体

OpenRouter Agent SDK 提供 create-agent-tui 和 create-headless-agent 两种技能,可在几分钟内脚手架搭建个性化编码智能体。前者附带终端 UI,后者为无头模式,适用于脚本与管道自动化场景。

另有 1 家信源报道OpenRouter:Announcements(RSS)
推荐理由:虽然隔了一个多月,但这个官方教程把 Agent SDK 的脚手架玩法拆得很透,想自己搭 coding agent 的开发者抄一遍就能跑起来,省得从头写 harness。
08:13
Claude Code:GitHub Releases(RSS)精选
AI 评分 56/100
Claude 代码工具 v2.1.119 版本更新

Claude 代码工具发布 v2.1.119 版本,带来多项功能优化与问题修复。主要更新包括:用户配置现持久化至本地文件;新增 prUrlTemplate 设置以自定义 PR 徽章链接;--from-pr 命令扩展支持 GitLab、Bitbucket 等多个平台。工具权限与交互行为在多处实现统一,例如 --print 模式现在遵从代理的前置元数据定义。界面体验获得改进,如斜杠命令建议会高亮匹配字符,长描述自动换行。此外,本次更新修复了大量已知问题,涉及粘贴格式错乱、工具意外隐藏、MCP 服务器连接失败、权限模式行为异常及界面显示错误等。


推荐理由:Claude Code 这次更新全是打磨细节,没有大功能但修了一堆让人骂娘的 bug,重度用户值得升级,其他人等下一个大版本也行。
04:21
Ethan Mollick:One Useful Thing(RSS)精选
AI 评分 77/100
未来的标志:GPT-5.5

OpenAI 发布了新一代模型 GPT-5.5。其上下文窗口从 GPT-5 的 128K 大幅扩展至 512K,推理速度提升约 40%,在多模态理解与代码生成基准测试中表现显著超越前代。模型在复杂指令遵循和长文档处理方面能力突出,同时 API 调用成本降低了 30%。这一升级被视为通向通用人工智能(AGI)道路上的一个重要里程碑。

另有 2 家信源报道Hacker News 热门(buzzing.cc 中文翻译)OpenAI:官网动态(RSS · 排除企业/客户案例)
推荐理由:Ethan Mollick 拿 GPT-5.5 压测了论文写作和游戏设计,代际提升肉眼可见,但锯齿前沿仍未消失。这篇一手实测告诉你当前能力的天花板和暗角,比任何官方博客都值得看。