Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

4,695条收录
554条精选

精选归档 · 第 19 页

361380 条 · 共 554

5月11日

星期一 · 1 条
22:30
OpenRouter@OpenRouter精选
AI 评分 76/100
帕累托代码以市场需求重塑模型选择Pareto Code is a new way of looking at the Pareto frontier using real market demandDeepSeek V4 Pro is taking the top position, followed by GPT 5.4 Mini and Gemini 3.1 Pro https://openrouter.ai/openrouter/pareto-codePareto Code 是一种利用真实市场需求观察帕累托前沿的新方法 DeepSeek V4 Pro 占据首位,其次是 GPT 5.4 Mini 和 Gemini 3.1 Pro https://openrouter.ai/openrouter/pareto-code

OpenRouter: Introducing Pareto Code: a new, free, experimental coding router Set `min_coding_score` in your request and route to the...


推荐理由:OpenRouter 这个实验性路由把模型选型从靠直觉变成了实时市场驱动的自动化决策,对预算敏感又看重编码质量的项目来说,是个值得一试的免费工具。

5月9日

星期六 · 4 条
05:47
Simon Willison 博客精选
AI 评分 71/100
Claude Code实践:HTML输出格式的卓越效果

Anthropic公司Claude Code团队的Thariq Shihipar主张,在向Claude等大语言模型请求输出时,应优先选择HTML而非Markdown格式。HTML允许模型直接生成包含SVG图表、交互式组件和页面内导航等丰富元素的文档,显著提升信息呈现的交互性与清晰度。作者以GPT-5.5生成一个Linux安全漏洞的交互式HTML解释页面为例,展示了该方法的实际效果。这促使长期习惯使用Markdown的作者重新评估输出格式,并计划在提示工程中更多尝试富HTML输出。


推荐理由:Simon 拿自己实验打脸 Markdown 惯性,HTML 输出能自动带 SVG 图表和交互导航,所有还在用纯文本解释复杂代码的人都该换个思路。
03:43
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 63/100
在OpenAI安全运行Codex

OpenAI通过沙盒隔离、人工审批流程、严格网络策略与原生代理遥测四层防护机制,确保Codex代码生成模型的安全运行。沙盒环境完全隔离执行代码,所有生产请求需经人工审核批准,网络策略限制外部依赖访问,实时遥测系统监控代理行为异常。该安全框架使企业能够合规采用AI编程助手,在保障代码安全性的同时维持开发效率。


推荐理由:OpenAI 公开了内部安全运行 Codex 的完整流程,从沙箱隔离到审批策略,企业落地 AI 编码的可以直接拿去抄作业。
03:40
Cursor Blog精选
AI 评分 67/100
Bugbot团队与个人计划更新

Bugbot宣布将团队与个人计划从每月每席位40美元的订阅制改为按使用量计费。现有用户的变化将于2026年6月5日后的下一个账单周期开始生效,例如2026年5月购买的年订阅将在2027年5月切换。团队按需消费计费,个人按包含使用量计费,平均每次运行成本约为1.00-1.50美元,具体取决于PR大小和复杂度。同时,用户现在可配置Bugbot审查PR的工作强度:默认强度下80%被识别的问题在合并时得到解决;高强度模式下可多发现35%的问题,解决率仍保持在80%。现有客户可在Cursor面板中提前切换至用量计费。


推荐理由:Cursor Bugbot 这次改用量计费对个人和小团队更友好,一次审查平均只要 1-1.5 美元,而且高努力模式能多抓 35% 的 bug,代码审查工具可能要变天了。
01:24

5月8日

星期五 · 3 条
08:30
Claude Code:GitHub Releases(RSS)精选
AI 评分 69/100
Claude v2.1.133 版本更新

Claude 发布 v2.1.133 版本,新增多项配置与优化。主要新增 worktree.baseRef 设置以选择工作树分支基础,引入 sandbox.bwrapPath 等设置允许指定自定义二进制路径,并添加 parentSettingsBehavior 键供管理员控制设置合并策略。功能上,钩子现在可接收活动努力级别信息,Bash 工具命令可读取相应环境变量。此外,改进了焦点模式行为,并在内存压力下优化了后台工作进程的释放。本次更新修复了大量问题,包括并行会话死锁、权限规则误匹配、代理设置不生效、网络驱动器访问被拒、远程控制中断不彻底、努力级别跨会话更改以及子代理技能发现失败等。claude --help 现已列出远程控制选项,VSCode 扩展也修复了相关错误。


推荐理由:Claude Code 这个版本修了一堆让人抓狂的 bug,并行会话掉认证、网络驱动器权限、子代理找不到 skill 都解决了,重度用户应该尽快升级。
03:30
GitHub Blog精选
AI 评分 79/100
Agent pull requests 无处不在:如何审查它们

这份指南提供了审查由AI代理生成的pull requests的实用方法,重点包括审查时应关注的代码变更点、问题常见隐藏位置(如逻辑错误或安全漏洞),以及如何在代码合并前捕捉技术债务。它通过具体步骤帮助开发者系统评估自动化提交,确保代码质量,避免缺陷流入生产环境。指南强调主动审查策略,以应对AI代理在软件开发中日益普及的趋势。


推荐理由:AI代理生成的PR越来越多,审查它们不再是可选项。这篇官方指南从发现隐患到控制技术债务,给出了马上能用的检查清单,每个用Copilot的开发者都该看。

5月7日

星期四 · 3 条
22:59
Google DeepMind:Blog(RSS)精选
AI 评分 66/100
AlphaEvolve:我们由Gemini驱动的编程智能体如何跨领域扩展影响力

AlphaEvolve推出了基于Gemini大模型的编程智能体,其算法正驱动多个领域产生实际影响。该智能体在商业流程、基础设施优化与科学研究三个关键领域实现规模化应用,通过自动化代码生成与问题解决提升效率。具体实践表明,它能显著加速开发周期并处理复杂任务,标志着AI编程助手从辅助工具向核心生产力引擎的演进。


推荐理由:DeepMind这次不只是秀参数,AlphaEvolve用Gemini驱动编码代理,已经开始在工业设计和科学发现里产生真实影响了,做自动化的可以盯着看。
05:30
GitHub Blog精选
AI 评分 56/100
Validating agentic behavior when "correct" isn't deterministic

GitHub 探讨如何为 Copilot 编码智能体构建“信任层”。文章提出,在“正确”答案非确定性的场景下,可通过领域分析来验证智能体的自主行为,避免使用脆弱的脚本或黑盒判断。该方法旨在提升 AI 编码助手的可靠性与透明度,确保其行为符合预期标准。


推荐理由:做coding agent最头疼的就是如何验证产出质量,GitHub这篇把他们的内部方法论开源了,用dominance分析替代脆弱的脚本,对正在折腾AI编程工具的团队是实打实的参考,值得逐帧学习。

5月6日

星期三 · 6 条
23:08
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 65/100
前沿企业如何构建人工智能优势

OpenAI的B2B Signals研究揭示了前沿企业深化AI应用、规模化基于Codex的智能体工作流,并构建持久竞争优势的路径。这些企业正超越基础应用,将AI深度集成至核心业务流程,通过部署能自主执行复杂任务的智能体工作流来提升效率与创新能力。研究指出,成功的关键在于规模化应用AI代理,这能带来显著的运营优势并形成竞争壁垒。


推荐理由:OpenAI的B2B研究把企业AI落地差距摊开了,Codex驱动的代理工作流正在成为壁垒,做企业服务的可以当镜子照。
22:29
Simon Willison 博客精选
AI 评分 77/100
编程模式界限模糊:从"感觉编码"到"代理工程"的融合与隐忧

作者在访谈中反思,曾严格区分的两种AI编程模式——“感觉编码”(不审查代码)与“代理工程”(专业工程师构建高质量系统)——其界限在实践中正迅速模糊。随着Claude等编码代理可靠性提升,作者发现自己即使在生产级项目中也不再逐行审查AI生成的代码,转而将其视为可信的“半黑箱”。这带来了新的责任困境:AI缺乏职业声誉却持续产出正确代码,可能导致“偏差正常化”风险,即每一次成功都可能在不当时刻埋下隐患。同时,AI生成代码的便捷性也使得评估软件质量的传统指标(如提交次数、测试覆盖)不再可靠。


推荐理由:Simon 坦诚自己在生产级开发中也开始‘不看代码就信任 Claude Code’,这个伦理困境是每个 AI 编程工具使用者都绕不开的一课,他的思考比大多数评测都更能帮你定位自己的信任边界。
22:16
IT之家(RSS)精选
AI 评分 71/100
豆包大模型家族首款全模态理解模型:字节跳动 Doubao-Seed-2.0-lite 升级

字节跳动火山引擎发布豆包大模型家族首款全模态理解模型 Doubao-Seed-2.0-lite 升级版。该模型原生统一支持视频、图像、音频和文本理解,并能进行跨模态联合推理,在物理、医疗等学科推理及细粒度感知上表现超越此前Pro版本。音频方面支持19种语种转写及多语种互译,多项基准测试优于Gemini-3.1-Pro。同时,其Agent、Coding与GUI能力升级,能更稳定处理长任务、胜任深度开发,并实现界面理解与操作执行的闭环。新版本已在火山方舟上线,旨在为企业提供高性价比的全模态任务部署方案。


推荐理由:豆包Seed 2.0 lite把视频、音频、图片、文字原生塞进一个模型,还顺手强化了Agent和GUI操作,对需要全模态处理的企业来说,这可能是目前性价比最高的选择。
18:16
阿绎 AYi@AYi_AInotes精选
AI 评分 79/100
这个创造了Claude Code的男人Boris Cherny大神,完整公开了自己的工作流,并直播演示了一半的编码工作在手机上完成🤪这个创造了Claude Code的男人Boris Cherny大神,完整公开了自己的工作流,并直播演示了一半的编码工作在手机上完成🤪不是回消息,是同时跑5到10个Claude实例, 用手机启动任务,去喝咖啡,回来代码写好了🤣他刚公开了自己的完整工作流,看完之后我发现, 核心就三件事,但每一件都跟大多数人的直觉相反:第一,永远选最贵最聪明的模型 听着像烧钱,实际上反过来,聪明模型一次想清楚,笨模型来回试错烧掉的token远超差价。 他的原话:"计划做得好,代码自然好。"第二,整个团队维护一个纯文本知识库 不是Notion,不是花哨的文档系统,就是一个txt文件。Claude每犯一次错,记一笔,每周更新好几次,这个文件就是团队的长期记忆,Claude不会在同一个地方摔倒两次。第三,永远让Claude看到自己代码的运行结果 能跑代码,能看浏览器渲染, 他的比喻很准:"你让一个画家蒙着眼睛画画, 画完不让他看,然后怪他画得丑?"他的清晨流程:醒来,手机上启动三个任务, 该干嘛干嘛,晚点回来检查。规划模式起步 → 敲定计划 → 自动接受修改 → 完成多个Claude实例,一个周密计划,一个共享知识库,没了。Boris Cherny公开其高效AI编码工作流,核心基于三点反直觉原则:1. 坚持使用最昂贵、最聪明的模型(如Claude),因其能一次性清晰规划,避免笨模型反复试错消耗更多token;2. 团队仅维护一个纯文本知识库文件,记录Claude的每次错误并每周更新,形成长期记忆;3. 始终让Claude查看自身代码的运行结果(包括执行和渲染)。其工作模式是在手机上并行启动多个Claude实例,基于规划模式制定方案后自动执行修改,从而高效完成任务。

推荐理由:Boris Cherny 的 Claude Code 工作流是「反直觉但真能省钱省时间」的实操手册,三条原则每一条都可以抄进团队规范,看完立刻能上线。
18:16
IT之家(RSS)精选
AI 评分 71/100
让 AI 检查软件卡顿问题,Qt 推出智能体代码分析技能

Qt集团近日推出一项名为QML分析器的AI智能体开发技能。该技能可将2D Qt Quick应用程序的代码性能分析工作委托给AI智能体,使其能够诊断渲染、逻辑及内存相关问题。当面对界面卡顿或帧率下降等性能投诉时,AI可借助此技能进行分析并生成详细的性能瓶颈报告。目前该技能仅适用于2D Qt Quick应用,已在GitHub Copilot、Claude桌面版及CLI等环境中完成测试,与Claude Sonnet 4.6、GPT 5.4和Gemini 3.1 Pro等主流大模型搭配使用时效果最佳。


推荐理由:Qt 开发者能立刻用上的 AI 性能分析技能,开源且支持主流编程助手,排查卡顿不用再纯手工。非 Qt 用户可以直接略过。