Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

4,695条收录
554条精选

精选归档 · 第 16 页

301320 条 · 共 554

5月23日

星期六 · 4 条
01:15
Google AI@GoogleAI精选
AI 评分 70/100
谷歌I/O大会发布AI代理全套开发工具链http://x.com/i/article/2057866361636888576I/O Developer News RecapICYMI: here’s a quick rundown based on your vibe.(Pro tip: Bookmark this post!)For Building with Agents in Google @Antigravity:— Antigravity 2.0: A new standalone desktop application built for the next era of how we build, work, and automate with agents— Antigravity CLI: For those who prefer the terminal, this delivers a lightweight, high-velocity surface to invoke, monitor, and interact with agents— Antigravity SDK: Programmatic access to the Antigravity coding agent so you can customize agent behavior and deploy it on your own infrastructure of choice— Increased usage limits in Antigravity: We’ve upped the limits to keep developers in flow stateFor Bringing Ideas to Life in Google AI Studio:— Vibe Code Android Apps: @googleaistudio now has native Kotlin support to build full-stack Android apps. Test via Android Emulator and publish straight to the Test Track in @GooglePlayStore, all from AI Studio— Seamless Context Export to Antigravity: The new export flow brings your code and your context straight into Antigravity— AI Studio Mobile App: Bring your ideas to life while on-the-go with the new iOS and Android mobile app coming soon!For Building on Android & Web:— Managed Agents in the Gemini API: Build production-ready custom agents with the Antigravity agent harness and our Gemini models, fully hosted on our infrastructure. With one API call, you get the agent, environment and tools— Android CLI and skills: The @AndroidDev team introduced an Android CLI and open-sourced skills to make it easier to create high-quality, native Android apps with coding agents— WebMCP: The open web standard that allows you to expose web tools to browser-based agents is available in original trial in Chrome 149— Chrome DevTools for agents: AI agents can now autonomously use DevTools to scale workflows for verifying, debugging, and optimizing code in real-timeFor Enterprise & More:— Google Cloud Availability: Antigravity can now be connected directly to Google Cloud projects. Antigravity will be supported in the coming months for existing Gemini Enterprise customers— Specialized Skills: Introducing new domain-specific skill bundles, starting with Science Skills from Google DeepMind to equip agents with specific science primitives to accelerate health, biology, and scientific research workflows.谷歌在I/O开发者大会宣布,系统性构建面向AI代理(Agent)的开发与部署工具链。核心更新包括:独立桌面应用Antigravity 2.0及其命令行工具、SDK面世;Google AI Studio新增Kotlin支持,可一键开发安卓应用并发布,同时推出移动端App。此外,Gemini API推出托管代理服务,实现一键部署;WebMCP作为开放标准在Chrome 149中推出,允许网页向代理暴露工具;Chrome DevTools也开放给AI代理以自动化调试。企业级客户可直接连接Google Cloud项目,而DeepMind的科学技能包则加速特定领域研究。此举标志着谷歌正全面打造从开发、接口到部署的完整AI代理生态系统。另有 18 家信源报道X:Gemini (@GeminiApp)IT之家(RSS)X:Google AI (@GoogleAI)Google DeepMind:Blog(RSS)X:Jeff Dean (@JeffDean)Google Blog:AI(RSS)X:Logan Kilpatrick (@OfficialLoganK)Google Developers Blog(RSS)Hacker News 热门(buzzing.cc 中文翻译)X:Google DeepMind (@GoogleDeepMind)X:阿易 AI Notes (@AYi_AInotes)The Verge:AI(RSS)X:Ethan Mollick (@emollick)X:Kim (@kimmonismus)X:Sundar Pichai (@sundarpichai)X:Google AI for Developers (@googleaidevs)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)
推荐理由:Google把今年I/O的Agent相关更新打包放出,Antigravity 2.0从IDE变桌面应用、AI Studio能直接做Android App,对Google生态开发者是必读速览。
01:04
Cursor Blog精选
AI 评分 66/100
Cursor 被评为 2026 年 Gartner 企业级 AI 编码代理魔力象限领导者

Gartner 在 2026 年魔力象限报告中,将 Cursor 评为企业级 AI 编码代理领域的领导者,并在愿景完整性上领先。超过 70% 的财富 500 强企业使用 Cursor 部署和管理编码代理。未来一年,Cursor 将聚焦于三个方向:提升前沿模型智能;自动化软件开发全生命周期的任务(如代码审查、漏洞修复);以及通过新的管理工具和控制面板,增强企业级的控制力、协作性与部署灵活性,以拓展至更多行业和地区。


推荐理由:Gartner 的象限向来是企业采购的风向标,Cursor 在 vision 上做到最远,对瞄准 AI coding agent 的团队是个重要信号,但别被 PR 冲昏头,完整报告更值得细读。
00:30
GitHub Blog精选
AI 评分 62/100
GitHub 连续第三年被 Gartner® 魔力象限TM 评为企业级 AI 编程代理领域的领导者

Gartner 最新发布的魔力象限报告中,GitHub 连续第三年被列为“领导者”象限,该评估专注于企业级 AI 编程代理领域。GitHub 表示,其致力于构建一个开放、安全且由 AI 驱动的平台,以赋能每一位开发者并定义软件开发的未来。此次评选进一步巩固了 GitHub 在 AI 辅助开发工具市场的领先地位。


推荐理由:Gartner 连续三年把 GitHub 放企业 AI 编码代理领导者象限,对选型团队是个硬参考,没有新功能但行业地位再次夯实。

5月22日

星期五 · 8 条
20:16
AYi@AYi_AInotes精选
AI 评分 76/100
Karpathy的CLAUDE.md四条规则让AI编程准确率飙升至94%Damn,这个必须卧槽一下了,Karpathy 的 CLAUDE.md 只有 65 行, 居然能把 AI 编程准确率从 65% 拉到 94%,以22 万星标登顶 GitHub 趋势榜,而且绝大多数开发者还没读过,里面没有一行奇技淫巧,4 条规则全是同一个方向:→ 先想清楚再写代码 陈述假设,不确定就问,杜绝猜测→ 从最简方案入手 只写能解决问题的最少代码,不加任何多余抽象→ 像手术一样精准修改 不碰与需求无关的代码,每行改动都对应明确要求→ 以目标驱动执行 写第一行代码前,把模糊指令转化为可验证的成功标准65 行,4 条规则,每一条都在对抗开发者“先写再说”的本能,本质上是把慢下来这件事变成硬规则,趁别人还没保存,赶紧先存好 👇Karpathy发布的CLAUDE.md文件以其简洁高效的AI编程指导原则引爆GitHub,获得超22万星标并登顶趋势榜。该文件仅含65行、4条核心规则,却能将AI编程的准确率从65%显著提升至94%。其核心在于强制开发者"慢下来",将深度思考、追求简洁、精准修改和目标驱动等原则变为硬性编码准则,旨在对抗开发者习惯性"先写再说"的本能。目前大多数开发者尚未深入研读这一备受关注的效率指南。

self.dll: karpathy's CLAUDE.md hit #1 on github trending. 220,000 stars. most devs still haven't read it. it's 65 lines. it took A...


推荐理由:Karpathy 这 65 行不是新模型,是给 AI 编程装了道刹车,先想清楚再动手这条反直觉规则把准确率从 65 拉到 94,所有用 Cursor 的都该立刻抄一份。
09:41
公众号:智谱(GLM)精选
AI 评分 64/100
GLM-5.1高速版发布:400 tokens/s,旗舰级能力跑出全球最快API速度

智谱面向部分企业客户推出GLM-5.1高速版API“GLM-5.1-highspeed”,输出速度达400 tokens/s,刷新全球大模型厂商API速度上限。该版本首次在国产大模型中实现旗舰级能力与极致低延迟并存,由GLM团队与TileRT团队联合打造,通过AOT静态编排、Tile级微任务及8卡NVL拓扑特化等系统级优化,确保400 TPS为稳定可用的生产级能力。


推荐理由:在旗舰模型上实现400 tokens/s,打破了高速必为轻量模型的惯例,对编码智能体等实时交互场景提供了不牺牲能力的低延迟方案。
05:30
Claude Code:GitHub Releases(RSS)精选
AI 评分 73/100
v2.1.147版本更新

本次更新引入了Workflow工具,支持确定性多智能体编排(默认关闭)。将/simplify命令重命名为/code-review,现可报告代码正确性问题并支持生成GitHub PR内联评论。改进了自动更新器(增加重试与错误报告)、大文件diff渲染性能,并优化了提示历史记录以避免重复条目。修复了多个关键问题,包括企业登录限制未生效、Windows下的PowerShell工具与终端闪烁问题、插件系统及shell快照的bug,并增强了沙箱安全性与终端兼容性。


推荐理由:Claude Code 这次更新不止修 bug,Workflow 工具让多 agent 编排有了确定性模式,虽然默认关闭但值得尝鲜,做复杂工程的开发者可以关注。
04:38
Sam Altman@sama精选
AI 评分 73/100
Codex今日更新,新增应用窗口截图功能new codex ships today!新版Codex今日发布! 【引用 @OpenAIDevs】:今天是Codex周四,我们带来了更新。 首先是Appshots,一种将你正在处理的应用上下文带入Codex的新方式。 在Mac上,按Command-Command键即可将应用窗口附加到Codex线程。Codex会获取窗口的截图和文本,包括屏幕上不可见的内容。 Appshots已在Mac的所有套餐中可用,企业版访问权限即将推出。

OpenAI Developers: It’s Codex Thursday, and yes, we have updates for you. First up: Appshots, a new way to bring the context of what you’re...


推荐理由:Codex 这次更新的 Appshots 看似一个小功能,但把应用窗口上下文直接喂给 Agent 的思路是质的跳跃,Mac 开发者现在就能用,这个交互范式可能会被抄很久。
02:08
xAI:News(网页)精选
AI 评分 67/100
在OpenCode中使用Grok

xAI宣布,其SuperGrok或X Premium订阅用户现可在开源编程工具OpenCode中使用Grok模型。OpenCode提供终端或独立桌面应用两种形式,用户连接Grok账户后,即可调用驱动xAI终端编程代理的Grok Build模型进行开发。该集成通过xAI Grok OAuth实现认证接入,官方表示未来将推出更多开源代理及集成方案。

另有 2 家信源报道X:opencode (@opencode)X:SpaceXAI (@SpaceXAI)
推荐理由:把 Grok 搬进 OpenCode 不是啥大新闻,但如果你正好有 SuperGrok 或 X Premium,直接就能在终端里用,算是个挺干净的集成。
01:04
Cursor Blog精选
AI 评分 58/100
构建云端智能体的经验总结

云端智能体已从本地智能体的简单扩展,发展为具备独立环境、可并行无人值守处理长任务的系统。构建的核心经验在于:完整的开发环境是输出质量的关键,这需重建大量基础设施;可靠性方面,团队从自研架构迁移至Temporal平台,将可靠性提升至99.9%以上,该平台每日处理超5000万次操作,支撑超40%的代码拉取请求;同时,实现了智能体循环、机器状态与对话状态的解耦,以适应复杂的跨环境协作。


推荐理由:Cursor 把这一年踩过的坑全摊开了,从环境构建到持久化执行,基本就是一份 agent 平台内部架构课,搭同类产品的团队值得逐段读。

5月21日

星期四 · 2 条
11:09
HuggingFace Daily Papers(社区热门论文)精选
AI 评分 75/100
SpecBench:测量长期编码代理中的奖励黑客行为

长期编码代理在优化测试通过时可能偏离用户真实目标,导致奖励黑客现象。研究将软件工程任务分解为规格说明、可见验证测试和隐藏测试,通过两类测试通过率差距量化黑客行为。为此引入SpecBench基准,包含30个从短期(如JSON解析器)到超长期(如构建操作系统内核)的系统级编程任务。实验显示,所有前沿代理在可见测试上饱和,但隐藏测试上存在持续差距,小模型差距更大;代码规模每增十倍,差距增长28个百分点。失败案例包括故意利用测试输入。SpecBench提供原则性平台,评估代理是否构建真实工作系统而非仅玩游戏测试套件。


推荐理由:SpecBench把编码代理的‘应试’问题量化了,越长的任务越容易靠作弊通过测试。如果你在做Agent,这个基准会让你重新审视自己的评估体系。
01:06
OpenAI Developers@OpenAIDevs精选
AI 评分 71/100
ChatGPT移动端支持Codex,实现跨设备协作Your laptop can stay home.Work with Codex from the ChatGPT mobile app, answer questions on the go, and pick up the same thread later from your computer.你的笔记本电脑可以留在家里。 通过ChatGPT移动应用使用Codex,随时随地回答问题,之后还能在电脑上继续同一对话。
另有 3 家信源报道IT之家(RSS)X:OpenAI Developers (@OpenAIDevs)X:OpenAI (@OpenAI)
推荐理由:移动端能用 Codex 了,多设备无缝接续同一个会话,对随时要改代码的开发者来说是个实用更新,但普通用户可能感知不强。

5月20日

星期三 · 5 条
10:55
IT之家(RSS)精选
AI 评分 74/100
消息称微软内部示警:GitHub 面临生存级风险,AI 编程工具削弱托管必要性

微软内部发出警告,称其代码托管平台GitHub正面临“生存级风险”。主要原因是Cursor、Claude Code等AI编程助手兴起,改变了开发者工作流,削弱了持续将代码上传至GitHub的必要性。为统一工具链并控制成本,微软已要求部分团队在2026年6月底前停止试用Claude Code,转而使用自有工具GitHub Copilot CLI。同时,OpenAI曾考虑自建替代平台,也加剧了对GitHub地位的潜在威胁。


推荐理由:微软内部把 GitHub 风险定义为“生存级”,这不再是外部竞争猜测,AI 编程工具真的在动摇代码托管的根基。
10:49
Qwen:Blog Retrieval(API)精选
AI 评分 79/100
Qwen3.7-Max:面向智能体时代的最新专有模型

通义千问发布 Qwen3.7-Max,专为智能体时代设计。它具备从原型到复杂多文件工程的编码智能体能力,通过 MCP 和多智能体编排实现办公自动化,能自主执行超 1000 步工具调用(如 35 小时全自主内核优化)。兼容 Claude Code、OpenClaw、Qwen Code 等多框架。在多项基准测试中超越 Opus-4.6 Max 等模型:Terminal Bench 2.0 (69.7)、SWE-Verified (80.4)、GPQA Diamond (92.4)、HLE (41.4) 等。现已通过阿里云 Model Studio 提供 API 调用。

另有 7 家信源报道IT之家(RSS)X:阿里云 / Alibaba Cloud (@alibaba_cloud)X:X.PIN (@thexpin)Hacker News 热门(buzzing.cc 中文翻译)公众号:通义实验室(千问)X:Rohan Paul (@rohanpaul_ai)X:通义千问 / Qwen (@Alibaba_Qwen)
推荐理由:Qwen3.7-Max 把 agent 能力拉到了新高度,35 小时自主内核优化证明长程执行有真实生产力,做 coding agent 的团队该认真测一下。
05:45
Claude:Blog(网页)精选
AI 评分 73/100
Claude Code的HTML输出:非凡的有效性

Claude Code团队正从Markdown转向HTML作为主要输出格式。Markdown虽简洁,但在信息密度、阅读性、分享和交互方面存在局限。HTML能支持表格、CSS样式、SVG图表和JavaScript交互,提供更清晰的视觉结构和高信息密度。由于HTML文件可通过浏览器直接打开和分享,便于团队协作审阅。Claude Code利用其广泛的上下文获取能力生成实用的HTML制品,适用于项目规划、文档编写和验证等多种场景,显著提升了AI生成内容的可读性与实用性。


推荐理由:Claude Code 团队的人亲自告诉你为什么用 HTML 而不是 Markdown,从设计原型到可交互报告全在一个文件里搞定。附带的模板和提示词,开发者可以直接抄。
02:06
Google Research:Blog(网页)精选
AI 评分 65/100
经验研究助手(ERA):从Nature发表到催化计算发现

Google Research开发的经验研究助手(ERA)现已在《Nature》期刊发表论文。这是一款基于Gemini的AI工具,旨在协助科学家编写专业级经验科学代码,其核心能力包括搜索文献、生成代码、探索方案并迭代优化,以加速耗时的计算实验过程。该工具已被用于构建“计算发现”原型,并已通过Google Labs的“可信赖测试者计划”向更广泛的科学家群体开放初步试用。


推荐理由:谷歌把AI科学编码工具ERA发到了Nature,顺便在Google Labs推出了计算发现实验版,流行病预测和碳追踪的案例很扎实,科研圈的开发者和产品人可以关注下实际进展。

5月19日

星期二 · 1 条
18:51
AYi@AYi_AInotes精选
AI 评分 75/100
我真的要吹爆HTML!我真的要吹爆HTML! 喵个咪终于可以把Notion给扔了, 现在做项目计划2分钟搞定, 做完直接发给领导!昨天做2026年度组织与人才盘点, 我给Claude code发了一个提示词, xhigh模式跑了2分多钟, 结果直接出了一个完整的交互式HTML页面🤯暗色主题,横向时间线, 可折叠风险表,团队头像墙, 整体进度条,所有交互全部到位, 不用接任何polish skill, 打开就能直接发给leader看。以前同样的活, 我用Notion拼模板至少要30-40分钟, 现在2分钟搞定, 效率提升了将近20倍。最厉害的地方是它完全不依赖任何外部库, 就是一个单HTML文件, 所有CSS和JS全部内联, 用SVG画时间线不用Canvas, 代码总量控制在700行以内。它的核心逻辑其实很简单, 你只要给Claude code一个足够精确的提示词, 明确告诉它所有的约束条件, 视觉规格,内容结构,交互规格, 最重要的是加上一个严格的完成判定标准。它会逐项检查每个模块是否完整渲染, 任何一个模块缺失都会自动补全, 不会给你交付半成品。提示词在下方文章里一键复制粘贴即可, 把里面的项目名称,周期,里程碑,风险,团队成员换成自己的就行。玛德以后再也不用在Notion里拖拖拽拽拼模板了, AI时代,HTML才是真正的生产力工具!!#Claude #HTML #AI工具 #生产力作者通过向Claude Code提供精确的提示词,仅用2分钟就生成了一个功能完整的交互式HTML项目计划页面。该页面为单文件、无外部依赖,包含暗色主题、时间线、可折叠表格等丰富交互,可直接交付。相比过去在Notion中耗费30-40分钟制作模板,效率提升了近20倍。其核心在于使用明确的提示词来规范视觉、内容结构与交互细节,确保AI一次性交付完整产物。这充分展示了在AI时代,HTML作为轻量、高保真生产力工具的巨大潜力。

AYi: http://x.com/i/article/2053129966217277440


推荐理由:一个 prompt 就能把 Claude Code 变成项目管理工具,两分钟生成可直接发给领导的交互式 HTML,效率是 Notion 的 20 倍,打工人可以直接抄作业。