Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

4,695条收录
554条精选

精选归档 · 第 18 页

341360 条 · 共 554

5月15日

星期五 · 3 条
03:01
xAI:News(网页)精选
AI 评分 73/100
xAI 推出 Grok Build 早期测试版

xAI 面向 SuperGrok Heavy 订阅用户推出 Grok Build 早期测试版。这是一个直接在终端运行的新型编程智能体与命令行工具,专为专业软件工程和复杂任务设计。其核心功能包括:支持“计划模式”,允许用户在代码执行前审阅和修改详细步骤;能无缝集成现有开发工具链;可将大型任务分解,交由并行运行的专用子智能体处理。此外,该工具提供无头模式,便于脚本和自动化流程集成。用户可通过单行命令安装并立即在项目中使用。


推荐理由:xAI终于下场做终端里的编码代理了,功能规划看着挺全,但早期beta只开放给SuperGrok Heavy用户,普通开发者还得再等等。
02:00
Claude:Blog(网页)精选
AI 评分 74/100
创始人手册:构建AI原生初创公司

Anthropic公司发布了一份面向AI原生初创企业的实用指南,旨在重塑2026年创业生命周期的构思、最小可行产品、发布和规模化四个核心阶段。该手册为每个阶段提供了具体目标、退出标准、常见失败模式及AI驱动练习,涵盖如何利用Claude进行问题验证与客户发现、避免AI生成代码的技术债务、区分真实产品市场契合度与早期炒作,并引入智能工作流替代创始人手动操作。指南还整合了多家初创企业的实践案例,为从零开始围绕AI构建公司的创始人提供架构、范围与安全方面的最佳实践。


推荐理由:这份创业手册把从Idea到Scale四阶段拆成了可复制的流程和prompt,不再是玄学方法论,而是创始人可以直接上手操作的“AI创业作弊本”。
00:38
🚨 AI News | TestingCatalog@testingcatalog精选
AI 评分 76/100
Kimi发布支持多款AI编程助手的浏览器扩展Kimi released Kimi Web Bridge, a new browser extension that works with various agents, including Claude Code, Hermes, Codex, Kimi Code CLI, and more.One Browser Use for all 👀Kimi发布了Kimi Web Bridge,这是一款可与多种代理协同工作的新浏览器扩展,包括Claude Code、Hermes、Codex、Kimi Code CLI等。 一浏览器通用于所有 👀 试用地址:http://kimi.com/features/webbridge 及Chrome网上应用店。

Kimi.ai: Supports Kimi Code CLI, Claude Code, Cursor, Codex, Hermes, and more. Try it at: http://kimi.com/features/webbridge and ...


推荐理由:Kimi这个浏览器扩展把Claude Code、Cursor等各路Agent的网页交互统一了,如果真能无缝衔接,做开发的和做自动化的人可以省下大把调试时间。

5月14日

星期四 · 4 条
21:29
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 78/100
克劳德代码与《代码书》技能:有针对性的技能培养

开发者发布了一款名为“克劳德代码与《代码书》技能”的GitHub工具,旨在通过刻意练习提升编程技能。该工具利用AI模型生成特定主题的代码示例与解释,帮助用户进行针对性学习。项目在Hacker News上获得104点热度,关注度较高。其核心变化在于将传统的广泛学习转化为聚焦、可重复的技能训练模式,通过结构化练习提升学习效率。


推荐理由:这个skill把Claude Code变成一对一的代码教练,专门抓你代码里的坏习惯,对想用AI真正提升编码水平的人是个好东西。
13:58
Xiaomi MiMo@XiaomiMiMo精选
AI 评分 69/100
MiMo V2.5 Pro 获设计竞技场季军MiMo V2.5 Pro just placed 3rd on @DesignArena! 🎉MiMo V2.5 Pro 在 @DesignArena 上刚刚获得第三名!🎉 MiMo V2.5 Pro (Thinking) 在总排行榜上比 MiMo-V2.5 提升了 8 个名次,在前端编码任务中达到与 Claude Sonnet 4.6 相同的性能水平。 衷心祝贺 @XiaomiMiMo 团队取得这些进步!

Design Arena: BREAKING: MiMo V2.5 Pro (Thinking) takes 3rd overall out of open weights models on Design Arena. MiMo V2.5 Pro (Thinking...


推荐理由:小米MiMo在Design Arena前端编码评测里直接杀进前三,跟Claude Sonnet 4.6平起平坐,这是国产开源模型在代码能力上第一次给我真正的压迫感,搞前端的可以盯一下。
07:55
Claude Code:GitHub Releases(RSS)精选
AI 评分 67/100
Claude 工具 v2.1.141 版本更新

Claude 工具发布 v2.1.141 版本,带来多项功能新增与优化。主要更新包括:为钩子输出添加 terminalSequence 字段以支持无控制终端的桌面通知;新增 CLAUDE_CODE_PLUGIN_PREFER_HTTPS 环境变量,便于通过 HTTPS 克隆插件源码;引入 ANTHROPIC_WORKSPACE_ID 变量以在多工作区联盟中限定令牌范围。会话管理方面,claude agents 命令新增 --cwd 参数用于按目录筛选,并优化后台代理的状态归类。用户体验改进包括:在倒带菜单添加“总结至此”选项以压缩早期上下文;长思考超时后旋转指示器变色提供更明确反馈;此外,还修复了 Markdown 表格渲染异常、权限提示逻辑、历史记录管理等超过 30 项问题。


推荐理由:Claude Code 的小版本但修得扎实,MCP 连接、/bg 权限继承、VSCode 语音等一堆边角都补了,Agent 模式稳定性明显提升,强烈建议升级。

5月13日

星期三 · 9 条
11:55
Tencent Hy@TencentHunyuan精选
AI 评分 76/100
Hy3预览版登陆GMI,开源最强模型领跑Hy3 preview is now on @gmi_cloud. 🙌Hy3 预览版现已登陆 @gmi_cloud。🙌

GMI Cloud: Hy3 preview from @TencentHunyuan is now live on GMI #1 on OpenRouter's LLM leaderboard, open-sourced, and the strongest ...


推荐理由:腾讯混元 Hy3 开源且登顶 OpenRouter 排行榜,295B MoE 架构在推理和代码上提升明显,不是小厂的刷榜产品,搞 agent 和 coding 的可以认真试试。
08:00
ClaudeDevs@ClaudeDevs精选
AI 评分 69/100
Claude Code新增/goal功能确保任务完成How do you keep Claude working until the job is done? Claude Code helps with this in a few ways, including one we shipped recently: /goal.如何让Claude持续工作直至任务完成?Claude Code通过几种方式提供帮助,包括我们最近推出的功能:/goal。

推荐理由:Claude Code 的 /goal 命令解决了一个长期痛点,让 AI 能自己持续拆解执行复杂任务,不用开发者反复盯着推送,做长任务自动化的人可以直接试。
07:27
Hacker News:AI 热帖精选
AI 评分 76/100
展示 HN:Statewright--通过可视化状态机提升AI智能体可靠性

Statewright 是一个通过状态机为AI智能体提供约束的系统,能控制其在各阶段可使用的工具,从而聚焦推理并提升可靠性。它将工作流定义为规划、实施、测试等多个阶段,自动执行工具限制与状态转换。在本地模型测试中,两个模型在5项SWE-bench子任务上应用约束后,正确率从2/10显著提升至10/10。该系统已集成到Claude Code等平台,一个修复测试失败的典型工作流可在46秒内完成。


推荐理由:Statewright用状态机给AI代理上“紧箍咒”,让13B小模型也能搞定SWE-bench任务,做coding agent的应该立刻装上试试。
07:09
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 63/100
财务团队如何使用 Codex

财务团队能够利用 Codex,基于实际工作输入构建管理层报告、报告包、差异桥接、模型检查和规划场景。该工具将自然语言指令转化为代码,自动化处理财务数据整合、差异分析和模型验证等复杂任务,从而提升报告生成效率与准确性,并支持快速创建多版本规划场景。


推荐理由:金融团队终于有了一个正经的 AI 用例,用 Codex 自动生成 MBR、差异桥接和规划场景,比手工拉 Excel 高效太多了,做财务分析的建议点开看看。
02:30
01:53
GitHub Blog精选
AI 评分 61/100
GitHub Copilot 个人计划:在 Pro 和 Pro+ 中引入弹性配额,以及新的 Max 计划

GitHub 宣布从6月1日起更新 Copilot 个人计划阵容,基于用户反馈进行调整。主要变化包括在现有 Pro 和 Pro+ 计划中引入弹性配额机制,允许用户更灵活地分配使用量;同时新增 Max 计划,扩展高级选项。此次更新旨在提升计划的可定制性,为开发者提供更个性化的编程辅助服务,优化整体使用体验。


推荐理由:GitHub Copilot 个人版引入弹性配额和更贵的 Max 计划,对你这样每天靠它写代码的人,要么多花钱要么被限流,算清楚自己的用量比看功能列表更重要。
01:33

5月12日

星期二 · 4 条
23:53
GitHub Blog精选
AI 评分 58/100
Dungeons & Desktops: 使用 GitHub Copilot CLI 构建一款程序化生成的 Roguelike 游戏

一位 GitHub 员工利用 GitHub Copilot CLI 开发了一款扩展程序,能够将任何代码库转换成一个独特的 Roguelike 风格地下城。该工具通过 AI 辅助的代码生成,实现了程序化关卡创建,展示了 Copilot CLI 在创意编码和游戏原型开发中的实际应用潜力。项目核心是自动解析代码结构并生成对应的可探索地下城布局。


推荐理由:用 GitHub Copilot CLI 把代码库变成 roguelike 地牢,玩法挺有脑洞,做 Copilot 扩展的开发者可以看一眼思路。
19:49
公众号:智谱(GLM)精选
AI 评分 63/100
GLM-5.1获AA全新Coding Agent基准开源第一

全球权威评测机构Artificial Analysis发布全新Coding Agent Index,包含SWE-Bench-Pro-Hard-AA、Terminal-Bench v2和SWE-Atlas-QnA三项基准,用于衡量模型与Agent harness组合的真实编程能力。闭源模型Opus 4.7(在Cursor CLI中运行)全球第一,智谱GLM-5.1(在Claude Code中运行)获开源第一,代表国产大模型在实际编程Agent场景达到SOTA水平。

另有 2 家信源报道IT之家(RSS)公众号:智谱(GLM)
推荐理由:GLM-5.1 在 AA 的新 Coding Agent 基准上拿了开源第一,时隔一个月回头看,这个成绩对国产开源模型在编程 Agent 赛道的位置是个重要注脚,做工具链选型的还是值得扫一眼。
04:01
OpenAI Developers@OpenAIDevs精选
AI 评分 69/100
Codex插件助力AI应用与智能体开发提速Codex can now help you build AI apps and agents faster with OpenAI APIs using the OpenAI Developers plugin.Codex现可通过OpenAI Developers插件,帮助您利用OpenAI API更快地构建AI应用和智能体。

推荐理由:把 Codex 直接接入 OpenAI API 开发流程,这是在给自家开发者递快刀,做 AI 应用和 Agent 的可以第一时间装上,省掉的不只是时间,还有调试的心力。
02:52
Claude Code:GitHub Releases(RSS)精选
AI 评分 72/100
Claude Code v2.1.139 版本更新

本次更新引入了多项新功能与优化。核心新增包括:集中管理会话的Agent视图(研究预览)、可设置目标并持续工作的/goal命令、实时调整滚轮速度的/scroll-speed命令,以及查看插件详情的claude plugin details命令。交互界面导航与控制能力得到增强。底层优化涵盖MCP服务器可获取CLAUDE_PROJECT_DIR环境变量、/context all的令牌估算会考虑模型分词器并显示舍入值。此外,修复了超过20项问题,如凭证死锁、内存无限制增长、权限规则、UI显示错误及路径处理等缺陷。


推荐理由:Claude Code 这波更新给了两个真正改变工作流的杀手功能,agent view 让你一眼看清所有会话,/goal 命令能让 Claude 自己跑完一个任务直到满足条件,做开发的同学可以立刻试试。