Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

4,695条收录
554条精选

精选归档 · 第 13 页

241260 条 · 共 554

6月5日

星期五 · 12 条
22:53
TechCrunch:AI(RSS)精选
AI 评分 73/100
AI行业Token成本失控引发紧急管控:从"加速"转向"设护栏"

AI行业关注焦点从token最大化与快速迭代转向成本管控。业内普遍呼吁建立护栏机制,以应对推理和生成过程中不断飙升的token费用。这一趋势正在推动模型部署策略、API定价体系以及企业级AI应用的经济性评估发生根本性转变。


推荐理由:企业开始受不了AI账单了,Uber半年花光全年预算,微软撤销Claude Code许可,这可能是AI泡沫的第一声警报。这篇文章给所有用AI写代码的公司算了一笔账,值得一看。
15:40
Elon Musk@elonmusk精选
AI 评分 66/100
Grok 推出 worktrees 并行智能体Grok supports worktreesGrok 现已支持 worktrees。worktrees 是代码仓库的轻量级副本,允许在独立工作区中并行运行 AI 智能体,可通过主页或 grok -w 使用。

akshey: Grok Build tip of the day: worktrees! If you're unfamiliar with worktrees, they're essentially lightweight copies of you...


推荐理由:Grok Build现在支持worktrees,一条命令`grok -w`就能给每个agent独立工作空间,并行开发现场感一下拉满。做复杂任务的可以立刻用起来。
13:19
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 76/100
Open Code Review - 一款基于人工智能的代码审查命令行工具

Open Code Review 是一个基于人工智能的代码审查命令行(CLI)工具,旨在帮助开发者通过自动化的方式提升代码审查效率。


推荐理由:阿里巴巴把内部用了两年、审查了数百万缺陷的AI代码审查工具开源,它不走纯Agent路线,用确定性工程保证覆盖和位置准确,想落地AI代码审查的团队可以直接用。
11:14
IT之家(RSS)精选
AI 评分 71/100
腾讯高级执行副总裁汤道生:今年腾讯大部分代码都由 AI 生成

在 6 月 5 日的腾讯云 AI 产业应用大会上,腾讯高级执行副总裁汤道生表示,今年腾讯大部分代码都由 AI 生成,工程师将更多时间用于架构设计,定期指导与修正 AI 输出。腾讯 2026 年 Q1 财报显示,重组后的 AI 研发团队重构了基础设施,并搭建了 Hy3 preview 模型。腾讯总裁刘炽平今年 3 月透露,去年腾讯在 AI 新产品上投入 180 亿元,今年投入至少翻倍。


推荐理由:腾讯高管公开说今年大部分代码是AI写的,这个数据比谷歌微软还激进,对国内开发者的信号很明确,会写代码不再是护城河,能设计架构才是。
09:31
公众号:数字生命卡兹克精选
AI 评分 68/100
Anthropic《When AI builds itself》:当AI开始自我构建

Anthropic发文指出,AI系统正加速自身开发,递归自我改进或将到来。目前Anthropic超80%代码由Claude编写,工程师每日合并代码量达2024年8倍。Claude Opus 4.6可胜任12小时软件任务,Mythos Preview连续工作至少16小时,SWE-bench和CORE-Bench等基准均已饱和。内部测试显示,Mythos Preview使研究效率提升约4倍,代码速度优化达52倍,在开放任务中成功率达76%,并弥合97%的研究项目差距。Claude在64%情况下给出比人类更好的研究建议。

另有 8 家信源报道Anthropic:The Institute(旗舰研究长文 · 网页)Hacker News 热门(buzzing.cc 中文翻译)X:Emad Mostaque (@EMostaque)X:Kim (@kimmonismus)X:Anthropic (@AnthropicAI)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Testing Catalog (@testingcatalog)
推荐理由:Anthropic首次公开内部数据,工程师代码产出提升8倍,Claude自我加速的曲线已经画出来了。这篇文章不是预测是事实,做AI的人都该花20分钟读完。
09:28
Gary Marcus:The Road to AI We Can Trust(RSS)精选
AI 评分 59/100
Gary Marcus:无需恐慌Anthropic新博客

Anthropic发布最新博客后,推特圈热议不断。Gary Marcus在其博客中直接以“无需恐慌”为题发文,暗示不必过度反应。


推荐理由:这篇文章是评论圈难得的冷静声音,用逻辑拆解了 Anthropic 的恐慌叙事,顺便带来 S&P 500 不接纳 SpaceX 的利好,读起来像一份理性补丁。
06:45
Sam Altman@sama精选
AI 评分 80/100
用ChatGPT构建并发布网页应用build and publish web apps with chatgpt!i really wish i had this when i was a kid, but i do miss hypercard.用ChatGPT构建并发布网页应用! 我真希望我小时候就有这个,但我确实怀念HyperCard。

OpenAI: Building apps has never been easier. With Sites, Codex can turn your work, ideas, and plans into an interactive website ...

另有 5 家信源报道IT之家(RSS)X:OpenAI Developers (@OpenAIDevs)X:OpenAI (@OpenAI)X:Rohan Paul (@rohanpaul_ai)OpenAI:官网动态(RSS · 排除企业/客户案例)
推荐理由:Sam Altman 说希望小时候有这玩意,但企业版首发普通人还得等。把聊天直接变成可发布的网页 app,这方向让非开发者也能造工具。
06:04
Claude Code:GitHub Releases(RSS)精选
AI 评分 70/100
Claude Code v2.1.163 发布

新增 requiredMinimumVersionrequiredMaximumVersion 托管设置,版本超范围时拒绝启动并引导用户使用经批准版本。新增 /plugin list 命令及 --enabled/--disabled 筛选;/btw 添加 "c to copy" 快捷键,复制原始 markdown 答案到剪贴板。Hooks 方面,Stop 和 SubagentStop 可返回 additionalContext 给 Claude 反馈并保持对话。Skills 新增 \$ 转义语法,支持在命令中数字前使用字面 $。stdio MCP 服务器在 --resume 时接收与 hooks/Bash 相同的 CLAUDE_CODE_SESSION_ID。修复了 claude -p 永久挂起、$TMPDIR 被覆盖、Windows 上 session-env 目录 EEXIST 错误、后台 agent 会话在更新后自动升级等多处问题。

另有 2 家信源报道Claude Code:GitHub Releases(RSS)X:Claude Devs (@ClaudeDevs)
推荐理由:Claude Code 这次的版本管理设置对团队标准化很关键,plugin list 命令也让插件管理顺手多了,但这种工具更新属于用的人自然懂,不是所有人都需要关注。
05:56
Ethan Mollick:One Useful Thing(RSS)精选
AI 评分 61/100
共存与协同智能的终结

Ethan Mollick 在 One Useful Thing 博客中,以“共存与协同智能的终结”为题,并附带介绍了如何向 AI 推销一本书。


推荐理由:Mollick 这篇比单纯的新书预告有料,用自己给 AI 写推荐语的实验,把「AI 不再是助手而是守门人」这个新现实讲得很具体。对还在纠结怎么跟 AI 合作的人,是一个挺及时的视角更新。
01:19
Ethan Mollick@emollick精选
AI 评分 76/100
Anthropic称Claude编写超80%合并代码"As of May 2026, more than 80% of the code we merge into Anthropic’s codebase was authored by Claude."Matches independent measures. There really is no sign this is slowing down (which doesn't mean there aren't organizational challenges to absorbing this much productivity gain)截至2026年5月,我们合并到Anthropic代码库中的代码有超过80%由Claude编写。 与独立测量结果一致。确实没有迹象表明这一趋势正在放缓(但这并不意味着吸收如此多的生产率提升没有组织挑战)。
另有 8 家信源报道Anthropic:The Institute(旗舰研究长文 · 网页)Hacker News 热门(buzzing.cc 中文翻译)X:Emad Mostaque (@EMostaque)X:Kim (@kimmonismus)X:Anthropic (@AnthropicAI)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Testing Catalog (@testingcatalog)
推荐理由:Anthropic内部80%代码由Claude编写,这个数字把AI编程从辅助推到主力,所有码农都该想想这意味着什么。

6月4日

星期四 · 6 条
23:42
Hugging Face:Blog(RSS)精选
AI 评分 66/100
Hugging Face 为编码智能体重塑 hf CLI 输出格式

Hugging Face 重新设计 hf CLI,使其同时服务人类用户和编码智能体(Claude Code、Codex 等)。CLI 通过环境变量自动检测智能体驱动,输出紧凑无截断的 TSV 格式,避免 ANSI 和交互提示,大幅降低 token 消耗。复杂多步任务中,不使用 CLI 的智能体 token 消耗最高达 hf CLI 的 6 倍。2026 年 4 月起,Hugging Face 追踪 Hub 智能体流量,Claude Code 约 4 万用户、近 4900 万次请求,Codex 紧随其后。


推荐理由:HF CLI 现在会自动检测 agent 并切换输出,复杂任务上 token 消耗比 curl/SDK 节省 2-6 倍。如果你在用 Claude Code 或 Codex 操作 Hugging Face Hub,这是必读的升级指南。
21:00
公众号:昆仑万维(天工)精选
AI 评分 64/100
SkyClaw-v1.0 深度实测:Agent专属模型,顶尖性能表现,极致价格优势

5月26日,昆仑万维发布SkyClaw-v1.0,定位面向复杂工具使用和真实世界任务执行的高性能Agent模型,输入仅0.5元/百万token、输出4元/百万。实测显示,其从零生成番茄钟和记账本应用时,能自主用Web Audio API合成音效、用SVG手绘图表,细节处理成熟。在现有代码库修改任务中,越难的任务表现越好:单点bug修复精准,能准确诊断iOS Safari滚动问题并给出克制式修复方案。但官方未报告SWE-bench成绩,表明其优势集中在从零生成与模式匹配场景,而非大型仓库精确修改。极致低价使其在批量Agent任务与快速原型生成上性价比突出。


推荐理由:这篇实测把SkyClaw的「从零生成」和「老项目修改」摊开了揉碎了测,不看广告看疗效,让我看清Agent模型的分化到底意味着什么——便宜好用但有边界,想省钱做小工具的你值得细读。
17:26
HuggingFace Daily Papers(社区热门论文)精选
AI 评分 70/100
RHO:利用过往轨迹优化LLM智能体工具链的自监督方法

Retrospective Harness Optimization (RHO) 是一种自监督方法,仅利用过往轨迹优化LLM智能体的工具链(技能、工具和工作流程集合)。RHO从历史任务中选取多样化的困难任务核心集,并行重新执行;智能体通过自我验证和自我一致性分析回放,生成候选工具链更新,并依据自身成对自我偏好选择最有效更新。在软件工程、技术工作和知识工作三个领域评估中,单轮优化将SWE-Bench Pro通过率从59%提升至78%,无需外部评分。分析表明RHO有效针对先前失败模式,优化后的工具链改变智能体行为模式,在长周期会话中维持更高准确率。


推荐理由:不靠人工标注就能让 Agent 自我提升,单轮直接把 SWE-Bench Pro 通过率从 59% 拉到 78%,做自主 Agent 优化的同学应该仔细读一下。
05:58
Claude Code:GitHub Releases(RSS)精选
AI 评分 59/100
Claude Code v2.1.162 发布

Claude Code v2.1.162 发布,主要包含 Bug 修复和体验优化。claude agents --json 新增 waitingFor 字段,/effort 命令确认级别持久化,远程控制固定底部显示,/ide 菜单中 Windsurf 更名为 Devin Desktop。修复了配置文件只读导致启动黑屏、Windows 权限规则不匹配、LSP 的 workspaceSymbol 无结果、API 400 错误、MCP 超时低于 1000ms 被截断等十余项问题。


推荐理由:一系列扎实的修复,尤其是 Windows 权限匹配和启动挂死问题的解决,对于日常用 Claude Code 做开发的来说稳定性提升明显,可以升级。
04:15
Cursor Blog精选
AI 评分 60/100
Cursor Enterprise 推出 Organizations 组织管理功能

Cursor Enterprise 正式推出 Organizations 结构,允许企业在统一面板中管理多个团队。每个团队可独立设置预算、安全策略、模型访问和功能控制。新增 Groups 作为跨团队或团队内的轻量级用户集合,用于分段管理模型访问、花销上限和智能体权限,不同设置取最宽松权限生效。管理员可创建沙箱团队预先测试新功能,再向全公司推送;也可按部门划分模型访问和预算。组织级仪表盘汇总所有团队的 token 用量与花费,支持按团队、用户等维度筛选。身份提供商和 SCIM 目录在组织层面一次配置,成员自动同步。该功能现已全面开放给所有 Enterprise 客户。


推荐理由:这是 Cursor 企业版在治理能力上的关键补丁,把多团队预算、模型权限和沙盒测试管了起来,对想把 AI 编程推到千人规模的团队是实打实的基建更新。

6月3日

星期三 · 2 条
22:09
IT之家(RSS)精选
AI 评分 73/100
月之暗面 Kimi Work Beta 版开启内测:面向知识工作者的通用型本地 Agent

月之暗面今日宣布,Kimi Work Beta 版随最新版 Mac 和 Windows 客户端开启内测。Kimi Work 是基于 Kimi Code 的通用型本地 Agent,支持安装使用技能、运行定时任务,并继承在线版的专业技能与数据库,内置可调用浏览器的 Kimi WebBridge。用户用自然语言描述目标即可自动拆解任务、并行执行并交付产物。支持 Agent 集群,最高可创建含 300 个子 Agent 的团队。官方透露,Kimi Work 自身由 Kimi Code 写成,工程师一周内完成客户端开发,累计产出超 5 万行有效代码,其中 92% 由 AI 自主生成。

另有 2 家信源报道X:Kimi.ai (@Kimi_Moonshot)公众号:月之暗面(Kimi)
推荐理由:月之暗面把AI Agent搬到了本地,不是聊天窗口,而是直接操控你的电脑。92%的代码由AI自己写的自举能力,比功能本身更吓人。做办公自动化的同行该看看怎么被卷了。
16:25
Greg Brockman@gdb精选
AI 评分 73/100
Codex 周活用户超500万,成知识工作生产力工具codex for computer work is growing very fastCodex 的计算机工作应用增长非常快。

OpenAI Newsroom: Codex now has more than 5M weekly active users. But the bigger story is what people are using it for: not just writing c...


推荐理由:Codex 5M周活不是重点,关键在身份变了,从写代码的变成全工种生产力工具,这份报告可能定义了 AI 在组织里怎么渗透。