Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

4,695条收录
554条精选

精选归档 · 第 11 页

201220 条 · 共 554

6月12日

星期五 · 4 条
02:25
Linear:Now(RSS)精选
AI 评分 65/100
Linear Agent 新增编码会话、自动分类与代码审查功能

Linear Agent 推出编码会话、自动分类和 Diffs 代码审查,使智能体可直接从 issue 进入代码实现、自动调查并修复问题,并在 Linear 内完成代码审查与合并。编码会话基于 Claude Code 或 Codex 在云端运行,结果归组织所有。过去一个月,Linear Agent 已合并近 700 个 PR。


推荐理由:Coding sessions 让 Linear Agent 直接从 issue 跳到实现,团队可以共享和介入,比单人编程 agent 有意义得多,是开发流程的进化。
00:17
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 75/100
MiMo Code 现已发布并开源

2026年6月11日,小米旗下 MiMo Code 项目正式发布并开源,相关代码已托管于 mimo.xiaomi.com 供社区访问。


推荐理由:小米下场做 AI 编程工具,直接开源,121 个 HN 点赞说明社区有期待,对标 Cursor 还是自成一路,得看实际体验。
00:13
xAI:News(网页)精选
AI 评分 70/100
xAI 推出 Grok Build Plugin Marketplace

xAI 今日发布 Grok Build 内置插件市场。插件将技能、斜杠命令、AI 智能体、钩子、MCP 服务器和 LSP 打包为可安装包,用户无需离开终端即可浏览、安装和更新。首发合作伙伴包括 MongoDB、Vercel、Sentry、Chrome DevTools、Cloudflare 和 Superpowers。在 Grok Build 中输入 /marketplace 或使用 CLI 即可安装,每个远程插件均固定到特定 commit SHA 并经过验证。开发者可提交 PR 到 xai-org/plugin-marketplace 发布自己的插件。

另有 1 家信源报道X:SpaceXAI (@SpaceXAI)
推荐理由:Grok Build 这下可以像浏览器装扩展一样装插件了,涵盖数据库、部署、调试,开发者不必离开终端,这类集成对 AI 编程环境的体验影响挺大的。

6月11日

星期四 · 8 条
10:50
公众号:小米 MiMo精选
AI 评分 74/100
小米发布并开源终端AI编程助手MiMo Code V0.1.0,采用MIT协议

小米发布并开源终端AI编程助手MiMo Code V0.1.0,采用MIT协议。内置限时免费MiMo-V2.5多模态模型,性能比肩Claude Sonnet 4.6;支持接入DeepSeek、Kimi、GLM等模型。核心能力包括持久记忆系统(项目记忆、会话检查点、任务进度)和无限上下文——通过独立subagent自动保存状态解决长会话遗忘。独创Compose模式实现模型与Agent协同优化,SWE-Bench Pro达62%(Claude Code 57%),Terminal Bench 2达73%(68%)。内置语音输入和/dream命令,每7天自动合并记忆。终端输入mimo即可使用,所有设置中文汉化。

另有 1 家信源报道X:小米 MiMo (@XiaomiMiMo)
推荐理由:小米悄悄发了MiMo Code,开源且免费,用记忆系统和Compose模式解决了AI编程两大顽疾:健忘和跑偏,实测比同模型Claude Code更强,开发者现在就能装上试。
10:29
AI as Normal Technology(RSS)精选
AI 评分 70/100
为什么AI还没有、也不会取代软件工程师

对AI取代软件工程师导致大规模裁员的说法,证据并不支持。Block、Snap、Intuit等公司宣称由AI驱动的裁员,实际背后是财务压力或激进投资者要求,而非AI的真实生产力提升。一项HBR调查显示,21%的全球高管已因“预期AI”而大幅裁员,但仅2%因实际AI部署而裁员,10倍差距表明高管同样易受误导性叙事影响。


推荐理由:Arvind Narayanan 用 WARN Act 等一手数据和「三明治模型」反驳 AI 导致软件工程师大规模失业的论调,是近期关于 AI 就业影响最扎实的分析,PM 和工程师都该读。
04:23
Cursor Blog精选
AI 评分 74/100
Cursor Bugbot 更新:速度提升超 3 倍、成本降低 22%、发现更多 Bug

Cursor 的代码审查工具 Bugbot 迎来重大更新:运行速度提升超 3 倍,成本降低 22%,每轮审查多发现 10% 的 bug,90% 的运行在三分钟内完成。新增 /review 命令,可在推送代码前运行 Bugbot 和安全审查,并与 GitHub/GitLab 同步——若已通过 /review 审查过同一 diff,打开 PR 时 Bugbot 会自动跳过并备注。支持配置仅审查 PR 中新增内容。性能提升源于驱动 Bugbot 的 Composer 2.5 模型训练改进。Bugbot 遵循模型阻止列表,若组织禁用 Composer 2.5 则自动回退。该功能已在 Cursor 3.7+ 和 cursor.com/agents 上线,CLI 支持即将推出。


推荐理由:Cursor 的 Bugbot 三倍速跑 review 还便宜了 22%,这次更新让「commit 前先审一遍」变得几乎无痛,对日常开发流是个实在提升。
02:06
公众号:小米 MiMo精选
AI 评分 76/100
MiMo Code 发布并开源:模型 Agent 协同优化,迈向自进化时代

小米发布并开源终端 AI 编程助手 MiMo Code V0.1.0,基于 OpenCode 二次开发,采用 MIT 协议。其内置限时免费的 MiMo-V2.5 多模态模型,支持接入 DeepSeek、Kimi、GLM 等,并配备持久记忆系统与独创 Compose 模式。


推荐理由:MiMo Code与Claude Code的实测对比,展示了「慢写快验」规划型Agent比快速生成但欠测试的方式总成本更低,这一结果可为评估编程助手工作流提供参照。
00:23
GitHub Blog精选
AI 评分 68/100
通过语言服务器为 GitHub Copilot CLI 提供真正的代码智能

GitHub Copilot CLI 现在可以通过安装和配置 LSP(Language Server Protocol)服务器来替代原始的暴力 grep 或反编译方式,从而获得真正的代码智能。


推荐理由:虽然只是 Copilot CLI 的一个功能指南,但用 LSP 替代 grep 带来的代码理解提升是实打实的,搞 CLI 开发的可以直接抄作业。

6月10日

星期三 · 7 条
16:28
IT之家(RSS)精选
AI 评分 72/100
摩尔线程开源 MusaCoder 代码大模型,9B/27B 参数基于国产 GPU 全链路训练

摩尔线程发布并开源 MusaCoder 代码大模型,含 9B 和 27B 两个参数规模,是业内首个基于国产 GPU 算力底座完成全链路训练与验证的开源模型。后训练流程在基于 MTT S5000 的夸娥智算集群上完成,支持从 PyTorch 标准算子自动生成高性能 CUDA/MUSA 原生 Kernel 代码。在 KernelBench 评测中,MusaCoder-27B-RL 以 Overall Pass@8 93.2%、Avg.@8 88.60% 超越 Claude Opus、DeepSeek-V4 Pro、GLM-5.1、Kimi K2.6 等主流 SOTA 代码模型。


推荐理由:摩尔线程这个模型直接瞄准GPU底层算子,KernelBench分数压过了不少主流大模型,虽然场景窄,但在国产硬件自建软件生态的路上,迈出了挺关键一步。
04:55
Hugging Face:Blog(RSS)精选
AI 评分 73/100
Cohere发布North Mini Code:面向开发者的开源编码模型

Cohere发布North Mini Code,一款30B参数MoE模型(3B活跃参数),Apache 2.0开源。在Artificial Analysis Coding Index上得分33.4,超越Qwen3.5、Gemma 4等同类模型。后训练采用两阶段SFT和RLVR,在SWE-Bench Verified上pass@10达80.2%,Terminal-Bench v2上达55.1%。支持64K/128K上下文长度,专为智能体编码任务优化。


推荐理由:Cohere的新编码模型North Mini Code以30B参数MoE架构,在SWE-bench pass@1达到61%,Apache 2.0开源,是小模型在agent coding领域真正可用的信号。
03:17
Rohan Paul@rohanpaul_ai精选
AI 评分 75/100
Claude Code 团队 Thariq 分享提升 Claude Code 效率的十条建议Some really cool recommendation for pushing Claude Code to its full potential. By Thariq (@trq212) from Claude Code team.(Noted from his video by Grok)• Shift from verifying whether Claude did the work right to verifying whether Claude is doing the right work.• Treat Claude Fable 5 like a true thought partner by giving it the full context it needs upfront, rather than jumping straight into implementation.• Involve Claude early in the thinking process by starting with a small spec and asking it to interview you about the implementation details before finalizing the spec file.• Ask Claude to explore multiple directions for an idea and generate quick mockups (such as in HTML) for review, which helps catch misalignment before any code is written.• Provide Claude with rich context instead of rigid constraints—for example, explain that a feature is an experiment likely to be deleted in a month so it avoids building anything painful to throw away.• Give Claude explicit goals and verification methods once the direction is clear, especially for ambitious problems.• Use the new /goal command in Claude Code, which helps the model keep working until the objective is fully complete.• Use Workflows in Claude Code to let the model parallelize tasks, verify its own output, and prepare a report on what was implemented versus what differed from the plan.• Prompt Claude with a combined instruction such as: “Set a goal to implement the spec fully, then use a workflow to verify each part of the plan, and prepare a report on what was implemented and if anything differed.”• Be far more ambitious with Claude Fable 5 by assigning it tasks previously assumed to be impossible for LLMs, as the model now runs for hours, self-tests, and often produces higher-quality code than manual efforts.Experiment boldly—for instance, I edited this entire video using Claude Fable 5—because the model raises the bar on what developers can realistically achieve in a single session.Thariq(Claude Code 团队)提出十条建议,核心转变是:从检查 Claude 是否做对工作,转向检查它是否在做正确的工作。具体包括:提前提供完整上下文,将其视为思考伙伴;用小规格文档让 Claude 访谈实现细节;探索多方向并生成 HTML 原型;提供丰富上下文(如功能可能一个月后删除)而非硬约束;设定明确目标与验证方法;使用 /goal 命令;利用 Workflows 并行任务、自我验证并生成对比报告;同时设置目标和 workflow;更勇敢地将此前认为 LLM 无法完成的任务交给 Claude Fable 5,因其可运行数小时、自检并产出高质量代码。Thariq 本人用 Claude Fable 5 剪辑了整段视频证明其能力。

Rohan Paul: "We used to check if Claude is doing the work right, e.g. by double-checking its output, catching when it stopped early ...


推荐理由:Claude Code团队的实战建议,把Claude从“执行工具”升级为“思考伙伴”,用/goal和Workflows实现自我验证,这套工作流比新功能本身更有价值。
02:05
eric zakariasson@ericzakariasson精选
AI 评分 75/100
Cursor Evals 新增成本与输出 Token 图表we just shipped some improvements to http://cursor.com/evals!you can now see cost, output tokens and steps plotted in the graph for each model我们刚刚向 http://cursor.com/evals 推送了一些改进! 你现在可以看到每个模型的成本、输出 token 和步骤绘制在图表中

nate: http://cursor.com/evals now includes steps and output tokens as well! These are additional signals our team uses to eval...


推荐理由:Cursor Evals 这次更新不大,但把成本和步骤可视化放进评估页面,标志着选模型从拼跑分转向算账,做 AI 产品的该去看看。
01:04
Anthropic:Newsroom(网页)精选
AI 评分 90/100
Claude Fable 5 和 Claude Mythos 5

Anthropic 今日推出 Claude Fable 5(通用安全版)和 Claude Mythos 5(受限安全版)。Fable 5 在软件工程、知识工作、视觉、科研等几乎所有测试基准上达到 SOTA,Stripe 称其将数月工程压缩至数天,FrontierCode 评分居前沿模型之首,可仅凭截图重建网页应用源码。Mythos 5 在药物设计中实现约 10 倍加速,其分子生物学假说盲测获科学家偏好的概率约 80%。两模型售价均为 $10/百万输入 tokens、$50/百万输出 tokens,较 Claude Mythos Preview 降价过半。Fable 5 在部分敏感主题上回退至 Claude Opus 4.8,安全触发率低于 5% 的会话。Mythos 5 通过 Project Glasswing 向网络安全防御者开放。

另有 19 家信源报道公众号:卡尔的AI沃茨IT之家(RSS)Claude Code:GitHub Releases(RSS)X:Boris Cherny (@bcherny)X:Claude Devs (@ClaudeDevs)X:Eric Zakariasson (@ericzakariasson)Tomer Tunguz 博客(VC 分析)X:OpenRouter (@OpenRouter)公众号:数字生命卡兹克X:Dario Amodei (@DarioAmodei)X:Elvis Saravia (@omarsar0, DAIR.AI)X:Andrej Karpathy (@karpathy)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Kim (@kimmonismus)X:Claude (@claudeai)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Testing Catalog (@testingcatalog)
推荐理由:Anthropic把最危险的模型安全地放出来了,Fable 5在编码、科研上不是小数点级别的提升,价格还砍半,95%的请求直接跑满血版,必读。
00:35
OpenRouter@OpenRouter精选
AI 评分 73/100
OpenRouter与Cursor集成指南Want to use OpenRouter with Cursor?Here's an integration guide: https://openrouter.ai/docs/cookbook/coding-agents/cursor-integration想要在Cursor中使用OpenRouter吗? 这里有一份集成指南:https://openrouter.ai/docs/cookbook/coding-agents/cursor-integration
另有 1 家信源报道OpenRouter:Announcements(RSS)
推荐理由:用 Cursor 又想用 OpenRouter 上 Claude 4.6 或 Llama 4 的开发者,这篇指南帮你打通关键配置,不是大新闻但值得收藏
00:18
GitHub Blog精选
AI 评分 68/100
GitHub Copilot CLI 推出自定义 AI 智能体,将一次性终端提示转化为可重复工作流

GitHub Copilot CLI 新增自定义 AI 智能体功能,使 CLI 能够理解开发者的技术栈和团队工作流,将一次性终端提示转变为可重复、可审查的流程。


推荐理由:GitHub Copilot CLI 的自定义代理把一次性提示变成可重复工作流,相当于给命令行配了个 AI 副驾驶,做自动化的朋友值得一试。