精选归档 · 第 11 页
第 201–220 条 · 共 554 条
02:25
Linear Agent 新增编码会话、自动分类与代码审查功能Linear Agent 推出编码会话、自动分类和 Diffs 代码审查,使智能体可直接从 issue 进入代码实现、自动调查并修复问题,并在 Linear 内完成代码审查与合并。编码会话基于 Claude Code 或 Codex 在云端运行,结果归组织所有。过去一个月,Linear Agent 已合并近 700 个 PR。
推荐理由:Coding sessions 让 Linear Agent 直接从 issue 跳到实现,团队可以共享和介入,比单人编程 agent 有意义得多,是开发流程的进化。
00:17
Hacker News 热门(buzzing.cc 中文翻译)精选
MiMo Code 现已发布并开源2026年6月11日,小米旗下 MiMo Code 项目正式发布并开源,相关代码已托管于 mimo.xiaomi.com 供社区访问。
推荐理由:小米下场做 AI 编程工具,直接开源,121 个 HN 点赞说明社区有期待,对标 Cursor 还是自成一路,得看实际体验。
00:13
xAI 推出 Grok Build Plugin MarketplacexAI 今日发布 Grok Build 内置插件市场。插件将技能、斜杠命令、AI 智能体、钩子、MCP 服务器和 LSP 打包为可安装包,用户无需离开终端即可浏览、安装和更新。首发合作伙伴包括 MongoDB、Vercel、Sentry、Chrome DevTools、Cloudflare 和 Superpowers。在 Grok Build 中输入 /marketplace 或使用 CLI 即可安装,每个远程插件均固定到特定 commit SHA 并经过验证。开发者可提交 PR 到 xai-org/plugin-marketplace 发布自己的插件。
另有 1 家信源报道X:SpaceXAI (@SpaceXAI)
推荐理由:Grok Build 这下可以像浏览器装扩展一样装插件了,涵盖数据库、部署、调试,开发者不必离开终端,这类集成对 AI 编程环境的体验影响挺大的。
10:50
小米发布并开源终端AI编程助手MiMo Code V0.1.0,采用MIT协议小米发布并开源终端AI编程助手MiMo Code V0.1.0,采用MIT协议。内置限时免费MiMo-V2.5多模态模型,性能比肩Claude Sonnet 4.6;支持接入DeepSeek、Kimi、GLM等模型。核心能力包括持久记忆系统(项目记忆、会话检查点、任务进度)和无限上下文——通过独立subagent自动保存状态解决长会话遗忘。独创Compose模式实现模型与Agent协同优化,SWE-Bench Pro达62%(Claude Code 57%),Terminal Bench 2达73%(68%)。内置语音输入和/dream命令,每7天自动合并记忆。终端输入mimo即可使用,所有设置中文汉化。
另有 1 家信源报道X:小米 MiMo (@XiaomiMiMo)
推荐理由:小米悄悄发了MiMo Code,开源且免费,用记忆系统和Compose模式解决了AI编程两大顽疾:健忘和跑偏,实测比同模型Claude Code更强,开发者现在就能装上试。
10:29
AI as Normal Technology(RSS)精选
为什么AI还没有、也不会取代软件工程师对AI取代软件工程师导致大规模裁员的说法,证据并不支持。Block、Snap、Intuit等公司宣称由AI驱动的裁员,实际背后是财务压力或激进投资者要求,而非AI的真实生产力提升。一项HBR调查显示,21%的全球高管已因“预期AI”而大幅裁员,但仅2%因实际AI部署而裁员,10倍差距表明高管同样易受误导性叙事影响。
推荐理由:Arvind Narayanan 用 WARN Act 等一手数据和「三明治模型」反驳 AI 导致软件工程师大规模失业的论调,是近期关于 AI 就业影响最扎实的分析,PM 和工程师都该读。
04:23
Cursor Bugbot 更新:速度提升超 3 倍、成本降低 22%、发现更多 BugCursor 的代码审查工具 Bugbot 迎来重大更新:运行速度提升超 3 倍,成本降低 22%,每轮审查多发现 10% 的 bug,90% 的运行在三分钟内完成。新增 /review 命令,可在推送代码前运行 Bugbot 和安全审查,并与 GitHub/GitLab 同步——若已通过 /review 审查过同一 diff,打开 PR 时 Bugbot 会自动跳过并备注。支持配置仅审查 PR 中新增内容。性能提升源于驱动 Bugbot 的 Composer 2.5 模型训练改进。Bugbot 遵循模型阻止列表,若组织禁用 Composer 2.5 则自动回退。该功能已在 Cursor 3.7+ 和 cursor.com/agents 上线,CLI 支持即将推出。
推荐理由:Cursor 的 Bugbot 三倍速跑 review 还便宜了 22%,这次更新让「commit 前先审一遍」变得几乎无痛,对日常开发流是个实在提升。
02:06
MiMo Code 发布并开源:模型 Agent 协同优化,迈向自进化时代小米发布并开源终端 AI 编程助手 MiMo Code V0.1.0,基于 OpenCode 二次开发,采用 MIT 协议。其内置限时免费的 MiMo-V2.5 多模态模型,支持接入 DeepSeek、Kimi、GLM 等,并配备持久记忆系统与独创 Compose 模式。
推荐理由:MiMo Code与Claude Code的实测对比,展示了「慢写快验」规划型Agent比快速生成但欠测试的方式总成本更低,这一结果可为评估编程助手工作流提供参照。
00:23
通过语言服务器为 GitHub Copilot CLI 提供真正的代码智能GitHub Copilot CLI 现在可以通过安装和配置 LSP(Language Server Protocol)服务器来替代原始的暴力 grep 或反编译方式,从而获得真正的代码智能。
推荐理由:虽然只是 Copilot CLI 的一个功能指南,但用 LSP 替代 grep 带来的代码理解提升是实打实的,搞 CLI 开发的可以直接抄作业。
16:28
摩尔线程开源 MusaCoder 代码大模型,9B/27B 参数基于国产 GPU 全链路训练摩尔线程发布并开源 MusaCoder 代码大模型,含 9B 和 27B 两个参数规模,是业内首个基于国产 GPU 算力底座完成全链路训练与验证的开源模型。后训练流程在基于 MTT S5000 的夸娥智算集群上完成,支持从 PyTorch 标准算子自动生成高性能 CUDA/MUSA 原生 Kernel 代码。在 KernelBench 评测中,MusaCoder-27B-RL 以 Overall Pass@8 93.2%、Avg.@8 88.60% 超越 Claude Opus、DeepSeek-V4 Pro、GLM-5.1、Kimi K2.6 等主流 SOTA 代码模型。
推荐理由:摩尔线程这个模型直接瞄准GPU底层算子,KernelBench分数压过了不少主流大模型,虽然场景窄,但在国产硬件自建软件生态的路上,迈出了挺关键一步。
04:55
Cohere发布North Mini Code:面向开发者的开源编码模型Cohere发布North Mini Code,一款30B参数MoE模型(3B活跃参数),Apache 2.0开源。在Artificial Analysis Coding Index上得分33.4,超越Qwen3.5、Gemma 4等同类模型。后训练采用两阶段SFT和RLVR,在SWE-Bench Verified上pass@10达80.2%,Terminal-Bench v2上达55.1%。支持64K/128K上下文长度,专为智能体编码任务优化。
推荐理由:Cohere的新编码模型North Mini Code以30B参数MoE架构,在SWE-bench pass@1达到61%,Apache 2.0开源,是小模型在agent coding领域真正可用的信号。
03:17
Rohan Paul@rohanpaul_ai精选 Claude Code 团队 Thariq 分享提升 Claude Code 效率的十条建议Some really cool recommendation for pushing Claude Code to its full potential. By Thariq (@trq212) from Claude Code team.(Noted from his video by Grok)• Shift from verifying whether Claude did the work right to verifying whether Claude is doing the right work.• Treat Claude Fable 5 like a true thought partner by giving it the full context it needs upfront, rather than jumping straight into implementation.• Involve Claude early in the thinking process by starting with a small spec and asking it to interview you about the implementation details before finalizing the spec file.• Ask Claude to explore multiple directions for an idea and generate quick mockups (such as in HTML) for review, which helps catch misalignment before any code is written.• Provide Claude with rich context instead of rigid constraints—for example, explain that a feature is an experiment likely to be deleted in a month so it avoids building anything painful to throw away.• Give Claude explicit goals and verification methods once the direction is clear, especially for ambitious problems.• Use the new /goal command in Claude Code, which helps the model keep working until the objective is fully complete.• Use Workflows in Claude Code to let the model parallelize tasks, verify its own output, and prepare a report on what was implemented versus what differed from the plan.• Prompt Claude with a combined instruction such as: “Set a goal to implement the spec fully, then use a workflow to verify each part of the plan, and prepare a report on what was implemented and if anything differed.”• Be far more ambitious with Claude Fable 5 by assigning it tasks previously assumed to be impossible for LLMs, as the model now runs for hours, self-tests, and often produces higher-quality code than manual efforts.Experiment boldly—for instance, I edited this entire video using Claude Fable 5—because the model raises the bar on what developers can realistically achieve in a single session.译Thariq(Claude Code 团队)提出十条建议,核心转变是:从检查 Claude 是否做对工作,转向检查它是否在做正确的工作。具体包括:提前提供完整上下文,将其视为思考伙伴;用小规格文档让 Claude 访谈实现细节;探索多方向并生成 HTML 原型;提供丰富上下文(如功能可能一个月后删除)而非硬约束;设定明确目标与验证方法;使用 /goal 命令;利用 Workflows 并行任务、自我验证并生成对比报告;同时设置目标和 workflow;更勇敢地将此前认为 LLM 无法完成的任务交给 Claude Fable 5,因其可运行数小时、自检并产出高质量代码。Thariq 本人用 Claude Fable 5 剪辑了整段视频证明其能力。Rohan Paul: "We used to check if Claude is doing the work right, e.g. by double-checking its output, catching when it stopped early ...
推荐理由:Claude Code团队的实战建议,把Claude从“执行工具”升级为“思考伙伴”,用/goal和Workflows实现自我验证,这套工作流比新功能本身更有价值。
01:04
Claude Fable 5 和 Claude Mythos 5Anthropic 今日推出 Claude Fable 5(通用安全版)和 Claude Mythos 5(受限安全版)。Fable 5 在软件工程、知识工作、视觉、科研等几乎所有测试基准上达到 SOTA,Stripe 称其将数月工程压缩至数天,FrontierCode 评分居前沿模型之首,可仅凭截图重建网页应用源码。Mythos 5 在药物设计中实现约 10 倍加速,其分子生物学假说盲测获科学家偏好的概率约 80%。两模型售价均为 $10/百万输入 tokens、$50/百万输出 tokens,较 Claude Mythos Preview 降价过半。Fable 5 在部分敏感主题上回退至 Claude Opus 4.8,安全触发率低于 5% 的会话。Mythos 5 通过 Project Glasswing 向网络安全防御者开放。
另有 19 家信源报道公众号:卡尔的AI沃茨IT之家(RSS)Claude Code:GitHub Releases(RSS)X:Boris Cherny (@bcherny)X:Claude Devs (@ClaudeDevs)X:Eric Zakariasson (@ericzakariasson)Tomer Tunguz 博客(VC 分析)X:OpenRouter (@OpenRouter)公众号:数字生命卡兹克X:Dario Amodei (@DarioAmodei)X:Elvis Saravia (@omarsar0, DAIR.AI)X:Andrej Karpathy (@karpathy)The Verge:AI(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Kim (@kimmonismus)X:Claude (@claudeai)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Testing Catalog (@testingcatalog)
推荐理由:Anthropic把最危险的模型安全地放出来了,Fable 5在编码、科研上不是小数点级别的提升,价格还砍半,95%的请求直接跑满血版,必读。