内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态一手 · 486 条
来源全部一手资讯X
类型全部
全部模型产品行业论文教程观点
标签「编码」清除

8月15日周六

06:03Nathan Lambert:Interconnects(RSS)62同事件GLM-5.3:中国实验室如何跟上前沿步伐同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》

8月14日周五

23:23Cursor Blog68精选Cursor 正式被 SpaceX 收购
22:51Claude:Blog(网页)63Claude Code 会话如何最大化 token 价值
13:41公众号:智谱(GLM)73精选GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
07:57Claude Code:GitHub Releases(RSS)50Claude Code v2.1.232 发布:默认启用 Subagent forking,新增 GitLab 支持与多项安全修复
07:50Claude:Blog(网页)50JetBrains CTO 谈如何评估并部署 Claude Fable 5:私有仓库评测、效率提升与安全策略
02:23Cursor Blog65精选Cursor 推出 builds:云智能体启动速度提升至 3 倍
01:22Google DeepMind:Blog(RSS)72精选Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型

8月13日周四

23:23Cursor Blog55Cursor 获得 AIUC-1 认证,通过智能体安全与可靠性独立审查
19:20公众号:火山引擎46亚信×火山引擎:6000+席位用TRAE跑通企业级AI研发
16:57Claude Code:GitHub Releases(RSS)18Claude Code v2.1.231 发布
05:15OpenRouter:Announcements(RSS)61OpenRouter 工具调用指南:一次编写循环,切换模型字符串即可跨模型运行
04:57Claude Code:GitHub Releases(RSS)50Claude Code v2.1.229 发布:新增远程会话恢复、插件市场命令源及多项修复
03:59GitHub Blog27GitHub Copilot 应用如何写出你的第一条提示词
02:23Cursor Blog70精选Cursor 与 SpaceXAI 联合发布 Grok 4.6
00:09xAI:News(网页)77精选xAI 发布 Grok 4.6,强化长时运行智能体能力

8月12日周三

03:56Claude Code:GitHub Releases(RSS)39Claude Code v2.1.228 发布:修复交互会话重绘、Windows Git 检测及多项稳定性问题
03:32Databricks:Blog(RSS)58Databricks 开源 Metals v2:面向数百万行代码库的 Java 和 Scala 语言服务器
01:45Microsoft AI:官方博客(网页)24MAI-Code-1.1-Flash: Better, faster, at a quarter of the cost
00:56Google Developers Blog(RSS)34Go 为何是 AI 辅助软件工程的理想语言

8月11日周二

14:01公众号:智谱(GLM)71精选ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线
07:56Claude Code:GitHub Releases(RSS)50Claude Code v2.1.227 发布:修复订阅层级误判与 Bash 命令失败问题
03:58GitHub Blog31GitHub Copilot SDK for Java 发布:用原生 Java 代码驱动 Copilot

8月10日周一

23:44OpenRouter:Announcements(RSS)77精选OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

8月8日周六

10:53Claude Code:GitHub Releases(RSS)17Claude Code v2.1.226 发布
01:31Databricks:Blog(RSS)62Databricks 如何规模化管控 AI 编程成本

8月7日周五

03:53GitHub Blog69精选GitHub Copilot 应用中的斜杠命令使用指南

8月6日周四

23:21Cursor Blog58Cursor Router 如何为任务选择合适模型

8月5日周三

00:09Claude:YouTube(RSS)17How auto mode works with Claude Code

8月3日周一

16:19公众号:火山引擎47火山引擎 Doubao-Seed-Evolving 再升级:检索更准、幻觉更少
10:10Qwen:Blog Retrieval(API)89精选Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数

8月1日周六

01:26LangChain:Blog(RSS)50LangChain 推出 ReviewBench:用真实 PR 反馈评测代码审查智能体
00:52GitHub Blog54GitHub 开源 casefold:以内存速度进行源码大小写折叠

7月31日周五

01:51GitHub Blog65精选GitHub Copilot 应用新增堆叠会话与拉取请求功能
00:00DeepSeek:API 更新日志72精选DeepSeek-V4-Flash 正式版 API 上线公测

7月30日周四

23:20Cursor Blog53Cursor 如何为云智能体构建开发环境

7月29日周三

01:44Tomer Tunguz 博客(VC 分析)58AI 框架(Harness)对模型性能的影响超过模型本身:GPT-5.5 在 Cursor 上得分 87.2%,比 Codex 高 25.7 个百分点
01:25Databricks:Blog(RSS)49Databricks 用 Unity AI Gateway Budgets 管理内部编码智能体支出

7月28日周二

22:30公众号:百度智能云(文心)57Unity中国发布团结引擎2.0,AI Agent"团结Codely"与百度智能云合作落地私有化AI Coding
22:16公众号:百度智能云(文心)38Unity中国发布团结引擎2.0,携手百度智能云推出AI Agent"团结Codely"
已加载 40 条
全部 AI 动态
2026年8月17日星期一 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
一手信源 · 标签「编码」 · 486 条清除

8月15日

星期六 · 1 条
06:03
Nathan Lambert:Interconnects(RSS)同事件
AI 评分 62/100
GLM-5.3:中国实验室如何跟上前沿步伐

Z.ai 今日发布 GLM-5.3,目前仅限编程套餐使用,API 即将上线,两周后开源权重至 Hugging Face。该模型在多项基准上超越 Moonshot AI 的 Kimi K3,部分指标超过 Claude Fable 5 或 GPT-5.6-Sol,仅约 750B 参数,为 Kimi K3 的三分之一。

安全/对齐模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》

8月14日

星期五 · 7 条
23:23
Cursor Blog精选
AI 评分 68/100
Cursor 正式被 SpaceX 收购

Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 GPU 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。

xAI编码行业动态
另有 12 家信源报道X:Lee Robinson (@leerob)X:SpaceXAI (@SpaceXAI)IT之家(RSS)X:Eric Zakariasson (@ericzakariasson)Hacker News 热门(buzzing.cc 中文翻译)X:Kim (@kimmonismus)X:阿易 AI Notes (@AYi_AInotes)a16z:News(RSS)X:Michael Truell (@mntruell)X:Rohan Paul (@rohanpaul_ai)X:Testing Catalog (@testingcatalog)TechCrunch:AI(RSS)
推荐理由:Cursor 并入 SpaceX 后获得大规模算力,其用户可能直接受益于更经济的强模型,这改变对编程工具后续能力迭代与定价的预期。
22:51
Claude:Blog(网页)
AI 评分 63/100
Claude Code 会话如何最大化 token 价值

Claude Code 的 token 成本由模型、输入/输出 token 和提示缓存三因素决定,输出 token 价格约为输入的 5 倍。任务间运行 /clear 可减少无关上下文回传,降低 token 用量;会话中途切换模型或 effort 级别会破坏提示缓存,增加成本。

Anthropic教程/实践编码
13:41
公众号:智谱(GLM)精选
AI 评分 73/100
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。

开源生态模型发布编码
另有 8 家信源报道X:智谱 Z.ai (@Zai_org)X:Testing Catalog (@testingcatalog)X:Rohan Paul (@rohanpaul_ai)MarkTechPost(RSS)The Decoder:AI News(RSS)X:SemiAnalysis (@SemiAnalysis_)X:Kim (@kimmonismus)IT之家(RSS)
推荐理由:把网络安全能力作为开源卖点,价值在于让缺乏闭源安全服务的中小团队也能开展漏洞审计,改变防御能力只集中在少数机构的现状。
07:57
Claude Code:GitHub Releases(RSS)
AI 评分 50/100
Claude Code v2.1.232 发布:默认启用 Subagent forking,新增 GitLab 支持与多项安全修复

Claude Code v2.1.232 默认启用 subagent forking,子代理可继承完整对话与提示缓存,交互会话中的非队友代理默认后台运行。新增 GitLab token 密钥脱敏、插件市场 GitLab 仓库克隆支持,并修复 PowerShell 与 Windows 权限绕过、嵌套 git 仓库信任继承等多项安全漏洞。

AnthropicMCP/工具产品更新编码
07:50
Claude:Blog(网页)
AI 评分 50/100
JetBrains CTO 谈如何评估并部署 Claude Fable 5:私有仓库评测、效率提升与安全策略

JetBrains CTO Vladislav Tankov 详解其团队如何用私有仓库评测前沿模型,并决定何时采用 Claude Fable 5。该模型在其评测中 Python 通过率达 44.3%,较 Opus 4.8 的 28.2% 提升 16 个百分点,且解题步骤减少约 22%。JetBrains 将安全与数据保留视为部署核心,偏好零数据保留,但接受为调查最严重问题而进行的有限审查。

Anthropic安全/对齐编码行业动态
02:23
Cursor Blog精选
AI 评分 65/100
Cursor 推出 builds:云智能体启动速度提升至 3 倍

Cursor 推出 builds 功能,在后台持续准备就绪的开发环境副本,让云智能体启动时无需从零搭建,响应速度最高提升 3 倍。内部环境启动快 10 倍,首个 token 生成快 3 倍;智能体始终从最近一次成功的 build 启动,依赖更新或安装脚本出错时不会影响运行。8 月 17 日起所有环境默认启用 builds,无需额外费用。

智能体产品更新编码部署/工程

推荐理由:把环境准备从每次会话冷启动改为后台持续快照,云代理长任务的启动成本和中断风险降低,为把更多工程流程交给自动代理提供了更可靠的运行基础。
01:22
Google DeepMind:Blog(RSS)精选
AI 评分 72/100
Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型

Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。

智能体Google模型发布编码
另有 16 家信源报道X:Logan Kilpatrick (@OfficialLoganK)IT之家(RSS)X:Ammaar Reshi (@ammaar)X:Rohan Paul (@rohanpaul_ai)Ars Technica:AI(RSS)X:Demis Hassabis (@demishassabis)MarkTechPost(RSS)X:Gemini (@GeminiApp)X:Google AI for Developers (@googleaidevs)X:Google AI (@GoogleAI)X:Google DeepMind (@GoogleDeepMind)X:Sundar Pichai (@sundarpichai)The Decoder:AI News(RSS)X:Elvis Saravia (@omarsar0, DAIR.AI)X:Artificial Analysis (@ArtificialAnlys)X:fofr (@fofrAI)
推荐理由:相比 3.6 Flash,价格减半且 FrontierCode 和 DeepSWE 分数提升,让成本敏感型编码智能体团队有了新的性价比基线。

8月13日

星期四 · 8 条
23:23
Cursor Blog
AI 评分 55/100
Cursor 获得 AIUC-1 认证,通过智能体安全与可靠性独立审查

Cursor 通过独立审查与对抗性测试,正式获得 AIUC-1 认证,该标准由 100 多家财富 500 强 CISO 参与制定,并获 MITRE、云安全联盟及斯坦福研究者的技术支持。测试覆盖 IDE 和云端智能体,涉及规则、hooks 与 Auto-review 等防护机制,Cursor 在数千个场景中通过全部要求。维持认证需至少每季度复测一次,并每年接受全面审计。

智能体安全/对齐编码
19:20
公众号:火山引擎
AI 评分 46/100
亚信×火山引擎:6000+席位用TRAE跑通企业级AI研发

亚信与火山引擎合作,通过TRAE IDE将AI Coding融入研发交付全链路,已实现6000+研发席位规模化部署,研发团队AI编码贡献率达32%,SDLC整体提效15%,核心团队代码缺陷逃逸率下降69%~71%。双方还基于TRAE打造“天枢·元衡”Token ERP,构建精准计量、分级计费、智能核算的三层度量体系,实现Token成本可算、可控、可审计。

编码行业动态部署/工程
16:57
Claude Code:GitHub Releases(RSS)
AI 评分 18/100
Claude Code v2.1.231 发布

Anthropic 发布 Claude Code v2.1.231。该版本为终端内的智能体编码工具,可通过自然语言指令执行日常任务、解释复杂代码并处理 git 工作流,帮助开发者提升编码速度。

Anthropic产品更新编码
05:15
OpenRouter:Announcements(RSS)
AI 评分 61/100
OpenRouter 工具调用指南:一次编写循环,切换模型字符串即可跨模型运行

OpenRouter 发布工具调用指南,展示如何用同一套代码在 Claude、GPT 和开源权重模型间切换,仅需更改模型字符串。指南涵盖定义工具、发送请求、读取 tool_calls 响应、执行函数并返回结果的完整循环,支持 OpenAI 兼容的 JSON schema,并提供 cURL、Python 和 JavaScript/TypeScript 示例。

MCP/工具教程/实践编码
04:57
Claude Code:GitHub Releases(RSS)
AI 评分 50/100
Claude Code v2.1.229 发布:新增远程会话恢复、插件市场命令源及多项修复

Claude Code v2.1.229 发布,新增远程控制会话恢复、自托管 runner 的服务器端 hook 支持,以及插件市场命令源。修复了长响应流式输出丢失、窄终端渲染崩溃、Windows 扩展路径崩溃等问题。改进工作流扇出以复用缓存提示前缀,并调整 /commit-push-pr 对危险 git/gh 命令不再自动批准。

Anthropic产品更新编码部署/工程
03:59
GitHub Blog
AI 评分 27/100
GitHub Copilot 应用如何写出你的第一条提示词

GitHub Copilot 应用发布入门指南,教用户写出第一条提示词,并学会选择合适的上下文与模型,从而自信地开启首个任务。该指南面向 Copilot 应用的新手用户,帮助其快速上手提示词编写。

GitHub教程/实践编码
02:23
Cursor Blog精选
AI 评分 70/100
Cursor 与 SpaceXAI 联合发布 Grok 4.6

Cursor 与 SpaceXAI 今日发布 Grok 4.6,重点强化长时运行智能体与交互式视觉任务,在多项智能体编程与知识工作基准上达到前沿水平,并在 Artificial Analysis Intelligence Index 上追平 GPT-5.6 Sol。

智能体模型发布编码
另有 6 家信源报道IT之家(RSS)X:阿易 AI Notes (@AYi_AInotes)Hacker News 热门(buzzing.cc 中文翻译)X:Artificial Analysis (@ArtificialAnlys)The Decoder:AI News(RSS)X:cb_doge (@cb_doge)
推荐理由:长程轨迹中出现自检与验证,对需要模型持续执行多步项目的团队,可能减少中途人工纠偏,比单纯基准分更有参考价值。
00:09
xAI:News(网页)精选
AI 评分 77/100
xAI 发布 Grok 4.6,强化长时运行智能体能力

xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol。

智能体xAI模型发布编码
另有 9 家信源报道X:Testing Catalog (@testingcatalog)X:Elon Musk (@elonmusk, xAI)IT之家(RSS)X:Lee Robinson (@leerob)X:阿易 AI Notes (@AYi_AInotes)X:Kim (@kimmonismus)The Decoder:AI News(RSS)X:cb_doge (@cb_doge)MarkTechPost(RSS)
推荐理由:与 GPT-5.6 Sol 在智能体综合基准上持平,同时把输入 token 价格定在 2 美元,长任务应用的试错成本可能重新计算。

8月12日

星期三 · 4 条
03:56
Claude Code:GitHub Releases(RSS)
AI 评分 39/100
Claude Code v2.1.228 发布:修复交互会话重绘、Windows Git 检测及多项稳定性问题

Claude Code v2.1.228 发布,修复了交互会话在内部布局错误后停止重绘、Windows 下从 Git 安装父目录启动时无法找到 git/Git Bash、/tui 在 /model 更改后回退到旧模型等问题。

Anthropic产品更新编码
03:32
Databricks:Blog(RSS)
AI 评分 58/100
Databricks 开源 Metals v2:面向数百万行代码库的 Java 和 Scala 语言服务器

Databricks 开源 Metals v2,这是其面向数百万行代码库的 Java 和 Scala 语言服务器。Metals v2 专为智能体驱动的开发场景设计,旨在提升大规模代码库中的编辑与导航性能。目前 Databricks 的大部分代码已由智能体编写,该工具服务于工程师仍需要手动介入的环节。

产品更新编码
01:45
Microsoft AI:官方博客(网页)
AI 评分 24/100
MAI-Code-1.1-Flash: Better, faster, at a quarter of the cost
Microsoft模型发布编码
00:56
Google Developers Blog(RSS)
AI 评分 34/100
Go 为何是 AI 辅助软件工程的理想语言

Go 凭借严格的编译器、集成工具链和毫不妥协的可读性,为 AI 编码助手提供确定性护栏,帮助模型自我纠错并生成高度标准化的代码。通过强制生态一致性和严格向后兼容,Go 平台让工程团队能在生产环境中高效验证、优化和维护高速 AI 生成代码。

Google现象/趋势编码

8月11日

星期二 · 3 条
14:01
公众号:智谱(GLM)精选
AI 评分 71/100
ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线

ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。

智能体MCP/工具产品更新编码
另有 1 家信源报道IT之家(RSS)
推荐理由:Goal模式将复杂任务从需要开发者逐轮推动变为设定目标后自行迭代,搭配Subagents并行协作,适合跨文件重构和全栈开发的长流程任务。
07:56
Claude Code:GitHub Releases(RSS)
AI 评分 50/100
Claude Code v2.1.227 发布:修复订阅层级误判与 Bash 命令失败问题

Claude Code v2.1.227 修复了会话以过期登录 token 启动时功能标志未按用户订阅层级评估的问题,该问题曾错误提示 Max 计划用户为 Fable 启用用量积分。

Anthropic产品更新编码
03:58
GitHub Blog
AI 评分 31/100
GitHub Copilot SDK for Java 发布:用原生 Java 代码驱动 Copilot

GitHub 推出 Copilot SDK for Java,企业 Java 开发者可通过注解和虚拟线程等惯用 Java 代码直接驱动 GitHub Copilot。该 SDK 将 Copilot 能力嵌入 Java 开发流程,支持以原生方式集成 AI 编程助手功能。

GitHub产品更新编码

8月10日

星期一 · 1 条
23:44
OpenRouter:Announcements(RSS)精选
AI 评分 77/100
OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

OpenRouter 基于每周超 55T token 的社区消费数据,推出新版 Auto 路由器(openrouter/auto),其模型选择在多数任务和成本档位上优于旧版。新路由器按约 30 种任务类型匹配近 7 天社区实际消费的模型,支持 cost_tier 参数(low 至 max)并遵循账户隐私设置。在 MMLU Pro 等基准上,新默认档位在多数领域以更低成本达到旧版同等性能。

产品更新推理编码
另有 1 家信源报道X:OpenRouter (@OpenRouter)
推荐理由:基于平台每周55T token的社区支出分布,新路由将模型选择众包化,基准显示默认档成本下降超60%且多数任务性能不减,适合调用量大的应用。

8月8日

星期六 · 2 条
10:53
Claude Code:GitHub Releases(RSS)
AI 评分 17/100
Claude Code v2.1.226 发布

Anthropic 发布 Claude Code v2.1.226。该版本为终端内的智能体编码工具,可通过自然语言指令执行日常任务、解释复杂代码并处理 git 工作流,帮助开发者加速编码。

Anthropic产品更新编码
01:31
Databricks:Blog(RSS)
AI 评分 62/100
Databricks 如何规模化管控 AI 编程成本

Databricks 分享了规模化管控 AI 编程成本的方法,其智能体编程已带来可衡量的价值提升。文章重点探讨了在团队规模扩大时,如何通过成本追踪、工具选型与使用策略,在维持代码质量与开发效率的同时,控制 AI 编程工具带来的支出增长。

教程/实践编码

8月7日

星期五 · 1 条
03:53
GitHub Blog精选
AI 评分 69/100
GitHub Copilot 应用中的斜杠命令使用指南

GitHub Copilot 应用中的斜杠命令可帮助管理会话、导航项目和自定义 Copilot 工作流。与 CLI 版不同,应用版命令更侧重工作流,如 /plan 用于编码前规划、/spar 用于挑战方案假设、/autopilot 用于自动执行实现。/clear 和 /model 在 CLI 和应用中均可用。

智能体GitHub教程/实践编码

推荐理由:文章不是罗列命令,而是提供了可复用的场景模板,为 /plan、/spar 等命令配好了规划、评审和实现的具体提示词,省去从零组织任务描述的时间。

8月6日

星期四 · 1 条
23:21
Cursor Blog
AI 评分 58/100
Cursor Router 如何为任务选择合适模型

Cursor Router 通过 Compass 复杂度预测器和基于真实开发者流量的任务分类法,为每个对话轮次匹配最合适的模型。Auto Intelligence 模式在用户满意度超过 Fable 的同时成本降低 68%,Auto Balance 模式以低于 Opus 4.8 成本 41% 实现更优表现。系统从实时流量中学习模型在不同任务类别上的表现差异,以数据驱动方式替代基准分数推断。

智能体MCP/工具产品更新推理

8月5日

星期三 · 1 条
00:09
Claude:YouTube(RSS)
AI 评分 17/100
How auto mode works with Claude Code
Anthropic教程/实践编码

8月3日

星期一 · 2 条
16:19
公众号:火山引擎
AI 评分 47/100
火山引擎 Doubao-Seed-Evolving 再升级:检索更准、幻觉更少

火山引擎升级 Doubao-Seed-Evolving,聚焦 Coding 与 Agent 能力,提升复杂仓库修复、跨文件修改等工程任务稳定性,增强信息检索、缺失召回与多工具并行调用能力,并改善幻觉控制以减少基于错误检索结果的作答。该模型已上线火山 Agent Plan,单月套餐限时 9.9 元起,参与「体验奖励计划」调用成本立减 20%。

智能体模型发布编码
10:10
Qwen:Blog Retrieval(API)精选
AI 评分 89/100
Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数

Qwen 正式发布 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,拥有 2.4T 参数(95B 激活),并首次开源 Qwen-Max 级权重,开放权重将于下周发布。

智能体多模态模型发布编码
另有 7 家信源报道X:通义千问 / Qwen (@Alibaba_Qwen)IT之家(RSS)X:Nathan Lambert (@natolambert)X:阿易 AI Notes (@AYi_AInotes)X:Kim (@kimmonismus)X:Testing Catalog (@testingcatalog)公众号:数字生命卡兹克
推荐理由:首次将 Max 级模型权重开源,为开源社区提供比肩闭源旗舰的能力,但实际效果需待下周权重放出后由社区验证。

8月1日

星期六 · 2 条
01:26
LangChain:Blog(RSS)
AI 评分 50/100
LangChain 推出 ReviewBench:用真实 PR 反馈评测代码审查智能体

LangChain 构建了 ReviewBench,一个用于评测代码审查智能体的基准,其评估依据来自可信审查者对真实 PR 的反馈。该基准旨在衡量智能体在代码审查任务中的表现,为开发者提供更贴近实际场景的评测标准。

智能体编码评测/基准
00:52
GitHub Blog
AI 评分 54/100
GitHub 开源 casefold:以内存速度进行源码大小写折叠

GitHub 为代码搜索引擎 Blackbird 优化大小写折叠性能,该引擎索引超 1.8 亿个仓库、480TB 源码。团队发现移除提前退出分支比保留优化更快,最终在 Apple M4 上实现超 45 GiB/s 吞吐,接近内存带宽。结果已开源为 Rust crate casefold,仅实现简单(1 对 1)折叠,与 ripgrep 等工具保持一致。

GitHub教程/实践编码部署/工程

7月31日

星期五 · 2 条
01:51
GitHub Blog精选
AI 评分 65/100
GitHub Copilot 应用新增堆叠会话与拉取请求功能

GitHub Copilot 应用推出堆叠会话功能,允许用户在同一个仓库中创建一系列相互承接的任务,每个会话可基于前一个会话的成果继续工作。作者通过一个十余年历史的个人项目演示了该功能:先使用 Plan 模式制定前端现代化计划,再通过堆叠会话将 React-Bootstrap 替换工作拆分为独立会话,并自动为每个会话创建对应的拉取请求,避免范围蔓延。

GitHub产品更新编码

推荐理由:GitHub Copilot 的堆叠会话让多步骤 PR 拆分成链,Cassidy 用十年老项目演示如何避免巨型改动,对 Copilot 用户是可直接套用的实操指南。
00:00
DeepSeek:API 更新日志精选
AI 评分 72/100
DeepSeek-V4-Flash 正式版 API 上线公测

DeepSeek-V4-Flash 正式版 API 上线公测,模型名设为 deepseek-v4-flash 即可使用,调用方式不变。其 Agent 能力大幅增强,Terminal Bench 2.1 得分 82.7,NL2Repo 54.2,Toolathlon verified 70.3,DSBench-Hard 59.6,多项基准远超 V4-Pro-Preview。

智能体DeepSeek模型发布编码
另有 5 家信源报道X:DeepSeek (@deepseek_ai)X:阿易 AI Notes (@AYi_AInotes)X:Emad Mostaque (@EMostaque)X:Rohan Paul (@rohanpaul_ai)IT之家(RSS)
推荐理由:DeepSeek V4-Flash 正式版 Agent 能力大幅跃升,多个编码 agent 基准分数翻倍,对做代码助手的团队是个高性价比的生产力入口。虽然是 Flash 版,但后训练打磨的成果让人更期待 Pro 正式版。

7月30日

星期四 · 1 条
23:20
Cursor Blog
AI 评分 53/100
Cursor 如何为云智能体构建开发环境

Cursor 将开发环境本身作为面向智能体的产品来构建,使云智能体能测试代码变更。团队通过统一跨平台工具链、开发 CLI 工具 anydev 简化构建命令,并构建 Cursor Cloud MCP 实现环境自愈。目前,云智能体在 Cursor 单体仓库中提交的合并 PR 占比已从去年 12 月的约十分之一升至过半。

教程/实践编码部署/工程

7月29日

星期三 · 2 条
01:44
Tomer Tunguz 博客(VC 分析)
AI 评分 58/100
AI 框架(Harness)对模型性能的影响超过模型本身:GPT-5.5 在 Cursor 上得分 87.2%,比 Codex 高 25.7 个百分点

Endor Labs 测试发现,同一模型在不同框架(Harness)上性能差异巨大:OpenAI 的 GPT-5.5 在原生 Codex 框架上功能正确率为 61.5%,在 Cursor 上达 87.2%;Anthropic 的 Opus 4.7 在 Claude Code 上为 87.2%,在 Cursor 上为 91.1%。

AnthropicOpenAI大佬观点编码
01:25
Databricks:Blog(RSS)
AI 评分 49/100
Databricks 用 Unity AI Gateway Budgets 管理内部编码智能体支出

Databricks 通过 Unity AI Gateway Budgets 管理内部编码智能体的 API 调用成本,为不同团队设置预算上限并实时监控支出。该系统支持按项目、用户或模型分配额度,超出阈值时自动触发告警或限流。此举旨在控制 AI 工具使用成本,同时避免影响开发效率。

教程/实践编码部署/工程

7月28日

星期二 · 2 条
22:30
公众号:百度智能云(文心)
AI 评分 57/100
Unity中国发布团结引擎2.0,AI Agent"团结Codely"与百度智能云合作落地私有化AI Coding

7月28日,Unity中国发布团结引擎2.0,围绕核心引擎能力、跨平台部署、AI原生架构三大方向升级,其中可独立执行游戏开发任务的AI Agent“团结Codely”正式亮相。该Agent覆盖代码搜索、代码生成、IDE智能编辑等能力,基于百度百舸AI计算平台和昆仑芯P800等异构算力完成私有化部署验证,支持GLM、Kimi等开源模型推理适配,实现数据不出内网、模型服务可控的AI研发产线。

产品更新编码部署/工程
另有 1 家信源报道IT之家(RSS)
22:16
公众号:百度智能云(文心)
AI 评分 38/100
Unity中国发布团结引擎2.0,携手百度智能云推出AI Agent"团结Codely"

Unity中国7月28日发布团结引擎2.0,围绕核心引擎能力、跨平台部署、AI原生架构三大方向升级,并推出可独立执行游戏开发任务的AI Agent“团结Codely”。该Agent覆盖Web、IDE、命令行等场景,提供代码搜索、生成、智能编辑及引擎开发辅助能力。百度智能云基于百舸平台与昆仑芯P800国产算力,协助完成GLM、Kimi等开源模型的推理适配与私有化部署验证。

智能体产品更新编码部署/工程
已加载 40 条