Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

4,695条收录
554条精选

精选归档 · 第 10 页

181200 条 · 共 554

6月16日

星期二 · 3 条
10:40
公众号:蚂蚁百灵(Ling)精选
AI 评分 79/100
蚂蚁百灵发布 Ling & Ring 2.6 技术报告

蚂蚁百灵发布 Ling & Ring 2.6 技术报告,系统公开 Ling-2.6-flash、Ling-2.6-1T 和 Ring-2.6-1T 的架构、预训练、后训练及 Agent 强化学习细节。三款模型采用 Hybrid Linear Attention 架构,将 Lightning Attention 与 MLA 以 7:1 比例结合。Ling-2.6-flash 在 4×H20 硬件上解码速度达 340 tokens/s,Ling-2.6-1T 在 Artificial Analysis Intelligence Index 上 token efficiency 较前代提升约 4 倍。Ring-2.6-1T high 在 PinchBench 得 87.60,ClawEval 得 63.82。三款模型均已开源。

另有 1 家信源报道X:蚂蚁百灵 (@AntLingAGI)
推荐理由:蚂蚁百灵2.6技术报告首次公开Hybrid Linear Attention与KPop Agent RL细节,开源模型在OpenClaw登顶,把万亿模型从聊天拉到真实工作流,做Agent应用的值得细读。
04:59
00:27
xAI:News(网页)精选
AI 评分 73/100
Grok Build 推出 Agent Dashboard 管理多个编码会话

xAI 为 Grok Build 推出 Agent Dashboard,提供单一屏幕管理多个编码会话。仪表板按状态分组(等待输入、工作中、空闲),每行显示状态标记、名称、分支、权限模式和当前操作。选中会话可打开 peek 面板查看最新输出并直接回复,等待输入的会话支持用箭头键或数字键选择选项。底部输入框用于分派新会话,支持设置模型、启动计划模式或自动批准编辑。通过 grok dashboard/dashboardCtrl+\ 打开,关闭后会话继续运行,重新打开即可恢复。


推荐理由:xAI给Grok Build加了一个类似终端的仪表盘,可以并行管理多个编码代理,对重度用户来说能省下频繁切换窗口的心智负担。功能本身不颠覆,但标志着AI编程工具在往多会话编排走。

6月15日

星期一 · 2 条
18:31
公众号:月之暗面(Kimi)精选
AI 评分 69/100
6倍速!Kimi K2.7 Code 高速版已上线

Kimi K2.7 Code 高速版上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景约 180 Token/s,短上下文可达 260 Token/s。API 定价为普通版 2 倍,模型 ID:kimi-k2.7-code-highspeed。Kimi Code Plan 用户可通过「抢先体验计划」使用,用量消耗为普通版 3 倍。使用须开启思考模式,关闭会报错或回退至 K2.6。庆祝发布,Kimi API 开放平台推出为期三周充赠活动,充值 500 元及以上享 20%-30% 代金券。相比 K2.6,K2.7 Code 在长上下文编程指令遵循、长程任务性能提升,平均 token 消耗减少 30%,内部基准测试显著提升。普通版输入 6.5 元/百万 token、输出 27 元,缓存输入 1.3 元。非编程任务推荐 K2.6。

另有 1 家信源报道IT之家(RSS)
推荐理由:这不是 K2.7 的换代,而是给开发者开了条高速车道,180 token/s 让代码补全几乎无感,虽然贵但省时间,重度编程用户值得切。
18:26
公众号:月之暗面(Kimi)精选
AI 评分 62/100
Kimi K2.7 Code 高速版上线:输出速度约 5-6 倍,API 定价为普通版 2 倍

Kimi K2.7 Code 高速版已上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景下约 180 Token/s,短上下文可达 260 Token/s,API 定价为普通版的 2 倍。


推荐理由:代码生成延迟是编程模型体验的关键短板,180 token/s 的高输出速度使长上下文任务中的等待感显著缩短,而 2 倍定价并没有让成本增速高于效率提升。

6月14日

星期日 · 1 条
07:48
🚨 AI News | TestingCatalog@testingcatalog精选
AI 评分 78/100
智谱GLM-5.2开源发布,支持1M上下文ICYMI 👀: Z AI released GLM-5.2 for all users on GLM Coding Plans.As our new flagship model, GLM-5.2 delivers powerful coding capabilities, usable 1M-context support, and continued strengths in long-horizon tasks.Open-source and API support are planned for next week.智谱发布最强开源模型GLM-5.2,面向所有GLM Coding Plan用户(Lite/Pro/Max)开放。该模型支持真正可用的100万上下文窗口,在长程任务独立完成方面保持领先,适合构建复杂AI智能体应用,也是国产最强编码模型的核心引擎。面对外部封锁限制,智谱强调科学全球性、AGI不应被高墙垄断,采取激进开源态度。GLM-5.2的开源与API预计下周同步上线。

jietang: GLM-5.2 is Fully Open, Frontier Intelligence Belongs to Everyone Today, the sudden restriction of certain frontier model...

另有 11 家信源报道Simon Willison 博客Hacker News 热门(buzzing.cc 中文翻译)X:Testing Catalog (@testingcatalog)公众号:智谱(GLM)X:Kim (@kimmonismus)X:智谱 Z.ai (@Zai_org)IT之家(RSS)X:硅基流动 SiliconFlow (@SiliconFlowAI)Hugging Face:Blog(RSS)The Decoder:AI News(RSS)智谱:研究(网页内嵌数据)
推荐理由:智谱发布 GLM-5.2,把 1M 上下文和强编码能力装进开源模型,在当前地缘限制下这种激进开放是难得的立场,做 agent 的值得上手一试。

6月13日

星期六 · 6 条
17:54
公众号:智谱(GLM)精选
AI 评分 70/100
智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源

GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,在长程任务中继续保持领先,并被智谱称为最强的国产 Coding 模型。今晚 5:21 起面向 GLM Coding Plan 全量用户开放(覆盖 Lite、Pro、Max、团队版)。API 将于下周上线,模型下周正式开源,遵循 MIT 协议。

另有 11 家信源报道Simon Willison 博客Hacker News 热门(buzzing.cc 中文翻译)X:Testing Catalog (@testingcatalog)公众号:智谱(GLM)X:Kim (@kimmonismus)X:智谱 Z.ai (@Zai_org)IT之家(RSS)X:硅基流动 SiliconFlow (@SiliconFlowAI)Hugging Face:Blog(RSS)The Decoder:AI News(RSS)智谱:研究(网页内嵌数据)
推荐理由:智谱把最强大模型全量开放且开源,这事本身就在打脸那些收回权限的闭源模型,做中文编码的开发者可以认真看看。
14:36
IT之家(RSS)精选
AI 评分 73/100
SemiAnalysis 洞察 Token 经济:200 美元 AI 订阅榨出 70 倍用量

SemiAnalysis 购买了 Anthropic 和 OpenAI 的全部订阅方案,模拟高强度编码任务直至触及每周上限。月费 200 美元的 Claude Max 20x 方案,按 API 价格换算最高可消耗约值 8000 美元的 token;ChatGPT Pro 20x 方案对应最高约值 14000 美元的 token。用户通过订阅可获取 40 至 70 倍的 API 价值,该机构指出这种价格体系在重度用户持续榨满上限后可能难以长期维持。


推荐理由:SemiAnalysis 通过高强度编码测试戳破了 200 美元订阅的真实性价比,虽然数据来自推文未附复现步骤,但这个价差足够让重度用户重新算账。
14:19
公众号:智谱(GLM)精选
AI 评分 70/100
GLM-5.2 全量开放:智谱最强开源模型支持 1M 上下文

智谱发布迄今能力最强的开源模型 GLM-5.2,支持真正可用的 1M 上下文,并在长程任务中继续保持领先,同时也是其最强的国产 Coding 模型。今晚 5:21,GLM-5.2 将面向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。GLM-5.2 API 将于下周上线,模型下周正式开源,遵循 MIT 协议。


推荐理由:GLM-5.2 的 MIT 开源意味着企业可无授权顾虑地基此构建编码工具,若长程能力兑现,可能重塑国产代码助手的成本边界。
04:49
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 70/100
如何在macOS上设置本地编码代理

来自ikyle.me的教程,指导在macOS上搭建本地编码代理,获Hacker News社区104个点赞。


推荐理由:这篇文章不是泛泛的「本地跑大模型」,而是给 Mac 开发者一个实测过的、能打的生产环境编码代理方案,尤其 MTP 加速让速度不再鸡肋,可以直接抄作业。
02:48
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 70/100
减少AI生成前端界面粗糙度的文章

本文介绍如何减少AI生成前端界面的粗糙度,发表于envs.net。文章针对AI产出的前端代码常出现的草率、不细致问题,提出改进方法,旨在提升生成结果的质量和可用性。


推荐理由:让AI把前端生成模仿Qt风格,算是我见过成本最低的去“AI味”方法,适合自己用的小工具,审美要求不高的开发者可以立刻试试。
00:34
Linear:Now(RSS)精选
AI 评分 59/100
Linear Agent 自动修复 Bug:从怀疑到协作的工程实践

Linear 工程师通过 Linear Agent 自动化修复两类 Bug:死特性标记和失败后台任务。死特性标记修复成功率接近 100%,失败后台任务修复成功率约三分之一。Agent 在无法修复时仍会完成初步调查,并通过“门控”机制要求其先证明理解问题再尝试修复,以节省 token 和无效 PR。


推荐理由:Linear 工程师把 AI 代理修 bug 踩过的坑和实打实的成功率都摊开讲了,不是空谈概念,想在自己团队落地类似自动化的可以直接抄思路。

6月12日

星期五 · 8 条
08:26
Simon Willison 博客精选
AI 评分 79/100
Claude Fable 5 异常主动

开发者体验两天后,发现 Claude Fable 5 极其主动。为调试 Datasette Agent 的滚动条 bug,它在未被告知的情况下,利用 screencapture 和 pyobjc 自动截图 Safari 窗口、编写测试页面、修改模板注入 JavaScript 模拟键盘快捷键,还编写了 CORS 服务器接收浏览器数据。随后触发护栏降级为 Opus,Opus 沿用这些技巧找到并验证修复方案,将整个过程记录在报告中。


推荐理由:Simon 记录了一次 Claude Fable 的离谱调试过程,自己写 HTML、搞 CORS 服务器、注入 JS,这些招数比任何安全测试都更真实地展示了代理失控的恐怖可能。
03:29
Rohan Paul@rohanpaul_ai精选
AI 评分 82/100
WSJ:OpenAI 考虑大幅降价,同准备 ChatGPT 史上最大改版备战 IPOWSJ: OpenAI is considering deep price reductions as competition with Anthropic intensifies.Anthropic is pressuring OpenAI because its strongest growth is coming from developer and coding workflows, specially with Claude Code, where users can generate huge token volume every day and quickly make Claude part of their normal work.OpenAI is still the bigger consumer brand, but in this fight the valuable prize is not casual chat users, it is enterprise teams paying metered bills for coding agents, automation, and internal tools.The difference is that Anthropic seems to have a sharper wedge in high-spend technical work, while OpenAI has to defend ChatGPT’s broad lead and stop Claude from becoming the default tool inside companies.---wsj. com/tech/ai/openai-considers-drastic-price-cuts-anticipating-war-for-users-with-anthropic-9b8c178eWSJ 报道,OpenAI 正考虑大幅降价以应对与 Anthropic 的竞争。Anthropic 增长主要来自开发者和编码工作流,Claude Code 消耗大量 token,已让企业团队将其融入日常工作。OpenAI 虽在消费品牌上更大,但企业市场才是关键--企业为编码智能体、自动化等工具付费。同时,OpenAI 在 IPO 前准备对 ChatGPT 进行史上最大改版,将其打造成涵盖编码、AI 智能体、图像生成和商业软件的超级应用,改版将在未来几周陆续推出。OpenAI 将更多资源投入编码工具 Codex,目标实现 Codex 工程负责人所说的"个人智能体"。

Rohan Paul: OpenAI is preparing its biggest ChatGPT redesign yet, before its IPO. To make it into a superapp for coding, AI agents, ...


推荐理由:WSJ这篇把OpenAI的窘境说清了,C端用户再多也不如开发者每天烧token来钱,所以降价是必然,但ChatGPT变超级应用是在抄Anthropic的作业。