OpenRouter数据显示,84%的模型token并非来自SOTA模型,用户最常用的六款模型性能约为前沿模型的77%,成本仅为Claude Fable 5的2.5%。8月10日当周,六款模型承载了80%流量,混合价格约$0.50/百万token,而Fable 5为$20。最佳开源模型性能已从一年前的48%提升至前沿模型的80%,企业正转向更小、微调或开源模型以优化性价比。
Claude Code v2.1.233 发布,为 --worktree 标志和 agents 视图新增 GitLab 合并请求 URL 支持,并添加可选的 forward_user_identity 网关设置以按用户归因支出。
未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。
另有 1 家信源报道X:Anthropic (@AnthropicAI)Claude Code 的 token 成本由模型、输入/输出 token 和提示缓存三因素决定,输出 token 价格约为输入的 5 倍。任务间运行 /clear 可减少无关上下文回传,降低 token 用量;会话中途切换模型或 effort 级别会破坏提示缓存,增加成本。
Claude Code v2.1.232 默认启用 subagent forking,子代理可继承完整对话与提示缓存,交互会话中的非队友代理默认后台运行。新增 GitLab token 密钥脱敏、插件市场 GitLab 仓库克隆支持,并修复 PowerShell 与 Windows 权限绕过、嵌套 git 仓库信任继承等多项安全漏洞。
JetBrains CTO Vladislav Tankov 详解其团队如何用私有仓库评测前沿模型,并决定何时采用 Claude Fable 5。该模型在其评测中 Python 通过率达 44.3%,较 Opus 4.8 的 28.2% 提升 16 个百分点,且解题步骤减少约 22%。JetBrains 将安全与数据保留视为部署核心,偏好零数据保留,但接受为调查最严重问题而进行的有限审查。
Anthropic 数据团队将 Claude Tag(公开测试版)作为 Slack 中数据分析智能体的基础,让非分析师也能用受治理的语义层提问并获得答案。团队分享了五项关键经验:将技能文件视为持续刷新的内容、为智能体配备预测/留存/漏斗等分析技能、接入内部知识索引而非仅连接数仓,并强调权限、数据新鲜度与可观测性的设计。
Anthropic 发布 Claude Code v2.1.231。该版本为终端内的智能体编码工具,可通过自然语言指令执行日常任务、解释复杂代码并处理 git 工作流,帮助开发者提升编码速度。
Anthropic 研究指出,随着 AI 智能体在共享代码库、市场等社会系统中承担更多任务,智能体间交互量或将超过人机交互。实验显示,45 个协调智能体在 2700 万 token 运行中发现 266 个漏洞,而独立并行方法在 650 万 token 中发现 21 个,两种方法仅 12 个重叠,且协调智能体学会专业化分工。研究同时警示个体层面的良性行为怪癖可能叠加为意外的系统性失败。
Claude Code v2.1.229 发布,新增远程控制会话恢复、自托管 runner 的服务器端 hook 支持,以及插件市场命令源。修复了长响应流式输出丢失、窄终端渲染崩溃、Windows 扩展路径崩溃等问题。改进工作流扇出以复用缓存提示前缀,并调整 /commit-push-pr 对危险 git/gh 命令不再自动批准。
Claude in Chrome 浏览器扩展的侧边栏现已升级为 Claude Cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换。
另有 1 家信源报道The Decoder:AI News(RSS)Anthropic 与独立研究者 David Roodman 合作发布报告,基于 56 项美国随机研究和欧洲实验证据,评估工人再培训项目应对 AI 劳动力市场冲击的效果。
Claude Platform 的 Compliance API 现可返回用户设备上 Cowork 和 Claude Code 会话的转录记录,面向 Claude Enterprise 组织开放测试。新增三个端点分别用于列出组织内会话、获取单个会话元数据及返回其转录内容,均使用现有 Compliance Access Key 和 read:compliance_user_data 权限。
作者在完成一本 RLHF 教科书后反思,LLM 在长文非虚构写作上进展停滞,GPT 4.5 和 Kimi K2 等写作强模型已显老旧,而编码、数学等任务已接近超人水平。模型能改错字、做编辑,但组织整章内容时仍混乱且易出错,作者认为这阻碍了模型自主解决开放科学问题。
另有 1 家信源报道X:Nathan Lambert (@natolambert)Claude Code v2.1.228 发布,修复了交互会话在内部布局错误后停止重绘、Windows 下从 Git 安装父目录启动时无法找到 git/Git Bash、/tui 在 /model 更改后回退到旧模型等问题。
Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进(RSI)的可能性:一旦AI达到人类顶级专家水平,可能在一年内实现相当于4-5年的AI进展,Ryan的中位预期是2031年自动化AI研发。双方还讨论了超级智能的对齐对象、奖励黑客行为是否会升级为AI联手接管世界等风险。
Claude Sonnet 5 的入门定价 $2/$10 每 MTok 现已成为标准价格,原定于 2026 年 9 月 1 日上调至 $3/$15 每 MTok 的计划将不再执行。
Claude Code v2.1.227 修复了会话以过期登录 token 启动时功能标志未按用户订阅层级评估的问题,该问题曾错误提示 Max 计划用户为 Fable 启用用量积分。
Anthropic 员工让 Claude 尝试攻克黎曼猜想,虽未成功,但一个未发布的研究版 Claude 在相关问题上取得突破:将满足黎曼猜想的 zeta 函数零点比例下界从 41.6% 提升至 67.2%。
另有 7 家信源报道X:Deedy Das (@deedydas)X:Anthropic (@AnthropicAI)X:阿易 AI Notes (@AYi_AInotes)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)TechCrunch:AI(RSS)X:Kim (@kimmonismus)Anthropic 发布 Claude Code v2.1.226。该版本为终端内的智能体编码工具,可通过自然语言指令执行日常任务、解释复杂代码并处理 git 工作流,帮助开发者加速编码。
Claude Code v2.1.225 为用量警告新增网关支出限额支持,达到限额时提示将显示上限、重置时间及操作者消息。该版本还为不受信任目录中的 claude agents 增加工作区信任提示,并修复了 MCP OAuth 服务器在 macOS 上的间歇性 401 错误、跨会话消息滞留及 Remote Control 会话恢复后对话历史损坏等问题。
Claude Code v2.1.224 发布,新增自托管环境功能,可将自有机器或容器作为 Team 和 Enterprise 计划下 Web、移动端及桌面会话的运行场所。该版本还支持跨会话消息互发、从 HTTPS zip 安装插件,并移除了每会话 200 个子智能体的生成上限。此外修复了沙箱文件系统拒绝规则可被绕过、长项目路径串会话等多项问题。
Anthropic 更新了 Claude Fable 5 的生物安全防护机制,将生物相关查询的“回退”次数减少约 85%,用户在日常健康与教育问题上将更少遇到系统切换至较弱模型的情况。此次更新扩大了模型可协助的生物任务范围,但涉及双重用途的病毒学、毒理学和分子设计请求仍会回退至 Opus 5。Anthropic 表示正通过可信访问途径,致力于缩小专业生物研究与药物开发领域的差距。
另有 1 家信源报道X:Claude (@claudeai)Claude Platform 为 Managed Agents 会话新增预算硬上限,按公开列表价计费,达到上限后会话暂停并返回 budget_reached 停止原因,调整或移除预算可恢复。会话可配置顾问模型,供主线程在推理中途咨询战略建议。此外,可在创建智能体时设置 inference_geo 控制推理地域,并支持从 GitHub 仓库自动加载技能。
Claude Code v2.1.223 发布,为严格已知市场和屏蔽市场设置新增“owner/*”通配符条目,可批量允许或阻止 GitHub 组织下的所有市场仓库。
Claude Platform 面向 Claude Enterprise 组织推出推理钩子(Inference hooks)Beta 版。该功能可将 claude.ai、Cowork 和 Claude Code 中的每个受管控提示词交由组织的 AI 安全服务器进行允许或拒绝判定,再继续推理。请求经过签名,失败处理可配置,每次拒绝都会记录在合规性 Activity Feed 中。
Claude 发布企业版成本控制指南,帮助 IT 管理员通过访问门控、模型权限、硬性支出上限等工具管理 Claude Enterprise 支出。指南建议以成本/成果而非 token 消耗衡量价值,并介绍了用量分析、数据导出、Analytics API 及分析聊天等监控功能。API 用户可通过提示词缓存(缓存命中成本为正常输入费率 10%)、批处理(半价)和 effort 参数等杠杆降低成本。
Claude Code v2.1.222 发布,修复了工作树隔离会话及其子代理可对主检出运行破坏性 git 命令的问题,隔离现适用于所有会话类型的文件编辑和 Bash。
科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却在上涨:Anthropic 7 月 24 日发布的 Fable 5 定价每百万输出 token 50 美元,较 Opus 5 翻倍;OpenAI 则在 Fable 5 发布五天后将 GPT-5.6 Luna 价格下调 80%。
Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 为首任首席全球事务官,负责全球政策、国际战略参与及政府关系事务。Cuéllar 曾任卡内基国际和平基金会主席、加州最高法院法官,并自 2026 年 1 月起担任 Anthropic 长期利益信托受托人,现已卸任该职务加入公司。
另有 1 家信源报道X:Rohan Paul (@rohanpaul_ai)OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenCode、Hermes 等 harness 的优化配置,省去手动设置大量环境变量的麻烦。
另有 1 家信源报道X:OpenRouter (@OpenRouter)Claude Code v2.1.221 发布,为 VSCode 新增 Focus view 聊天菜单开关,可隐藏工具活动并显示实时运行指示器。新增 Linux/WSL 沙箱凭据文件 "mask" 模式,并修复 zsh 隐藏命令执行、PowerShell 路径引号处理等多项权限检查绕过问题。同时改进 Vertex AI 工具搜索、自动模式权限检查缓存效率,并降低提示词缓存成本。