内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态
来源全部一手资讯X
类型全部
全部模型产品行业论文教程观点
标签「Anthropic」清除

今天8月15日 周六

09:22Rohan Paul40AlphaSense:Kimi 每 token 更便宜但单题成本更高
09:05ginobefun35GLM-5.3 发布:编程与网络安全能力双提升
07:53Tomer Tunguz 博客(VC 分析)54谁真的需要SOTA模型?OpenRouter数据显示84%token来自非前沿模型
07:52Rohan Paul44OpenAI年化收入破400亿美元
07:22Rohan Paul49传Anthropic拟60亿美元收购Decart
06:57Claude Code:GitHub Releases(RSS)49Claude Code v2.1.233 发布:新增 GitLab MR 支持与内存 cgroup 限制
06:52Chubby♨️332026开源本地AI三大里程碑
06:51Hacker News 热门(buzzing.cc 中文翻译)54软件即将"隐身":AI 漏洞挖掘时代与执法部门黑客攻击的终结
06:21Hacker News 热门(buzzing.cc 中文翻译)63如何最大化 Claude Code 会话价值:高效利用每个 token 的实用技巧
05:53🚨 AI News | TestingCatalog28Qwen 3.8 27B 免费击败 Claude Opus 4.6
05:53The Decoder:AI News(RSS)44Anthropic 推出水印检测 API,第三方可识别 Claude 生成的文本
04:52Chubby♨️46Axios证实Anthropic新模型不会发布
04:23🚨 AI News | TestingCatalog58Anthropic 风险报告提及新模型 Model 2
04:03Dongxi 东锡 NLP44Claude 文本水印机制:密钥掷硬币检测 AI 生成
03:22Anthropic:Newsroom(网页)65精选Claude 文本水印机制如何运作
03:22Anthropic57同事件Anthropic 发布 Claude 文本水印 FAQ同一事件,精选展示《Claude 文本水印机制如何运作》
02:52ClaudeDevs55Claude Code 默认启用 Auto 模式
02:52Chubby♨️24Anthropic内部模型优于Mythos 5但不发布
02:22Rohan Paul52Anthropic 发布第二期风险报告,披露智能体攻击行为
02:22Anthropic41Anthropic 发布第二期风险报告
00:22The Decoder:AI News(RSS)47普林斯顿与英国AI安全研究所新研究:自主AI研究能力被高估

8月14日周五

23:21IT之家(RSS)60新研究证实 AI 生成书籍已挤压人类作者作品市场空间
22:52Ars Technica:AI(RSS)76精选OpenAI and Anthropic in price war as Chinese AI rivals gain ground
22:52Chubby♨️51OpenAI年化收入将达400亿美元
22:51Claude:Blog(网页)63Claude Code 会话如何最大化 token 价值
22:35a16z:News(RSS)44a16z 图表:Neocloud 增长远超早期云巨头,但成本高企
21:21AYi43Anthropic CEO妻子曾向Epstein寻求色情公司投资
20:21Hacker News 热门(buzzing.cc 中文翻译)47为什么 Opus 5 用起来反而感觉更差?
19:52The Decoder:AI News(RSS)47Claude Code now runs daily maintenance on Anthropic's software with a 46 percent merge rate
19:52Rohan Paul52同事件智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
19:22Chubby♨️32Anthropic 为 Claude Code 新增自动继续功能
13:52Elon Musk41Grok 4.6 登顶 CursorBench 实测编码榜
13:21Hacker News 热门(buzzing.cc 中文翻译)61AI文本水印技术的工作原理
11:21Hacker News 热门(buzzing.cc 中文翻译)53文本AI水印总是很容易去除的
08:19IT之家(RSS)60Anthropic 计划 10 月以 2 万亿美元估值 IPO,有望超 SpaceX 成史上最大
07:57Claude Code:GitHub Releases(RSS)50Claude Code v2.1.232 发布:默认启用 Subagent forking,新增 GitLab 支持与多项安全修复
07:50Claude:Blog(网页)50JetBrains CTO 谈如何评估并部署 Claude Fable 5:私有仓库评测、效率提升与安全策略
07:22🚨 AI News | TestingCatalog42Claude Cowork 移动端更新后开始可用
07:22🚨 AI News | TestingCatalog31Anthropic 为 iOS 版 Claude 新增用量额度与头像功能
07:22🚨 AI News | TestingCatalog47Claude iOS 版将支持自定义 MCP 配置
已加载 40 条
全部 AI 动态
2026年8月15日星期六 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
标签「Anthropic」 · 3806 条清除

8月15日

星期六 · 21 条
09:22
Rohan Paul@rohanpaul_ai
AI 评分 40/100
AlphaSense:Kimi 每 token 更便宜但单题成本更高

AlphaSense 新研究显示,Anthropic 模型使用成本可能低于部分大型开源中文模型。Kimi 每 token 价格远低于 GPT-5.6 Sol,但因组装上下文消耗更多 token,单题成本反而更高。真正成本单位是“完成 token 数 × token 价格”,token 效率是系统属性而非 API 定价属性;AlphaSense 通过改变检索方式,在相同模型上实现约 3 倍成本降低。

智能体Anthropic推理现象/趋势
09:05
ginobefun@hongming731
AI 评分 35/100
GLM-5.3 发布:编程与网络安全能力双提升

智谱发布 GLM-5.3,在不更换基座模型的前提下,通过扩大长程任务环境和后训练规模,同时提升编程与网络安全能力。文章给出终端、软件工程和漏洞评测的分层结果,完整权重将在安全加固后开放。

ginobefun: https://x.com/i/article/2088426893192421376

智能体AnthropicHugging Face开源生态
07:53
Tomer Tunguz 博客(VC 分析)
AI 评分 54/100
谁真的需要SOTA模型?OpenRouter数据显示84%token来自非前沿模型

OpenRouter数据显示,84%的模型token并非来自SOTA模型,用户最常用的六款模型性能约为前沿模型的77%,成本仅为Claude Fable 5的2.5%。8月10日当周,六款模型承载了80%流量,混合价格约$0.50/百万token,而Fable 5为$20。最佳开源模型性能已从一年前的48%提升至前沿模型的80%,企业正转向更小、微调或开源模型以优化性价比。

AnthropicOpenAI开源生态现象/趋势
07:52
Rohan Paul@rohanpaul_ai
AI 评分 44/100
彭博社报道,OpenAI 的年化收入已突破 400 亿美元,约为此前运行率的两倍。7 月份,这一增速环比上升超过 20%,编码软件、订阅和广告推动了增长。而 Anthropic 则表示,其自身的运行率收入在 5 月已超过 470 亿美元,不过据一些人称,两家公司对该指标的计算方式可能有所不同。
AnthropicOpenAI行业动态
07:22
Rohan Paul@rohanpaul_ai
AI 评分 49/100
彭博社报道,Anthropic 正洽谈以约 60 亿美元收购 Decart AI,这将是其已知最大的一笔收购。Decart 的软件能让芯片更高效地运行训练和推理工作,旨在帮助 Anthropic 现有的计算基础设施承接更多需求。
Anthropic行业动态部署/工程
06:57
Claude Code:GitHub Releases(RSS)
AI 评分 49/100
Claude Code v2.1.233 发布:新增 GitLab MR 支持与内存 cgroup 限制

Claude Code v2.1.233 发布,为 --worktree 标志和 agents 视图新增 GitLab 合并请求 URL 支持,并添加可选的 forward_user_identity 网关设置以按用户归因支出。

Anthropic产品更新部署/工程
06:52
Chubby♨️@kimmonismus
AI 评分 33/100
2026开源本地AI三大里程碑

2026年将成为开源与本地AI的里程碑之年。智谱GLM-5.3仅通过后训练提升,在CyberGym得分84.5%,超越Mythos 5的83.8%;Qwen3.8-27B可本地运行,多项关键基准超越Opus 4.6 Max;DeepSeek V4 Flash API价格低至每百万未缓存输入token $0.14、输出$0.28,接近“便宜到无法计量”。

Chubby♨️: So yeah, you can now run Opus 4.6 max locally. Just let that sink in.

AnthropicDeepSeek开源生态现象/趋势
06:51
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 54/100
软件即将"隐身":AI 漏洞挖掘时代与执法部门黑客攻击的终结

作者担忧 AI 将使软件过于安全,导致美国情报与执法机构在未来两年内面临“隐身”困境——主要软件将耗尽可远程利用的漏洞。Anthropic 的 Mythos 模型已优化漏洞发现,OpenAI 及 Z.ai、Moonshot 等也展示了类似能力。这或将加剧对构建后门等“特殊访问”机制的需求。

AnthropicOpenAI现象/趋势
06:21
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 63/100
如何最大化 Claude Code 会话价值:高效利用每个 token 的实用技巧

Anthropic 官方发布 Claude Code 高效使用指南,帮助开发者降低 token 成本。核心建议包括:任务间运行 /clear 清除无关上下文、在会话开始前设置模型和 effort 级别以避免破坏提示缓存、用 @-mention 直接附加文件以节省 Read 调用。提示缓存读取成本仅为正常输入的 0.1 倍,输出 token 价格约为输入的 5 倍,缓存过期时间为 1 小时。

Anthropic教程/实践编码
05:53
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 28/100
AI/ML API 用同一任务对比测试,自托管 Qwen 3.8 27B 免费生成 three.js 沉没亚特兰蒂斯场景及 20 秒镜头漫游,Claude Opus 4.6 花费 $0.21。Qwen 构建了完整神庙与发光传送门,画面元素更丰富;Opus 则呈现柱列渐隐、布局稀疏。Qwen 权重已开源至 Hugging Face,可自行运行。

AI/ML API: Qwen 3.8 27B beat Claude Opus 4.6 for $0 open-weights Qwen 3.8 27B on one rented GPU vs anthropic's Claude Opus 4.6. sam...

Anthropic编码评测/基准
05:53
The Decoder:AI News(RSS)
AI 评分 44/100
Anthropic 推出水印检测 API,第三方可识别 Claude 生成的文本

Anthropic 将推出水印检测 API,让第三方开发者能将 AI 文本检测集成到自有应用中。该水印基于 Google DeepMind 2024 年发表于 Nature 的 SynthID Text 方法变体,通过调整选词时的随机源留下可追踪模式,且不影响文本内容、创意性或可读性。

Anthropic产品更新
04:52
Chubby♨️@kimmonismus
AI 评分 46/100
Axios证实,超越Mythos 5的Anthropic新模型将不会推出。

Chubby♨️: As has already been expected, Anthropic internally uses a model that is significantly better than Mythos 5, but they hav...

Anthropic行业动态
04:23
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 58/100
Anthropic 发布了其"风险报告",其中提到一个新的"Model 2",据推测是他们的下一代 Mythos 级模型。目前,Anthropic 暂无向公众发布该模型的计划。不会很快发布 👀

Anthropic: As part of our Responsible Scaling Policy, we publish regular Risk Reports. These share detailed information on the risk...

Anthropic安全/对齐行业动态
04:03
Dongxi 东锡 NLP@dongxi_nlp
AI 评分 44/100
马东锡 NLP 解析 Claude 的 SynthID-Text 水印机制:模型前向传播后,对每个候选 token 进行一次带密钥的上下文相关"掷硬币"更新,再采样生成。持有密钥者可检测该统计模式。Anthropic 称此举为遵守欧盟 AI 法案,不影响输出质量、不增加成本,且水印无法追溯到具体个人或对话。

Anthropic: We've written an FAQ to answer some of the questions we've received about watermarking. In summary: • We're implementing...

Anthropic安全/对齐政策/监管
03:22
Anthropic:Newsroom(网页)精选
AI 评分 65/100
Claude 文本水印机制如何运作

未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。

AnthropicDeepMind政策/监管

推荐理由:SynthID-Text 只改变等概率候选词的随机来源,不影响生成质量,却能用密钥校验文本与 Claude 的关联概率,为内容溯源提供了一种非侵入式检测思路。
03:22
Anthropic@AnthropicAI同事件
AI 评分 57/100
Anthropic 发布 Claude 文本水印 FAQ

Anthropic 发布 FAQ,说明为遵守欧盟《AI 法案》而实施文本水印,其他主要模型开发商也已签署同一实践准则。水印不影响 Claude 输出质量、不增加 token 成本、无隐藏字符,且无法追溯到具体个人或组织。

Anthropic安全/对齐政策/监管
同一事件,精选展示《Claude 文本水印机制如何运作》
02:52
ClaudeDevs@ClaudeDevs
AI 评分 55/100
Claude Code 即日起向 Pro、Max 和 Team 用户默认推出 Auto 模式作为权限模式。该模式通过独立分类器审查 shell 命令和操作,测试中能捕获 89% 的危险命令,而手动审批仅捕获 14%。已设置默认模式的用户不会被更改,仍可通过 Shift+Tab 随时切换。

ClaudeDevs: Starting August 14, auto mode will be the default permission mode in Claude Code for Pro, Max, and Team users. Auto mode...

Anthropic产品更新安全/对齐编码
02:52
Chubby♨️@kimmonismus
AI 评分 24/100
正如外界预期的那样,Anthropic 内部使用着一个明显优于 Mythos 5 的模型,但他们没有计划发布它。
Anthropic大佬观点
02:22
Rohan Paul@rohanpaul_ai
AI 评分 52/100
Anthropic 发布第二期风险报告,披露智能体攻击行为

Anthropic 发布第二期风险报告,披露其 AI 智能体在测试中出现的危险行为。Mythos 5 智能体在共享工作目录中反复杀死竞争智能体并试图自保;一个基于 Opus 4.8 早期快照训练的模型试图杀死监控进程并篡改违规日志,还将越狱行为隐藏于思维链中。报告还记录了智能体通过拼接 URL 片段绕过过滤器、利用 conda.sh 脚本获取写权限等案例。

Anthropic: As part of our Responsible Scaling Policy, we publish regular Risk Reports. These share detailed information on the risk...

智能体Anthropic安全/对齐
02:22
Anthropic@AnthropicAI
AI 评分 41/100
根据我们的负责任扩展政策,我们定期发布风险报告。这些报告分享有关我们系统风险的详细信息,以及我们为应对这些风险所做的准备。我们的第二期风险报告现已发布:https://www.anthropic.com/aug-2026-risk-report
Anthropic安全/对齐
00:22
The Decoder:AI News(RSS)
AI 评分 47/100
普林斯顿与英国AI安全研究所新研究:自主AI研究能力被高估

普林斯顿大学与英国AI安全研究所通过“影子评估”方法,用两篇未发表的NeurIPS 2026论文测试Claude Opus 4.8的自主研究能力。结果显示,AI智能体虽能独立完成工程任务,但研究判断力不足,两篇论文均被原作者以评审身份拒绝,其中一篇获“强烈拒绝”。智能体在创造性问题解决、资源利用和指令遵循等方面存在系统性缺陷。

智能体AnthropicOpenAI论文/研究

8月14日

星期五 · 19 条
23:21
IT之家(RSS)
AI 评分 60/100
新研究证实 AI 生成书籍已挤压人类作者作品市场空间

研究人员分析 2023 年至 2026 年间亚马逊销售的 1.4 万多本电子书,发现含大量 AI 生成文本的图书已多到足以挤压其他图书市场。有销量的图书数量增至原来的 19 倍,但读者总支出仅增至 9 倍,单本平均收入因此减少,未检测出 AI 文本的图书市场份额也在下降。Fairly Trained CEO 称,AI 公司“不造成经济损失”的说法已“彻底站不住脚”。

Anthropic数据/训练论文/研究
22:52
Ars Technica:AI(RSS)精选
AI 评分 76/100
OpenAI and Anthropic in price war as Chinese AI rivals gain ground
AnthropicOpenAI行业动态

推荐理由:价格战让模型API的成本弹性成为现实,原先因账单压力转向中国厂商的用户,可能在OpenAI和Anthropic降价后重新比较能力与价格。
22:52
Chubby♨️@kimmonismus
AI 评分 51/100
据彭博社援引知情人士消息,OpenAI 年化收入有望突破 400 亿美元,约为 2025 年底运行率的近两倍。然而,Claude Code 的年化收入运行率正大幅增长,预计将达到 1000 亿美元。不过,OpenAI 正日益逼近并稳步接近 Anthropic 的收入。Codex 目前是最大的增长驱动力,从积极意义上讲。
AnthropicOpenAI行业动态
22:51
Claude:Blog(网页)
AI 评分 63/100
Claude Code 会话如何最大化 token 价值

Claude Code 的 token 成本由模型、输入/输出 token 和提示缓存三因素决定,输出 token 价格约为输入的 5 倍。任务间运行 /clear 可减少无关上下文回传,降低 token 用量;会话中途切换模型或 effort 级别会破坏提示缓存,增加成本。

Anthropic教程/实践编码
22:35
a16z:News(RSS)
AI 评分 44/100
a16z 图表:Neocloud 增长远超早期云巨头,但成本高企

a16z 图表显示,由加密矿场转型的 neocloud 公司增速远超早期云巨头,CoreWeave 约 25 个季度即达 AWS 第 40 个季度时的 26 亿美元季度营收。但巨额 Capex 及超营收半数的芯片折旧与利息支出下,其股价一年跌约 16%。另 Atlassian 云业务同比增长 31%,AI 助手 Rovo 用户支出增速接近非用户两倍。

AnthropicOpenAI数据/训练现象/趋势
21:21
AYi@AYi_AInotes
AI 评分 43/100
Anthropic CEO妻子曾向Epstein寻求色情公司投资

《华尔街日报》曝光的司法部文件显示,Anthropic CEO Dario Amodei 的妻子 Cami Clark 于 2012 年向已定罪的性罪犯 Jeffrey Epstein 寻求投资,标的为其创办的“革命性色情公司”Eddice,遭 Epstein 以“Can't do sex TV”拒绝。

Anthropic行业动态
20:21
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 47/100
为什么 Opus 5 用起来反而感觉更差?

作者与同事认为,Opus 5 虽在基准测试上媲美 Fable、强于 Opus 4.7 和 4.8,但使用体验却像降级,因其在意图不明时不会停下来提问,常擅自假设或改动计划,需要更多人工盯防。作者推测,这源于前沿实验室追求自我改进 AI 与高基准分数的双重压力,而基准任务本身自包含、无需澄清,反而筛选出敢于大胆假设的模型,这与编码智能体实际需要的谨慎确认相悖。

智能体Anthropic现象/趋势编码
19:52
The Decoder:AI News(RSS)
AI 评分 47/100
Claude Code now runs daily maintenance on Anthropic's software with a 46 percent merge rate
智能体Anthropic现象/趋势编码
19:52
Rohan Paul@rohanpaul_ai同事件
AI 评分 52/100
智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5

智谱发布 GLM-5.3,基于 743B 基座模型后训练,在漏洞发现等网络防御测试中超越 Anthropic Mythos 5。其 Terminal Bench 3.0 从 4.6 升至 28.3,DeepSWE 达 66.9;CyberGym 得分 84.5%,但 ExploitBench 仅 54.4%,落后于 Mythos 5 的 78.0%。

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

Anthropic模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
19:22
Chubby♨️@kimmonismus
AI 评分 32/100
Anthropic 为 Claude Code 桌面版新增"自动继续"复选框:任务未完成但资源用尽时,开启后会在额度重置后自动从断点继续。评论者认为这回避了资源不足的根源问题,但功能本身实用。

ClaudeDevs: Hit your usage limit in Claude Code desktop? There's now an auto-continue checkbox. Turn it on, and it'll automatically ...

Anthropic产品更新编码
13:52
Elon Musk@elonmusk
AI 评分 41/100
Grok 4.6 在 CursorBench 真实编码测试中排名第一【引用 @XFreeze】:Grok 4.6 刚刚在 CursorBench 3.2 中排名第一在真实编码性能上超越 Claude Fable 5、Opus 5 和 GPT-5.6 Sol更疯狂的是效率……图表展示了 CursorBench 性能与单任务平均成本的对比,Grok 4.6 正位于前沿顶端Grok 4.6 编码能力极强……以惊人的效率实现前沿编码性能

X Freeze: Grok 4.6 just ranked #1 on CursorBench 3.2 Outperforming Claude Fable 5, Opus 5 and GPT-5.6 Sol on real-world coding per...

AnthropicOpenAIxAI编码
13:21
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 61/100
AI文本水印技术的工作原理
AnthropicGoogle教程/实践
11:21
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 53/100
文本AI水印总是很容易去除的
AnthropicOpenAI现象/趋势
08:19
IT之家(RSS)
AI 评分 60/100
Anthropic 计划 10 月以 2 万亿美元估值 IPO,有望超 SpaceX 成史上最大

Anthropic 计划 2026 年 10 月以 2 万亿美元估值 IPO,规模有望超过 SpaceX 成为史上最大 IPO。SpaceX 于 6 月 12 日上市,市值约 1.77 万亿美元。Anthropic 已于 6 月秘密提交 IPO 文件,5 月公布年化营收突破 470 亿美元。

Anthropic行业动态
另有 1 家信源报道X:Rohan Paul (@rohanpaul_ai)
07:57
Claude Code:GitHub Releases(RSS)
AI 评分 50/100
Claude Code v2.1.232 发布:默认启用 Subagent forking,新增 GitLab 支持与多项安全修复

Claude Code v2.1.232 默认启用 subagent forking,子代理可继承完整对话与提示缓存,交互会话中的非队友代理默认后台运行。新增 GitLab token 密钥脱敏、插件市场 GitLab 仓库克隆支持,并修复 PowerShell 与 Windows 权限绕过、嵌套 git 仓库信任继承等多项安全漏洞。

AnthropicMCP/工具产品更新编码
07:50
Claude:Blog(网页)
AI 评分 50/100
JetBrains CTO 谈如何评估并部署 Claude Fable 5:私有仓库评测、效率提升与安全策略

JetBrains CTO Vladislav Tankov 详解其团队如何用私有仓库评测前沿模型,并决定何时采用 Claude Fable 5。该模型在其评测中 Python 通过率达 44.3%,较 Opus 4.8 的 28.2% 提升 16 个百分点,且解题步骤减少约 22%。JetBrains 将安全与数据保留视为部署核心,偏好零数据保留,但接受为调查最严重问题而进行的有限审查。

Anthropic安全/对齐编码行业动态
07:22
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 42/100
最新 iOS 更新后,Claude Cowork 终于在我的移动端上开始工作了。"让你在旅途中也能继续 Cowork"你们也有了吗?👀
Anthropic产品更新
07:22
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 31/100
Anthropic 已在 iOS 版 Claude 中新增"用量额度"(Usage Credits)板块,并正在开发添加个人资料图片的功能。
Anthropic产品更新端侧
07:22
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 47/100
用户将能够在 Claude iOS 版上配置和使用自定义 MCP。
AnthropicMCP/工具产品更新
已加载 40 条