内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态模型 · 189 条
来源全部一手资讯X
类型模型
全部模型产品行业论文教程观点
标签「Anthropic」清除

8月20日周四

18:25The Decoder:AI News(RSS)57Anthropic 内部运行未发布模型"Model 2",性能超越所有公开版 Claude

8月19日周三

22:48Rohan Paul51Ornith-1.5 开源模型发布,多项基准超越 Claude Opus 4.8

8月18日周二

22:54Chubby♨️34Fable 5.1 或 5.5 已在灰度测试,发布临近

8月14日周五

19:52Rohan Paul52同事件智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
00:52Chubby♨️41Anthropic遭炮轰,Grok 4.6模型卡发布

7月25日周六

18:53The Decoder:AI News(RSS)60Anthropic 称 Opus 5 几乎免疫浏览器提示词注入,攻击成功率降至零
08:51Simon Willison 博客58Anthropic 发布 Claude Opus 5
08:24凡人小北51Claude Opus 5 发布,性能接近 Fable 5 价格减半
07:40公众号:数字生命卡兹克64同事件Claude Opus 5 发布,以一半价格逼近 Fable 5同一事件,精选展示《Anthropic 发布 Claude Opus 5》
06:50IT之家(RSS)77同事件Anthropic Opus 5 发布:性能逼近 Fable 5 但价格砍半,刷新 ARC-AGI-3 纪录同一事件,精选展示《Anthropic 发布 Claude Opus 5》
05:56MarkTechPost(RSS)58Anthropic 发布 Claude Opus 5:前沿级智能体编程与计算机使用能力,Opus 定价不变
05:26Ars Technica:AI(RSS)50Anthropic 发布 Opus 5,聚焦 token 效率而非能力飞跃
04:54Chubby♨️57Opus 5 发布:两月性能跃升,ARC-AGI 3 超 30%
04:53Rohan Paul54GPT-5.6 Sol 在 DeepSWE 基准测试中以 72.7% 领先 Opus 5 的 68.8%
03:24Chubby♨️48Opus 5 性能全面超越 Fable 5
03:23Rohan Paul54Anthropic 发布 Claude Opus 5,价格仅为 Fable 5 一半但性能更强
02:53The Decoder:AI News(RSS)67Anthropic 发布 Claude Opus 5:以 Fable 5 一半的 token 价格实现接近其性能
02:24Chubby♨️61Claude Opus 5 发布,性能接近 Fable 5
01:58🚨 AI News | TestingCatalog59Anthropic 发布 Claude Opus 5,性能接近 Fable 5 价格减半
01:54Chubby♨️54Anthropic 发布 Claude Opus 5:以一半成本达到接近前沿智能水平
01:54AI Notkilleveryoneism Memes ⏸️57Claude Opus 5 发布,性能接近 Fable 5 价格减半
01:25Yuchen Jin54Opus 5 发布:性能超越 Fable 5,价格减半
01:24Claude61Claude Opus 5 发布,性能接近 Fable 5 价格减半
01:24TechCrunch:AI(RSS)69Anthropic 发布 Opus 5,性能超越 Fable 5 且限制更少
01:24Anthropic:Newsroom(网页)92精选Anthropic 发布 Claude Opus 5
01:24The Verge:AI(RSS)67Anthropic 发布 Claude Opus 5,安全防护强于前代且接近 Fable 5 能力
01:24elvis48Claude Opus 5 发布,价格减半效率提升
01:23OpenRouter50OpenRouter 上线 Claude Opus 5
01:23ClaudeDevs55Claude Opus 5 登陆 Claude Code 与平台
01:21Thariq58Opus 5 补全 Claude 5 家族,日常驱动首选

7月23日周四

21:54Chubby♨️50Opus 4.8 已路由至 Opus 5,发布在即
19:58🚨 AI News | TestingCatalog38Anthropic 准备发布 Claude Opus 5
19:53Chubby♨️41Claude Opus 5 正陆续上线各平台

7月14日周二

09:02MarkTechPost(RSS)58Anthropic 发布 Claude Sonnet 5:智能体能力与基准测试对比

7月10日周五

02:40The Decoder:AI News(RSS)72同事件GPT-5.6 Sol 以三分之一成本接近 Fable 5 基准成绩同一事件,精选展示《GPT-5.6 系列模型发布:Sol、Terra、Luna》

7月7日周二

09:13IT之家(RSS)52谷歌 Gemini 3.5 Pro 模型爆料:7 月 17 日发布,支持 200 万上下文窗口

7月5日周日

05:30Chubby♨️37GPT-5.6 Sol 初期报告:30小时超 Claude Opus 64小时加速

7月2日周四

17:44Hacker News 热门(buzzing.cc 中文翻译)54《克劳德·法布尔5》宣传版访问权限
01:07Ars Technica:AI(RSS)73同事件美国解除对Anthropic Claude Fable 5和Mythos 5的出口限制同一事件,精选展示《重新部署 Claude Fable 5》

7月1日周三

16:50Artificial Intelligence News(RSS)69Anthropic 推出 Claude Sonnet 5,恢复 Fable 5 和 Mythos 5 访问权限
已加载 40 条
全部 AI 动态
2026年8月24日星期一 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
模型 · 标签「Anthropic」 · 189 条清除

8月20日

星期四 · 1 条
18:25
The Decoder:AI News(RSS)
AI 评分 57/100
Anthropic 内部运行未发布模型"Model 2",性能超越所有公开版 Claude

Anthropic 在内部运行一款未发布的 AI 模型“Model 2”,其综合性能略强于 Claude Mythos 5,但在某些领域较弱。据该公司 2026 年 8 月的风险报告,该模型在内部能力指数 AECI 上比 Mythos 5 高约 1.5 点,提升幅度小于从 Mythos Preview 到 Mythos 5 的跃升。该模型主要用于内部编码、数据生成及研究与工程,目前无外部发布计划。

智能体Anthropic模型发布

8月19日

星期三 · 1 条
22:48
Rohan Paul@rohanpaul_ai
AI 评分 51/100
Ornith-1.5 开源模型发布,多项基准超越 Claude Opus 4.8

Ornith-1.5 开源 LLM 家族发布,含 9B Dense、35B MoE 和 397B MoE 三档,其中 397B 在 Terminal-Bench 2.1(86.1)、SWE-bench Verified(86)、WideSearch(80.8)和 BrowseComp(86.6)上均超越 Claude Opus 4.8。

Ornith: Aloha! 🌺Introducing Ornith-1.5, a family of open-source LLMs spanning 9B Dense, 35B MoE, and 397B MoE, trained with sel...

Anthropic开源生态数据/训练模型发布
另有 2 家信源报道IT之家(RSS)Hacker News 热门(buzzing.cc 中文翻译)

8月18日

星期二 · 1 条
22:54
Chubby♨️@kimmonismus
AI 评分 34/100
据可靠爆料者 @synthwavedd,Anthropic 已在部分账号上测试 Fable 5 的继任者(或为 Fable 5.1/5.5),涉及 Claude Web 及可能的 Claude Code。Fable 5 正式发布当天也曾经历同样的灰度测试,官方正式发布或已临近。

leo 🐾: 🚨 A successor to Fable 5, likely Fable 5.1, is now being tested for a subset of accounts with "Fable 5" selected on Cla...

Anthropic模型发布

8月14日

星期五 · 2 条
19:52
Rohan Paul@rohanpaul_ai同事件
AI 评分 52/100
智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5

智谱发布 GLM-5.3,基于 743B 基座模型后训练,在漏洞发现等网络防御测试中超越 Anthropic Mythos 5。其 Terminal Bench 3.0 从 4.6 升至 28.3,DeepSWE 达 66.9;CyberGym 得分 84.5%,但 ExploitBench 仅 54.4%,落后于 Mythos 5 的 78.0%。

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

Anthropic模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
00:52
Chubby♨️@kimmonismus
AI 评分 41/100
向Anthropic开火【引用 @leerob】:我们发布了Grok 4.6的模型卡!其中深入介绍了该模型在编码、工程、知识工作等多个不同评估中的能力。我们还讨论了部署前的安全测试和我们的防护措施栈。https://media.x.ai/v1/website/card-4p6-4cd2dc57.pdf

Lee Robinson: We've released the model card for Grok 4.6! It goes in-depth on the capabilities of the model across many different eval...

AnthropicxAI模型发布编码

7月25日

星期六 · 25 条
18:53
The Decoder:AI News(RSS)
AI 评分 60/100
Anthropic 称 Opus 5 几乎免疫浏览器提示词注入,攻击成功率降至零

Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。在 129 个浏览器智能体测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。

智能体Anthropic安全/对齐
08:51
Simon Willison 博客
AI 评分 58/100
Anthropic 发布 Claude Opus 5

Anthropic 发布 Claude Opus 5,定位为接近 Claude Fable 5 前沿智能但价格减半的模型,目前在 Artificial Analysis 排行榜上领先所有模型。该模型定价与 Opus 4.8 相同,并提供成本翻倍的“快速模式”。因通用能力提升,Opus 5 在网络安全漏洞发现上接近 Mythos 5,但在漏洞利用上仍大幅落后。

Anthropic安全/对齐模型发布评测/基准
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
08:24
凡人小北@frxiaobei
AI 评分 51/100
我给你转发,别封我号好不好

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
07:40
公众号:数字生命卡兹克同事件
AI 评分 64/100
Claude Opus 5 发布,以一半价格逼近 Fable 5

Anthropic 发布 Claude Opus 5,已全量上线,支持 100 万上下文,知识截止至 2026 年 5 月。在 ARC-AGI-3 上得分 30.2%,接近 GPT-5.6 Sol(7.8%)的四倍;输入每百万 Token 5 美元、输出每百万 Token 25 美元,价格与 Opus 4.8 相同,仅为 Fable 5 的一半。

Anthropic模型发布评测/基准
同一事件,精选展示《Anthropic 发布 Claude Opus 5》
06:50
IT之家(RSS)同事件
AI 评分 77/100
Anthropic Opus 5 发布:性能逼近 Fable 5 但价格砍半,刷新 ARC-AGI-3 纪录

Anthropic 发布旗舰模型 Claude Opus 5,在多项代码与知识评测中领先,ARC-AGI 3 得分约为第二名模型的 3 倍。其性能接近更高规格的 Claude Fable 5,但价格约为后者一半,输入/输出价格分别为每百万词元 5 美元和 25 美元,与 Opus 4.8 持平。

Anthropic推理模型发布
同一事件,精选展示《Anthropic 发布 Claude Opus 5》
05:56
MarkTechPost(RSS)
AI 评分 58/100
Anthropic 发布 Claude Opus 5:前沿级智能体编程与计算机使用能力,Opus 定价不变

Anthropic 推出 Claude Opus 5,取代 Opus 4.8 成为 Opus 系列旗舰模型。定价维持不变,输入每百万 token 5 美元、输出每百万 token 25 美元。Anthropic 称 Opus 5 的智能水平接近 Claude Fable 5,但价格仅为后者一半。

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
05:26
Ars Technica:AI(RSS)
AI 评分 50/100
Anthropic 发布 Opus 5,聚焦 token 效率而非能力飞跃

Anthropic 今日推出 Opus 5,这是其热门编程模型的最新更新。与 Opus 4.5 在智能体编码性能上的突破不同,Opus 5 主要提升 token 效率,而非带来能力上的大幅飞跃。

Anthropic模型发布编码
04:54
Chubby♨️@kimmonismus
AI 评分 57/100
Opus 5 发布:两月性能跃升,ARC-AGI 3 超 30%

Opus 5 在发布仅两个月后,ARC-AGI 3 基准性能从 Opus 4.8 的不足 5% 跃升至超过 30%。据 Artificial Benchmark,Opus 5 智能水平与 Fable 5 相当,但每任务成本低 26%。该模型在多数评测上超越 Fable 5,标志着 AI 能力的快速迭代。

Chubby♨️: HERE WE GO: OPUS 5 And it outperforms Fable 5 almost on all evals!! Holy cow!!

Anthropic推理模型发布
另有 2 家信源报道The Decoder:AI News(RSS)X:Ethan Mollick (@emollick)
04:53
Rohan Paul@rohanpaul_ai
AI 评分 54/100
GPT-5.6 Sol 在 DeepSWE 基准测试中取得 72.7% 的成绩,领先于 Claude Opus 5 的 68.8%。DeepSWE 测试模型在陌生代码库中自主完成功能开发或 Bug 修复的能力。

Rohan Paul: Anthropic launched Claude Opus 5 at half the price of its most powerful model Fable 5, while at the same time beating Fe...

AnthropicOpenAI模型发布编码
03:24
Chubby♨️@kimmonismus
AI 评分 48/100
哦不,哦不,不不。这勾起了旧日回忆。

Chubby♨️: HERE WE GO: OPUS 5 And it outperforms Fable 5 almost on all evals!! Holy cow!!

Anthropic模型发布
03:23
Rohan Paul@rohanpaul_ai
AI 评分 54/100
Anthropic 发布 Claude Opus 5,价格仅为 Fable 5 一半但性能更强

Anthropic 推出 Claude Opus 5,输入/输出价格分别为 $5/$25 每百万 token,仅为 Fable 5 的一半,但在几乎所有基准测试中击败后者。该模型在编码、操作计算机、研究等经济价值高的任务上表现更优,且具备更宽松的网络分类器和自动回退选项。

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布编码
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
02:53
The Decoder:AI News(RSS)
AI 评分 67/100
Anthropic 发布 Claude Opus 5:以 Fable 5 一半的 token 价格实现接近其性能

Anthropic 推出旗舰模型 Claude Opus 5,在智能体编程和知识工作基准测试中领先,并在 ARC-AGI-3 上取得 30.2% 的分数,是 GPT-5.6 Sol 的近四倍。

Anthropic模型发布编码评测/基准
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
02:24
Chubby♨️@kimmonismus
AI 评分 61/100
来了:Opus 5它在几乎所有评测上都优于 Fable 5!!天哪!!【引用 @claudeai】:推出 Claude Opus 5。这是一款深思熟虑且主动的模型,以一半的价格接近 Fable 5 的前沿智能。

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:58
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 59/100
Anthropic 发布 Claude Opus 5,性能与旗舰模型 Fable 5 相当,但价格仅为后者一半。该模型在 ARC AGI 3 基准上获得 30 分,达到 SOTA,并在 Computer Use 能力上超越 Fable 5。

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:54
Chubby♨️@kimmonismus
AI 评分 54/100
Anthropic 发布 Claude Opus 5:以一半成本达到接近前沿智能水平

Anthropic 推出 Claude Opus 5,在 CursorBench 上以一半成本达到 Fable 5 的 0.5% 以内性能,在 OSWorld 上以三分之一成本超越 Fable 5。该模型 Frontier-Bench 性能是 Opus 4.8 的两倍多,定价不变,现为 Claude Max 默认模型及 Pro 最强选项。

Chubby♨️: HERE WE GO: OPUS 5 And it outperforms Fable 5 almost on all evals!! Holy cow!!

Anthropic推理模型发布编码
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:54
AI Notkilleveryoneism Memes ⏸️@AISafetyMemes
AI 评分 57/100
天哪。

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:25
Yuchen Jin@Yuchenj_UW
AI 评分 54/100
没想到今天会是 Opus 5 发布日!Opus 5 在几乎所有基准测试上都击败了 Fable 5。它在编码和智能体能力上似乎有重大飞跃,且模型 token 效率大幅提升。而且它的价格只有 Fable 5 的一半。迫不及待想试试了。
Anthropic推理模型发布编码
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:24
Claude@claudeai
AI 评分 61/100
Introducing Claude Opus 5.这是一款深思熟虑且主动的模型,以一半的价格接近 Fable 5 的前沿智能水平。
Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:24
TechCrunch:AI(RSS)
AI 评分 69/100
Anthropic 发布 Opus 5,性能超越 Fable 5 且限制更少

Anthropic 推出 Opus 5,这是其旗舰模型的最新版本。Opus 5 在多项基准测试中超越 Fable 5,且不受 Fable 和 Mythos 的 30 天数据保留政策限制,价格更低、限制更少。新模型还引入了 Automatic Fallbacks 测试功能,可在触发安全分类器时自动将请求路由至较弱模型,避免返回错误信息。

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:24
Anthropic:Newsroom(网页)精选
AI 评分 92/100
Anthropic 发布 Claude Opus 5

Anthropic 发布 Claude Opus 5,其智能水平接近 Claude Fable 5,但价格减半。该模型在 Frontier-Bench v0.1 上性能超过 Opus 4.8 两倍以上,在 ARC-AGI 3 上得分是次优模型的三倍。Opus 5 即日起成为 Claude Max 的默认模型和 Claude Pro 的最强模型。

Anthropic安全/对齐推理模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
推荐理由:Anthropic 这次把 Opus 的性价比条拉满了,性能翻倍价格减半,实际编码和知识工作基准已经超越所有模型。最打动我的是它自查自纠的严谨,写代码像真开发者一样审自己的页面,这种责任心以前只在人身上见过。
01:24
The Verge:AI(RSS)
AI 评分 67/100
Anthropic 发布 Claude Opus 5,安全防护强于前代且接近 Fable 5 能力

Anthropic 发布 Claude Opus 5,官方称其在多个领域“接近 Claude Fable 5 的能力”,复杂编程任务表现更优。该模型网络安全防护强于前代 Opus 4.8,定价与前任相同(输入 5 美元/输出 25 美元)。

Anthropic安全/对齐模型发布编码
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:24
elvis@omarsar0
AI 评分 48/100
Claude Opus 5 来了。价格是 Fable 5 的一半,这很棒!但重点是 token 效率。我喜欢这个方向,我们需要既前沿又实惠的智能。

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布
01:23
OpenRouter@OpenRouter
AI 评分 50/100
Claude Opus 5 来自 @AnthropicAI 现已登陆 OpenRouter!Opus 5 在多项基准测试中与 Fable 5 持平或更优,且每任务成本更低,同时在另一些测试中较 Opus 4.8 有显著提升。
Anthropic模型发布
01:23
ClaudeDevs@ClaudeDevs
AI 评分 55/100
Opus 5 今天在 Claude Code 和 Claude 平台上线。有几件事值得了解:🧵

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)
01:21
Thariq@trq212
AI 评分 58/100
Opus 5 完美补全了我们的 Claude 5 家族。我认为它是一款出色的日常驱动模型,搭配 Fable 可用于规划、头脑风暴或修复最棘手的 bug。

Claude: Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...

Anthropic模型发布
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)

7月23日

星期四 · 3 条
21:54
Chubby♨️@kimmonismus
AI 评分 50/100
看起来 Opus 4.8 已经路由到 Opus 5。今天发布在即。太兴奋了!想象一下 Fable 5 的性能,成本只有一半。

Chetaslua: 🚨 Claude Opus 5 release soon currently opus 4.8 is routes opus 5 according to @JasonBotterill it answer when gemini 3 p...

Anthropic模型发布
19:58
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 38/100
ANTHROPIC 🔥:Claude Opus 5 模型正在准备发布。时间表尚未确认;不过,此类准备工作通常会在发布前进行。Opus 发布节奏 👀 - 从 4.6 到 4.7 间隔 70 天 - 从 4.7 到 4.8 间隔 42 天 - 至今已过去 56 天文档 🗞 https://www.testingcatalog.com/anthropic-preparing-for-potential-claude-opus-5-rollout/

M1: Early preparations for Claude Opus 5 have been spotted again. Seems imminent.

Anthropic模型发布
19:53
Chubby♨️@kimmonismus
AI 评分 41/100
Opus 5 似乎正在各提供商处陆续上线!!今天是它的发布日。我对它的表现感到无比兴奋,你根本无法想象!

M1: Claude Opus 5 now appears to be rolling out across providers.

Anthropic模型发布

7月14日

星期二 · 1 条
09:02
MarkTechPost(RSS)
AI 评分 58/100
Anthropic 发布 Claude Sonnet 5:智能体能力与基准测试对比

Anthropic 发布 Claude Sonnet 5,定位为最具智能体能力的 Sonnet 模型,支持规划、驱动浏览器和终端,并可在长任务中自主运行。Sonnet 5 在每项已发布基准测试中均超越前代 Sonnet 4.6:SWE-bench Pro 达 63.2%(Sonnet 4.6 为 58.1%),OSWorld-Verified 达 81.2%(78.5%),HLE 达 57.4%(46.8%),知识工作基准 GDPval-AA v2 得分 1,618,略超 Opus 4.8 的 1,615。API 定价方面,Sonnet 5 输入/输出价格为 $2/$10 每百万 token(8 月 31 日前促销价),之后恢复 $3/$15;Opus 4.8 为 $5/$25。模型支持低、中、高、极高四种推理努力级别,上下文窗口为 100 万 token。Sonnet 5 即日起作为 Free 和 Pro 计划的默认模型,并已在 Claude Code 和 Claude Platform 上线。

智能体Anthropic模型发布编码

7月10日

星期五 · 1 条
02:40
The Decoder:AI News(RSS)同事件
AI 评分 72/100
GPT-5.6 Sol 以三分之一成本接近 Fable 5 基准成绩

OpenAI 新旗舰 GPT-5.6 Sol 在 Artificial Analysis 的 Intelligence Index 上获 59 分,仅比 Claude Fable 5 低 1 分;在 Coding Agent Index(Codex 环境)中以 80 分位居第一,AA-Briefcase 的 Presentation Elo 得分最高,但整体排名仍落后于 Fable 5。Sol 每次任务成本 1.04 美元,约为 Fable 5 的三分之一。小变体 Terra 和 Luna 成本分别再低 50% 和 80%。GPT-5.6 首次引入缓存写入费,输入/输出 token 每百万 $5/$30(Sol)、$2.50/$15(Terra)、$1/$6(Luna),缓存读取享 90% 折扣。Sol 在智能体编码任务中比同类模型少耗用最多 54% 的输出 token。

AnthropicOpenAI模型发布编码
同一事件,精选展示《GPT-5.6 系列模型发布:Sol、Terra、Luna》

7月7日

星期二 · 1 条
09:13
IT之家(RSS)
AI 评分 52/100
谷歌 Gemini 3.5 Pro 模型爆料:7 月 17 日发布,支持 200 万上下文窗口

消息源 @HarshithLucky3 爆料,谷歌计划 7 月 17 日发布 Gemini 3.5 Pro 模型,支持 200 万 tokens 上下文窗口,引入全新“深度思考”推理模式。该模型面向复杂智能体工作流,承担比已发布的 Gemini 3.5 Flash 更高阶的推理与执行角色。据 LMSYS Chatbot Arena 截图显示,在编码任务中 Gemini 3.5 Pro 表现优于 Anthropic 的 Claude Fable 5 High。

AnthropicGoogle多模态推理

7月5日

星期日 · 1 条
05:30
Chubby♨️@kimmonismus
AI 评分 37/100
据早期测试,GPT-5.6(代号 Sol)在30小时内已超越 Claude Opus 64小时运行达到的加速效果,尽管其初期探索更慢、失败更多、写代码更少。Sol 采用不同策略:不使用低精度,而是借助集群/DSMEM 和创新的数值方法取得优势,后续将转向低精度并利用 Tensor Cores(TC)。当前在某个排行榜位列第7。开发者认为这种"更少暴力探索、更持久研究"的思路令人期待。

Bryce, the CUDA Colonel: 30 hours in and Sol has surpassed the speedup of the 64 hour Opus run Very different approaches; Sol isn't using low pre...

AnthropicOpenAI推理模型发布

7月2日

星期四 · 2 条
17:44
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 54/100
《克劳德·法布尔5》宣传版访问权限

Anthropic 于 2026 年 7 月 1 日至 7 月 7 日推出 Claude Fable 5 限时推广,Pro、Max、Team 及 Enterprise premium seats 订阅用户可免费使用每周限额的 50%。支持网页、移动端、桌面端、Cowork、Code(需 v2.1.170+)、Design、Microsoft 365、Teams 及 Tag。超出免费额度后可购买 usage credits 或切换其他模型。API、Enterprise 标准座及 usage-based 计划不参与。

Anthropic模型发布
01:07
Ars Technica:AI(RSS)同事件
AI 评分 73/100
美国解除对Anthropic Claude Fable 5和Mythos 5的出口限制

美国解除对Anthropic最新Claude模型Fable 5和Mythos 5的出口限制。Fable 5即日起全球可用,Mythos 5自6月26日起恢复美国组织访问。此前Commerce Department于6月12日以国家安全风险为由要求Anthropic切断境外访问。Anthropic与政府合作加强安全措施:Fable 5已修复Amazon研究人员发现的越狱方法,目前99%以上案例被拦截,但加固安全可能屏蔽部分良性常规编码请求。Anthropic还建立红队测试和24/7内部监控团队,被屏蔽请求转至Opus 4.8。

Anthropic安全/对齐政策/监管模型发布
同一事件,精选展示《重新部署 Claude Fable 5》

7月1日

星期三 · 1 条
16:50
Artificial Intelligence News(RSS)
AI 评分 69/100
Anthropic 推出 Claude Sonnet 5,恢复 Fable 5 和 Mythos 5 访问权限

Anthropic 发布 Claude Sonnet 5,同时恢复 Fable 5 与 Mythos 5 的访问。此前因美国联邦出口管制指令,三款模型暂停 18 天。Amazon 研究人员发现绕过 Fable 5 安全控制的方法,Anthropic 已部署更新的自动分类器,在超 99% 测试中阻止该利用。Sonnet 5 在 SWE-bench Pro 得分 63.2%,Terminal-Bench 2.1 得分 80.4%,输入价格 $3.00/百万 tokens,输出 $15.00(推广期至 8 月 31 日为 $2.00/$10.00)。Rakuten、Zapier、Zed、Factory 等已部署。安全审计显示非合规行为率低于前代,且系统不具备高级进攻性网络安全能力。

智能体Anthropic安全/对齐模型发布
已加载 40 条