Anthropic 在内部运行一款未发布的 AI 模型“Model 2”,其综合性能略强于 Claude Mythos 5,但在某些领域较弱。据该公司 2026 年 8 月的风险报告,该模型在内部能力指数 AECI 上比 Mythos 5 高约 1.5 点,提升幅度小于从 Mythos Preview 到 Mythos 5 的跃升。该模型主要用于内部编码、数据生成及研究与工程,目前无外部发布计划。
Anthropic 在内部运行一款未发布的 AI 模型“Model 2”,其综合性能略强于 Claude Mythos 5,但在某些领域较弱。据该公司 2026 年 8 月的风险报告,该模型在内部能力指数 AECI 上比 Mythos 5 高约 1.5 点,提升幅度小于从 Mythos Preview 到 Mythos 5 的跃升。该模型主要用于内部编码、数据生成及研究与工程,目前无外部发布计划。
Ornith-1.5 开源 LLM 家族发布,含 9B Dense、35B MoE 和 397B MoE 三档,其中 397B 在 Terminal-Bench 2.1(86.1)、SWE-bench Verified(86)、WideSearch(80.8)和 BrowseComp(86.6)上均超越 Claude Opus 4.8。
Aloha! 🌺Introducing Ornith-1.5, a family of open-source LLMs spanning 9B Dense, 35B MoE, and 397B MoE, trained with sel...
另有 2 家信源报道IT之家(RSS)Hacker News 热门(buzzing.cc 中文翻译)🚨 A successor to Fable 5, likely Fable 5.1, is now being tested for a subset of accounts with "Fable 5" selected on Cla...
智谱发布 GLM-5.3,基于 743B 基座模型后训练,在漏洞发现等网络防御测试中超越 Anthropic Mythos 5。其 Terminal Bench 3.0 从 4.6 升至 28.3,DeepSWE 达 66.9;CyberGym 得分 84.5%,但 ExploitBench 仅 54.4%,落后于 Mythos 5 的 78.0%。
Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》We've released the model card for Grok 4.6! It goes in-depth on the capabilities of the model across many different eval...
Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。在 129 个浏览器智能体测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。
Anthropic 发布 Claude Opus 5,定位为接近 Claude Fable 5 前沿智能但价格减半的模型,目前在 Artificial Analysis 排行榜上领先所有模型。该模型定价与 Opus 4.8 相同,并提供成本翻倍的“快速模式”。因通用能力提升,Opus 5 在网络安全漏洞发现上接近 Mythos 5,但在漏洞利用上仍大幅落后。
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Anthropic 发布 Claude Opus 5,已全量上线,支持 100 万上下文,知识截止至 2026 年 5 月。在 ARC-AGI-3 上得分 30.2%,接近 GPT-5.6 Sol(7.8%)的四倍;输入每百万 Token 5 美元、输出每百万 Token 25 美元,价格与 Opus 4.8 相同,仅为 Fable 5 的一半。
同一事件,精选展示《Anthropic 发布 Claude Opus 5》Anthropic 发布旗舰模型 Claude Opus 5,在多项代码与知识评测中领先,ARC-AGI 3 得分约为第二名模型的 3 倍。其性能接近更高规格的 Claude Fable 5,但价格约为后者一半,输入/输出价格分别为每百万词元 5 美元和 25 美元,与 Opus 4.8 持平。
同一事件,精选展示《Anthropic 发布 Claude Opus 5》Anthropic 推出 Claude Opus 5,取代 Opus 4.8 成为 Opus 系列旗舰模型。定价维持不变,输入每百万 token 5 美元、输出每百万 token 25 美元。Anthropic 称 Opus 5 的智能水平接近 Claude Fable 5,但价格仅为后者一半。
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Anthropic 今日推出 Opus 5,这是其热门编程模型的最新更新。与 Opus 4.5 在智能体编码性能上的突破不同,Opus 5 主要提升 token 效率,而非带来能力上的大幅飞跃。
Opus 5 在发布仅两个月后,ARC-AGI 3 基准性能从 Opus 4.8 的不足 5% 跃升至超过 30%。据 Artificial Benchmark,Opus 5 智能水平与 Fable 5 相当,但每任务成本低 26%。该模型在多数评测上超越 Fable 5,标志着 AI 能力的快速迭代。
HERE WE GO: OPUS 5 And it outperforms Fable 5 almost on all evals!! Holy cow!!
另有 2 家信源报道The Decoder:AI News(RSS)X:Ethan Mollick (@emollick)Anthropic launched Claude Opus 5 at half the price of its most powerful model Fable 5, while at the same time beating Fe...
HERE WE GO: OPUS 5 And it outperforms Fable 5 almost on all evals!! Holy cow!!
Anthropic 推出 Claude Opus 5,输入/输出价格分别为 $5/$25 每百万 token,仅为 Fable 5 的一半,但在几乎所有基准测试中击败后者。该模型在编码、操作计算机、研究等经济价值高的任务上表现更优,且具备更宽松的网络分类器和自动回退选项。
Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Anthropic 推出旗舰模型 Claude Opus 5,在智能体编程和知识工作基准测试中领先,并在 ARC-AGI-3 上取得 30.2% 的分数,是 GPT-5.6 Sol 的近四倍。
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Anthropic 推出 Claude Opus 5,在 CursorBench 上以一半成本达到 Fable 5 的 0.5% 以内性能,在 OSWorld 上以三分之一成本超越 Fable 5。该模型 Frontier-Bench 性能是 Opus 4.8 的两倍多,定价不变,现为 Claude Max 默认模型及 Pro 最强选项。
HERE WE GO: OPUS 5 And it outperforms Fable 5 almost on all evals!! Holy cow!!
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Anthropic 推出 Opus 5,这是其旗舰模型的最新版本。Opus 5 在多项基准测试中超越 Fable 5,且不受 Fable 和 Mythos 的 30 天数据保留政策限制,价格更低、限制更少。新模型还引入了 Automatic Fallbacks 测试功能,可在触发安全分类器时自动将请求路由至较弱模型,避免返回错误信息。
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Anthropic 发布 Claude Opus 5,其智能水平接近 Claude Fable 5,但价格减半。该模型在 Frontier-Bench v0.1 上性能超过 Opus 4.8 两倍以上,在 ARC-AGI 3 上得分是次优模型的三倍。Opus 5 即日起成为 Claude Max 的默认模型和 Claude Pro 的最强模型。
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Anthropic 发布 Claude Opus 5,官方称其在多个领域“接近 Claude Fable 5 的能力”,复杂编程任务表现更优。该模型网络安全防护强于前代 Opus 4.8,定价与前任相同(输入 5 美元/输出 25 美元)。
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable ...
另有 2 家信源报道公众号:卡尔的AI沃茨X:Boris Cherny (@bcherny)🚨 Claude Opus 5 release soon currently opus 4.8 is routes opus 5 according to @JasonBotterill it answer when gemini 3 p...
Early preparations for Claude Opus 5 have been spotted again. Seems imminent.
Claude Opus 5 now appears to be rolling out across providers.
Anthropic 发布 Claude Sonnet 5,定位为最具智能体能力的 Sonnet 模型,支持规划、驱动浏览器和终端,并可在长任务中自主运行。Sonnet 5 在每项已发布基准测试中均超越前代 Sonnet 4.6:SWE-bench Pro 达 63.2%(Sonnet 4.6 为 58.1%),OSWorld-Verified 达 81.2%(78.5%),HLE 达 57.4%(46.8%),知识工作基准 GDPval-AA v2 得分 1,618,略超 Opus 4.8 的 1,615。API 定价方面,Sonnet 5 输入/输出价格为 $2/$10 每百万 token(8 月 31 日前促销价),之后恢复 $3/$15;Opus 4.8 为 $5/$25。模型支持低、中、高、极高四种推理努力级别,上下文窗口为 100 万 token。Sonnet 5 即日起作为 Free 和 Pro 计划的默认模型,并已在 Claude Code 和 Claude Platform 上线。
OpenAI 新旗舰 GPT-5.6 Sol 在 Artificial Analysis 的 Intelligence Index 上获 59 分,仅比 Claude Fable 5 低 1 分;在 Coding Agent Index(Codex 环境)中以 80 分位居第一,AA-Briefcase 的 Presentation Elo 得分最高,但整体排名仍落后于 Fable 5。Sol 每次任务成本 1.04 美元,约为 Fable 5 的三分之一。小变体 Terra 和 Luna 成本分别再低 50% 和 80%。GPT-5.6 首次引入缓存写入费,输入/输出 token 每百万 $5/$30(Sol)、$2.50/$15(Terra)、$1/$6(Luna),缓存读取享 90% 折扣。Sol 在智能体编码任务中比同类模型少耗用最多 54% 的输出 token。
同一事件,精选展示《GPT-5.6 系列模型发布:Sol、Terra、Luna》消息源 @HarshithLucky3 爆料,谷歌计划 7 月 17 日发布 Gemini 3.5 Pro 模型,支持 200 万 tokens 上下文窗口,引入全新“深度思考”推理模式。该模型面向复杂智能体工作流,承担比已发布的 Gemini 3.5 Flash 更高阶的推理与执行角色。据 LMSYS Chatbot Arena 截图显示,在编码任务中 Gemini 3.5 Pro 表现优于 Anthropic 的 Claude Fable 5 High。
30 hours in and Sol has surpassed the speedup of the 64 hour Opus run Very different approaches; Sol isn't using low pre...
Anthropic 于 2026 年 7 月 1 日至 7 月 7 日推出 Claude Fable 5 限时推广,Pro、Max、Team 及 Enterprise premium seats 订阅用户可免费使用每周限额的 50%。支持网页、移动端、桌面端、Cowork、Code(需 v2.1.170+)、Design、Microsoft 365、Teams 及 Tag。超出免费额度后可购买 usage credits 或切换其他模型。API、Enterprise 标准座及 usage-based 计划不参与。
美国解除对Anthropic最新Claude模型Fable 5和Mythos 5的出口限制。Fable 5即日起全球可用,Mythos 5自6月26日起恢复美国组织访问。此前Commerce Department于6月12日以国家安全风险为由要求Anthropic切断境外访问。Anthropic与政府合作加强安全措施:Fable 5已修复Amazon研究人员发现的越狱方法,目前99%以上案例被拦截,但加固安全可能屏蔽部分良性常规编码请求。Anthropic还建立红队测试和24/7内部监控团队,被屏蔽请求转至Opus 4.8。
同一事件,精选展示《重新部署 Claude Fable 5》Anthropic 发布 Claude Sonnet 5,同时恢复 Fable 5 与 Mythos 5 的访问。此前因美国联邦出口管制指令,三款模型暂停 18 天。Amazon 研究人员发现绕过 Fable 5 安全控制的方法,Anthropic 已部署更新的自动分类器,在超 99% 测试中阻止该利用。Sonnet 5 在 SWE-bench Pro 得分 63.2%,Terminal-Bench 2.1 得分 80.4%,输入价格 $3.00/百万 tokens,输出 $15.00(推广期至 8 月 31 日为 $2.00/$10.00)。Rakuten、Zapier、Zed、Factory 等已部署。安全审计显示非合规行为率低于前代,且系统不具备高级进攻性网络安全能力。