内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态模型 · 499 条
来源全部一手资讯X
类型模型
全部模型产品行业论文教程观点
标签「Agent」清除

8月16日周日

08:23Elon Musk35Grok 4.6 发布,可自动制作游戏预告片

8月15日周六

10:21IT之家(RSS)60DeepSeek V4 Pro 正式版与 Harness 智能体框架上线国家超算互联网
02:21AYi50小红书开源生活智能体模型 dots3-note
00:52Qwen54Qwen3.8-2.4T-A95B 上线 SiliconFlow
00:24Alibaba Cloud50Qwen3.8-Max 上线 Fireworks 获 Day 0 支持
00:22Qwen46通义千问 Qwen3.8-27B 开源,RTX 5090 跑出 206 tok/s

8月14日周五

23:54Alibaba Cloud50Qwen3.8-Max 上线 Fireworks,面向智能体与重度编码场景
23:52Qwen50Qwen3.8-Max 上线 Fireworks,Day 0 即支持
23:52Aravind Srinivas38GLM-5.3 获赞:700B 参数表现亮眼
23:22Qwen50Qwen3.8-Max上线Together AI,2.4T参数
23:22Qwen45Qwen3.8-Max 登陆 Fireworks,Day 0 上线
21:51Hacker News 热门(buzzing.cc 中文翻译)61同事件DeepSeek 峰谷电价更新:V4-Pro 正式发布,API 引入峰谷定价同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:31公众号:小红书技术(dots.llm)79精选dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理
13:52jietang51GLM-5.3 发布:专注编程与网络防御
13:22Z.ai63同事件智谱发布GLM-5.3,主打编码与网安同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
13:22SiliconFlow65精选DeepSeek V4 Pro 登陆硅基流动,1M 上下文
10:02HuggingFace Daily Papers(社区热门论文)66Intern-S2-Preview:面向科学发现的智能体基础模型
08:19IT之家(RSS)63同事件谷歌推出 Gemini 3.7 Flash 模型,首发优惠价为原 3.6 Flash 的一半同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
06:33OpenRouter36OpenRouter 上线 Voyage Code 4 代码检索模型
05:18TechCrunch:AI(RSS)54Writer 发布新旗舰模型 Palmyra X6 并升级智能体框架以控制 token 成本
02:22Chubby♨️45Gemini 3.7 Flash 正式发布,性能较 3.6 显著提升
02:06SpaceXAI49Grok 4.6 上线 Pi,强化智能体任务
01:52🚨 AI News | TestingCatalog44Gemini 3.7 Flash 上线 Spark,强化 Workspace 工具调用
01:33Google AI72同事件Gemini 3.7 Flash 发布:编码智能体主力模型同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:30Google AI Developers66同事件Gemini 3.7 Flash 发布:主打编码与智能体任务同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:30Sundar Pichai63同事件Gemini 3.7 Flash 发布,性能大增价格减半同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:22🚨 AI News | TestingCatalog49Gemini 3.7 Flash 发布,价格减半
01:22Ars Technica:AI(RSS)55同事件Google 发布 Gemini 3.7 Flash,距上一代仅三周同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:22Google DeepMind:Blog(RSS)72精选Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型
00:52The Decoder:AI News(RSS)63同事件DeepSeek 发布 V4-Pro 升级版,开源智能体软件并上调 API 价格同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》

8月13日周四

21:15AYi67DeepSeek-V4-Pro 发布,Agent 成本打穿地板
20:51🚨 AI News | TestingCatalog52DeepSeek-V4-Pro 发布,主打 Agent 升级
20:20Chubby♨️52DeepSeek-V4-Pro 正式发布,支持可调推理强度
19:50DeepSeek65同事件DeepSeek 发布 V4-Pro 与 V4-Flash 升级同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:20公众号:DeepSeek(深度求索)73同事件DeepSeek-V4-Pro 正式版上线同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:16DeepSeek:API 更新日志81精选DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强
14:21MarkTechPost(RSS)67同事件SpaceXAI 发布 Grok 4.6:面向长时运行智能体、编程与知识工作的 50 万上下文模型同一事件,精选展示《xAI 发布 Grok 4.6,强化长时运行智能体能力》
13:15IT之家(RSS)58韩国 Upstage 发布 Solar Pro 4:512K 上下文商用大模型,Agent Arena 排名 44
02:50The Decoder:AI News(RSS)63同事件SpaceXAI's Grok 4.6 matches OpenAI's best model and undercuts it on price同一事件,精选展示《Cursor 与 SpaceXAI 联合发布 Grok 4.6》
02:50SemiAnalysis64同事件DeepSeek v4 Pro 1.5T 发布,大幅超越 Nemotron3 Ultra同一事件,精选展示《DeepSeek V4 Pro 登陆硅基流动,1M 上下文》
已加载 40 条
全部 AI 动态
2026年8月17日星期一 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
模型 · 标签「Agent」 · 499 条清除

8月16日

星期日 · 1 条
08:23
Elon Musk@elonmusk
AI 评分 35/100
Grok 4.6【引用 @KettlebellDan】:我让 Grok Build 为我的游戏制作了一支预告片它启动了游戏、亲自游玩、录制屏幕、剪辑画面,并完成配音。我全程没有动过手X THE GAME - 免费游玩 https://kettlebelldan.com/x_the_game_v2

Dan: So I asked Grok Build to make a trailer for my video game It booted the game, played it, recorded the screen, edited the...

智能体xAI模型发布视频

8月15日

星期六 · 5 条
10:21
IT之家(RSS)
AI 评分 60/100
DeepSeek V4 Pro 正式版与 Harness 智能体框架上线国家超算互联网

国家超算互联网于 8 月 14 日上线 DeepSeek V4 Pro 正式版(DeepSeek-V4-Pro-0813)及智能体框架 DeepSeek Harness。该模型增强了 Agent 能力,生产环境性能提升显著,整体性能可与 Claude Fable 5、Opus-4.8 相媲美。DeepSeek Harness 开发者预览版(v0.1)已面向全球开放测试,并以 MIT 协议开源。

智能体DeepSeek开源生态模型发布
02:21
AYi@AYi_AInotes
AI 评分 50/100
小红书开源生活智能体模型 dots3-note

小红书(RedNote)开源大语言模型 dots3-note preview,主打长时程生活智能体场景。该模型为 280B MoE、16B 激活参数,512K 上下文窗口,支持文本、视觉、音频多模态,并引入针对长时任务 RL 训练的新方法 TEMPO。模型权重与两个生活智能体基准 VibeSearchBench、VibeLifeBench 已在 Hugging Face 开源。

dots studio: Introducing dots3-note preview - a small but mighty step toward long-horizon agency in real life. 🔹 280B MoE with 16B a...

智能体多模态开源生态模型发布
00:52
Qwen@Alibaba_Qwen
AI 评分 54/100
通义千问开源 Qwen3.8-2.4T-A95B,并已在 SiliconFlow 上线,支持 Day-0 使用。该模型拥有 2.4T 参数、95B 激活参数,主打自主编程、深度研究与端到端智能体执行。API 定价为输入 $2.00/百万 token、输出 $6.00/百万 token、缓存输入 $0.25/百万 token。

SiliconFlow: 🚀 Day-0 Support! @Alibaba_Qwen has open-sourced Qwen3.8-2.4T-A95B - and it's now live on SiliconFlow. ⚡ With 2.4T param...

智能体开源生态模型发布编码
另有 4 家信源报道X:硅基流动 SiliconFlow (@SiliconFlowAI)X:Rohan Paul (@rohanpaul_ai)IT之家(RSS)X:Clément Delangue(Hugging Face CEO) (@ClementDelangue)
00:24
Alibaba Cloud@alibaba_cloud
AI 评分 50/100
阿里云宣布 Qwen3.8-Max 在 Fireworks 平台上线,Fireworks 作为 Day 0 首发合作伙伴同步支持。该模型为 2.4T 参数 MoE 架构(Qwen3.8-2.4T-A95B),专为自主智能体、重度编码和长上下文场景设计,即日起可开始构建。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码
00:22
Qwen@Alibaba_Qwen
AI 评分 46/100
通义千问开源 Qwen3.8-27B 小模型,SGLang 首日支持即上线。在单张 RTX 5090 上配合 NVFP4 与 DSpark 实现 206.1 tok/s 解码速度,DGX Spark 上为 38.28 tok/s。该模型在智能体规划与长程任务上树立小模型新标杆。

SGLang: The king of small models is back! Qwen3.8-27B from @Alibaba_Qwen is open source, and Day-0 support is live in SGLang: - ...

智能体开源生态模型发布端侧

8月14日

星期五 · 24 条
23:54
Alibaba Cloud@alibaba_cloud
AI 评分 50/100
阿里云 Qwen3.8-Max 已在 Fireworks 平台 Day 0 上线。该 2.4T 参数 MoE 模型(Qwen3.8-2.4T-A95B)专为自主智能体、重度编码和大上下文窗口设计,即日起可开始构建。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码
23:52
Qwen@Alibaba_Qwen
AI 评分 50/100
通义千问发布 Qwen3.8-Max,已上线 Fireworks 并获 Day 0 支持。该模型为 2.4T 参数 MoE 架构(A95B),专为自主智能体、重度编程和长上下文场景设计,即日起可开始构建应用。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码
23:52
Aravind Srinivas@AravSrinivas
AI 评分 38/100
对于一个 700B 参数的模型来说,这个数字令人印象深刻!

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

智能体开源生态模型发布编码
23:22
Qwen@Alibaba_Qwen
AI 评分 50/100
Qwen3.8-Max已在Together AI上线。Together AI是我们的Day 0首发合作伙伴,我们找不到更合适的名字来共享Day 0。2.4T参数、95B激活、1M上下文--现在全部齐了。🧑🤝🧑

Together AI: Qwen3.8-2.4T-A95B is live on Together AI. The Qwen team's new open-weight MoE packs 2.4T total parameters with 95B activ...

智能体开源生态模型发布
23:22
Qwen@Alibaba_Qwen
AI 评分 45/100
通义千问发布 Qwen3.8-Max,已在 Fireworks 平台 Day 0 上线。该模型为 2.4T 参数 MoE 架构(A95B),专为自主智能体、重度编码和长上下文任务设计,即日起可开始构建应用。

Fireworks: Qwen3.8-2.4T-A95B is now live on Fireworks with Day-0 support! This 2.4T parameter MoE model is built for autonomous age...

智能体模型发布编码
21:51
Hacker News 热门(buzzing.cc 中文翻译)同事件
AI 评分 61/100
DeepSeek 峰谷电价更新:V4-Pro 正式发布,API 引入峰谷定价

DeepSeek 今日发布 V4-Pro,主打 Agent 能力升级,支持灵活推理强度(低/高/最大三档),并原生支持 OpenAI Responses API,可一键适配 Codex。V4-Pro 已上线应用/网页端(Expert Mode)及 API,模型名称不变。API 同步引入峰谷定价,谷时价格较峰时低 50%,新价格于 2026 年 8 月 16 日 16:00 UTC 生效。

智能体DeepSeek推理模型发布
同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:31
公众号:小红书技术(dots.llm)精选
AI 评分 79/100
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理

小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。

智能体Hugging Face多模态开源生态
另有 1 家信源报道X:Kim (@kimmonismus)
推荐理由:除开源模型外,TEMPO 让同一智能体在每个宏观步骤切换为 critic,用测试时推理估计回报,给稀疏奖励长程任务的强化学习训练提供了可借鉴的结构。
13:52
jietang@jietang
AI 评分 51/100
GLM-5.3 即将推出,聚焦编程能力。

Z.ai: Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved throug...

智能体开源生态模型发布编码
13:22
Z.ai@Zai_org同事件
AI 评分 63/100
推出 GLM-5.3:为编码而生,为网络防御而备。• 基于 743B 基础模型进行后训练,实现顶尖的编码与智能体能力 • 网络安全领域重大飞跃,树立开源模型新标准技术博客:https://z.ai/blog/glm-5.3
智能体模型发布编码
同一事件,精选展示《GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力》
13:22
SiliconFlow@SiliconFlowAI精选
AI 评分 65/100
DeepSeek V4 Pro 登陆硅基流动,1M 上下文

DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 MIT 开源协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景。

智能体DeepSeek推理模型发布
另有 2 家信源报道IT之家(RSS)Simon Willison 博客
推荐理由:每百万缓存命中 0.44 美元与 1M 上下文组合,使 Agent 工作流在长上下文成本测算上有了更具体参照。
10:02
HuggingFace Daily Papers(社区热门论文)
AI 评分 66/100
Intern-S2-Preview:面向科学发现的智能体基础模型

Intern-S2-Preview 是一系列科学智能体基础模型,支持多模态科学理解、推理、生成及长周期任务。其训练流程涵盖科学多模态预训练、监督微调、可扩展多任务强化学习及智能体强化学习,并采用部分回滚、自适应长度正则化等技术提升稳定性。Intern-S2-Preview-397B 在多项科学、多模态及智能体基准上取得领先结果,其时间序列模块提升了 SciTS 上的信号理解与预测能力。

智能体多模态数据/训练模型发布
08:19
IT之家(RSS)同事件
AI 评分 63/100
谷歌推出 Gemini 3.7 Flash 模型,首发优惠价为原 3.6 Flash 的一半

谷歌推出专为编程与 Agents 场景打造的 Gemini 3.7 Flash 模型,距 3.6 Flash 发布仅约三周,在软件工程、知识工作及网页开发工作流方面大幅提升。

智能体Google模型发布编码
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
06:33
OpenRouter@OpenRouter
AI 评分 36/100
编码智能体的代码检索在 OpenRouter 上有了新选择。来自 MongoDB 旗下 @VoyageAI 的 Voyage Code 4 支持 256、512、1024 和 2048 维度的 Matryoshka 嵌入向量,并提供多种量化选项。试用:https://openrouter.ai/voyageai/voyage-code-4
智能体检索增强模型发布编码
05:18
TechCrunch:AI(RSS)
AI 评分 54/100
Writer 发布新旗舰模型 Palmyra X6 并升级智能体框架以控制 token 成本

Writer 周四推出新旗舰模型 Palmyra X6,基于 Z.ai 开源模型 GLM-5.2 构建,结合框架基础设施升级,预计可为客户在基础任务上削减高达 50% 的成本。该公司同时发布标准智能体框架的重大升级,两项功能即日起对客户开放。Writer 研究显示,框架效率优化比模型选择更能可靠降低成本,测试中成本平均下降 40%。

智能体模型发布部署/工程
02:22
Chubby♨️@kimmonismus
AI 评分 45/100
Google 正式发布 Gemini 3.7 Flash,较 3.6 版本在 FrontierCode、DeepSWE 等基准上显著提升,规划更缜密、工具调用更可靠,并将驱动 24/7 个人智能体 Gemini Spark。年底前输入/输出 token 价格分别为每百万 $0.75 和 $3.75。

Chubby♨️: Gemini 3.7 Flash official released. Surprisingly solid jump over 3.6! FrontierCode: 43.6% vs. 34.4% DeepSWE: 65.3% vs. 4...

智能体Google模型发布
02:06
SpaceXAI@SpaceXAI
AI 评分 49/100
Grok 4.6 现已在 Pi 中可用。【引用 @pidotdev】:别忘了刷新你的模型目录。Grok 4.6 已发布 🛸专为长时间运行的智能体任务打造,在编程、知识工作和视觉任务方面能力更强。输入 $2/M,输出 $6/M。欢迎 Grok 4.6 加入 Pi。

Pi: ICYMI refresh your model catalogs. Grok 4.6 is out 🛸 Built for long-running agent tasks, with stronger capabilities acr...

智能体xAI模型发布
01:52
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 44/100
Google 将 Gemini 3.7 Flash 部署至 Gemini Spark,并改进其操作 Google Workspace 应用的工具使用能力。该模型被官方称为面向编程与智能体的最强"工作马"模型。Spark 现已向 160 多个国家的 Pro 和 Ultra 订阅用户开放。

Google Gemini: Gemini Spark, available to Google AI Pro and Ultra subscribers in over 160 countries, will be using Gemini 3.7 Flash sta...

智能体Google模型发布编码
01:33
Google AI@GoogleAI同事件
AI 评分 72/100
Gemini 3.7 Flash 发布:编码智能体主力模型

Google AI 推出 Gemini 3.7 Flash,定位编码与智能体场景的主力模型。该模型已集成至 Gemini App 的 Spark 功能,可跨 Gmail、Google 日历和 Google 文档处理多步骤复杂任务。3.7 Flash 年底前提供半价优惠,输入 $0.75/1M tokens,输出 $3.75/1M tokens。

智能体Google模型发布编码
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:30
Google AI Developers@googleaidevs同事件
AI 评分 66/100
Gemini 3.7 Flash 发布:主打编码与智能体任务

Google 发布 Gemini 3.7 Flash,定位为面向编码和智能体任务的高性能模型,具备更强的指令遵循、首遍代码准确率与智能体任务执行能力。官方演示其构建复杂 3D 网页游戏,涵盖 Three.js 引擎逻辑、Nano Banana 素材生成与程序化音频集成。

智能体Google模型发布编码
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:30
Sundar Pichai@sundarpichai同事件
AI 评分 63/100
Gemini 3.7 Flash 发布,性能大增价格减半

Google 在 3.6 Flash 发布仅 3 周后推出 Gemini 3.7 Flash,在软件工程、知识工作和网页开发方面显著提升,尤其擅长编码和智能体任务。其入门价格仅为 3.6 Flash 原价的一半,已上线 Antigravity、Gemini API、Gemini Enterprise 等平台。

智能体Google模型发布编码
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:22
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 49/100
Google 发布 Gemini 3.7 Flash,已上线 API、AI Studio 和 Antigravity,并将推广至其他产品。该模型价格比 Gemini 3.6 Flash 便宜 50%,在 DeepSWE V1.1 上得分 65%,接近 GPT-5.6 Terra 的表现。距 3.6 Flash 发布仅 3 周,新模型在编程和智能体任务上提升显著。

Sundar Pichai: Our Flash models are workhorses that offer performance at a great price. So, we're shipping updates fast to get them in ...

智能体Google模型发布编码
01:22
Ars Technica:AI(RSS)同事件
AI 评分 55/100
Google 发布 Gemini 3.7 Flash,距上一代仅三周

Google 今日推出 Gemini 3.7 Flash,取代三周前发布的 3.6 Flash,主打改进的编码与智能体性能,并以更低“入门价”应对竞品低价。

智能体Google模型发布编码
同一事件,精选展示《Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型》
01:22
Google DeepMind:Blog(RSS)精选
AI 评分 72/100
Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型

Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。

智能体Google模型发布编码
另有 11 家信源报道X:Logan Kilpatrick (@OfficialLoganK)X:Ammaar Reshi (@ammaar)X:Rohan Paul (@rohanpaul_ai)X:Demis Hassabis (@demishassabis)MarkTechPost(RSS)X:Gemini (@GeminiApp)X:Google DeepMind (@GoogleDeepMind)The Decoder:AI News(RSS)X:Elvis Saravia (@omarsar0, DAIR.AI)X:Artificial Analysis (@ArtificialAnlys)X:fofr (@fofrAI)
推荐理由:相比 3.6 Flash,价格减半且 FrontierCode 和 DeepSWE 分数提升,让成本敏感型编码智能体团队有了新的性价比基线。
00:52
The Decoder:AI News(RSS)同事件
AI 评分 63/100
DeepSeek 发布 V4-Pro 升级版,开源智能体软件并上调 API 价格

DeepSeek 将旗舰模型 V4-Pro 移出测试阶段,新构建版本 V4-Pro-0813 在 Terminal Bench 2.1 上得分从 72.1 升至 87.9,DeepSWE 从 12.8 升至 62.7,但整体排名仍落后于 Claude Opus 5。

智能体DeepSeek开源生态模型发布
同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》

8月13日

星期四 · 10 条
21:15
AYi@AYi_AInotes
AI 评分 67/100
DeepSeek-V4-Pro 发布,Agent 成本打穿地板

DeepSeek 正式发布 V4-Pro 0813,Agent 基准全面追平第一梯队:Terminal Bench 87.9、Cybergym 83.3,DeepSWE 从 12.8 跃升至 62.7。

DeepSeek: We're launching DeepSeek-V4-Pro today! 🚀 🔷 Major Agent upgrades with strong production gains! 🔷 Flexible reasoning ef...

智能体DeepSeek推理模型发布
另有 4 家信源报道Simon Willison 博客X:X.PIN (@thexpin)IT之家(RSS)X:Rohan Paul (@rohanpaul_ai)
20:51
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 52/100
DeepSeek 发布 DeepSeek-V4-Pro,已在 DeepSeek Chat"Expert Mode"及 API 上线。该模型带来重大 Agent 升级,支持灵活推理强度(低/高/最大),并原生支持 OpenAI Responses API,针对 Codex 优化且可一键配置。模型名称保持不变。

DeepSeek: We're launching DeepSeek-V4-Pro today! 🚀 🔷 Major Agent upgrades with strong production gains! 🔷 Flexible reasoning ef...

智能体DeepSeek推理模型发布
另有 4 家信源报道IT之家(RSS)Simon Willison 博客X:X.PIN (@thexpin)X:Rohan Paul (@rohanpaul_ai)
20:20
Chubby♨️@kimmonismus
AI 评分 52/100
DeepSeek-V4-Pro 正式发布,支持可调推理强度

DeepSeek-V4-Pro 正式发布,支持低/高/最大三档可调推理强度,V4-Flash 同样获得该控制。模型新增原生 OpenAI Responses API 支持及 Codex 一键配置,现有 API 模型名称保持不变。V4-Pro 已通过 API 及 App/Web 的 Expert Mode 上线,官方称智能体升级带来显著生产收益,但未公布独立基准数据。

DeepSeek: We're launching DeepSeek-V4-Pro today! 🚀 🔷 Major Agent upgrades with strong production gains! 🔷 Flexible reasoning ef...

智能体DeepSeek推理模型发布
另有 3 家信源报道X:X.PIN (@thexpin)IT之家(RSS)X:Rohan Paul (@rohanpaul_ai)
19:50
DeepSeek@deepseek_ai同事件
AI 评分 65/100
我们今天正式发布 DeepSeek-V4-Pro!🚀🔷 重大 Agent 升级,带来强劲的生产环境性能提升!🔷 V4-Pro 与 V4-Flash 支持灵活推理强度:简单任务用低强度,日常 Agent 工作流用高强度,复杂任务用最高强度。🔷 原生支持 OpenAI Responses API,针对 Codex 优化,一键即可完成配置。V4 Pro 现已上线 App 和网页端,可通过"专家模式"体验。V4 Pro 也已通过 API 提供。模型名称保持不变--具体配置请参阅 API 文档。
智能体DeepSeek推理模型发布
同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:20
公众号:DeepSeek(深度求索)同事件
AI 评分 73/100
DeepSeek-V4-Pro 正式版上线

DeepSeek 发布 V4 Pro 正式版,已同步在 APP、网页端和 API 更新上线,用户可在 APP 或网页端选择“专家模式”使用。正式版增强 Agent 能力,API 原生支持 OpenAI Responses API 格式并适配 Codex。

智能体DeepSeek推理模型发布
同一事件,精选展示《DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强》
19:16
DeepSeek:API 更新日志精选
AI 评分 81/100
DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强

DeepSeek-V4-Pro 正式版已在 APP、网页端和 API 同步上线,模型名设为 deepseek-v4-pro 即可使用。其 Agent 能力显著提升,HLE (wo/w tools) 达 42.7/60.0,Terminal Bench 2.1 为 87.9。

智能体DeepSeek模型发布
另有 3 家信源报道X:X.PIN (@thexpin)IT之家(RSS)X:Rohan Paul (@rohanpaul_ai)
推荐理由:峰谷定价把闲时成本降至高峰一半,适合批量推理、评估任务等可延迟工作负载调整执行时间,为降低 API 支出提供空间。
14:21
MarkTechPost(RSS)同事件
AI 评分 67/100
SpaceXAI 发布 Grok 4.6:面向长时运行智能体、编程与知识工作的 50 万上下文模型

SpaceXAI 发布 Grok 4.6,这是基于 Grok 4.5 的后训练升级而非更大规模的基础模型,支持 500K 上下文 token、文本与图像输入,并新增 xhigh 推理强度档位。

智能体xAI模型发布编码
同一事件,精选展示《xAI 发布 Grok 4.6,强化长时运行智能体能力》
13:15
IT之家(RSS)
AI 评分 58/100
韩国 Upstage 发布 Solar Pro 4:512K 上下文商用大模型,Agent Arena 排名 44

韩国 AI 实验室 Upstage 推出面向复杂智能体任务的商用大模型 Solar Pro 4,上下文窗口 512K,最高输出 128K token。定价为每百万 tokens 输入 0.3 美元、输出 1.2 美元,缓存读取 0.06 美元。该模型在 Agent Arena 排名第 44,与 MiniMax M2.7 同级,是首个登上该榜单的韩国实验室。

智能体推理模型发布
另有 1 家信源报道X:Artificial Analysis (@ArtificialAnlys)
02:50
The Decoder:AI News(RSS)同事件
AI 评分 63/100
SpaceXAI's Grok 4.6 matches OpenAI's best model and undercuts it on price
智能体xAI模型发布
同一事件,精选展示《Cursor 与 SpaceXAI 联合发布 Grok 4.6》
02:50
SemiAnalysis@SemiAnalysis_同事件
AI 评分 64/100
祝贺 @deepseek_ai 发布 DeepSeekv4 Pro 0813 1.5T🔥 它在智能体任务上大幅超越 Nemotron3 Ultra。此外,DeepSeekv4 Flash 0731 同样大幅超越 Nemotron3 Ultra,而活跃参数少 4.2 倍,总参数也少近 2 倍!Nemotron 团队有很多优秀的人才,但根本上,委员会式的模型前沿开发是行不通的。👇️ 1/3🧵
智能体DeepSeek模型发布
同一事件,精选展示《DeepSeek V4 Pro 登陆硅基流动,1M 上下文》
已加载 40 条