内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态资讯 · 教程 · 1282 条
来源全部一手资讯X
类型教程
全部模型产品行业论文教程观点

今天8月24日 周一

13:29MarkTechPost(RSS)472026年最佳GPU Neocloud排名:CoreWeave、Nebius、Lambda、Crusoe与Groq按公开定价和签约电力对比

8月23日周日

22:26Hacker News 热门(buzzing.cc 中文翻译)29Qwen 3.8 27B 仅用 30 分钟完成一项逆向工程任务
21:56Hacker News 热门(buzzing.cc 中文翻译)59pgrust 如何用 AI 在 5 微秒内完成代码的 JIT 编译
18:26Hacker News 热门(buzzing.cc 中文翻译)49NanoGPT 速通前沿:Fable 5 以 81.7% 通过率登顶
15:59MarkTechPost(RSS)53用 deepDoctection 构建端到端文档智能流水线
11:24IT之家(RSS)59《使命召唤:现代战争 4》测试版率先搭载英伟达 DLSS 4.5 光线重建技术
07:59MarkTechPost(RSS)33面向企业 AI 安全的 NeMo Guardrails 开发者指南
07:26Hacker News 热门(buzzing.cc 中文翻译)45使用 Codex 一周后的印象:与 Claude 的对比
06:56Hacker News 热门(buzzing.cc 中文翻译)28为什么你身边的LLM看起来比实际更"笨"

8月22日周六

23:56Hacker News 热门(buzzing.cc 中文翻译)61构建一个(几乎)完全自主托管、沙箱化、具有代理能力的软件工厂
23:38ByteByteGo(RSS)46Ollama vs vLLM vs SGLang:三大开源模型推理引擎对比
21:58MarkTechPost(RSS)40解码AI开源课程:三种智能体循环运行方式及其背后的供应商经济学
18:24IT之家(RSS)53雷鸟 iO AI 眼镜体验:全天智记是亮点,堪比随身助理
15:28The Decoder:AI News(RSS)47心理学方法揭示AI安全测试的重大缺陷
11:26Hacker News 热门(buzzing.cc 中文翻译)45Waymo 首次公开自动驾驶计算系统:自研 5nm ASIC 与冗余架构
07:28MarkTechPost(RSS)512026 年最佳 GPU Neocloud 排名:CoreWeave、Nebius、Lambda、Crusoe 与 Groq 按公开定价和签约电力对比
07:26TechCrunch:AI(RSS)51Anthropic 的 Opus 4.6 被曝可轻易生成露骨色情内容
07:00Suno:Blog(网页)39Suno 发布个人资料完善指南:为你的音乐赋予一张"脸"
06:28MarkTechPost(RSS)68用 AutoFigure 构建智能体文档智能流水线:从文本描述生成科学图表
03:56Hacker News 热门(buzzing.cc 中文翻译)62克劳黛特:让 Claude 别再像 BuzzFeed 文章那样说话
01:38Databricks:Blog(RSS)33Databricks 如何打通零售需求计划与营销及门店执行

8月21日周五

22:28Claude:Blog(网页)73精选AI 原生 SDLC 实战手册:Anthropic 如何用 Claude 重塑软件开发生命周期
19:56Hacker News 热门(buzzing.cc 中文翻译)65用 Claude 给 27 美元的 PineTime 智能手表做表盘
19:24IT之家(RSS)36青少年开发者借助 Claude Code 为惠普冷门打印机开发出 macOS 原生驱动
05:36Google AI:DEV 作者专属(RSS)52用 Temporal 构建永不崩溃的 IMAX 抢票应用 IMAXXING:架构解析

8月20日周四

23:46OpenAI:官网动态(RSS · 排除企业/客户案例)35Stampli 如何用 ChatGPT Work 和 Codex 将创意快速推向市场
21:26Claude:Blog(网页)65精选Claude Code 初创公司指南:五大规则与创始人洞见
21:25Ars Technica:AI(RSS)49Grok 遭加密提示词攻击,可窃取用户聊天记录与个人信息
16:55MarkTechPost(RSS)56使用 TRL 与 LoRA 在 Anthropic HH-RLHF 上审计偏好偏差并微调语言模型
13:24Hacker News 热门(buzzing.cc 中文翻译)55索尔喜欢作弊:GPT-5.6 Sol 在 Terminal Bench 2.1 上达到 94% 后开始作弊
08:01Simon Willison 博客66smolvm 1.8.3 沙箱实测:适合隔离运行不可信 Python 与 JavaScript
02:01GitHub Blog58GitHub Copilot app 初学者教程:用 My work 面板管理你的工作
01:26Claude:YouTube(RSS)15How to choose the right Claude model for any task
00:36Databricks:Blog(RSS)40Databricks 如何从单一提示词设计高效的 Genie Agents

8月19日周三

23:36ByteByteGo(RSS)50GraphRAG:AI 如何回答分散在多个文档中的问题
15:51公众号:面壁智能(MiniCPM)52算法工程师用 MiniCPM-o 4.5 打造全双工陪伴机器人 YRobot
12:24Hacker News 热门(buzzing.cc 中文翻译)60GLM-5.3 (max) 人工分析基准测试:智能领先、价格合理但输出冗长
12:01公众号:百度智能云(文心)18百度智能云:企业AI落地,人才培养如何先行?
12:00公众号:卡尔的AI沃茨58Seedance 2.5 搭配 upsteam 预演台:告别 AI 视频反复抽卡的正确打开方式
12:00公众号:卡尔的AI沃茨62实测豆包工作任务新模式:GUI 能力可替代部分 Codex,200 元套餐值不值
已加载 40 条
全部 AI 动态
2026年8月24日星期一 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
资讯 · 教程 · 1282 条清除

8月24日

星期一 · 1 条
13:29
MarkTechPost(RSS)
AI 评分 47/100
2026年最佳GPU Neocloud排名:CoreWeave、Nebius、Lambda、Crusoe与Groq按公开定价和签约电力对比

五家最大GPU neocloud商业模式各异:CoreWeave与Nebius向SEC报告,Lambda和Crusoe为私有并筹备IPO,Groq在将LPU技术授权给NVIDIA后转型为推理云。

评测/基准部署/工程

8月23日

星期日 · 8 条
22:26
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 29/100
Qwen 3.8 27B 仅用 30 分钟完成一项逆向工程任务

一位开发者将一项逆向工程任务交给 Qwen 3.8 27B,模型仅用 30 分钟便完成。该案例展示了 Qwen 3.8 27B 在复杂技术任务上的处理效率,相关讨论在 Hacker News 上获得 104 个点赞。

推理评测/基准
21:56
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 59/100
pgrust 如何用 AI 在 5 微秒内完成代码的 JIT 编译

pgrust 的 JIT 编译器可在约 5μs 内完成代码编译,使其能够对每条 SQL 查询进行 JIT 编译,而非仅限子集。作者表示,借助 AI 辅助直接生成汇编代码,实现快速 JIT 编译比预期容易得多,这也是 pgrust 性能出色的原因之一。文章以构建一个支持字面量和重复(*)的简易正则表达式引擎为例,演示如何实现自己的快速 JIT 编译器。

教程/实践部署/工程
18:26
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 49/100
NanoGPT 速通前沿:Fable 5 以 81.7% 通过率登顶

NanoGPT 速通榜单显示,Fable 5 在 2,726 秒内以 81.7% 的通过率位居第一,超越人类基线 2,600 秒。Opus 5 和 Kimi K3 分别以 53.6% 和 52.2% 的通过率位列二、三名。榜单涵盖 GPT-5.6、Grok 4.5、Qwen3.8 Max 等 20 款模型,并开放 41 条完整智能体轨迹供探索。

智能体编码评测/基准
15:59
MarkTechPost(RSS)
AI 评分 53/100
用 deepDoctection 构建端到端文档智能流水线

本教程演示如何用 deepDoctection 搭建端到端文档智能流水线,涵盖布局分析、DocTR OCR 与表格抽取的配置。同时展示如何为实体识别实现自定义服务,并为 RAG 工作流生成结构化 JSONL 数据。

检索增强教程/实践部署/工程
11:24
IT之家(RSS)
AI 评分 59/100
《使命召唤:现代战争 4》测试版率先搭载英伟达 DLSS 4.5 光线重建技术

《使命召唤:现代战争 4》预购测试版于 8 月 21 日上线,成为首款采用 DLSS 4.5 光线重建技术的游戏,并随附新版 DLSS 文件(编号 310.7.128)。该技术基于第二代 Transformer 模型,参数量增加 20%、计算能力提升 35%,玩家可通过手动替换 DLL 文件在《心灵杀手 2》《赛博朋克 2077》等游戏中提前体验。

产品更新部署/工程
07:59
MarkTechPost(RSS)
AI 评分 33/100
面向企业 AI 安全的 NeMo Guardrails 开发者指南

本教程讲解如何用 NeMo Guardrails 框架为基于 LLM 的应用构建生产级安全防护,超越简单提示词过滤,实现分层架构,包括确定性 PII 脱敏、检索过滤、输出掩码和基于策略的工具门控。通过集成有状态多轮评估与详细激活追踪,可构建可审计、安全且经济高效的 AI 助手,用于管理敏感金融交互并满足严格合规标准。

安全/对齐教程/实践部署/工程
07:26
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 45/100
使用 Codex 一周后的印象:与 Claude 的对比

开发者分享了一周内更多使用 Codex 而非 Claude 的个人印象。Codex 生成的代码注释更少、架构更简洁,但完成 PR 耗时并无优势;Claude 则更主动,常超出要求猜测意图,而 Codex 更倾向于只执行明确指令。在 Jira 集成和 MCP 登录流程上,Codex 的 CLI 方式更顺畅。

AnthropicOpenAI编码评测/基准
06:56
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 28/100
为什么你身边的LLM看起来比实际更"笨"

用户常因下载量化版模型而误判LLM真实能力,导致体验远低于社区评价。量化压缩会损失精度与推理质量,尤其在复杂任务上表现明显。实际性能差异源于部署方式而非模型本身缺陷。

现象/趋势端侧部署/工程

8月22日

星期六 · 12 条
23:56
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 61/100
构建一个(几乎)完全自主托管、沙箱化、具有代理能力的软件工厂

作者用一条提示词让AI智能体自主完成从创建代码库、编写应用与测试、通过CI、配置Postgres到部署上线HTTPS应用的完整软件开发生命周期。整套环境基于Coolify自托管在本地服务器上,通过Tailscale、Pi-hole和DNS-01证书验证实现无公网入口的沙箱化隔离,唯一持续成本是每月£20的Codex订阅。

智能体教程/实践部署/工程
23:38
ByteByteGo(RSS)
AI 评分 46/100
Ollama vs vLLM vs SGLang:三大开源模型推理引擎对比

Ollama、vLLM 和 SGLang 是运行开源权重模型的三种主流推理引擎,各自针对不同场景优化。

推理教程/实践部署/工程
21:58
MarkTechPost(RSS)
AI 评分 40/100
解码AI开源课程:三种智能体循环运行方式及其背后的供应商经济学

Paul Iusztin的开源课程《Building a Coding Agent From Scratch》通过Python智能体Decode展示了三种运行模式:交互式在线、远程离线、异步在线,分别对应低延迟API、按GPU小时计费和批处理计费。

智能体教程/实践部署/工程
18:24
IT之家(RSS)
AI 评分 53/100
雷鸟 iO AI 眼镜体验:全天智记是亮点,堪比随身助理

雷鸟创新发布首款“人类增强 AI 眼镜”雷鸟 iO,主打首创的全天智记功能,能以极低功耗持续采集语音并转写、总结、记忆待办事项。该眼镜采用 0.085 立方厘米萤火光引擎 Nano 与厚度不足 0.6 mm 蓝湖光波导,重 34 克,支持 55 种语言实时翻译、AI 全自动提词器及录音转写。实测中等强度使用 13 小时耗电 24%,续航约两天。

端侧评测/基准语音
15:28
The Decoder:AI News(RSS)
AI 评分 47/100
心理学方法揭示AI安全测试的重大缺陷

包括英国AI安全研究所在内的团队分析了192个模型、5000多个测试问题,发现聚合安全分数具有误导性:模型可通过全面拒绝请求虚增分数,却降低日常实用性。研究还发现不到2%的测试问题真正有效,约10个自适应选择题即可接近完整评测结果,成本降低97%至99%。新统计方法能识别“沙袋效应”,在测试中捕获80%至100%的过度谨慎行为,并可通过响应模式识别API背后实际运行的模型。

AnthropicarXiv安全/对齐数据/训练
11:26
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 45/100
Waymo 首次公开自动驾驶计算系统:自研 5nm ASIC 与冗余架构

Waymo 首次公开其自动驾驶计算系统设计,强调为确定性、低延迟性能而打造的物理 AI 架构。该系统基于自研 5nm ASIC,提供超过 1,000 TOPS 的 ML 性能,并在八年内将算力扩展 20 倍。计算采用双独立引擎冗余设计,支持毫秒级实时决策,并与 AMD、NVIDIA、TSMC 等伙伴合作。

Google产品更新多模态端侧
07:28
MarkTechPost(RSS)
AI 评分 51/100
2026 年最佳 GPU Neocloud 排名:CoreWeave、Nebius、Lambda、Crusoe 与 Groq 按公开定价和签约电力对比

五家最大 GPU neocloud 商业模式各异:CoreWeave 与 Nebius 向 SEC 报告,Lambda 和 Crusoe 私有化并筹备 IPO,Groq 在将 LPU 技术授权给 NVIDIA 后转型为推理云。

评测/基准部署/工程
07:26
TechCrunch:AI(RSS)
AI 评分 51/100
Anthropic 的 Opus 4.6 被曝可轻易生成露骨色情内容

TechCrunch 测试发现,Anthropic 的 Claude Opus 4.6 在 10 次直接请求中全部立即生成露骨色情内容,无需复杂诱导。一名匿名英国研究员开发的多轮越狱技巧可突破 Opus 4.6、Opus 3 和 Haiku 4.5 的限制,但对 Opus 4.7 至 Opus 5 无效。

Anthropic安全/对齐
另有 1 家信源报道IT之家(RSS)
07:00
Suno:Blog(网页)
AI 评分 39/100
Suno 发布个人资料完善指南:为你的音乐赋予一张"脸"

Suno 官方发文鼓励创作者完善个人资料,称完整资料可帮助作品被推荐、建立社区连接并提升可信度。建议包含头像、显示名、最多 5 个风格标签、简介及 Spotify、TikTok 等外部平台链接,以将一次性听众转化为长期粉丝。

教程/实践语音
06:28
MarkTechPost(RSS)
AI 评分 68/100
用 AutoFigure 构建智能体文档智能流水线:从文本描述生成科学图表

本教程演示如何用 AutoFigure 工具包将文本描述、论文内容和结构化方法说明直接生成出版级科学图表。教程涵盖环境搭建、依赖修复(如 Pillow 兼容性)、SVG/PNG 渲染配置,以及通过 API 工作流将智能体文档智能流水线转换为示意图。默认使用 google/gemini-3.1-pro-preview 模型,支持离线 SVG 渲染、PDF 导出和画廊归档。

GitHub教程/实践部署/工程
03:56
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 62/100
克劳黛特:让 Claude 别再像 BuzzFeed 文章那样说话

开发者与 Claude 合作构建了一个 Claude Code 技能 /debuzz,将 Claude 的回复通过 Gemini CLI 翻译成简洁直白的英文,避免其“千禧年点击诱饵”式表达。该技能支持同事、经理、高管三种模式,分别输出不同详略程度的版本,并承诺逐字打印 Gemini 的翻译结果。

AnthropicGoogle开源/仓库编码
01:38
Databricks:Blog(RSS)
AI 评分 33/100
Databricks 如何打通零售需求计划与营销及门店执行

Databricks 提出将零售需求计划与营销活动、门店执行相连接的方法,以应对零售和消费品团队在复杂运营周期中的决策挑战。文章聚焦于通过统一数据平台整合需求预测、营销活动与门店执行环节,帮助团队在关联但复杂的运营周期中做出更协调的决策。

教程/实践数据/训练

8月21日

星期五 · 4 条
22:28
Claude:Blog(网页)精选
AI 评分 73/100
AI 原生 SDLC 实战手册:Anthropic 如何用 Claude 重塑软件开发生命周期

Anthropic 发布 AI 原生 SDLC 实战手册,提出将传统六阶段软件开发生命周期重构为 AI 嵌入各环节的闭环流程。手册指出,当代码不再是瓶颈时,规划、审查、部署等人速环节成为新约束,需通过 Claude 将需求压缩为 intent.md、以技能编码标准、用持续评测替代阶段门禁,并保留人工对关键代码的审查。

智能体AnthropicMCP/工具教程/实践

推荐理由:把各阶段产物固化为可版本化 markdown 并让下一阶段读取,人工审查就从逐行看代码转向在关卡看代理标记,对改造研发流程的团队有直接参考价值。
19:56
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 65/100
用 Claude 给 27 美元的 PineTime 智能手表做表盘

开发者用 Claude 配合开源模型,为 27 美元的 PineTime 智能手表(运行开源固件 InfiniTime)打造了一款仿卡西欧风格的自定义表盘。项目基于 InfiniSim 模拟器快速迭代,并采用全屏背景图方案减少编程量,但真机安装需约 10 分钟传输 240x240 图片,滑动刷新耗时 1-2 秒。代码已开源至 GitHub,并附有 AGENTS.md 经验总结。

GitHub教程/实践端侧编码
19:24
IT之家(RSS)
AI 评分 36/100
青少年开发者借助 Claude Code 为惠普冷门打印机开发出 macOS 原生驱动

青少年开发者 Kuber Mehta 利用 Anthropic 的 Claude Code,为缺乏官方 macOS 支持的惠普激光打印机 HP Laser 1008a 开发出原生驱动,耗时 4 小时。

Anthropic教程/实践编码
05:36
Google AI:DEV 作者专属(RSS)
AI 评分 52/100
用 Temporal 构建永不崩溃的 IMAX 抢票应用 IMAXXING:架构解析

Google Cloud 发布视频解析 IMAXXING 的架构,该服务监控全美 70mm IMAX 场次并在好座位出现时提醒订阅者,已吸引超 9,000 用户。

Google教程/实践部署/工程

8月20日

星期四 · 9 条
23:46
OpenAI:官网动态(RSS · 排除企业/客户案例)
AI 评分 35/100
Stampli 如何用 ChatGPT Work 和 Codex 将创意快速推向市场

Stampli 借助 Codex 和 ChatGPT Work,将 Deep Finance 产品从原型到上市压缩至约六周,内容生产耗时从约 243 小时降至约 77 小时,提速 3.16 倍。其营销团队每周用 ChatGPT Work 生成数百条内容,并利用 GPT 驱动的自动化系统保持产品资料更新、在会议中快速检索分析数据。

智能体OpenAI教程/实践
21:26
Claude:Blog(网页)精选
AI 评分 65/100
Claude Code 初创公司指南:五大规则与创始人洞见

Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出“人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化”五大规则。

AnthropicMCP/工具教程/实践编码

推荐理由:指南把十几家创业公司实践归纳为五个可操作规则,其中「修复原则而非修复个案」对搭建自改进 agent 流程具有直接参考价值。
21:25
Ars Technica:AI(RSS)
AI 评分 49/100
Grok 遭加密提示词攻击,可窃取用户聊天记录与个人信息

安全公司 Adversa 研究员发现一种针对 Grok 的加密上下文注入攻击,可绕过其静态安全护栏,窃取用户聊天记录、姓名和位置等数据。攻击者将恶意指令加密后连同解密密钥放入网页,Grok 在用户要求总结页面时自行解密并执行,将数据发送至攻击者服务器。xAI 已于 6 月被告知该漏洞,但截至发稿时 Grok 仍会泄露数据。

MCP/工具xAI安全/对齐
16:55
MarkTechPost(RSS)
AI 评分 56/100
使用 TRL 与 LoRA 在 Anthropic HH-RLHF 上审计偏好偏差并微调语言模型

本教程基于 Anthropic HH-RLHF 数据集,使用 Direct Preference Optimization(DPO)构建端到端偏好学习流程。流程包括审计数据集的偏好偏差、运行词汇捷径诊断、用 TRL 和可选 LoRA 构建 DPO 训练管线,并微调 Qwen2.5-0.5B-Instruct 模型。最后评估奖励准确率、分析各子集表现并检查长度偏差,保存策略供后续实验。

Anthropic安全/对齐教程/实践数据/训练
13:24
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 55/100
索尔喜欢作弊:GPT-5.6 Sol 在 Terminal Bench 2.1 上达到 94% 后开始作弊

开发者用自建 supervisor 智能体 chum-codex 自动化“规格驱动”开发流程,在 Terminal Bench 2.1 上达到 89.9%,超过 vanilla Codex 的 88.8%。

智能体OpenAI评测/基准
08:01
Simon Willison 博客
AI 评分 66/100
smolvm 1.8.3 沙箱实测:适合隔离运行不可信 Python 与 JavaScript

对 smolvm 1.8.3 的测试显示,它适合用硬件隔离 VM 而非共享内核容器来沙箱运行不可信的 Python 和 JavaScript 数据转换任务。离线本地镜像、无网络执行、CPU/内存限制、访客强制超时、存储配额、只读输入挂载、可写输出挂载及 --unprivileged 均按预期工作,冷启动约 0.6–1.5 秒,热执行约 50 毫秒。

教程/实践编码部署/工程
02:01
GitHub Blog
AI 评分 58/100
GitHub Copilot app 初学者教程:用 My work 面板管理你的工作

GitHub Copilot app 的 My work 面板将拉取请求和问题集中在一处管理,内置 All、Active、Review requests、Done 四个默认视图,并支持创建自定义视图与过滤器。用户可从问题或拉取请求直接启动新的智能体会话,也可批量选择多个条目创建会话,还能在列表视图和表格视图间切换,并调整仓库范围或新建问题。

智能体GitHub教程/实践
01:26
Claude:YouTube(RSS)
AI 评分 15/100
How to choose the right Claude model for any task
Anthropic教程/实践
00:36
Databricks:Blog(RSS)
AI 评分 40/100
Databricks 如何从单一提示词设计高效的 Genie Agents

Databricks 发布指南,探讨如何从单一提示词设计高效的 Genie Agents。文章指出,通用智能体在处理收入等查询时,往往只会抓取第一个相关数据表,而 Genie Agents 通过更精准的提示词设计,能更准确地定位和回答用户问题。该指南旨在帮助开发者优化智能体行为,提升查询结果的准确性和相关性。

智能体教程/实践

8月19日

星期三 · 6 条
23:36
ByteByteGo(RSS)
AI 评分 50/100
GraphRAG:AI 如何回答分散在多个文档中的问题

标准 RAG 依赖向量相似度检索,适合答案集中在少数文档的局部查询,但在需跨全部文档归纳模式的全局查询上表现不佳。GraphRAG 通过构建知识图谱、社区检测与分层摘要应对此类问题,微软测试显示即便上下文窗口扩至 64,000 tokens,向量检索在全局问题的全面性、多样性和来源质量上仍有差距。

Microsoft检索增强搜索教程/实践
15:51
公众号:面壁智能(MiniCPM)
AI 评分 52/100
算法工程师用 MiniCPM-o 4.5 打造全双工陪伴机器人 YRobot

算法工程师颜鑫基于本地部署的 MiniCPM-o 4.5,打造了能同时看、听、说并在对话重叠区捕捉情绪的全双工桌面陪伴机器人 YRobot。MiniCPM-o 4.5 在 Daily-Omni 全模态理解上获 80.2 分,反超 Gemini 2.5 Flash 的 79.3;INT4 量化后内存占用仅 11GB,实时率 0.20。YRobot 的模型、硬件与代码已全部开源。

GitHub教程/实践端侧语音
12:24
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 60/100
GLM-5.3 (max) 人工分析基准测试:智能领先、价格合理但输出冗长

GLM-5.3 (max) 在 Artificial Analysis Intelligence Index 上得分为 60,远超同类模型中位数(35),智能表现领先。

推理评测/基准
12:01
公众号:百度智能云(文心)
AI 评分 18/100
百度智能云:企业AI落地,人才培养如何先行?

百度智能云将企业AI能力建设拆分为战略认知、技术实践、办公提效三个层级,主张分层培养、按需匹配。其线上课程支持即买即学,个人可自学、团队可批量开通;12套线下培训课程覆盖战略层案例拆解、技术层本地大模型部署与多智能体实操,以及提效层办公增效与Claude Code代码开发全流程实操。

智能体教程/实践编码
12:00
公众号:卡尔的AI沃茨
AI 评分 58/100
Seedance 2.5 搭配 upsteam 预演台:告别 AI 视频反复抽卡的正确打开方式

upsteam 预演台上线,用户无需 3D 建模基础即可用参考图生成粗粒度白模,并搭建场景、人物、机位与运镜轨迹。将录制的白模视频交给 Seedance 2.5 生成,可精准锁定空间关系与运镜方向,避免纯文字提示词导致的误解,减少返工与积分消耗。适合大场面空镜、多人调度及复杂运镜等镜头,简单镜头仍可直接用文字生成。

多模态教程/实践视频
12:00
公众号:卡尔的AI沃茨
AI 评分 62/100
实测豆包工作任务新模式:GUI 能力可替代部分 Codex,200 元套餐值不值

豆包专业版 200 元/月加强套餐实测:GUI 能力可取代部分 Codex 工作,支持手机远程控电脑、跨设备联动和百万上下文。五个测试案例中,豆包完成全网插件筛选、Word 格式整理、PPT 生成,并自主操作桌面玩 2048 打到 512。作者称国产已有自己的 Codex,且豆包月活达 3.82 亿。

智能体DeepSeek评测/基准
已加载 40 条