Topic · 主题全部主题 →

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

8,251条收录
891条精选

精选归档 · 第 9 页

161180 条 · 共 891

7月14日

星期二 · 3 条
16:56
公众号:腾讯混元精选
AI 评分 78/100
腾讯混元将Hy3旗舰模型量化至1bit与4bit,单卡即可部署

腾讯混元将295B参数的Hy3旗舰模型权重量化至1bit与4bit并打包成GGUF,配合llama.cpp生态,使原本需多卡集群部署的模型最少一张96GB推理显卡即可运行。1bit版将权重从598GB压缩至85.5GiB,4bit版体积169.9GiB,两张显卡可承载;量化版在长文理解、Agent与代码任务上贴近满血效果,开启MTP后解码速度提升约50%-60%。


推荐理由:将 295B 旗舰模型量化至单卡部署,1bit 版本在长文理解上仍接近满血,且提供 MTP 加速,改变了本地运行大模型的门槛与成本考量。
16:36
IT之家(RSS)精选
AI 评分 72/100
高德发布通用世界模型工坊 ABot-WorldStudio,已开放测试

阿里巴巴旗下高德发布通用世界模型工坊 ABot-WorldStudio,并开放测试。该产品将交互式视频生成与 3DGS 场景生成统一,用户输入文字或图片即可生成可实时交互、可分享的 AI 世界。工坊内置“时空任意门”,穿越后可跃迁至另一完整 3D 世界。官方实测单次连续推理稳定运行超1小时,无崩溃、无质量衰减。底层模型 ABot-World0 与 ABot-3DWorld0 均可在单张 5090 上本地部署,已全面开源。


推荐理由:把世界模型从一分钟短片推进到小时级稳定探索,还支持本地一张消费级显卡跑,这对做具身智能和边界探索的团队是个值得上手的信号。
08:00
Claude Platform:开发者版本说明(RSS)精选
AI 评分 67/100
Claude Enterprise Admin API 开放 Beta 版,支持用户与群组管理

Claude Enterprise 组织现可通过 Admin API(Beta)管理成员、群组及自定义角色,包括按邮箱查找、更改角色、移除成员及管理邀请。群组与自定义角色请求需添加 anthropic-beta: ce-user-management-2026-07-13 标头,拥有 read:org_audit 权限的密钥可调用所有 GET 端点。


推荐理由:Claude Enterprise 的管理员现在能用 API 自动化成员管理和权限分配,对需要批量操作的团队是个省事的功能,虽然只是常规迭代,但确实补上了缺了很久的拼图。

7月13日

星期一 · 2 条
05:29
Tibo@thsottiaux精选
AI 评分 65/100
OpenAI 为 50 万 ChatGPT Work 和 Codex 用户增加"banked reset"功能Added a banked reset to 500k users of ChatGPT Work and Codex.What’s been happening: • Just released the ability to use a banked reset from web and mobile. Before today you could only do it in the desktop app • Had an issue where less than 10% of users who used a banked reset and it didn’t actually reset. This was during a 2 hour window. • It was hard to find all the exact users where it didn’t apply, so instead granted a banked reset to everyone who pressed the reset button in that 2 hour window. This also gives us the opportunity to validate the new infra ahead of tomorrowTomorrow we will celebrate our 7M active users milestone and grant the first banked reset across all of our ChatGPT Work and Codex users.We will also release a bunch of updates to the desktop app, addressing a ton of your feedback.Talk soonOpenAI 为 50 万 ChatGPT Work 和 Codex 用户增加了"banked reset"功能,现已支持网页和移动端使用,此前仅限桌面端。期间曾出现 2 小时窗口内不到 10% 用户重置未生效的问题,OpenAI 为所有在该窗口内点击重置按钮的用户补发了重置额度。明天将庆祝 700 万活跃用户里程碑,并向所有 ChatGPT Work 和 Codex 用户发放首次重置额度,同时发布桌面端多项更新。另有 22 家信源报道X:Ethan Mollick (@emollick)OpenAI:官网动态(RSS · 排除企业/客户案例)X:OpenAI (@OpenAI)X:Rohan Paul (@rohanpaul_ai)TechCrunch:AI(RSS)The Decoder:AI News(RSS)IT之家(RSS)The Verge:AI(RSS)Hacker News 热门(buzzing.cc 中文翻译)X:Kim (@kimmonismus)X:Tibo (@thsottiaux)X:Nathan Lambert (@natolambert)X:Sam Altman (@sama)MarkTechPost(RSS)X:Greg Brockman (@gdb)Simon Willison 博客X:Gabriel (@gabriel1)X:小北 (@frxiaobei)X:阿易 AI Notes (@AYi_AInotes)公众号:卡尔的AI沃茨X:OpenAI Developers (@OpenAIDevs)X:Testing Catalog (@testingcatalog)
推荐理由:ChatGPT Work 和 Codex 的 banked reset 终于能在网页和移动端用了,修复了一个只有 10% 用户成功重置的 bug,明天还会给 700 万用户每人送一次免费重置,用这两个工具的人可以直接去试试。

7月11日

星期六 · 4 条
09:20
Claude Code:GitHub Releases(RSS)精选
AI 评分 56/100
Claude Code v2.1.207 发布

Claude Code v2.1.207 发布。Auto 模式在 Bedrock、Vertex AI 和 Foundry 上无需 CLAUDE_CODE_ENABLE_AUTO_MODE 即可使用,可通过 disableAutoMode 设置关闭。修复了流式响应中包含超长列表、表格、段落或代码块时终端冻结和按键延迟的问题;修复了非交互式运行中远程托管设置被永久记录为已同意而未显示安全同意对话框的问题;修复了自动更新程序每次发布时覆盖 ~/.local/bin/claude 自定义启动脚本或符号链接的问题。Bedrock、Vertex 和 Claude Platform on AWS 默认切换为 Claude Opus 4.8。Auto 模式不再从 .claude/settings.local.json 读取 autoMode,改为使用 ~/.claude/settings.json。修复了 Windows 上 AWS 凭证解析卡住时无限挂起的问题,60 秒超时保护现在生效。


推荐理由:对使用 Bedrock、Vertex 和 Foundry 的开发者来说,自动模式默认开放是最实用的变化,加上模型默认升到 Opus 4.8,是个值得升级的稳定版。

7月10日

星期五 · 6 条
22:00
公众号:百度智能云(文心)精选
AI 评分 71/100
百度搭子在成都AI Day发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟

百度搭子在成都百度AI Day上发布四项更新。个人版新增浏览器调用、智能路由(平均任务耗时降20%,Token利用率提升25%)、多端共享记忆及强化PPT生成,并上架“一镜”数字人制作、“灵医”报告解读等Skill。行业首个自媒体专业套件支持选题到复盘全链路。企业版支持团队协作与权限管理。搭子联盟启动,中国联通等已加入。上线三个月,日均提问量增长20倍。


推荐理由:百度搭子这次更新算不上行业事件,但浏览器调用和自媒体套件确实在缩减创作链路,企业版尝试把AI能力沉淀为组织资产,对深度使用百度的团队有实际价值。
10:13
Claude Code:GitHub Releases(RSS)精选
AI 评分 62/100
Claude Code v2.1.206 发布

Claude Code v2.1.206 发布,主要更新包括:为 /cd 命令添加目录路径建议;新增 /doctor 检查以建议修剪 CLAUDE.md 文件中模型可从代码库推导的内容;/commit-push-pr 现在自动允许 git push 到仓库配置的推送远程仓库;/login 支持 Anthropic 运营的公共网关端点;后台智能体在更新后自动升级。修复了过期登录导致所有模型报错、claude --resume--continue 在启动时无键盘响应、MCP 服务器忽略 request_timeout_ms 配置、OAuth MCP 服务器需手动重新认证、/model 选择器价格显示错误、桌面会话卡在“运行中”状态、Windows 上键盘输入被忽略等多项问题。


推荐理由:Claude Code 这次更新修复了一串体验问题,/doctor 检查能帮团队清理冗余的项目文件,后台静默升级也减少了等待时间,日常使用的开发者更新一下不会亏。
06:51
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 70/100
Show HN: 如何在我的低配置电脑上运行 GLM-5.2

colibrì v1.0 引擎以纯 C 实现、零运行时依赖,可在约 25 GB RAM 的消费级电脑上运行 744B 参数的 GLM-5.2 MoE 模型。模型经 int4 量化后磁盘占用约 370 GB,常驻内存仅 9.9 GB,通过流式加载磁盘专家实现推理。冷解码速度约

另有 1 家信源报道X:karminski (@karminski3)
推荐理由:这个单C文件项目让744B的MoE模型在25GB内存的笔记本上跑了起来,虽然慢,但证明了消费级硬件也能把前沿模型‘盘活’,做本地推理的极客值得看看。
05:44
OpenAI Developers@OpenAIDevs精选
AI 评分 68/100
ChatGPT Sites将创意变可发布网站Turn an idea into a live Site you can publish and shareHere’s what some of the team at OpenAI built with Sites 👇@prd_008 used Sites to turn an idea into a personal focus app:将一个想法变成可发布和分享的实时网站 以下是OpenAI团队的一些成员用Sites构建的示例👇 @prd_008 用Sites将一个想法变成了个人专注应用:

pranav: ChatGPT Sites 现已面向 Plus、Pro、Business 和 Enterprise 用户开放。支持网页端、移动端和桌面端。 我利用新版 ChatGPT 中的 Sites 插件,将一个想法变成了一个个人待办事项应用。 以下是我...

另有 1 家信源报道X:OpenAI Developers (@OpenAIDevs)
推荐理由:ChatGPT Sites 把建站门槛拉到一句话描述,我觉得这是 ChatGPT 从「聊完就忘」到「留下东西」的关键一步,但现阶段模板和分发都太简陋,产品人可以先尝鲜别急着押注。
05:21
Google Developers Blog(RSS)精选
AI 评分 62/100
Google 推出 LiteRT.js:高性能 Web AI 推理运行时

Google 发布 LiteRT.js,这是 LiteRT 跨平台边缘 AI 运行时的最新成员,专为 JavaScript 开发者设计,可直接在浏览器中运行机器学习模型。LiteRT.js 基于 WebGPU 和即将推出的 WebNN 实现 SOTA 推理性能,同时支持回退到 WebAssembly CPU 方案。


推荐理由:Google 将 LiteRT 扩展到了浏览器端,让 Web 开发者可以直接在客户端跑 AI 推理,但发布缺少性能数据和对比,实质价值还要看后续的 benchmark。

7月9日

星期四 · 4 条
22:33
Mistral AI:News(网页)精选
AI 评分 55/100
Mistral 推出 Studio,为 AI 提示词和技能提供系统记录

Mistral 今日推出 Studio,为 AI 提示词和技能提供集中式系统记录。平台将 prompts 和 skills 视为生产资产,支持不可变版本、回滚、明确所有权、分类标签和审计日志,保证变更可追溯。非开发者可直接编辑测试,通过标签将变更推送至生产,保留原有 CI/CD 流程。可观测性让生产输出回溯到对应资产版本,形成闭环治理。现面向 Mistral Studio 客户开放。


推荐理由:企业提示词管理混乱是真实痛点,Studio 这次更新把治理和迭代闭环做进了生产系统,比单独的目录工具更进一步。
21:40
Anthropic:Newsroom(网页)精选
AI 评分 73/100
Claude 推出反思功能(Beta)

Anthropic 为 Claude 推出一项反思功能(Beta),帮助用户追踪使用模式。用户可回顾过去 1、3、6 或 12 个月的活动总结,涵盖关键主题、使用频率和任务类型。功能结合 4D AI Fluency Framework(委托、描述、辨别、勤勉)提供协作分析,支持设定静音时段或定时休息提醒。隐私方面,不涉及无痕对话和健康集成工具,也不提取连接工具中的底层文件。该功能面向 Free、Pro 和 Max 用户,需开启记忆功能,可通过 Claude 网页或桌面应用设置。


推荐理由:这是大模型公司第一次认真讨论‘人机边界’,上线了帮你看清自己怎么用 Claude 的反思仪表盘,我觉得做产品的可以思考一下这个设计思路。
00:21
Hugging Face:Blog(RSS)精选
AI 评分 66/100
原生速度的 vLLM transformers 建模后端

Hugging Face 宣布 transformers vLLM 后端现与手写原生 vLLM 实现速度相当甚至更快。模型作者无需移植代码,即可自动利用 transformers 获得超快推理。测试使用 Qwen3-4B(单 GPU)、Qwen3-32B(张量并行)和 Qwen3-235B-A22B-FP8 MoE(数据+专家并行)三种配置,吞吐量均达到或超过原生。该后端通过 torch.fx 静态分析图、AST 重写代码实现动态层融合,支持张量/管道/专家并行及 torch.compile。用户仅需添加 --model-impl transformers 标志。目前不支持线性注意力模型但即将支持。


推荐理由:用 transformers 写的模型,现在不用改一行代码就能在 vLLM 里跑到手写实现的水平,模型作者最大的集成痛被抹平了。虽然主要是工程黑魔法,但生态意义不小。