内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态一手 · 142 条
来源全部一手资讯X
类型全部
全部模型产品行业论文教程观点
标签「图像生成」清除

8月23日周日

01:26OpenRouter:Announcements(RSS)55OpenRouter 推出图像基准测试,覆盖全部 39 款图像模型

8月22日周六

01:01Midjourney:Updates(RSS)35Midjourney alpha 网站更新日志:8/20/26 修复与改进

8月18日周二

23:53Runway:News(网页)40Populous 如何用 Runway 呈现全球标志性场馆设计
13:34蚂蚁 inclusionAI:GitHub 新仓库64精选inclusionAI 开源 ConceptEdit:基于概念缩放与密集监督的图像编辑数据生成管线
05:23OpenRouter:Announcements(RSS)56OpenRouter 图像生成 API:代码优先的接入教程

8月13日周四

18:20公众号:可灵AI(快手·视频)33刷屏海内外的"中式天庭"《天宫之约》,出自可灵3.0

8月11日周二

07:44Microsoft AI:官方博客(网页)30MAI-Image-2.6 launches at No. 2 on Arena ahead of Google, Meta and xAI

8月7日周五

14:11公众号:火山引擎81精选Seedance 2.5 API上线,视频生成开启「电影级长叙事」

8月6日周四

07:24Runway:News(网页)31Chime 如何用 Runway 制作最新全国电视广告
06:52Apple Machine Learning Research(RSS)56驯服扩散 Transformer 中的离群 token:Dual-Stage Registers 干预

8月4日周二

00:41Runway:News(网页)52Nvidia 高管:AI 是值得重建的全新计算模型

7月31日周五

01:25Runway:News(网页)40Skyscanner 如何用 Runway 消除前期制作中的猜测

7月28日周二

00:36Microsoft AI:官方博客(网页)49Introducing MAI-Image-1, debuting in the top 10 on LMArena
00:25OpenRouter:Announcements(RSS)60OpenRouter 新增图像生成模型专用 API 端点

7月25日周六

06:22Midjourney:Updates(RSS)73精选Midjourney V8.2 发布:专注美学提升与个性化理解

7月24日周五

00:30Microsoft AI:官方博客(网页)43Introducing MAI-Image-2.5-Pro and MAI-Voice-2-Flash

7月23日周四

00:00Black Forest Labs:Blog(网页)59精选FLUX 3 发布:Black Forest Labs 多模态模型,支持原生音频、图像生成与动作预测

7月21日周二

14:22Qwen:Blog Retrieval(API)77精选通义千问发布 Qwen-Image-3.0 图像生成模型,核心关键词为"实"

7月16日周四

01:31Apple Machine Learning Research(RSS)36仅需一层适配层:将预训练视觉编码器用于扩散模型图像生成

7月15日周三

00:06Google Blog:AI(RSS)49Google Images 25周年:推出可浏览图片主页与AI Overviews图像生成功能

7月10日周五

21:03公众号:可灵AI(快手·视频)18可灵两周年品牌片《Now You See It Too》:让想象力被看见

7月8日周三

22:00公众号:火山引擎57Seedream 5.0 Pro API上线,让图像创作开启"专业表达"阶段
21:22字节 Seed:Research Feed(网页内嵌数据)78精选Seedream 5.0 Pro 发布:不止"生成",更懂"设计"
18:10公众号:火山引擎49火山引擎Seedance官方API接入声明

7月7日周二

23:10Apple Machine Learning Research(RSS)40MT-EditFlow:基于流匹配的多轮图像编辑强化学习
11:10公众号:火山引擎41安踏集团×火山引擎:打造穿搭大模型"灵犀",重塑线上购物体验

7月3日周五

18:05公众号:京东JoyAI65精选JoyAI App上线UGC数字人功能,一张照片即可"捏"出专属虚拟玩伴

7月1日周三

01:29Apple:Newsroom(RSS)66精选Apple Creator Studio 更新:更智能、更快速、更互联
00:08Google DeepMind:Blog(RSS)70精选Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash

6月26日周五

02:57Midjourney:Updates(RSS)62精选Midjourney V8.1 草稿模式新增随机风格功能

6月25日周四

19:30公众号:百度智能云(文心)48百度智能云联合五家伙伴,加速AIGC内容工业化生产
19:20公众号:生数科技(Vidu·视频)38生数科技与极豆科技达成战略合作,共建汽车行业AIGC解决方案
14:40公众号:京东JoyAI55JoyAI 上线「欢乐足球季」:上传照片一键生成足球主题动态视频
14:23公众号:京东JoyAI62精选JoyAI 上线「欢乐足球季」:上传一张照片即可生成赛场动态视频

6月24日周三

19:31OpenRouter:Announcements(RSS)73精选OpenRouter推出统一图像API

6月21日周日

13:00公众号:腾讯元宝64精选腾讯元宝父亲节活动:上传照片生成与年轻爸爸的合影

6月19日周五

10:10公众号:腾讯元宝48腾讯元宝端午图像编辑:粽叶头套指令说明

6月18日周四

12:00公众号:龙猫LongCat(美团)59美团智能创作团队海报生成技术体系:PosterCraft/PosterOmni/PosterReward
10:24公众号:龙猫LongCat(美团)49美团海报生成 AIGC 技术创新与实践

6月17日周三

06:13Midjourney:Updates(RSS)66精选Midjourney V8.1 推出 Draft mode 草稿模式与新功能预览
已加载 40 条
全部 AI 动态
2026年8月25日星期二 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
一手信源 · 标签「图像生成」 · 142 条清除

8月23日

星期日 · 1 条
01:26
OpenRouter:Announcements(RSS)
AI 评分 55/100
OpenRouter 推出图像基准测试,覆盖全部 39 款图像模型

OpenRouter 发布 Visual Image Benchmarks,帮助用户快速评估其提供的全部 39 款图像模型(截至 2026 年 8 月)的实际能力。基准测试用七类挑战性提示词区分模型差异,包括不可能场景、计数、文本、空间关系、否定指令、编辑和一致性,并以网格形式展示结果,支持按价格和生成时间排序。OpenRouter 计划未来将该工具扩展至视频和音频模态。

产品更新图像生成多模态

8月22日

星期六 · 1 条
01:01
Midjourney:Updates(RSS)
AI 评分 35/100
Midjourney alpha 网站更新日志:8/20/26 修复与改进

Midjourney 发布 alpha.midjourney.com 两周内第二轮更新,修复大量 UX 问题并新增文件夹分组功能。用户可在侧边栏将项目整理为可折叠树状分组,支持双击重命名;Upscale、Zoom、Vary 功能回归,Vary 现在遵循用户设置而非静默运行 HD。设置项不再自动重置,站点卡顿、编辑器遮挡、提示词粘贴损坏等问题均已修复。

产品更新图像生成

8月18日

星期二 · 3 条
23:53
Runway:News(网页)
AI 评分 40/100
Populous 如何用 Runway 呈现全球标志性场馆设计

全球设计公司 Populous 高级建筑师 Georgina Myers 介绍团队用 Runway 辅助体育场馆概念设计:过去完整视频需外部渲染团队至少三周,且提交前两周须冻结设计模型;如今 Runway 能生成传达尺度感的完整渲染和航拍图,将视觉制作时间缩短,让设计师把时间还给设计本身。该工具已用于利雅得 MBS 体育场等中东项目,支持 9 种不同活动模式的场景迭代。

图像生成教程/实践视频
13:34
蚂蚁 inclusionAI:GitHub 新仓库精选
AI 评分 64/100
inclusionAI 开源 ConceptEdit:基于概念缩放与密集监督的图像编辑数据生成管线

蚂蚁集团 inclusionAI 开源 ConceptEdit,一个基于概念缩放与密集监督的图像编辑数据生成管线。该管线通过三阶段流程(VLM 生成指令、FLUX 执行编辑、VQA 评估筛选)构建大规模、基于分类法的图像编辑数据集,并提供单概念与多概念两种变体。项目采用 MIT 许可证,支持断点续跑,需 OpenAI 兼容 VLM 端点与本地 FLUX 检查点。

GitHub图像生成开源/仓库数据/训练

推荐理由:流水线把图像编辑数据生成拆为指令生成、FLUX 编辑、VLM 评判三步,多概念版本将多个并行编辑合并为一条指令并支持断点续跑,为构建带质检的编辑训练数据提供可复用框架。
05:23
OpenRouter:Announcements(RSS)
AI 评分 56/100
OpenRouter 图像生成 API:代码优先的接入教程

OpenRouter 推出专用图像生成 API,通过统一请求格式和单一密钥即可调用多个提供商的图像模型。开发者向 POST /api/v1/images 发送请求,响应中的 data[0].b64_json 包含 base64 编码的图像数据,解码后即可保存为本地文件。教程演示了 Python 和 JavaScript 两种实现,并支持通过 input_references 传入参考图像生成变体。

产品更新图像生成部署/工程

8月13日

星期四 · 1 条
18:20
公众号:可灵AI(快手·视频)
AI 评分 33/100
刷屏海内外的"中式天庭"《天宫之约》,出自可灵3.0

古风AI短片《天宫之约》爆火,播放近7000万、点赞超400万,被外交部发言人毛宁转发,海外平台观看超540万。该片由90后创作者栖光用可灵3.0制作,他看重可灵的画面质感、光影效果、精准提示词响应与生成稳定性。栖光已加入可灵AI创作者计划3.0,该计划设“灵感聚光计划”,提供每月百万现金池、千万级灵感值激励及单项目最高亿级曝光资源。

图像生成现象/趋势视频

8月11日

星期二 · 1 条
07:44
Microsoft AI:官方博客(网页)
AI 评分 30/100
MAI-Image-2.6 launches at No. 2 on Arena ahead of Google, Meta and xAI
Microsoft图像生成模型发布

8月7日

星期五 · 1 条
14:11
公众号:火山引擎精选
AI 评分 81/100
Seedance 2.5 API上线,视频生成开启「电影级长叙事」

火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。

产品更新图像生成视频
另有 1 家信源报道公众号:数字生命卡兹克
推荐理由:原生30秒时长和秒级时间戳控制,把长叙事视频从靠抽卡变为导演级调度;角色与光影的稳定提升让广告、影视等商业场景更接近实际生产标准。

8月6日

星期四 · 2 条
07:24
Runway:News(网页)
AI 评分 31/100
Chime 如何用 Runway 制作最新全国电视广告

Chime 执行制片人 Shayla Love 透露,团队用 Runway 将原本需约 30 万美元、涉及 80 多名真实会员的电视广告尾卡制作压缩至 3 万美元以内,且几乎无制作开销。Runway 的定制工作流将质量参差的 UGC 照片转化为稳定、达到电视播出标准的动态画面。团队还计划用 Runway 制作概念故事板,以加速广告审批流程。

图像生成教程/实践视频
06:52
Apple Machine Learning Research(RSS)
AI 评分 56/100
驯服扩散 Transformer 中的离群 token:Dual-Stage Registers 干预

研究发现扩散 Transformer(DiT)图像生成流程中,预训练 ViT 编码器和 DiT 去噪器均会产生离群 token,尤其在中间层,且简单掩蔽高范数 token 无法改善性能,问题与局部 patch 语义损坏相关。为此提出 Dual-Stage Registers(DSR)干预方法,在 ImageNet 和文生图任务上持续减少离群伪影并提升生成质量。

图像生成数据/训练论文/研究

8月4日

星期二 · 1 条
00:41
Runway:News(网页)
AI 评分 52/100
Nvidia 高管:AI 是值得重建的全新计算模型

Nvidia 媒体与娱乐部门副总裁 Richard Kerris 认为,AI 不是可叠加的功能,而是值得围绕其重建的全新计算模型。Runway 仅用一天便将 Gen-4.5 迁移至 Nvidia 最新平台 Vera Rubin,生成速度从分钟级提升至即时,使视频生成变为实时创作循环。

图像生成大佬观点视频

7月31日

星期五 · 1 条
01:25
Runway:News(网页)
AI 评分 40/100
Skyscanner 如何用 Runway 消除前期制作中的猜测

Skyscanner 品牌团队在美加品牌广告拍摄中,使用 Runway 辅助艺术指导,在开拍前锁定镜头构图、灯光方向和演员站位,并在片场实时验证拍摄内容。团队将 Runway 生成的场景、道具和构图直接放入最终广告版式(OOH、Meta 广告等),将原本需要两周的构思过程压缩为可执行的预可视化方案,使拍摄现场反馈闭环从后期提前到实时。

图像生成教程/实践

7月28日

星期二 · 2 条
00:36
Microsoft AI:官方博客(网页)
AI 评分 49/100
Introducing MAI-Image-1, debuting in the top 10 on LMArena
Microsoft图像生成模型发布
00:25
OpenRouter:Announcements(RSS)
AI 评分 60/100
OpenRouter 新增图像生成模型专用 API 端点

OpenRouter 通过专用 /api/v1/images 端点提供图像生成模型服务,图像理解仍通过 /chat/completions 端点完成,两者共用同一 API Key 和计费体系。该平台同时公布了两种任务的完整接口合约,并修复了此前出现的“no endpoints found”错误。

图像生成教程/实践

7月25日

星期六 · 1 条
06:22
Midjourney:Updates(RSS)精选
AI 评分 73/100
Midjourney V8.2 发布:专注美学提升与个性化理解

Midjourney 今日推出 V8.2 图像模型,重点提升美学质量、图像创意与个性化表现。低质量图像出现频率将显著降低,个性化功能能更精准理解用户审美偏好。V8.2 的个性化配置文件拥有更大、更优的图像选择池,建议用户尝试新旧配置文件体验最新版本。

图像生成模型发布
另有 1 家信源报道X:Midjourney (@midjourney)
推荐理由:Midjourney V8.2 把审美和个性化放到了C位,不再追分辨率,这对重度用户是实在的体验升级,建议立刻用老 profile 试试新模型。

7月24日

星期五 · 1 条
00:30
Microsoft AI:官方博客(网页)
AI 评分 43/100
Introducing MAI-Image-2.5-Pro and MAI-Voice-2-Flash
Microsoft图像生成模型发布语音

7月23日

星期四 · 1 条
00:00
Black Forest Labs:Blog(网页)精选
AI 评分 59/100
FLUX 3 发布:Black Forest Labs 多模态模型,支持原生音频、图像生成与动作预测

Black Forest Labs 发布多模态模型 FLUX 3,面向视频领域,原生支持音频、图像生成与动作预测。该模型旨在成为视觉智能的骨干,目前官方已展示其能力与早期结果。

图像生成多模态模型发布

推荐理由:Black Forest Labs 把图像、视频、音频拉通到一个模型里,这比单纯提升画质更有想象力,但目前只有一句简介,像个预告片,想真评估的还得等技术细节。

7月21日

星期二 · 1 条
14:22
Qwen:Blog Retrieval(API)精选
AI 评分 77/100
通义千问发布 Qwen-Image-3.0 图像生成模型,核心关键词为"实"

通义千问发布第三代图像生成基座模型 Qwen-Image-3.0,核心关键词为“实”。该模型支持最长 4.5k token 指令输入,可单次生成包含 9 个复杂信息图的 3×3 网格布局;文本渲染精度达 10px,并支持 12 种语言原生渲染,旨在将图像转化为可部署的生产力工具。

图像生成多模态模型发布

推荐理由:我觉得 Qwen-Image-3.0 不只是画得好看,而是真正追求“有用”,4.5k token 输入、12 种语言渲染、10px 精细文字,对做设计、内容生产的人是生产力级突破。

7月16日

星期四 · 1 条
01:31
Apple Machine Learning Research(RSS)
AI 评分 36/100
仅需一层适配层:将预训练视觉编码器用于扩散模型图像生成

Apple 研究提出在预训练视觉编码器后添加一个轻量级适配层,即可直接用于扩散模型图像生成,无需重新训练整个编码器。该方法在 ImageNet 无条件生成任务上达到 1 FID,性能与专用编码器相当,且大幅降低计算成本。

图像生成论文/研究

7月15日

星期三 · 1 条
00:06
Google Blog:AI(RSS)
AI 评分 49/100
Google Images 25周年:推出可浏览图片主页与AI Overviews图像生成功能

Google Images迎来25周年,推出两项新功能:一是全新的可浏览图片主页,展示来自网络的动态沉浸式图片画廊,实时更新并根据用户兴趣智能定制,支持收藏夹标签页,未来几周在美国桌面端英文上线;二是将图像生成直接引入AI Overviews,基于最新的Nano Banana模型,将文本提示词转化为高质量定制图像,未来几周在英文区域逐步推出。回顾了2001年上线、2009年相似图片、2011年以图搜图、2018年Google Lens、2022年多模态搜索、2024年Circle to Search、2025年Lens+AI Mode及Search Live、2026年Circle to Search多对象识别等里程碑。

Google产品更新图像生成多模态

7月10日

星期五 · 1 条
21:03
公众号:可灵AI(快手·视频)
AI 评分 18/100
可灵两周年品牌片《Now You See It Too》:让想象力被看见

可灵在成立两周年之际发布创意品牌片《Now You See It Too》(想象,你亦可见),由可灵与全球创作者共同完成,其中许多画面来自「可灵两周年·年度创作集锦征集」的用户投稿。影片记录梦境、幻想、童年、爱等难以言说的画面,呈现 AI 时代人类想象力的集体表达,让过去只存在于脑海中的画面可以被保存、分享和被他人看见。

图像生成行业动态视频

7月8日

星期三 · 3 条
22:00
公众号:火山引擎
AI 评分 57/100
Seedream 5.0 Pro API上线,让图像创作开启"专业表达"阶段

火山引擎上线豆包图像创作模型 Seedream 5.0 Pro 的 API 服务。该模型在交互式精准编辑、复杂信息可视化、影像与人像质感真实、原生多语种输入与生成等方面实现能力突破:支持点选、圈选、草图渲染、色值编辑、图层分离等像素级编辑;可稳定输出高密度信息图;强化光影、材质和皮肤肌理还原;原生支持中、英、西、葡、阿、法、德、俄、日、韩、泰等十余种语言。广泛适配电商营销、广告创意、深度教育、影视视觉开发、全球化出海物料等企业场景。

产品更新图像生成多模态
21:22
字节 Seed:Research Feed(网页内嵌数据)精选
AI 评分 78/100
Seedream 5.0 Pro 发布:不止"生成",更懂"设计"

字节 Seed 今日发布多模态图像创作模型 Seedream 5.0 Pro,在图文匹配、结构合理性、文字渲染与画面美感上全面升级。四大核心突破:复杂信息可视化,可生成高密度信息图;交互式精准编辑,支持点选、圈选、草图渲染、色彩与材质替换、图层分离及多图融合,实现像素级编辑;真实的影像与人像质感,还原光影、材质与皮肤肌理;原生多语种输入与生成,支持十余种语言及本地化视觉特征。已陆续在豆包、即梦、火山方舟等平台上线。

图像生成多模态模型发布
另有 1 家信源报道IT之家(RSS)
推荐理由:字节这次发布的 Seedream 5.0 Pro 把图像生成从「画得好看」推进到「能输出信息图、能精准编辑」的实用设计工具,尤其复杂信息图和交互编辑是当前竞品明显短板,做设计的值得立刻试试。
18:10
公众号:火山引擎
AI 评分 49/100
火山引擎Seedance官方API接入声明

火山引擎声明,市场上出现的“火山Seedance模型接口”“Seedance低价中转接口”等均为非官方授权,存在数据泄露、服务中断、无SLA等风险。官方渠道是当前唯一合法的API接入途径。已接入非官方接口的客户应在30天内通过火山引擎官方完成合规迁移。火山引擎近期发布Seedance 2.5,欢迎通过官方路径接入。

图像生成行业动态

7月7日

星期二 · 2 条
23:10
Apple Machine Learning Research(RSS)
AI 评分 40/100
MT-EditFlow:基于流匹配的多轮图像编辑强化学习

针对单轮图像编辑模型在多轮交互中因单轮失败导致序列中断、误差累积的问题,提出 MT-EditFlow 流匹配强化学习框架。该框架整合多轮视角与多奖励公式,统一支持 GRPO 和 NFT 类强化学习方法,并系统分析轮次聚合评分策略、VLM 推理模式(权衡奖励偏差与方差)以及优势融合层级(防止奖励黑客行为)。研究发现将聚合优势广播至整个编辑轨迹能弥合局部规划与全局多轮任务成功之间的差距。实验表明,MT-EditFlow 在多种基模型上显著提升性能,其中 FLUX.1-Kontext-dev 的 turn-3 整体性能提升 6.85 分,超越 Qwen-Image-Edit 等开源模型。

图像生成多模态论文/研究
11:10
公众号:火山引擎
AI 评分 41/100
安踏集团×火山引擎:打造穿搭大模型"灵犀",重塑线上购物体验

安踏集团与火山引擎合作,基于Lumina平台及Seedream、Seedance、Seed系列模型,推出“灵犀穿搭大模型”,实现智能穿搭推荐、虚拟试衣试鞋及创意海报视频生成。在主流电商平台试运行中,转化率提升超10%,退货率下降超10%,版型与材质还原度超90%,内容制作周期从数天压缩至几分钟,成本下降80%。该模型依托安踏近6年百万组产品数据训练,在穿着贴合感、材质质感、清晰度、光影自然度、细节保真度、整体真实感六项技术维度优于通用模型。

产品更新图像生成多模态

7月3日

星期五 · 1 条
18:05
公众号:京东JoyAI精选
AI 评分 65/100
JoyAI App上线UGC数字人功能,一张照片即可"捏"出专属虚拟玩伴

JoyAI App正式上线UGC数字人功能,用户上传一张照片即可生成高度还原的写实数字分身,或搭配模板重塑为卡通形象,并支持复刻音色。该功能复用“万能博士”技术底座,实现全双工对话能力,可随时打断、自然接话,同时提供点外卖、金融咨询等生活服务。

产品更新图像生成多模态

推荐理由:照片生成数字人并不新鲜,但把全双工对话和京东生活服务(点外卖、金融咨询)集成进一个虚拟玩伴,让陪伴型智能体有了更直接的服务抓手。

7月1日

星期三 · 2 条
01:29
Apple:Newsroom(RSS)精选
AI 评分 66/100
Apple Creator Studio 更新:更智能、更快速、更互联

Apple Creator Studio 推出多项 AI 增强更新。Final Cut Pro 新增 on-device AI 驱动的 Generate Captions(自动转录音频生成字幕)和 Edit Detection(自动检测剪辑点)。Mac 版加入 Auto Mask(自动识别皮肤、天空等主体)、增强的 Match Color 和 Advanced Trimming。支持将帧发送至 Pixelmator Pro 编辑,并在 Keynote、Pages、Numbers 中直接调用 Pixelmator Pro 修改图片。Logic Pro 新增 Grammy 制作人制作的 Producer Project 及 Chord ID 改进。订阅价 $12.99/月或 $129/年,新用户免费试用一个月,教育用户 $2.99/月。

产品更新图像生成语音

推荐理由:Final Cut Pro 的自动字幕和遮罩是实打实的工作流提升,Pixelmator Pro 的深度整合也让设计更顺畅,虽然没有颠覆性突破,但创意工作者今天就能用上。
00:08
Google DeepMind:Blog(RSS)精选
AI 评分 70/100
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash

Google DeepMind 推出 Nano Banana 2 Lite(gemini-3.1-flash-lite-image),为 Nano Banana 系列速度最快、成本最低的图像模型,文本到图像输出仅需 4 秒,每 1K 分辨率图像成本 $0.034,已上线 Google AI Studio、Gemini API 及消费者产品(AI Mode in Search、Gemini app 等)。同时推出 Gemini Omni Flash(gemini-omni-flash-preview),支持高画质视频生成与对话式编辑,视频输出定价 $0.10/秒,面向开发者开放 API。

Google图像生成多模态模型发布
另有 3 家信源报道X:Google AI (@GoogleAI)X:Logan Kilpatrick (@OfficialLoganK)X:Google DeepMind (@GoogleDeepMind)
推荐理由:Nano Banana 2 Lite 把图像生成拉到 4 秒延迟和 0.034 美元单价,很适合高频草稿流,Omni Flash 首次对开发者开放视频生成和对话编辑,两个模型串起来的快速迭代工作流是这次最实用的更新。

6月26日

星期五 · 1 条
02:57
Midjourney:Updates(RSS)精选
AI 评分 62/100
Midjourney V8.1 草稿模式新增随机风格功能

Midjourney V8.1 的草稿模式(draft mode)添加了随机风格功能。用户在提示词中加入 --sref random 即可一键生成 24 张不同风格的图片。开启草稿模式可通过点击提示栏的 ⚡ 图标或添加 --draft 参数。

产品更新图像生成

推荐理由:Midjourney 在 V8.1 草稿模式加了随机风格,一键出 24 种草图,对找灵感的创作者算顺手小升级,但改变不了核心创作流程,只适合深度用户尝鲜。

6月25日

星期四 · 4 条
19:30
公众号:百度智能云(文心)
AI 评分 48/100
百度智能云联合五家伙伴,加速AIGC内容工业化生产

百度智能云携手酱油文化、VAST、炫佳科技、魔方元启、LIKEAI,将千帆、百舸等能力落地于AI漫剧、3D内容、短剧创作。酱油文化漫剧制作周期压缩90%,月产能超200部,单月营收达5000万量级,抖音破亿作品中五分之一出自其手。VAST的Tripo大模型基于百度百舸数秒生成生产级3D网格。炫佳科技Kino-AIGC模型通过网信办备案并登顶VBench,累计生成超10万分钟AI视频。魔方元启制作周期缩短50%-80%。LIKEAI实现7-10人班组单周单部短剧交付,代表作《哎呀,我的娘亲是女帝》上线24小时播放量超2亿。

图像生成行业动态视频
19:20
公众号:生数科技(Vidu·视频)
AI 评分 38/100
生数科技与极豆科技达成战略合作,共建汽车行业AIGC解决方案

6月24日,生数科技与极豆科技签署战略合作协议。双方将整合生数科技多模态大模型(Vidu等)与极豆科技汽车AI解决方案、AI中台及车规级研发能力,围绕座舱内容、车主服务等场景打造汽车行业AIGC解决方案。重点探索个性化欢迎、亲子互动、旅途影像等场景,通过模型接入与场景编排将内容生成从预置供给升级为实时动态生成。同时将AIGC延伸至通勤、补能、车辆服务等环节,探索API、SDK及私有化部署等交付方式。极豆科技已与30余家车企合作,累计量产装车超1400万辆。

图像生成多模态行业动态视频
14:40
公众号:京东JoyAI
AI 评分 55/100
JoyAI 上线「欢乐足球季」:上传照片一键生成足球主题动态视频

JoyAI APP 上线「欢乐足球季」主题活动,用户上传一张人像照片即可生成沉浸式赛场动态视频,支持近 20 款视频模板(看台抓拍、进球巅峰时刻、足球手势舞等),内置全景推进、特写定格等多类运镜逻辑,人物动作与表情自然拟合,赛场光影与人群动效同步渲染。同时上线近 50 款足球主题 AI 智能体,覆盖战术复盘、趣味评球、互动陪伴等方向。活动上线首周日均互动增长率超 158%。

产品更新图像生成视频
14:23
公众号:京东JoyAI精选
AI 评分 62/100
JoyAI 上线「欢乐足球季」:上传一张照片即可生成赛场动态视频

JoyAI APP 上线「欢乐足球季」主题活动,用户上传一张人像照片即可生成沉浸式赛场动态视频,支持肢体动作拟合、环境动态渲染与专业运镜。活动提供近 20 款视频模板,覆盖看台抓拍、进球庆祝、足球手势舞等玩法,并同步上线近 50 款足球主题聊球智能体。上线首周互动量日均增长率超 158%。

产品更新图像生成多模态

推荐理由:模板覆盖看台、进球、手势舞等场景,无需编辑技能即可产出氛围感短片,对丰富观赛社交内容有直接帮助。

6月24日

星期三 · 1 条
19:31
OpenRouter:Announcements(RSS)精选
AI 评分 73/100
OpenRouter推出统一图像API

OpenRouter推出统一图像API,整合Google、OpenAI、Black Forest Labs、Recraft、ByteDance、Sourceful、Microsoft、xAI等30+模型。新API提供标准化请求格式,通过/api/v1/images/models端点返回每个模型的分辨率、宽高比、输出数量、输入参考图数量、种子等能力描述;通过/api/v1/images/models/{id}/endpoints端点获取具体服务商的定价与参数支持(如Seedream 4.5每张$0.04、FLUX.2 Pro每百万像素$0.03、GPT-5.4 Image 2按token计费)。OpenAI的GPT 5系列图像模型支持SSE流式预览,启用"stream": true即可边生成边返回预览。新图像模型将仅添加至专用API,建议现有用户切换。

智能体产品更新图像生成多模态
另有 1 家信源报道X:OpenRouter (@OpenRouter)
推荐理由:OpenRouter 把 30+ 图像模型收进一个 API,参数自动发现和流式预览让频繁切换模型的开发者省去不少适配麻烦,尤其对 Agent 工作流很友好。

6月21日

星期日 · 1 条
13:00
公众号:腾讯元宝精选
AI 评分 64/100
腾讯元宝父亲节活动:上传照片生成与年轻爸爸的合影

腾讯元宝推出父亲节主题活动,用户可选择爸爸年轻时照片与自己的照片,输入提示词(如“帮我生成一张和爸爸的合影,将图2的我融合到图1爸爸的照片中,我想穿越回__年前,和他一起_____;保留爸爸照片的背景、动作及五官;人物姿态自然协调,整体光线与色调保持一致”),元宝即可生成合影。活动旨在让用户“回到过去”看到爸爸的青春模样。

图像生成教程/实践

推荐理由:元宝的父亲节营销,但合影生成指令写得具体可复现,比普通AI写真教程更接地气,父亲节想整活的可以直接抄作业。

6月19日

星期五 · 1 条
10:10
公众号:腾讯元宝
AI 评分 48/100
腾讯元宝端午图像编辑:粽叶头套指令说明

用户发布多组详细提示词,要求保留原图主体及背景,仅对宠物、人物、表情包、企鹅等对象添加真实风格的绿色粽叶头套或指套。指令强调粽叶需具备叶脉、折痕、色差、翘边和自然阴影,用红白细绳或草绳固定并在下巴处松松打结,整体效果类似手机随手拍的真实照片,避免卡通感、头盔感和过度规整。每段提示词均独立指定保留原图和比例,不改变原表情或姿势。

图像生成教程/实践

6月18日

星期四 · 2 条
12:00
公众号:龙猫LongCat(美团)
AI 评分 59/100
美团智能创作团队海报生成技术体系:PosterCraft/PosterOmni/PosterReward

美团智能创作团队构建了覆盖“生成—编辑—评判”全链路的海报生成技术体系。PosterCraft(ICLR 2026)通过四阶段级联优化实现端到端高美感海报生成,文字渲染准确率接近顶级闭源商业系统;PosterOmni(CVPR 2026)以单一统一模型覆盖扩图、补全、比例调整、风格迁移等六类设计任务;PosterReward(CVPR 2026)是首个专门面向海报质量的奖励模型,在专项评测基准上达86%准确率。三者相互协同,已全部开源至MeiGen-AI仓库,并在美团外卖套餐图生成、品牌IP袋鼠团团等业务中落地。

图像生成开源生态教程/实践评测/基准
10:24
公众号:龙猫LongCat(美团)
AI 评分 49/100
美团海报生成 AIGC 技术创新与实践

美团智能创作团队构建了覆盖“能生成、能编辑、能评判”的海报生成技术闭环:PosterCraft(ICLR 2026)实现端到端文字、视觉与版式统一优化,文字渲染准确率接近 Gemini 2.0-Flash-Gen 等闭源商业系统。

图像生成开源/仓库教程/实践

6月17日

星期三 · 1 条
06:13
Midjourney:Updates(RSS)精选
AI 评分 66/100
Midjourney V8.1 推出 Draft mode 草稿模式与新功能预览

Midjourney V8.1 的 Draft mode 草稿模式每次生成24张低分辨率低质量图片。用户可对任意图片点击 "Vary",将其渲染为全质量、全分辨率版本。草稿任务消耗的快速小时数减半。

产品更新图像生成
另有 1 家信源报道X:Midjourney (@midjourney)
推荐理由:这是我最近看到最实用的 Midjourney 更新,草稿模式半价生成 24 张低质量图,快速筛选后再渲染,直接降低试错成本。
已加载 40 条