内容
精选全部 AI 动态热点榜AI 日报主题收藏
接入
Agent 接入
更多
关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态
来源全部一手资讯X
类型全部
全部模型产品行业论文教程观点
标签「图像生成」清除

今天8月9日 周日

00:42Elon Musk48Grok 图像模型编辑功能获好评
00:42Elon Musk66精选Grok Imagine 图像编辑迎来重大升级

8月8日周六

23:42Elon Musk29Grok Imagine 图像编辑能力大幅提升
22:12Baidu Inc.25百度DuMate以猫眼视角看家庆国际猫咪日
18:08AYi52Grok Imagine 2.0跃居文生图竞技场第二
16:42Chubby♨️49Grok Image 2.0 排名第二,紧追 GPT Image 2
16:12Chubby♨️35Grok 发布 Image 2.0,仅次于 OpenAI
15:14🚨 AI News | TestingCatalog56Grok Imagine Image 2.0 发布,支持精准编辑
14:42Rohan Paul47Grok Imagine 2.0(Low)登顶文生图竞技场第二
14:11IT之家(RSS)57全球第二:马斯克 SpaceXAI 推出 Imagine Image 2.0,强化 AI 生图 / 编辑能力
14:08AYi35Grok Imagine Image 2.0 文生图实测惊艳
13:05elsewhere:文章(RSS)26葬AI发布 meme bench 视频模型评测基准
12:42DogeDesigner62Grok Image 2.0 实现精准图像生成与编辑
12:42DogeDesigner72Grok Imagine 2.0登顶双榜第二
12:12DogeDesigner40Grok Imagine 2.0 登顶图像编辑榜第二
12:12DogeDesigner41Grok Imagine 2.0 精准图像生成能力展示
12:12DogeDesigner62Grok Imagine 新增 20 个图像模板
11:42DogeDesigner64SpaceXAI发布Grok Imagine Image 2.0图像模型
11:42DogeDesigner49Grok Imagine 2.0 登顶文生图榜第二
01:12Artificial Analysis65文生图竞技场更新:GPT Image 2 全项第一

8月7日周五

14:11公众号:火山引擎81精选Seedance 2.5 API上线,视频生成开启「电影级长叙事」
10:41Hacker News 热门(buzzing.cc 中文翻译)48当网友发现我的艺术作品是AI生成的时
03:40Chubby♨️57Dreamina Seedance 2.5 全球首发评测

8月6日周四

21:10IT之家(RSS)73阿里全新视频生成模型 Wan3.0 开启公测:单次生成 30 秒视频,支持文档输入
18:10Alibaba Cloud72通义千问 Qwen-Image-3.0 发布,支持 4.5K 提示词
18:10IT之家(RSS)64美国祖父母热衷用 AI 生成童书把孙辈写进故事,引发父母辈反感
17:40Alibaba Cloud77通义千问图像3.0发布,支持4.5K提示词
15:44Alexandr Wang17Muse Spark 1.2 展现前所未见能力
14:39Alibaba Cloud81精选Qwen-Image-3.0 发布:高分辨率低至 0.03 美元
14:09Alibaba Cloud71Qwen-Image-3.0 正式商用,支持 12 种语言
10:55HuggingFace Daily Papers(社区热门论文)52Poly-OPD:面向能力可选流模型的多教师同策略蒸馏框架
10:55HuggingFace Daily Papers(社区热门论文)62ToolArtist:面向智能体图像生成的工具使用统一多模态模型
10:55HuggingFace Daily Papers(社区热门论文)49UniWorld-View:基于视频扩散模型的大基线视图合成
07:24Runway:News(网页)31Chime 如何用 Runway 制作最新全国电视广告
06:52Apple Machine Learning Research(RSS)56驯服扩散 Transformer 中的离群 token:Dual-Stage Registers 干预
01:39Hacker News 热门(buzzing.cc 中文翻译)53Qwen 3.0 Image Pro 发布:支持 4.5k token 输入与 10px 级文字渲染

8月5日周三

23:09Krea21Krea AI 询问谁想要 Seedance 2.5 访问权限
23:09fofr9Nostromo 场景引发热议
21:35Alibaba Cloud25阿里云展示HappyHorse 1.1与Wan2.7生成效果
21:35Alibaba Cloud69阿里云发布 Qwen-Image-3.0,支持复杂提示与多语言
已加载 40 条
全部 AI 动态
2026年8月9日星期日 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
标签「图像生成」 · 1304 条清除

8月9日

星期日 · 2 条
00:42
Elon Musk@elonmusk
48
试试吧!【引用 @venturetwins】:我对新的 Grok 图像模型和编辑功能印象深刻!我从 Gap 网站截了几件商品图,快速生成了一组照片。工作流工具很酷--物品/人物可分段编辑,可以调整宽高比,还能融入新的参考内容。

Justine Moore: I'm impressed with the new Grok Image model and editing features! Screenshotted a few items from the Gap website and gen...

xAI图像生成模型发布
00:42
Elon Musk@elonmusk精选
66
Grok Imagine 图像编辑功能重大升级【引用 @XFreeze】:你可以直接悬停在 Grok Imagine 中的任意特定区域,并即时进行编辑

X Freeze: 你只需将鼠标悬停在 Grok Imagine 中的任意特定片段上,就能立即对其进行编辑。

xAI产品更新图像生成
另有 1 家信源报道X:cb_doge (@cb_doge)
推荐理由:悬停选中并即时编辑把图层和遮罩等概念替换为手势,降低了图像修改的操作门槛。

8月8日

星期六 · 18 条
23:42
Elon Musk@elonmusk
29
马斯克称 Grok Imagine 图像编辑能力大幅提升。用户反馈其分段与精准编辑工具可只修改目标区域而保留其余部分,无需重新生成整图,编辑更快更实用,正成为强大的图像编辑器。

X Freeze: Grok Imagine's image editing literally blows my mind I just edited this entire image from scratch using Grok Imagine and...

xAI产品更新图像生成
22:12
Baidu Inc.@Baidu_Inc
25
我们让 DuMate 用猫的视角看了一遍房子。结果发现,你一直住在它们全装修好的公寓里。祝世界各地的小房东们国际猫咪日快乐。🐈
产品更新图像生成
18:08
AYi@AYi_AInotes
52
Grok Imagine 2.0跃居文生图竞技场第二

老马真的是频频放大招啊, @SpaceXAI xAI在文本生成图像这块闷声干了票大的, Grok Imagine Image 2.0 Low版,直接从文生图竞技场第14名跳到第2名🥇 1320分!!! 更离谱的是分项: 艺术第2,肖像第2,文字渲染第2,卡通动漫第2,照片级电影感第2,产品品牌商业设计第3。 图像编辑竞技场也第2,1439分。 注意,这还仅仅是Low版啊兄弟们, 目前仅在app内可用,API还没开放。 从14到2,这就不是普通迭代了,简直就是跃迁

Grok: Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved fac...

xAI图像生成模型发布
16:42
Chubby♨️@kimmonismus
49
Grok Image 2.0 (Low) 排名高于所有其他图像模型,仅次于 GPT Image 2。干得漂亮,SpaceXai

Chubby♨️: Grok announced Image 2.0. It's the second-best image model in the world! SpaceX is really catching up. Now only slightly...

图像生成模型发布
16:12
Chubby♨️@kimmonismus
35
Grok 发布了 Image 2.0。这是全球第二好的图像模型!SpaceX 真的在迎头赶上。现在只比 OpenAI 的图像 2.0 稍逊一筹。很高兴看到竞争在加剧。

Grok: Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved fac...

xAI产品更新图像生成
15:14
🚨 AI News | TestingCatalog@testingcatalog
56
xAI 发布 Grok Imagine Image 2.0 图像模型,现已在 Grok 应用的 Quality Mode 下可用。新模型主打精准编辑、清晰文本渲染、更高事实性和实用性,将编辑作为一等能力,在文生图与图像编辑两项上均排名世界第二。

Grok: Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved fac...

xAI图像生成模型发布
14:42
Rohan Paul@rohanpaul_ai
47
Grok Imagine Image 2.0(Low)在文生图竞技场跃升12位至第2名(1320分),超越自家上一代质量模型(第14名,1228分)。该版本仅限App使用,不支持API。在图像编辑竞技场同样以1439分位列第2,并在艺术、肖像、文字渲染等五个类别中均排名第2。

Arena.ai: Exciting news: Grok Imagine Image 2.0 (Low) by @SpaceXAI has landed in the Text-to-Image Arena at #2 (1320 pts)! This re...

xAI图像生成行业动态
14:11
IT之家(RSS)
57
全球第二:马斯克 SpaceXAI 推出 Imagine Image 2.0,强化 AI 生图 / 编辑能力

马斯克旗下 SpaceXAI 今日发布 Imagine Image 2.0 模型,已作为全新质量模式在 Grok.com 网页版及 iOS、安卓应用上线。该模型更遵循指令,能规划文字排版、保持多部分画面一致,并新增魔棒、分割、背景移除、多参考图编辑(最多 5 张)及智能调整尺寸等编辑工具。

xAI图像生成模型发布
14:08
AYi@AYi_AInotes
35
Imagine Image 2.0的文生图效果真的很顶啊,我就一句话,给我一个特斯拉超级工厂和中国知名建筑的一个对比图,然后也就是 10 秒左右就出来了,速度特别快

Grok: Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved fac...

xAI图像生成模型发布
13:05
elsewhere:文章(RSS)
26
葬AI发布 meme bench 视频模型评测基准

葬AI发布 meme bench,用于评测视频模型能力。该基准历时半个月打造,旨在更全面地衡量视频模型表现。

图像生成视频评测/基准
12:42
DogeDesigner@cb_doge
62
精准的图像生成和编辑终于来到了 @GrokImage 2.0 专为精准图像生成与编辑而打造。它能遵循最细微的指令细节,处理清晰文字与复杂布局,保持一致性,并且只改动你要求的部分。立即体验!
产品更新图像生成多模态
12:42
DogeDesigner@cb_doge
72
GROK 巨大飞跃 🚀Grok Imagine Image 2.0 目前在文生图与图像编辑竞技场均排名第二,得分分别为 1320 和 1439。其表现超越了 Meta、微软、谷歌、阿里巴巴、字节跳动等公司的领先模型。
xAI图像生成多模态评测/基准
12:12
DogeDesigner@cb_doge
40
突发:Grok Imagine Image 2.0 以 1439 分的 Arena 评分位列图像编辑模型第二名,超越 Meta、微软、谷歌和字节跳动的模型。
xAI图像生成评测/基准
12:12
DogeDesigner@cb_doge
41
Grok Imagine Image 2.0 在精准图像生成方面表现出色。它能处理复杂布局、组织密集信息,甚至能以惊人准确度渲染小号文字。以下是一些完全使用 Image 2.0 制作的信息图 👇
产品更新图像生成
12:12
DogeDesigner@cb_doge
62
突发:随着 Image 2.0 模型的发布,Grok Imagine 现新增 20 个用于精准图像生成与编辑的模板。• 吉祥物制作 • 表情符号创建 • 智能调整大小 • 个人头像 • 重新想象 • 周边制作 • 专业证件照 • 背景移除与更换 • 产品换色 • 图标制作 • 编辑产品海报 • 房间布景 • 电商照片 • 主打产品展示 • 角色精灵 • 道具与 UI 套件 • 二维码皮肤 • 照片拼贴 • UGC 照片 • 照片编辑
xAI图像生成模型发布
11:42
DogeDesigner@cb_doge
64
突发:SpaceXAI 刚刚发布了 Grok Imagine Image 2.0,这是其用于专业图像生成和编辑的最新模型。• 改进的提示词准确性、排版和布局 • 使用魔棒和分割进行精确编辑 • 背景移除和智能调整大小 • 支持最多 5 张输入图像 • 跨代生成的一致性更好 • 新增产品图、头像、图标、游戏资产等模板现已在 Grok 网页版、iOS 和 Android 上以 Quality Mode 提供。
xAI图像生成模型发布
11:42
DogeDesigner@cb_doge
49
突发:Grok Imagine Image 2.0 以 1320 分的 Arena 评分位列文生图模型第二名,超越 Meta、Google、阿里巴巴、字节跳动等公司的模型。
xAI图像生成评测/基准
01:12
Artificial Analysis@ArtificialAnlys
65
文生图竞技场更新:GPT Image 2 全项第一

Artificial Analysis 更新文生图竞技场,按 10 类真实用例与 9 项能力评测模型,覆盖营销、电商、UI/UX 设计等场景。GPT Image 2 在所有用例和能力榜单均列第一;Nano Banana 2 以 $67/千图成为性价比之选,MAI-Image-2.5 是电商领域最佳廉价选项,Nano Banana Pro 则在真人电影领域表现突出。

OpenAI图像生成评测/基准

8月7日

星期五 · 3 条
14:11
公众号:火山引擎精选
81
Seedance 2.5 API上线,视频生成开启「电影级长叙事」

火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。

产品更新图像生成视频
另有 1 家信源报道公众号:数字生命卡兹克
推荐理由:原生30秒时长和秒级时间戳控制,把长叙事视频从靠抽卡变为导演级调度;角色与光影的稳定提升让广告、影视等商业场景更接近实际生产标准。
10:41
Hacker News 热门(buzzing.cc 中文翻译)
48
当网友发现我的艺术作品是AI生成的时

艺术家 David Revoy 发文讲述网友识别出其作品为 AI 生成后的经历。他观察到,一旦作品被打上 AI 标签,观众的评价和互动方式会发生显著变化,甚至影响对作品本身的解读。文章探讨了 AI 生成内容在艺术社区中引发的信任与认知问题。

图像生成现象/趋势
03:40
Chubby♨️@kimmonismus
57
1/ 我一直在测试 Dreamina Seedance 2.5,不出所料:这是目前最好的文生视频模型。没有之一。它也是美国区域支持 Seedance 2.5 模型的最快平台。这是 Seedance 2.5 的全球首发,Dreamina 专为充分发挥其性能而打造,无需再切换到其他工具。以下是我制作的两段视频片段:
图像生成视频评测/基准

8月6日

星期四 · 13 条
21:10
IT之家(RSS)
73
阿里全新视频生成模型 Wan3.0 开启公测:单次生成 30 秒视频,支持文档输入

阿里云今日宣布全新一代视频生成模型 Wan3.0 开启公测,单次可生成 30 秒视频,并首次支持 doc、xls、ppt、pdf、md 等文档格式输入,号称“万物皆可生视频”。

图像生成模型发布视频
另有 2 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)公众号:千问APP(阿里)
18:10
Alibaba Cloud@alibaba_cloud
72
每张图像都始于想象。Qwen-Image-3.0 可处理 4.5K-token 提示词,一次性生成学术页面(含 LaTeX)、分镜脚本、UI 线框图、游戏美术、建筑渲染和电影预演。起价 $0.03/张。开启创意之旅: • Model Studio:https://click.alibabacloud.com/m/20000001640/ • Qwen Cloud:https://click.qwencloud.com/m/20000001622/
图像生成多模态模型发布
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
18:10
IT之家(RSS)
64
美国祖父母热衷用 AI 生成童书把孙辈写进故事,引发父母辈反感

美国祖父母正流行用 AI 平台制作以孙辈为主角的个性化童书,却引发孩子父母强烈反感,甚至导致家庭矛盾。Imagitime、StoryWonderBook 和 Childbook.ai 等平台只需用户提供孩子信息即可生成故事,但家长担忧儿童照片和身份信息被 AI 平台滥用。麦考瑞大学研究员徐道之指出,AI 童书缺乏幽默感和戏剧张力,孩子对这类“专属故事”反应冷淡。

图像生成现象/趋势
17:40
Alibaba Cloud@alibaba_cloud
77
每张图像都始于想象。Qwen-Image-3.0 可处理 4.5K token 的提示词,一次性生成学术页面(含 LaTeX)、分镜脚本、UI 线框图、游戏美术、建筑渲染和电影预演。起价 $0.03/张。开启创意之旅:https://click.alibabacloud.com/m/20000001640
产品更新图像生成多模态
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
15:44
Alexandr Wang@alexandr_wang
17
太神奇了 🪄

Hunter Bown: so uhhh muse spark 1.2 is doing things i've never seen other models do

图像生成现象/趋势
14:39
Alibaba Cloud@alibaba_cloud精选
81
Qwen-Image-3.0 已可投入生产。支持 4.5K token 提示词。100%+ 文本准确率(无破损 logo)。原生支持 12 种语言。定价灵活可扩展:高分辨率低至 $0.03。完整详情见图片。👉 探索:• Model Studio:https://click.alibabacloud.com/m/20000001606/ • Qwen Cloud:https://click.qwencloud.com/m/20000001648/ #Qwen #QwenImage3 #AlibabaCloud #GenerativeAI #AICreativity
产品更新图像生成多模态
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
推荐理由:文本渲染准确率从「需要后期修图」变为可能直接可用,多语言和透明定价让团队在商用评估时减少了不确定性。
14:09
Alibaba Cloud@alibaba_cloud
71
Qwen-Image-3.0 已可投入生产。支持 4.5K-token 提示词。文本准确率 100%+(无破损 logo)。原生支持 12 种语言。定价灵活可扩展:高清图低至 $0.03。完整详情见图片。👉 探索:• Model Studio:https://click.alibabacloud.com/m/20000001606/ • Qwen Cloud:https://click.qwencloud.com/m/20000001648/ #Qwen #QwenImage3 #AlibabaCloud #GenerativeAI ##AICreativity
图像生成模型发布
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
10:55
HuggingFace Daily Papers(社区热门论文)
52
Poly-OPD:面向能力可选流模型的多教师同策略蒸馏框架

Poly-OPD 通过像素桥与冻结 DINOv2 空间监督,将异构多教师的互补能力整合进单一紧凑的流匹配学生模型。将 FLUX.1-dev 和 Z-Image 蒸馏至 2.5B 的 SD3.5-Medium 学生模型后,GenEval 从 67.3 提升至 73.3,超越两个更大的教师模型,DrawBench HPSv3 从 9.34 提升至 11.35。

arXiv图像生成数据/训练论文/研究
10:55
HuggingFace Daily Papers(社区热门论文)
62
ToolArtist:面向智能体图像生成的工具使用统一多模态模型

ToolArtist 通过后训练统一多模态模型,将推理、外部工具调用与原生图像生成整合于单一智能体策略中。其采用监督微调配合搜索与图像生成工具,并引入 RAD-GRPO 强化学习算法,以意图与质量奖励联合优化。实验表明,全流程智能体控制方案持续优于固定流程或部分控制方案,训练数据与基础设施已开源。

智能体arXiv图像生成多模态
10:55
HuggingFace Daily Papers(社区热门论文)
49
UniWorld-View:基于视频扩散模型的大基线视图合成

UniWorld-View 提出统一框架,将显式 3D 引导与生成式扩散建模结合,实现单目输入下可控的大基线新视图合成。其遮挡感知点云渲染策略可解决可见性歧义,为扩散合成提供精确先验,在极端相机运动下仍能生成高保真视图,并支持输出多视图视频用于动态 3DGS 重建。WorldScore 基准与零样本 NVS 基准实验验证了其在可控性、几何一致性与视觉保真度上的有效性。

arXiv图像生成多模态论文/研究
07:24
Runway:News(网页)
31
Chime 如何用 Runway 制作最新全国电视广告

Chime 执行制片人 Shayla Love 透露,团队用 Runway 将原本需约 30 万美元、涉及 80 多名真实会员的电视广告尾卡制作压缩至 3 万美元以内,且几乎无制作开销。Runway 的定制工作流将质量参差的 UGC 照片转化为稳定、达到电视播出标准的动态画面。团队还计划用 Runway 制作概念故事板,以加速广告审批流程。

图像生成教程/实践视频
06:52
Apple Machine Learning Research(RSS)
56
驯服扩散 Transformer 中的离群 token:Dual-Stage Registers 干预

研究发现扩散 Transformer(DiT)图像生成流程中,预训练 ViT 编码器和 DiT 去噪器均会产生离群 token,尤其在中间层,且简单掩蔽高范数 token 无法改善性能,问题与局部 patch 语义损坏相关。为此提出 Dual-Stage Registers(DSR)干预方法,在 ImageNet 和文生图任务上持续减少离群伪影并提升生成质量。

图像生成数据/训练论文/研究
01:39
Hacker News 热门(buzzing.cc 中文翻译)
53
Qwen 3.0 Image Pro 发布:支持 4.5k token 输入与 10px 级文字渲染

通义千问推出 Qwen-Image-3.0-Pro 图像生成模型,支持最多 4.5k token 输入和图文混排,可一次生成报纸、分镜、菜单等复杂版式。模型能精确渲染小至 10px 的文字,原生支持 12 种语言和 20+ 字体,并模拟网页、游戏、直播等主流界面。API 定价为 1K 图像输入 $0.003、1K 图像输出 $0.04。

图像生成多模态模型发布
另有 2 家信源报道X:通义千问 / Qwen (@Alibaba_Qwen)X:阿里云 / Alibaba Cloud (@alibaba_cloud)

8月5日

星期三 · 4 条
23:09
Krea@krea_ai
21
谁想要 Seedance 2.5 的访问权限?
图像生成行业动态视频
23:09
fofr@fofrAI
9
那个诺斯特罗莫场景。
其他图像生成视频
21:35
Alibaba Cloud@alibaba_cloud
25
阿里云展示HappyHorse 1.1与Wan2.7生成效果

阿里云转发@WonderStudiosX的演示,展示其用HappyHorse 1.1和Wan2.7将单一创意演化为完整故事宇宙的生成效果。该作品通过阿里云Model Studio和Qwen Cloud提供API,用户可基于此构建自己的生成式AI故事。

Wonder Studios: One story, a hundred directions. Built with HappyHorse 1.1 + Wan2.7. Start building with the API on @alibaba_cloud Model...

图像生成现象/趋势视频
21:35
Alibaba Cloud@alibaba_cloud
69
阿里云发布 Qwen-Image-3.0,支持复杂提示与多语言

阿里云正式发布 Qwen-Image-3.0,支持 4.5K-token 提示词、复杂布局、10px 级文字、完整 LaTeX 页面及 12 种语言内容生成。该模型适用于 PPT、UI 设计、广告、建筑、游戏及短剧等场景,并以极具竞争力的定价提供更丰富的图像创作能力。

图像生成多模态模型发布
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
已加载 40 条