Topic · 主题全部主题 →

图像生成

AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。

1,413条收录
126条精选
● 持续更新

8月9日

星期日 · 2 条
18:01
公众号:卡尔的AI沃茨精选
AI 评分 72/100
Seedance 2.5 上线一周新增六种创意玩法

Seedance 2.5 上线一周后,国内外社区涌现出时间静止、超级英雄变身、创意广告、K-pop MV、电商广告、拉片复刻等六类热门玩法。经实测,该版本人物面部告别“AI 油腻感”,动作自然度与镜头切换较 2.0 更合理,单次生成超长视频时长拉至 300 秒,并支持片段重拍与智能续写。通过 LibTV 年费会员,生成成本最低可至 0.4 元/秒。


推荐理由:把时间静止、口香糖广告等创意拆成可复用的镜头语言和提示词,直接降低同类效果的试错成本。
00:42
Elon Musk@elonmusk精选
AI 评分 66/100
Grok Imagine 图像编辑功能重大升级【引用 @XFreeze】:你可以直接悬停在 Grok Imagine 中的任意特定区域,并即时进行编辑

X Freeze: 你只需将鼠标悬停在 Grok Imagine 中的任意特定片段上,就能立即对其进行编辑。

另有 1 家信源报道X:cb_doge (@cb_doge)
推荐理由:悬停选中并即时编辑把图层和遮罩等概念替换为手势,降低了图像修改的操作门槛。

8月7日

星期五 · 1 条
14:11
公众号:火山引擎精选
AI 评分 81/100
Seedance 2.5 API上线,视频生成开启「电影级长叙事」

火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。

另有 1 家信源报道公众号:数字生命卡兹克
推荐理由:原生30秒时长和秒级时间戳控制,把长叙事视频从靠抽卡变为导演级调度;角色与光影的稳定提升让广告、影视等商业场景更接近实际生产标准。

8月6日

星期四 · 1 条

8月5日

星期三 · 3 条
11:08
Qwen@Alibaba_Qwen精选
AI 评分 68/100
阿里通义千问发布 Qwen-Image-3.0-Pro 与 Standard,现已在 Qwen Cloud 上线。该模型在 Arena 文生图榜单中位列中国模型第一、主流模型第二,支持 4.5k-token 提示词、10px 级文字渲染及 12 种语言。Pro 版起价 $0.04/张,Standard 版起价 $0.03/张。

Qwen Cloud: 🔔 Qwen-Image-3.0 is now live on Qwen Cloud! Ranked #1 among Chinese models and #2 among mainstream models in Arena. ai'...

另有 2 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)Hacker News 热门(buzzing.cc 中文翻译)
推荐理由:生成与编辑合并在单一模型内,多语言长文本排版的门槛和每次调用成本都明显降低。
09:55
HuggingFace Daily Papers(社区热门论文)精选
AI 评分 76/100
Any-OPD:面向流匹配模型的异构同策略蒸馏框架

Any-OPD 提出首个支持任意异构流匹配生成器对的同策略蒸馏框架,仅通过冻结的 DINOv2 表示空间桥接教师与学生模型,无需共享 VAE、架构或噪声调度。将 FLUX.1-dev 蒸馏至 SD3.5-Medium 后,学生模型 PickScore 与 HPSv3 均显著提升,以教师五分之一的参数量达到接近其性能,而直接潜在回归训练完全失败。


推荐理由:将异构流匹配蒸馏转化为在独立视觉空间求解固定点,配合噪声级对齐跨过VAE与架构差异,2.5B学生模型在偏好指标上逼近12B教师。
00:07
SenseTime@SenseTime_AI精选
AI 评分 67/100
商汤 SenseNova U1 开源:统一推理与图像生成

商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。

另有 1 家信源报道X:商汤 SenseTime (@SenseTime_AI)
推荐理由:把推理和图像生成整合进单一模型流,信息图模式和逐步教程展示了从推理到可视化的直接路径,为需要图文连贯输出的应用提供了可探索的开源方案。

8月2日

星期日 · 1 条
21:26
公众号:卡尔的AI沃茨精选
AI 评分 72/100
实测MiniMax H3做后期和动效:视频届的审美王来了

MiniMax H3视频模型实测覆盖广告TVC、短剧、创意片头、动态海报、UI动效和游戏实机六类场景,可生成5-15秒视频、原生双声道、直出2K,一次最多放9张图、3段视频和3段音频,提示语最高支持7000字符。


推荐理由:多个场景测试显示 H3 在动态文字稳定性和动效克制上表现突出,提供的提示语结构可直接用于 UI、游戏宣传片等需要文字控制的视频生成。

7月31日

星期五 · 1 条
03:16
Google AI@GoogleAI精选
AI 评分 69/100
Google Earth 集成 Nano Banana 2 图像生成

Google Earth 网页版上线基于 Nano Banana 2 的图像生成功能,用户可通过文本提示词将卫星与 3D 影像结合,重新想象全球任意地点(如百年前的城市风貌或社区新球场)。该功能现已面向所有用户开放。


推荐理由:Google 把图像生成塞进地球,直接用 Nano Banana 2 在卫星图上创作,门槛低得谁都能玩,做城市设计或创意提案的人可以立刻试试。

7月25日

星期六 · 1 条
06:22
Midjourney:Updates(RSS)精选
AI 评分 73/100
Midjourney V8.2 发布:专注美学提升与个性化理解

Midjourney 今日推出 V8.2 图像模型,重点提升美学质量、图像创意与个性化表现。低质量图像出现频率将显著降低,个性化功能能更精准理解用户审美偏好。V8.2 的个性化配置文件拥有更大、更优的图像选择池,建议用户尝试新旧配置文件体验最新版本。

另有 1 家信源报道X:Midjourney (@midjourney)
推荐理由:Midjourney V8.2 把审美和个性化放到了C位,不再追分辨率,这对重度用户是实在的体验升级,建议立刻用老 profile 试试新模型。

7月23日

星期四 · 1 条
00:00
Black Forest Labs:Blog(网页)精选
AI 评分 59/100
FLUX 3 发布:Black Forest Labs 多模态模型,支持原生音频、图像生成与动作预测

Black Forest Labs 发布多模态模型 FLUX 3,面向视频领域,原生支持音频、图像生成与动作预测。该模型旨在成为视觉智能的骨干,目前官方已展示其能力与早期结果。


推荐理由:Black Forest Labs 把图像、视频、音频拉通到一个模型里,这比单纯提升画质更有想象力,但目前只有一句简介,像个预告片,想真评估的还得等技术细节。

7月22日

星期三 · 2 条
21:00
公众号:卡尔的AI沃茨精选
AI 评分 71/100
实测Qwen-Image-3.0:19大场景挑战GPT Image2,中文长文本与多图融合表现亮眼

Qwen-Image-3.0上线,支持最高4.5k token输入、12种语言、20多种字体,以及多图融合、图中图和图片编辑。实测显示,其在中文长文本生成、多语言混合排版、UI设计、多图融合与图片编辑等19个场景中均能稳定输出,文字不崩且信息对应准确,图片质量已能与GPT Image2媲美。该模型在国内可直接使用,速度快且价格不贵。


推荐理由:Qwen-Image-3.0 的实测效果在中文文字稳定性和多图融合上可以和 GPT Image2 掰手腕,看完这些案例,你会意识到国产图像模型已经能务实替代一部分工作流了。
20:52
Qwen@Alibaba_Qwen精选
AI 评分 73/100
通义千问发布Qwen-Image-3.0:主打"真实"的第三代图像生成模型

通义千问发布第三代图像生成模型Qwen-Image-3.0,核心关键词为“真实”。模型支持最长4.5k token的提示词,可一次性生成复杂布局(如报纸、试卷、3×3信息图),并能渲染10px级文字、完整LaTeX论文页面及逼真皮肤纹理。它还支持12种语言、100多种艺术风格,并具备实时网络检索能力,旨在成为设计、教育等领域的实用生产力工具。

另有 3 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)X:swyx (@swyx)The Decoder:AI News(RSS)
推荐理由:Qwen-Image 3.0 不再只追求画质,而是把图像生成变成排版工具,支持4.5k token提示和10px可读文本,设计、电商、教育团队可以直接用来出稿,是今年最实用的图像模型更新。

7月21日

星期二 · 1 条
14:22
Qwen:Blog Retrieval(API)精选
AI 评分 77/100
通义千问发布 Qwen-Image-3.0 图像生成模型,核心关键词为"实"

通义千问发布第三代图像生成基座模型 Qwen-Image-3.0,核心关键词为“实”。该模型支持最长 4.5k token 指令输入,可单次生成包含 9 个复杂信息图的 3×3 网格布局;文本渲染精度达 10px,并支持 12 种语言原生渲染,旨在将图像转化为可部署的生产力工具。


推荐理由:我觉得 Qwen-Image-3.0 不只是画得好看,而是真正追求“有用”,4.5k token 输入、12 种语言渲染、10px 精细文字,对做设计、内容生产的人是生产力级突破。

7月14日

星期二 · 1 条
08:00
HuggingFace Daily Papers(社区热门论文)精选
AI 评分 74/100
Boogu-Image-0.1 发布:开源统一多模态理解与生成模型,训练成本仅约 40 万美元

Boogu-Image-0.1 系列开源统一多模态理解与生成模型发布,包含 Base、Turbo、Edit 和 Edit-Turbo 四个变体,支持高质量文生图、快速推理、指令编辑及中英双语文本渲染。


推荐理由:开源多模态模型终于有一个能打闭源系统的了,40万美元训练成本刷到接近GPT-Image-2的水平,想自己部署图像生成和编辑产品的开发者可以认真看看。

7月11日

星期六 · 1 条
08:10
The Verge:AI(RSS)精选
AI 评分 76/100
Meta 关闭 Instagram 用户可基于公开账户生成 AI 深度伪造图片的功能

在遭到强烈反对后,Meta 关闭了本周早些时候推出的一项 Instagram 功能。该功能允许用户通过 @ 提及公开 Instagram 账户,基于其内容生成 AI 图片,且无需账户所有者许可。Meta 在关于其新 Muse Image AI 模型的博客文章更新中表示,其初衷是提供有用的创意工具并给予用户认可,但用户反馈表明该功能可能被滥用。

另有 1 家信源报道The Decoder:AI News(RSS)
推荐理由:Meta 在舆论压力下火速撤回刚发布的 AI 深度伪造功能,这次公关折返跑比功能本身更有信息量,平台对隐私反弹的优先级已经高于技术落地,但默认 opt-out 的根本矛盾还在。

7月10日

星期五 · 1 条
15:31
Elon Musk@elonmusk精选
AI 评分 68/100
Elon Musk 转发用户 @0x0funky 对 Grok Build 的称赞。该用户称 Grok Build 是目前唯一集大成的 coding agentic workflow,内建图像生成和图片生视频功能,生图速度快且品质不输 Codex。Agent 可直接完成图像与视频生成,无需额外串接 MCP 或外部服务。用户结合 Agent Sprite Forge 工具,利用 Grok Build 的视频生成能力,先产出 6 秒角色动作视频再反编译为 game sprite,大幅减少对齐问题,制作 2D 横版游戏耗时不到 30 分钟,而此前用 Codex 需 1-2 小时且品质更优。

0xFunky: Grok Build 真的太疯狂了。 先不管 GPT-5.6 到底有没有发布、好不好用。 先来大力称赞一下 @grok 的 Grok Build,这是目前唯一一个集大成的 coding agentic workflow。 Grok Buil...


推荐理由:这个 Grok Build 加 Agent Sprite Forge 的工作流把做 2D 游戏的时间压到了 30 分钟,之前要 1-2 小时,而且品质更好,独立游戏开发者可以直接抄作业。

7月9日

星期四 · 1 条
06:22

7月8日

星期三 · 3 条
21:22
字节 Seed:Research Feed(网页内嵌数据)精选
AI 评分 78/100
Seedream 5.0 Pro 发布:不止"生成",更懂"设计"

字节 Seed 今日发布多模态图像创作模型 Seedream 5.0 Pro,在图文匹配、结构合理性、文字渲染与画面美感上全面升级。四大核心突破:复杂信息可视化,可生成高密度信息图;交互式精准编辑,支持点选、圈选、草图渲染、色彩与材质替换、图层分离及多图融合,实现像素级编辑;真实的影像与人像质感,还原光影、材质与皮肤肌理;原生多语种输入与生成,支持十余种语言及本地化视觉特征。已陆续在豆包、即梦、火山方舟等平台上线。

另有 1 家信源报道IT之家(RSS)
推荐理由:字节这次发布的 Seedream 5.0 Pro 把图像生成从「画得好看」推进到「能输出信息图、能精准编辑」的实用设计工具,尤其复杂信息图和交互编辑是当前竞品明显短板,做设计的值得立刻试试。
04:51
Krea@krea_ai精选
AI 评分 66/100
Krea 2 的身份保留功能已发布,配套模型和 ComfyUI 节点也已上线。🔥

Brie Wensleydale🧀🐭: 这才是我渴望的那种身份保留型功能。 我明天要出门旅行,所以没法测试它。我很好奇它在风格化角色上的表现如何...... https://huggingface.co/conradlocke/krea2-identity-edit https:...


推荐理由:Krea 2的ID保持终于被社区做出来了,附带ComfyUI节点,想稳定控制角色一致性的人可以立刻用起来。
03:58
AI at Meta@AIatMeta精选
AI 评分 75/100
Meta Superintelligence Labs 推出 Muse Image 和 Muse Video

Meta Superintelligence Labs 发布首个媒体生成模型 Muse Image 和 Muse Video。Muse Image 是目前最先进的图像生成模型,能精确遵循指令、精准编辑、多参考构图,并利用 Instagram 社交上下文。它还具备智能体工具使用能力并集成 Muse Spark。用户可通过 Meta AI 应用、网页、Instagram Stories 和 WhatsApp 试用,初始限于部分国家。Muse Video 基于相同预训练基础,实现高视觉保真度并原生支持音频。

另有 6 家信源报道TechCrunch:AI(RSS)IT之家(RSS)The Verge:AI(RSS)X:AI at Meta (@AIatMeta)The Decoder:AI News(RSS)X:Testing Catalog (@testingcatalog)
推荐理由:Meta 超级智能实验室的首个媒体生成模型,把图像生成跟 Instagram 社交语境结合听起来很实用,但细节还少,期待后续实测。

7月6日

星期一 · 1 条
01:53
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 70/100
三周前,我不小心创办了一家小公司

一位父亲为患有自闭症的非语言儿子开发了一款沟通应用,在言语治疗室的等候区展示时,所有非语言儿童的母亲看到后都忍不住流泪,言语治疗师也啜泣了五分钟。他意外发现产品市场匹配,决定腾出时间让更多孩子能用上,即使这意味着几周睡眠不足。应用本身是专为理解语言困难的儿童设计的,与传统的AAC设备不同——后者主要面向身体障碍但语言理解正常的成人。


推荐理由:这篇文章读来会让人看天花板,一位父亲用 AI 图像和声音克隆为儿子创造了沟通工具,意外找到了产品市场契合。它比任何融资新闻都更让我相信,AI 的真正价值在于解决那些被忽视的具体问题。

7月3日

星期五 · 2 条
18:05
公众号:京东JoyAI精选
AI 评分 65/100
JoyAI App上线UGC数字人功能,一张照片即可"捏"出专属虚拟玩伴

JoyAI App正式上线UGC数字人功能,用户上传一张照片即可生成高度还原的写实数字分身,或搭配模板重塑为卡通形象,并支持复刻音色。该功能复用“万能博士”技术底座,实现全双工对话能力,可随时打断、自然接话,同时提供点外卖、金融咨询等生活服务。


推荐理由:照片生成数字人并不新鲜,但把全双工对话和京东生活服务(点外卖、金融咨询)集成进一个虚拟玩伴,让陪伴型智能体有了更直接的服务抓手。
11:34
HuggingFace Daily Papers(社区热门论文)精选
AI 评分 74/100
表示分布匹配(RDM)用于一步视觉生成

表示分布匹配(RDM)通过匹配冻结预训练编码器下的生成与参考特征分布来训练一步图像生成器。三个发现:经典MMD正确估计后成为可扩展目标;生成批次大小最优超过2048;单一表示可被欺骗,需匹配平衡编码器组合并采用独立于训练损失的SW_r14评估。改进的iRDM在ImageNet上以SW_r14 1.30达一步生成SOTA,PickScore在71.2%样本上偏好iRDM。该方法将四步FLUX.2后训练为一步生成器,在GenEval(0.826对0.794)和PickScore(22.76对22.58)上超越原版,仅需90 H200 GPU小时。


推荐理由:这篇论文把MMD重新变成了一流的一步生成目标,用多编码器匹配防止作弊,并把FLUX.2四步模型浓缩成一步,性能不降反升,90 GPU小时就能复现,做视觉生成的人应该仔细看。

7月1日

星期三 · 2 条
01:29
Apple:Newsroom(RSS)精选
AI 评分 66/100
Apple Creator Studio 更新:更智能、更快速、更互联

Apple Creator Studio 推出多项 AI 增强更新。Final Cut Pro 新增 on-device AI 驱动的 Generate Captions(自动转录音频生成字幕)和 Edit Detection(自动检测剪辑点)。Mac 版加入 Auto Mask(自动识别皮肤、天空等主体)、增强的 Match Color 和 Advanced Trimming。支持将帧发送至 Pixelmator Pro 编辑,并在 Keynote、Pages、Numbers 中直接调用 Pixelmator Pro 修改图片。Logic Pro 新增 Grammy 制作人制作的 Producer Project 及 Chord ID 改进。订阅价 $12.99/月或 $129/年,新用户免费试用一个月,教育用户 $2.99/月。


推荐理由:Final Cut Pro 的自动字幕和遮罩是实打实的工作流提升,Pixelmator Pro 的深度整合也让设计更顺畅,虽然没有颠覆性突破,但创意工作者今天就能用上。
00:08
Google DeepMind:Blog(RSS)精选
AI 评分 70/100
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash

Google DeepMind 推出 Nano Banana 2 Lite(gemini-3.1-flash-lite-image),为 Nano Banana 系列速度最快、成本最低的图像模型,文本到图像输出仅需 4 秒,每 1K 分辨率图像成本 $0.034,已上线 Google AI Studio、Gemini API 及消费者产品(AI Mode in Search、Gemini app 等)。同时推出 Gemini Omni Flash(gemini-omni-flash-preview),支持高画质视频生成与对话式编辑,视频输出定价 $0.10/秒,面向开发者开放 API。

另有 3 家信源报道X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)X:Google DeepMind (@GoogleDeepMind)
推荐理由:Nano Banana 2 Lite 把图像生成拉到 4 秒延迟和 0.034 美元单价,很适合高频草稿流,Omni Flash 首次对开发者开放视频生成和对话编辑,两个模型串起来的快速迭代工作流是这次最实用的更新。

6月26日

星期五 · 2 条
03:12
Midjourney@midjourney精选
AI 评分 67/100
Midjourney 带来两项更新。一是加入 --preview 参数可提前体验 V8.2 的美学与个性化效果;二是此前在 V8.1 推出的大批量草稿模式(生成 24 张低分辨率图,价格仅为标准 4 张的一半,点击 "Vary" 可升级为全分辨率)现在支持搭配 --sref random 使用,探索风格空间的速度比之前快 24 倍。

Midjourney: 我们已为 V8.1 发布了一种全新的大批量草稿模式。这种新模式允许你以标准分辨率 4 图 Midjourney 任务一半的价格,生成 24 张较低分辨率的图像。当你喜欢某张图像时,只需按下"Vary"按钮,即可获得全分辨率的新版本。尽情享受...


推荐理由:新草稿模式让批量探索风格变得便宜又快速,配上 sref random 更是把试错效率拉满,设计师能直接用到工作流里。V8.2 预览只是小彩蛋,但暗示美学调校还在进化。
02:57
Midjourney:Updates(RSS)精选
AI 评分 62/100
Midjourney V8.1 草稿模式新增随机风格功能

Midjourney V8.1 的草稿模式(draft mode)添加了随机风格功能。用户在提示词中加入 --sref random 即可一键生成 24 张不同风格的图片。开启草稿模式可通过点击提示栏的 ⚡ 图标或添加 --draft 参数。


推荐理由:Midjourney 在 V8.1 草稿模式加了随机风格,一键出 24 种草图,对找灵感的创作者算顺手小升级,但改变不了核心创作流程,只适合深度用户尝鲜。

6月25日

星期四 · 1 条
14:23
公众号:京东JoyAI精选
AI 评分 62/100
JoyAI 上线「欢乐足球季」:上传一张照片即可生成赛场动态视频

JoyAI APP 上线「欢乐足球季」主题活动,用户上传一张人像照片即可生成沉浸式赛场动态视频,支持肢体动作拟合、环境动态渲染与专业运镜。活动提供近 20 款视频模板,覆盖看台抓拍、进球庆祝、足球手势舞等玩法,并同步上线近 50 款足球主题聊球智能体。上线首周互动量日均增长率超 158%。


推荐理由:模板覆盖看台、进球、手势舞等场景,无需编辑技能即可产出氛围感短片,对丰富观赛社交内容有直接帮助。

6月24日

星期三 · 2 条
19:31
OpenRouter:Announcements(RSS)精选
AI 评分 73/100
OpenRouter推出统一图像API

OpenRouter推出统一图像API,整合Google、OpenAI、Black Forest Labs、Recraft、ByteDance、Sourceful、Microsoft、xAI等30+模型。新API提供标准化请求格式,通过/api/v1/images/models端点返回每个模型的分辨率、宽高比、输出数量、输入参考图数量、种子等能力描述;通过/api/v1/images/models/{id}/endpoints端点获取具体服务商的定价与参数支持(如Seedream 4.5每张$0.04、FLUX.2 Pro每百万像素$0.03、GPT-5.4 Image 2按token计费)。OpenAI的GPT 5系列图像模型支持SSE流式预览,启用"stream": true即可边生成边返回预览。新图像模型将仅添加至专用API,建议现有用户切换。

另有 1 家信源报道X:OpenRouter (@OpenRouter)
推荐理由:OpenRouter 把 30+ 图像模型收进一个 API,参数自动发现和流式预览让频繁切换模型的开发者省去不少适配麻烦,尤其对 Agent 工作流很友好。
01:37
Krea@krea_ai精选
AI 评分 71/100
我们的技术报告已发布。深入解析创建 Krea 2 所用的数据、架构及训练技巧。https://www.krea.ai/blog/krea-2-technical-report

Krea: 今天,我们发布了 Krea 2 的开放权重。 欢迎 Krea 2 Raw 和 Krea 2 Turbo:前者是一个来自中期训练、未经知识蒸馏、旨在用于微调的模型,后者则是具有广泛美学多样性的快速蒸馏版本。 详情如下 👇

另有 2 家信源报道X:Krea AI (@krea_ai)Hacker News 热门(buzzing.cc 中文翻译)
推荐理由:Krea 2 开源了两个图像模型权重,一个未蒸馏适合微调,一个快速蒸馏版覆盖多样审美。对于做图像生成应用和模型融合的团队,这次开放权重比很多大厂都实在。

6月21日

星期日 · 1 条
13:00
公众号:腾讯元宝精选
AI 评分 64/100
腾讯元宝父亲节活动:上传照片生成与年轻爸爸的合影

腾讯元宝推出父亲节主题活动,用户可选择爸爸年轻时照片与自己的照片,输入提示词(如“帮我生成一张和爸爸的合影,将图2的我融合到图1爸爸的照片中,我想穿越回__年前,和他一起_____;保留爸爸照片的背景、动作及五官;人物姿态自然协调,整体光线与色调保持一致”),元宝即可生成合影。活动旨在让用户“回到过去”看到爸爸的青春模样。


推荐理由:元宝的父亲节营销,但合影生成指令写得具体可复现,比普通AI写真教程更接地气,父亲节想整活的可以直接抄作业。

6月18日

星期四 · 3 条
19:47
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 79/100
ChatGPT 图像生成器可被绕过滤镜生成暴力和色情内容

Mindgard 红队研究发现,ChatGPT 的图像生成器可通过简单提示词轻易绕过内容过滤器,在未直接请求的情况下自动生成性暴力、血腥谋杀等露骨图像。一个热门的“恢复照片”提示词因输入模糊而绕过输入过滤器,结果如同俄罗斯轮盘赌;进一步添加虚假图像 ID 和“不做审查”指令后,模型持续生成高度性化女性图像,甚至出现被捆绑殴打的尸体,并自动赋予惊悚标题。研究指出,OpenAI 此前声称修复的裸体问题仍未解决,暴露了 AI 工具广泛可及性与不足内容过滤的现实风险。


推荐理由:这是自 ChatGPT 图片功能上线以来最严重的安全漏洞曝光,Mindgard 用简单句子就绕过所有 filter 直接生成极端暴力色情图片,OpenAI 的回应和处理令人失望,暴露了训练数据治理的根本问题。
09:45
01:35
Midjourney@midjourney精选
AI 评分 71/100
我们发布了 V8.1 的新大批次草稿模式。该新模式可让你生成 24 张低分辨率图像,价格仅为标准分辨率四图 Midjourney 任务的一半。当你喜欢某张图像时,只需按下 "Vary" 即可获得全分辨率的新版本。尽情享受吧!

推荐理由:Midjourney 这个批量草稿模式把试错成本砍半,对高频出图的设计师是个实在的提速,但不算能力升级,更像效率补丁。

6月17日

星期三 · 1 条
06:13
Midjourney:Updates(RSS)精选
AI 评分 66/100
Midjourney V8.1 推出 Draft mode 草稿模式与新功能预览

Midjourney V8.1 的 Draft mode 草稿模式每次生成24张低分辨率低质量图片。用户可对任意图片点击 "Vary",将其渲染为全质量、全分辨率版本。草稿任务消耗的快速小时数减半。


推荐理由:这是我最近看到最实用的 Midjourney 更新,草稿模式半价生成 24 张低质量图,快速筛选后再渲染,直接降低试错成本。

6月16日

星期二 · 1 条
02:33
TechCrunch:AI(RSS)精选
AI 评分 71/100
Meta 在 Facebook 上线"AI Mode",基于平台公开信息合成答案

Meta 宣布在 Facebook 推出“AI Mode”搜索功能,利用 Meta AI 从公开帖子(含群组和 Reels)提取信息并合成答案,用户可用自然语言提问获得摘要。同时新增视频拼贴剪辑、过渡效果及 AI 照片预设(可更换服装、发型和配饰),体育迷可在 Stories 中点击“AI Edit”虚拟穿上队服。这些更新延续了此前动态头像、Marketplace 自动回复和创作者 AI 助手的部署节奏。此外,Meta 近期启动了 Facebook、Instagram 和 WhatsApp 的全球订阅计划(每月 3.99 美元起),更多 AI 订阅层级正在规划中。


推荐理由:Facebook 的 AI 模式把社交搜索变成问答,想法不新但执行够快,对普通用户吸引力大,只是答案来自群聊,可靠性是个坑。配套的 AI 照片编辑也让玩梗更方便,Meta 在拼命给 Facebook 塞 AI 留住用户。

6月12日

星期五 · 1 条
01:20

6月11日

星期四 · 2 条
23:07
12:10
Midjourney:Updates(RSS)精选
AI 评分 64/100
Midjourney V8.1 已成为默认模型

Midjourney 已将默认模型从 V7 升级为 V8.1。V8.1 在智能性、连贯性、对详细提示的遵循度以及文本渲染效果上均有提升,HD 模式也已支持。

另有 1 家信源报道X:Midjourney (@midjourney)
推荐理由:虽然V8.1不是大版本,但设为默认后所有用户自动升级,尤其是文本和复杂提示词的理解增强,做设计的朋友值得重新测试一下关键词。