逆向工程显示,MS Paint 和“照片”应用会将服务器下发的 GUID 以不可见方式嵌入本地生成的 AI 图像像素中。该水印由服务器签发,用于追踪图片来源,但用户无法直接察觉其存在。
逆向工程显示,MS Paint 和“照片”应用会将服务器下发的 GUID 以不可见方式嵌入本地生成的 AI 图像像素中。该水印由服务器签发,用于追踪图片来源,但用户无法直接察觉其存在。
《使命召唤:现代战争 4》抢先体验多人测试期间,玩家发现多幅疑似由生成式 AI 创建的游戏内美术作品,引发批评。动视已披露使用生成式 AI 工具帮助制作部分游戏内资产,但尚未确认这些具体作品是否由 AI 生成。玩家反应出现分歧,批评者认为该系列应付费聘请艺术家创作环境细节,也有人担忧 AI 内容在成品资产中愈发明显。
Grok Imagine gets a new Discovery view. check it out at https://grok.com/imagine.
Kimi K3 on my shader test: "create a visually interesting shader that can run in twigl-dot-app make it like an infinite ...
OpenRouter 发布 Visual Image Benchmarks,帮助用户快速评估其提供的全部 39 款图像模型(截至 2026 年 8 月)的实际能力。基准测试用七类挑战性提示词区分模型差异,包括不可能场景、计数、文本、空间关系、否定指令、编辑和一致性,并以网格形式展示结果,支持按价格和生成时间排序。OpenRouter 计划未来将该工具扩展至视频和音频模态。
四川眉山仁寿县警方近日查获一起利用 AI 合成虚假影像骚扰他人的案件,嫌疑人徐某某被依法行政拘留五天。徐某某为达成线下见面目的,用 AI 合成虚假私密照片并通过微信多次发送给小张,频繁骚扰恐吓;受害者保存聊天记录与截图后报警,警方一小时内将其抓获并固定完整证据链。
GPT Image 2 生成了一张 Dario 与 Sam Altman 在 B 站直播辩论的整活截图,全中文弹幕、字幕及完整网页端 UI 无一处错别字。该模型在中文排版、复杂 UI 拓扑结构还原及人物神态光影上表现精准,显示文生图竞争已转向对真实世界复杂符号系统的理解。
I asked GPT-5.6 Sol to create the most Claude-y possible parody image and what it came up with is pretty great and dead-...
Midjourney 发布 alpha.midjourney.com 两周内第二轮更新,修复大量 UX 问题并新增文件夹分组功能。用户可在侧边栏将项目整理为可折叠树状分组,支持双击重命名;Upscale、Zoom、Vary 功能回归,Vary 现在遵循用户设置而非静默运行 HD。设置项不再自动重置,站点卡顿、编辑器遮挡、提示词粘贴损坏等问题均已修复。
玉伯用同一段故宫亲子游PPT提示词,在YouMind Harness中测试四个不同模型,并公布生成结果供网友竞猜。生图均调用gpt-image-2,其中包含ox和ds-v4-flash-vision-exp模型。猜对驱动模型的用户将获得YouMind会员奖励。
推文区分“制作”与“创作”:制作是把已存在的可能性实现出来,创作是让此前不存在的可能性出现。真正危险的状态是制作开始假装自己就是创作——技术更复杂、画面更漂亮、prompt更长、模型更强,却没有新问题、新判断、新可能性。引用安迪·沃霍尔将创作降级为机械复制的观点,正好承接60年后的AI。
Andy Warhol 将人的成分/参与、原创必要性、创作行为 从传统艺术中开除 机械复制、将创作降级为制作 以及 为什么要原创 正好承接住了 60 年后的 AI,妙啊
OpenAI 宣布 GPT-Image-2 现支持生成透明背景的 PNG 格式图像,可用于电商商品页、PPT 插图、贴纸素材等场景。该功能目前仅通过 API 提供,用户需开启 background=transparent 参数启用,官方建议提示词中不要描述背景。
OpenAI 通过 API 为 GPT-Image-2 预览透明背景支持,用户可生成无背景的 PNG 图片。该功能覆盖电商产品图、PPT 图表、图标贴纸等设计元素及周边商品图四种用例。官方称生成时直接烘焙 alpha 通道优于传统抠图,尤其在透明玻璃或细纤维等复杂区域;用户通过 background=transparent 参数启用,并建议提示词中不描述背景。
1962 年安迪沃霍尔已经在采访中很好地回答了他关于 原创、cpoy、机械艺术的看法/观点,加上艺术界对 Pop Art 以及他本人的接纳,足够回应当下 AI 的很多争论 1962|ANDY WARHOL: It’s too human. ...
Transparent backgrounds are now available in preview for GPT-Image-2 in the API. Generate reusable assets you can place ...
ZHO指出,设计长期被误读为装饰,而AI不仅未扭转这一认知,反而加深了误解。他引用保罗·兰德的观点:将视觉元素赏心悦目地排布不等于好的布局,这正是AI图像生成无法达到真正设计标准的原因。从拼凑到原创设计、风格乃至方法论,每一步都差距巨大。
“ 有人认为,只要将某些视觉元素的集合(照片、字体、插图)以赏心悦目的方式进行排布,就能得出好的布局(layout),这是对 平面设计师 职能的错误认识 ” 保罗兰德(Paul Rand)的这段正好能解释/说明 为何 目前 AI 图像生成 ...
商汤科技今日宣布开源轻量级原生统一多模态大模型 SenseNova U1.5 Lite,该模型拥有 8B 参数,原生支持 3-4k 上下文长度和 4K 高分辨率图像输出。模型支持 Bounding Box、Visual Marker 及多图参考等精细视觉控制,在指令遵循与图像编辑保持度上超越同量级模型,文字渲染与复杂布局能力媲美超大规模商业模型。
Transparent backgrounds are now available in preview for GPT-Image-2 in the API. Generate reusable assets you can place ...
4DAnyone提出从无标定单目视频重建4D人体的框架,通过生成重建级多视角一致视频并提升至4D高斯泼溅(4DGS)。针对现有模型在数十个目标视角下的一致性失效问题,该方法以参考上下文打包(RCP)和目标任务上下文路由(TCR)分别实现O(1)参考复杂度与跨组上下文共享。在DNA-Rendering和DyMVHumans上,4DAnyone在视角视频质量与下游4DGS重建上均优于先前方法。
WithEveryone 提出统一框架,支持生成包含至多十个参考身份的群像。其核心目标 Layout-Grounded ID Loss 利用标注人脸区域直接监督目标身份,避免不稳定的嵌入匹配;在身份不相交基准上,目标上下文身份相似度从 GPT-Image-2 的 0.462 提升至 0.499,复制粘贴伪影从 0.169 降至 0.055,身份覆盖率达 97.3%,重复率仅 2.8%。
阿里发布第三代图像模型 Qwen-Image-3.0 系列,旗舰版 Pro 在 Artificial Analysis 图像编辑榜位列第六、文生图榜第九,较上代分别提升 83 和 48 Elo 分。该系列支持 4.5k token 提示词、10 像素级精确文字渲染及 12 种语言,Pro 版定价 $0.04/张(1K 分辨率),已在阿里云 Model Studio 上线。
商汤发布开源轻量级原生统一多模态模型 SenseNova U1.5 Lite,仅 8B 参数,支持视觉理解、生成与编辑。该模型主打原生 4K 生成、复杂指令跟随、中英文文本渲染及多图参考编辑,在指令跟随和编辑保持上超越同尺寸模型,文本渲染与复杂布局上比肩大型商业模型。
Microsoft's MAI-Image-2.5-Pro debuts at #1 on the Artificial Analysis Image Editing Leaderboard, and takes the #7 spot i...
微软MAI-Image-2.5-Pro在Artificial Analysis图像编辑排行榜登顶第一,文生图位列第七。该模型7月23日预览上线Microsoft Foundry,定价每1M文本输入token $5、图像输入$8、图像输出$106,约合每千张1024x1024图像$108.5。
Meta 平台近期为 AI 色情生成工具 Kromix 投放广告,该工具宣称“无限制”,并鼓励用户制作酷似美国女性政客的深度伪造视频,违反 Meta 禁止含色情内容广告的政策。这是 Meta 未能阻止非自愿亲密影像工具广告上架的最新一例。Kromix 自称“AI 图像风格化器”,在苹果 App Store 上架,邀请付费用户上传照片用于“卧室强奸”等场景。
ZHO 认为,自 2026 年起 AI 发展将带领人类进入文化上的“大垃圾时代”,大量垃圾质量的 AI 图/文/视频/应用将铺满物理与网络世界。他进一步指出,系统首先杀死美,因为美需要余裕、安全、时间、注意力与自由,而这些恰是效率社会最不允许的;美不再被创造,只被消费。
看到大量垃圾质量的 AI 图/文/视频/应用 逐渐铺满整个物理世界和网络世界,我意识到 对不起,我之前说的还是太保守了,因该是: 自 2026 开始,AI 的发展会带领人们进入一种文化上的 “大垃圾时代” 伴随 生产力提升/物质丰富 先来的...
EditBridge 提出一种扩散桥接框架,将超高清编辑视为从低分辨率编辑结果到高分辨率版本的结构化数据转换,并以原始高分辨率图像为条件保留真实细节。其引入先验引导的块状稀疏注意力机制,将跨图像交互限制在空间对齐区域,在 2K 分辨率下实现 3.6–8.4 倍加速,并可在 61 秒内完成 4K 编辑。
“Representation/表象 取代了 Reality/真实” 正回答了当下 AI 对文明的重塑 AI 才让我真正读懂红楼的现代性,卧槽啊🫡 黛玉啊黛玉,曹雪芹啊曹雪芹 《五美吟》显性的揭示了中国文化从古典到现代的审美结构,尤其述明...
ZHO借《红楼梦》中《五美吟》咏昭君诗,指出“一个人的真实价值被媒介、图像、中间人决定”的现代性,认为这正回答了当下AI对文明的重塑——Representation(表象)取代了Reality(真实),可将“画工”替换为摄影、社交媒体、算法、AI等。