商汤科技今日宣布开源轻量级原生统一多模态大模型 SenseNova U1.5 Lite,该模型拥有 8B 参数,原生支持 3-4k 上下文长度和 4K 高分辨率图像输出。模型支持 Bounding Box、Visual Marker 及多图参考等精细视觉控制,在指令遵循与图像编辑保持度上超越同量级模型,文字渲染与复杂布局能力媲美超大规模商业模型。
商汤科技今日宣布开源轻量级原生统一多模态大模型 SenseNova U1.5 Lite,该模型拥有 8B 参数,原生支持 3-4k 上下文长度和 4K 高分辨率图像输出。模型支持 Bounding Box、Visual Marker 及多图参考等精细视觉控制,在指令遵循与图像编辑保持度上超越同量级模型,文字渲染与复杂布局能力媲美超大规模商业模型。
阿里发布第三代图像模型 Qwen-Image-3.0 系列,旗舰版 Pro 在 Artificial Analysis 图像编辑榜位列第六、文生图榜第九,较上代分别提升 83 和 48 Elo 分。该系列支持 4.5k token 提示词、10 像素级精确文字渲染及 12 种语言,Pro 版定价 $0.04/张(1K 分辨率),已在阿里云 Model Studio 上线。
商汤发布开源轻量级原生统一多模态模型 SenseNova U1.5 Lite,仅 8B 参数,支持视觉理解、生成与编辑。该模型主打原生 4K 生成、复杂指令跟随、中英文文本渲染及多图参考编辑,在指令跟随和编辑保持上超越同尺寸模型,文本渲染与复杂布局上比肩大型商业模型。
MAI-Image keeps climbing! Now #3 on @arena's image editing leaderboard. Our latest MAI-Image model is available in Priva...
MAI-Image-2.6-Preview by @MicrosoftAI has landed at #3 in Single Image Edit with 1,420 pts! This is +19 pts above MAI-Im...
Qwen Image 3.0 is now on OpenArt ✨ The most Real Qwen image model yet. Native text across 12 languages, precise 10px typ...
微软发布新一代自研文生图模型 MAI-Image-2.6,在 Arena 排行榜位列第二,Elo 评分 1336 分,仅次于 OpenAI 的 GPT Image 2(Medium)。相比 2.5 版本,整体评分提升 79 分,文本渲染能力涨幅达 91 分,排名从第十位跃升至第二位。该模型已在 Arena 平台开放体验,计划本周部署至 MAI Playground。
字节这是把 AI 视频收费课的桌子掀了啊,做内容、做广告、做电商的都去存一份,比你花大几千买的 AI 课有用一万倍,官方把饭都喂到你嘴里了。 Seedance 2.5 和 Seedream 5.0 Pro 的提示词文档都免费开源出来了, 我...
另有 1 家信源报道X:阿易 AI Notes (@AYi_AInotes)MAI-Image-2.6 is now the #2 text-to-image model in the world - beating out Nano Banana, Meta, and Grok! Fantastic moment...
MAI-Image-2.6 by @MicrosoftAI has landed in the Text-to-Image Arena at #2 (1336 pts)! This release is just 45 pts behind...
MAI-Image-2.6 by @MicrosoftAI has landed in the Text-to-Image Arena at #2 (1336 pts)! This release is just 45 pts behind...
xAI 推出 Grok Image 2.0 模型,指令遵循更精细,文本渲染更锐利,并强化了复杂布局处理与生成一致性。新增 Magic Wand 局部编辑、区域分割、背景移除(支持透明导出)、最多 5 图多参考编辑及 Smart Resize 任意宽高比扩展,还提供 15 个照片编辑与产品图等场景模板。
I'm impressed with the new Grok Image model and editing features! Screenshotted a few items from the Gap website and gen...
老马真的是频频放大招啊, @SpaceXAI xAI在文本生成图像这块闷声干了票大的, Grok Imagine Image 2.0 Low版,直接从文生图竞技场第14名跳到第2名🥇 1320分!!! 更离谱的是分项: 艺术第2,肖像第2,文字渲染第2,卡通动漫第2,照片级电影感第2,产品品牌商业设计第3。 图像编辑竞技场也第2,1439分。 注意,这还仅仅是Low版啊兄弟们, 目前仅在app内可用,API还没开放。 从14到2,这就不是普通迭代了,简直就是跃迁
Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved fac...
另有 1 家信源报道X:cb_doge (@cb_doge)Grok announced Image 2.0. It's the second-best image model in the world! SpaceX is really catching up. Now only slightly...
Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved fac...
另有 1 家信源报道X:cb_doge (@cb_doge)马斯克旗下 SpaceXAI 今日发布 Imagine Image 2.0 模型,已作为全新质量模式在 Grok.com 网页版及 iOS、安卓应用上线。该模型更遵循指令,能规划文字排版、保持多部分画面一致,并新增魔棒、分割、背景移除、多参考图编辑(最多 5 张)及智能调整尺寸等编辑工具。
另有 1 家信源报道X:cb_doge (@cb_doge)Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved fac...
阿里云今日宣布全新一代视频生成模型 Wan3.0 开启公测,单次可生成 30 秒视频,并首次支持 doc、xls、ppt、pdf、md 等文档格式输入,号称“万物皆可生视频”。
同一事件,精选展示《千问全网首发公测,全新 Wan3.0 来了!》通义千问推出 Qwen-Image-3.0-Pro 图像生成模型,支持最多 4.5k token 输入和图文混排,可一次生成报纸、分镜、菜单等复杂版式。模型能精确渲染小至 10px 的文字,原生支持 12 种语言和 20+ 字体,并模拟网页、游戏、直播等主流界面。API 定价为 1K 图像输入 $0.003、1K 图像输出 $0.04。
同一事件,精选展示《Qwen-Image-3.0-Pro 上线 Qwen Cloud》阿里云正式发布 Qwen-Image-3.0,支持 4.5K-token 提示词、复杂布局、10px 级文字、完整 LaTeX 页面及 12 种语言内容生成。该模型适用于 PPT、UI 设计、广告、建筑、游戏及短剧等场景,并以极具竞争力的定价提供更丰富的图像创作能力。
同一事件,精选展示《Qwen-Image-3.0 发布:高分辨率低至 0.03 美元》Qwen Image 3.0 Pro is now available on fal - Renders complex, dense typography - Preserves key details like facial featu...
🔔 Qwen-Image-3.0 is now live on Qwen Cloud! Ranked #1 among Chinese models and #2 among mainstream models in Arena. ai'...
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)More exciting news from @Alibaba_Qwen: Qwen-Image-3.0-Pro has entered the Text-to-Image Arena at #5 with 1,263 pts! This...
商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。
商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步构建图文内容,如生成六步画龙教程。模型已上线 SenseNova Studio 与 HuggingFace。
同一事件,精选展示《商汤 SenseNova U1 开源:统一推理与图像生成》商汤科技今日开源轻量级统一多模态模型预览版 SenseNova U1.5-Lite-Preview。该模型以仅 8B-MoT 的规模,在多项主流生成/编辑质量评测基准上显著超越 U1,实现可比肩商用闭源模型的图像生成与编辑效果。相比 U1,新版本原生支持 4K 图像生成,并提升局部纹理细节、中英文文字生成与复杂版式组织,以及图像编辑和视觉指令遵循能力。
同一事件,精选展示《商汤发布 SenseNova U1.5-Lite-Preview 开源模型》Midjourney 今日推出 V8.2 图像模型,重点提升美学质量、图像创意与个性化表现。低质量图像出现频率将显著降低,个性化功能能更精准理解用户审美偏好。V8.2 的个性化配置文件拥有更大、更优的图像选择池,建议用户尝试新旧配置文件体验最新版本。