内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态模型 · 696 条
来源全部一手资讯X
类型模型
全部模型产品行业论文教程观点
标签「多模态」清除

今天8月25日 周二

15:18Alibaba Cloud39阿里云 Wan3.0 展示科幻短片角色一致性
13:48Alibaba Cloud49阿里云 Wan 3.0 上线 Flick,支持 30 秒生成
13:48Alibaba Cloud64阿里云 Wan 3.0 上线 Picsart 支持 30 秒视频
13:48Alibaba Cloud41阿里云 Wan 3.0 上线 OpenArt,原生 30 秒生成
13:18Alibaba Cloud61阿里云 Wan3.0 发布,视频生成质量飞跃
09:48Alibaba Cloud60通义万相 Wan 3.0 上线 Pixmax,限时 7 折
02:18Chubby♨️24Ox Alpha 大更新引期待

8月24日周一

23:59The Decoder:AI News(RSS)60阿里 Wan3.0 视频生成模型开放测试,支持文本、图片、文档生成最长 30 秒视频
23:18elvis32Ox Alpha 登顶 OpenRouter 且免费可用
22:29MarkTechPost(RSS)60Generalist AI 发布 GEN-1.5:一个从 3-12 秒演示中学会新任务的机器人基础模型
22:18Rohan Paul52同事件dots3-note 预览版:面向长期任务的开放权重多模态模型同一事件,精选展示《dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理》
18:18Alibaba Cloud42万相3.0上线SeaArt,支持多模态输入
18:18Alibaba Cloud54阿里云 Wan 3.0 上线 Scenario,支持 30 秒视频生成
18:18Alibaba Cloud42通义万相 Wan 3.0 上线 RunningHub
16:48Alibaba Cloud68阿里云 Wan 3.0 上线 Runware D0
16:18Alibaba Cloud44阿里云 Wan3.0 上线 Segmind,原生生成 30 秒视频
16:18Alibaba Cloud50阿里云 Wan3.0 上线 NadouPro,支持 30 秒原生视频
15:48Alibaba Cloud62阿里云 Wan3.0 上线 fal,单次生成 30 秒视频
15:48Alibaba Cloud63阿里云 Wan3.0 上线 TapNow,支持多格式参考
15:48Alibaba Cloud65阿里云Wan3.0上线Magnific支持多模态生成
15:48Alibaba Cloud40通义万相 Wan 3.0 上线 FlovaAI 限时优惠
15:18Alibaba Cloud64阿里云万相3.0上线DeeVid AI
12:24IT之家(RSS)68阿里巴巴达摩院推出肝癌 AI 模型 DAMO LiON,可精准识别 1 厘米微小肿瘤

8月22日周六

09:18Rohan Paul26Ox Alpha 单次生成完整 Three.js 3D 世界
03:28The Decoder:AI News(RSS)61同事件DeepSeek 发布实验性视觉模型 V4-Flash-Vision-Exp,智能体基准测试对标 Opus 4.8同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
02:18Rohan Paul40TARS 发布 AWE 3.5 具身原生基础模型

8月21日周五

22:18elvis49DeepSeek-V4-Flash-Vision-Exp 发布,多模态智能体性能逼近 Opus-4.8
21:44AYi41谷歌神秘模型Ox Alpha免费开放一周
21:07OpenRouter50DeepSeek V4 Flash Vision 上线 OpenRouter
19:56Hacker News 热门(buzzing.cc 中文翻译)45DeepSeek-v4-flash-vision-exp 发布:支持图像与文本多模态输入
18:48凡人小北44DeepSeek-V4-Flash-Vision-Exp 上线,网友喊话降价
18:44AYi62同事件DeepSeek多模态模型上线,百张图成本不足20美分同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
18:18🚨 AI News | TestingCatalog47DeepSeek 发布 V4-Flash-Vision-Exp 多模态模型
18:18Chubby♨️45DeepSeek 发布 V4-Flash-Vision-Exp 多模态模型
17:35DeepSeek64同事件DeepSeek 发布 V4-Flash-Vision-Exp 多模态模型同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
17:28Tianyi Cui49DeepSeek-V4-Flash-Vision-Exp 多模态模型上线
17:26DeepSeek:API 更新日志67精选DeepSeek-V4-Flash-Vision-Exp 发布
17:24IT之家(RSS)63同事件DeepSeek V4-Flash-Vision-Exp 上线,开启多模态 API 服务同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
16:18Chubby♨️36神秘新模型Ox Alpha现身:1M上下文免费一周
12:24IT之家(RSS)48商汤开源 8B 参数多模态大模型 SenseNova U1.5 Lite,原生支持 4K 图像输出
已加载 40 条
全部 AI 动态
2026年8月25日星期二 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
模型 · 标签「多模态」 · 696 条清除

8月25日

星期二 · 7 条
15:18
Alibaba Cloud@alibaba_cloud
AI 评分 39/100
阿里云 Wan3.0 beta 上线 VivaReel,官方发布科幻短片《STILL HERE》展示其能力。该片设定于废墟世界,讲述孤独外星人与 LED 面机器人的友谊,突出角色一致性、电影级动态与情感叙事。用户可通过 Qwen Cloud 或阿里云 Model Studio 使用。

VivaReel: Wan3.0 beta is now available on VivaReel. ⚡️ To put it to the test, we created STILL HERE — a cinematic sci-fi short set...

多模态模型发布
13:48
Alibaba Cloud@alibaba_cloud
AI 评分 49/100
阿里云 Wan 3.0 现已上线 @flickartHQ,支持最长 30 秒的视频生成,为每段镜头带来更多时间与创作自由。Flick 作为早期内测方,使用 Wan 3.0 制作了官方预告片《PHANOS》,称其具备行业领先质量与极具竞争力的定价。API 可通过 Model Studio 和 Qwen Cloud 获取。

Flick: PHANOS | A Flick Original. Official Trailer.🔥 As one of the early internal testers for Wan 3.0, we made this trailer wi...

多模态模型发布视频
13:48
Alibaba Cloud@alibaba_cloud
AI 评分 64/100
阿里云 Wan 3.0 正式上线 Picsart,支持原生 30 秒视频生成、同步音频及最多 20 个参考输入,确保跨镜头角色与细节一致。用户可先在 480p 下草稿,最终输出全质量版本,适合产品视频、广告概念等场景。API 已通过 Model Studio 和 Qwen Cloud 开放。

Picsart: WAN 3.0 is live on Picsart! 🔊🔥 Complete 30-second videos in one take, and a lot more 🤩 🎬 Full scenes, not fragments:...

多模态模型发布视频
13:48
Alibaba Cloud@alibaba_cloud
AI 评分 41/100
阿里云 Wan 3.0 现已在 OpenArt 上线,支持单次原生 30 秒视频生成,无需拼接,并保持角色、动作与光影一致,输出最高 1080p。用户可通过 Model Studio 与 Qwen Cloud 获取 API 接入。OpenArt 本周(8 月 24-31 日)升级 Pro 或 Wonder 套餐可无限次生成。

OpenArt: Wan 3.0 is live on OpenArt 🔊 • Native 30-second generation in a single pass — no stitching • Consistent motion, lightin...

多模态模型发布视频
13:18
Alibaba Cloud@alibaba_cloud
AI 评分 61/100
阿里云 Wan3.0 发布,视频生成质量飞跃

阿里云发布 Wan3.0 视频生成模型,被评测者评价为“质量持续高水准,而非偶发”,相较 Wan2.7 堪称全新模型。该模型支持文生视频(T2V)、图生视频(I2V)和参考生视频(R2V),现已上线 fal 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。

多模态模型发布视频
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
09:48
Alibaba Cloud@alibaba_cloud
AI 评分 60/100
阿里云通义万相 Wan 3.0 已上线 AI 创作平台 Pixmax,主打电影级画质输出。新版本支持任意艺术风格下的视觉一致性、物理真实的流畅运动,以及多模态与混合现实编辑能力。即日起至 8 月 24 日,Pixmax 用户可享 30% 折扣;开发者还可通过 Model Studio 与 Qwen Cloud 获取 API 接入。

Pixmax: Wan 3.0 is now live on Pixmax Effortless input. Cinema-grade output. Highlights: - Flawless visual consistency across an...

多模态模型发布视频
02:18
Chubby♨️@kimmonismus
AI 评分 24/100
Ox Alpha 似乎已经收到了一次重大更新。你无法想象我对正式发布和模型技术细节有多期待。

Tim Jayas: I feel Ox Alpha has continual learning and is modifying itself each day coz how else does it keep improving on it's own?...

多模态模型发布

8月24日

星期一 · 16 条
23:59
The Decoder:AI News(RSS)
AI 评分 60/100
阿里 Wan3.0 视频生成模型开放测试,支持文本、图片、文档生成最长 30 秒视频

阿里巴巴视频生成模型 Wan3.0 现已开放测试,可基于文本、PDF、网页和 PowerPoint 输入生成最长 30 秒的视频,时长较前代 Wan2.5 翻倍。

多模态模型发布视频
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
23:18
elvis@omarsar0
AI 评分 32/100
这是个很棒的模型。我用它搭配 Pi 玩得很开心。你可以在我们的 harness 游乐场免费测试 Ox Alpha 搭配 Pi 或 Hermes Agent:https://academy.dair.ai/dashboard/playground

Pi: Ox Alpha is currently the most popular model on @OpenRouter and is free to use! A reasoning model designed for coding, s...

智能体多模态推理模型发布
22:29
MarkTechPost(RSS)
AI 评分 60/100
Generalist AI 发布 GEN-1.5:一个从 3-12 秒演示中学会新任务的机器人基础模型

Generalist AI 发布机器人基础模型 GEN-1.5,将 3–12 秒的传感器运动数据放入 30 秒上下文窗口即可执行任务,无需梯度更新或微调。在 10 项操作任务中,单次上下文提示平均成功率达 59%(±10%),每任务用 5 分钟数据做 10 步梯度更新后提升至 83%(±9%)。该能力并非显式训练,而是从超八个月预训练中涌现;目前无公开权重、API 或定价,属研究发布。

具身智能多模态模型发布
22:18
Rohan Paul@rohanpaul_ai同事件
AI 评分 52/100
当一项任务持续数小时甚至数周,且外部世界不断变化时,AI 需要具备什么才能保持有用?目标会演变。新的约束会出现。计划会失败。认识一下 dots3-note 预览版,这是由 rednote 的 dots 工作室 @dotsstudioai 开发的开放权重多模态模型,面向现实生活中的长期任务自主性。• 总计 280B / 激活 16B 参数• 512K 上下文窗口• 文本、视觉和语音理解以下介绍它如何学习、自我评估并随时间适应。🧵
智能体多模态开源生态模型发布
同一事件,精选展示《dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理》
18:18
Alibaba Cloud@alibaba_cloud
AI 评分 42/100
Wan 3.0 现已上线 @SeaArt_Ai!🚀 更多输入。更多控制。更多创作可能。用 Wan 3.0 创作。📷✨ 更多 API 接入: • Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/

SeaArt.Ai🐋: Wan 3.0 is now live on SeaArt. More inputs. More control. More ways to create. Bring text, images, videos, audio, and mo...

多模态模型发布视频
18:18
Alibaba Cloud@alibaba_cloud
AI 评分 54/100
阿里云 Wan 3.0 视频模型上线 Scenario 平台,支持一次生成最长 30 秒片段、原生同步音频及多模态输入(首帧、尾帧、参考图、视频、音频、文档和 URL),并配备面向复杂输入的思考模式。开发者现可通过 Model Studio 和 Qwen Cloud 获取 API 接入。

Scenario: Wan 3.0 - One of the most anticipated video model releases of the year, here on Day 0 🚀 • Up to 30s clips in one pass •...

多模态模型发布视频
18:18
Alibaba Cloud@alibaba_cloud
AI 评分 42/100
阿里云通义万相 Wan 3.0 已在 RunningHub 上线,支持原生 30 秒视频生成、多模态参考输入和更强的时序一致性。用户可通过 Web UI 和 API 使用,并可通过 Model Studio 与 Qwen Cloud 获取更多 API 接入。

RunningHub: Wan 3.0 lands on RunningHub✨ ✅Pro‑grade text‑to‑video: 30‑sec generation, multi‑modal reference inputs, better temporal ...

多模态模型发布
16:48
Alibaba Cloud@alibaba_cloud
AI 评分 68/100
阿里云 Wan 3.0 现已在 Runware D0 上线,支持文生视频、帧与参考模式,可生成 30 秒片段,并支持多达 10 张参考图、5 段参考视频和 5 段参考音频输入,配备复杂多输入提示的思考模式。更多 API 访问可通过 Model Studio 和 Qwen Cloud 获取。

Runware: Wan 3.0 is now on Runware on D0 🎬 - Text-to-video, frame, and reference modes in one model - 30-second clips - Up to 10...

多模态模型发布视频
16:18
Alibaba Cloud@alibaba_cloud
AI 评分 44/100
阿里云 Wan3.0 视频生成模型已在 Segmind 平台上线,支持单次生成 2 至 30 秒视频,无需拼接。该模型具备 Omni-Reference 多模态参考能力,可输入文本、图像、音频、视频及文档等素材,并支持最高 1080p 分辨率与精细面部渲染。用户可通过 PixelFlow 或 API 调用,也可在 Model Studio 和 Qwen Cloud 获取更多访问权限。

Segmind: Wan 3.0 is now live on Segmind. - Native 30-second generation — 2 to 30s in a single pass, no stitching - Omni-Reference...

多模态模型发布
16:18
Alibaba Cloud@alibaba_cloud
AI 评分 50/100
阿里云 Wan3.0 已上线 NadouPro,升级视频生成的长度、多模态参考与真实感,并开放 Model Studio 与 Qwen Cloud 的 API 接入。新版本支持原生 30 秒视频生成、现实级渲染,以及 Omni-Reference 多模态参考,除文本、图像、音频、视频外,还可输入文档、表格、幻灯片和网页等。

NadouPro: 🚀 Wan3.0 is now available on NadouPro Built to fit higher requirement for authenticity, Wan3.0 upgrades video creation ...

多模态模型发布视频
15:48
Alibaba Cloud@alibaba_cloud
AI 评分 62/100
阿里云 Wan3.0 已上线 fal 平台,单次生成原生 30 秒视频,无需拼接。支持文本、图像、音频、视频、网页和文档等多模态输入,并提升真实世界运动渲染效果。更多 API 接入可通过 Model Studio 和 Qwen Cloud 获取。

fal: Wan 3.0 is now live on fal. - Produces native 30-second clips in a single pass without stitching - Omni-reference input:...

多模态模型发布视频
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
15:48
Alibaba Cloud@alibaba_cloud
AI 评分 63/100
阿里云 Wan3.0 多模态视频生成模型上线 TapNow,支持一次生成最长 30 秒视频,并接受多种参考格式输入。模型在场景中保持运动、光照和物理细节的一致性,现可通过 Model Studio 和 Qwen Cloud 获取 API 访问。

TapNow: Wan 3.0 brings multimodal video creation to TapNow. Generate up to 30 seconds in one take and create from multiple refer...

多模态模型发布视频
另有 1 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)
15:48
Alibaba Cloud@alibaba_cloud
AI 评分 65/100
Wan3.0 现已上线 @magnific。输入文本、图片、网页内容--输出 30 秒电影感视频。更多 API 接入: • Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/

Magnific: Opening night is today Wan 3.0 is now on Magnific. See its power with a story that holds the same face across 22 years, ...

多模态模型发布视频
另有 2 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)IT之家(RSS)
15:48
Alibaba Cloud@alibaba_cloud
AI 评分 40/100
阿里云 Wan 3.0 视频生成模型正式上线 FlovaAI,480P 版本限时低至 $0.013/秒。该版本支持音画同步与自然节奏过渡,带来更沉浸的内容呈现。用户还可通过 Model Studio 和 Qwen Cloud 获取 API 访问。

FlovaAI: FlovaAI x Wan 3.0 Launches Exclusively! Limited-Time Offer for Wan3.0 480P: As Low As $0.013/sec With original Audio And...

多模态模型发布视频
15:18
Alibaba Cloud@alibaba_cloud
AI 评分 64/100
Wan3.0 已在 @Deevid_AI 上线。🚀 更低的生成成本。创作更多,探索更多。电影级 AI 视频,更强的动态表现,更丰富的细节。立即开始创作!更多 API 接入:• Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/

Deevid AI: WAN 3.0 is live on DeeVid AI. Lower generation costs. Create more. Explore more. Cinematic AI video with stronger motion...

多模态模型发布视频
12:24
IT之家(RSS)
AI 评分 68/100
阿里巴巴达摩院推出肝癌 AI 模型 DAMO LiON,可精准识别 1 厘米微小肿瘤

阿里巴巴达摩院联合中国医科大学附属盛京医院等机构研发出肝癌诊断 AI 模型 DAMO LiON,可通过 CT 影像识别微小肝脏癌变病灶。两个月真实世界前瞻临床试验中,该模型发现 15 例原本被遗漏的恶性肿瘤,绝大部分为 1 厘米左右病灶;AI 协助阅片用时减少 27%,对恶性肿瘤敏感性提高 11.5%,相关论文登上《自然·医学》。

多模态模型发布

8月22日

星期六 · 3 条
09:18
Rohan Paul@rohanpaul_ai
AI 评分 26/100
Ox Alpha 单次生成完整 Three.js 3D 世界

Ox Alpha 在一次提示下生成 64,745 个输出 token,单次响应产出完整 Three.js dreamcore 3D 场景的全部程序化代码,无需外部素材。该模型支持 1M 上下文窗口、约 131k 最大输出 token,可处理文本+图像+视频输入并输出文本,定位为面向编码、长程智能体软件工程及生产负载的推理模型。aimlapi 正免费提供 Ox Alpha。

AI/ML API: NEW OX ALPHA FEELS CRAZY 🤯 We asked Ox Alpha to build a dreamcore 3D world in three.js — one prompt, one shot. No asset...

多模态推理模型发布编码
03:28
The Decoder:AI News(RSS)同事件
AI 评分 61/100
DeepSeek 发布实验性视觉模型 V4-Flash-Vision-Exp,智能体基准测试对标 Opus 4.8

DeepSeek 发布实验性多模态模型 V4-Flash-Vision-Exp,在图像理解基础上保持文本推理能力,其内部智能体基准测试成绩接近 Opus 4.8。该模型兼容 OpenAI 与 Anthropic API,支持 Base64、URL(32 MiB)及免费 Files API(64 MiB)三种传图方式,单图成本最高 384 tokens,单次请求最多 600 张图片。

智能体DeepSeek多模态模型发布
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
02:18
Rohan Paul@rohanpaul_ai
AI 评分 40/100
TARS 发布 AWE 3.5 具身原生基础模型

TARS 推出具身原生基础模型 AWE 3.5,采用“Born as One”架构,将动作、感知、几何与触觉整合进单一模型,而非后期拼接。该模型支持数分钟长时程闭环推理,任务执行效率约为 PI0.5 的 2 倍,并通过预训练双先验与后训练世界引擎滚动预测来优化决策。

具身智能多模态模型发布

8月21日

星期五 · 14 条
22:18
elvis@omarsar0
AI 评分 49/100
DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台,文本能力与 V4-Flash 持平,多模态智能体基准测试大幅跃升,性能接近 Opus-4.8。Ox Alpha 支持 1M token 上下文,可处理文本、图像和视频输入,在编码与智能体任务中表现出色。DeepSeek Harness 0.1.1 同步发布,开箱支持新模型。

DeepSeek: DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...

智能体DeepSeek多模态模型发布
21:44
AYi@AYi_AInotes
AI 评分 41/100
这么好的模型,竟然没人猜它是谷歌的【引用 @opencode】:Ox Alpha(隐身模型)接下来一周免费使用• 1M 上下文窗口 • 多模态 • 零数据留存慷慨的速率限制,近乎无限使用我们每天可处理 100T token 的容量,看看你能用它做什么

OpenCode: Ox Alpha (stealth model) is free for the next week - 1M Context - Multi-modal - Zero Data Retention Generous rate limits...

Google多模态模型发布
21:07
OpenRouter@OpenRouter
AI 评分 50/100
DeepSeek V4 Flash Vision Exp 已在 OpenRouter 上线!@deepseek_ai 的新模型支持图像输入,定价与 V4 Flash 相同,在文本智能体基准测试中与 V4 Flash 0731 持平,并在 Agents' Last Exam 和 ZeroBench 上超越 Opus-4.8。立即使用:https://openrouter.ai/deepseek/deepseek-v4-flash-vision-exp
DeepSeek多模态模型发布
19:56
Hacker News 热门(buzzing.cc 中文翻译)
AI 评分 45/100
DeepSeek-v4-flash-vision-exp 发布:支持图像与文本多模态输入

DeepSeek 推出 DeepSeek-v4-flash-vision-exp 模型,可同时接受图像与文本输入。用户能要求模型描述图片、从截图中读取文字、分析图表等。该实验版本扩展了 DeepSeek 的多模态能力。

DeepSeek多模态模型发布
18:48
凡人小北@frxiaobei
AI 评分 44/100
DeepSeek 发布实验性多模态模型 V4-Flash-Vision-Exp,文本能力对标 V4-Flash,多模态智能体基准大幅跃升,性能接近 Opus-4.8。模型已上线 API 平台,可用 model='deepseek-v4-flash-vision-exp' 调用,同日发布 DeepSeek Harness 0.1.1 支持新模型。网友 @梁子 借新模型上线之际,呼吁官方降价。

DeepSeek: DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...

DeepSeek多模态模型发布
18:44
AYi@AYi_AInotes同事件
AI 评分 62/100
DeepSeek多模态模型上线,百张图成本不足20美分

DeepSeek 发布实验性多模态模型 deepseek-v4-flash-vision-exp,文本能力对齐 V4-Flash,多模态 Agent 性能逼近 Opus-4.8,Agents Last Exam 27.3 对 25.7、ZeroBench 35.0 对 34.0。

DeepSeek: DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...

智能体DeepSeek多模态模型发布
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
18:18
🚨 AI News | TestingCatalog@testingcatalog
AI 评分 47/100
DeepSeek 在 API 平台上线多模态模型 deepseek-v4-flash-vision-exp,文本性能接近 Opus 4.8 并持平 DeepSeek-V4-Flash。

DeepSeek: Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for billing: up to 384 tok...

DeepSeek多模态模型发布
18:18
Chubby♨️@kimmonismus
AI 评分 45/100
DeepSeek 推出实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp,面向需要视觉能力的智能体,已在 DeepSeek API 平台上线。

DeepSeek: DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...

智能体DeepSeek多模态模型发布
17:35
DeepSeek@deepseek_ai同事件
AI 评分 64/100
DeepSeek 发布 V4-Flash-Vision-Exp 多模态模型

DeepSeek 推出实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp,文本能力与 V4-Flash 持平,涵盖智能体、推理与世界知识。

智能体DeepSeek多模态模型发布
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
17:28
Tianyi Cui@tianyi
AI 评分 49/100
DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台,文本能力与 V4-Flash 持平,多模态智能体性能大幅跃升,接近 Opus-4.8。DeepSeek Harness 0.1.1 同步发布,开箱即支持新模型,可用 model='deepseek-v4-flash-vision-exp' 调用。

DeepSeek: DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀 🔹 This experimental multimodal model matches ...

智能体DeepSeek多模态模型发布
17:26
DeepSeek:API 更新日志精选
AI 评分 67/100
DeepSeek-V4-Flash-Vision-Exp 发布

DeepSeek 上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,可通过设置 model='deepseek-v4-flash-vision-exp' 在 API 平台访问。

智能体DeepSeek多模态模型发布

推荐理由:实验版在纯文本能力与正式版持平的基础上补齐视觉,多模态 Agent 基准接近 Opus-4.8,让依赖视觉的 DeepSeek 工作流无需切换后端即可评估更强感知能力。
17:24
IT之家(RSS)同事件
AI 评分 63/100
DeepSeek V4-Flash-Vision-Exp 上线,开启多模态 API 服务

深度求索发布多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,已上线 API 平台。该模型纯文本能力与 V4-Flash 正式版持平,视觉理解 Agent Benchmark 表现大幅跃升,接近 Opus-4.8。API 按 token 计费,单张图片最多占 384 tokens,价格与 V4-Flash 一致,支持三种调用格式及三种图片传入方式。

DeepSeek多模态模型发布
同一事件,精选展示《DeepSeek-V4-Flash-Vision-Exp 发布》
16:18
Chubby♨️@kimmonismus
AI 评分 36/100
神秘新AI模型Ox Alpha悄然上线,提供1M上下文窗口、多模态能力、零数据保留,并在一周内近乎无限量免费使用。OpenCode称其每日可处理100万亿token(约每秒11.6亿token),但该模型的开发公司身份尚未公开。

OpenCode: Ox Alpha (stealth model) is free for the next week - 1M Context - Multi-modal - Zero Data Retention Generous rate limits...

多模态模型发布
12:24
IT之家(RSS)
AI 评分 48/100
商汤开源 8B 参数多模态大模型 SenseNova U1.5 Lite,原生支持 4K 图像输出

商汤科技今日宣布开源轻量级原生统一多模态大模型 SenseNova U1.5 Lite,该模型拥有 8B 参数,原生支持 3-4k 上下文长度和 4K 高分辨率图像输出。模型支持 Bounding Box、Visual Marker 及多图参考等精细视觉控制,在指令遵循与图像编辑保持度上超越同量级模型,文字渲染与复杂布局能力媲美超大规模商业模型。

图像生成多模态开源生态模型发布
已加载 40 条