全部标签

#视频生成

3 篇文章

·多模态, 论文解读
1 分钟0

UMM论文解读05-视频与世界模型篇:UniVideo双流统一、Emu3.5下一状态预测与Lance多任务协同

> 统一模型在图像领域验证成功后,自然向视频和世界模型延伸。快手可灵与滑铁卢大学的 UniVideo 用 MLLM+MMDiT 双流架构把统一理解/生成/编辑扩展到视频;智源的 Emu3.5 把"下一 token 预测"升维到"下一状态预测",用 790 年互联网视频训练出一个 34B 的原生多模态

·AI, 多模态, 视频生成
1 分钟0

MiniMax H3 深度解析:首款开源全模态生成模型的技术突破与产业影响

MiniMax H3 深度解析:首款开源全模态生成模型的技术突破与产业影响 2026年7月31日,MiniMax(稀宇科技)正式发布新一代全模态生成模型 MiniMax H3,并宣布将于近期开源。这是 MiniMax 从"特化任务模型"迈向"通用多模态智能"的重要里程碑,也是其首款开源

·AI
1 分钟0

通义万象前世今生:从 AI 绘画到电影级视频生成的完整演进

引言 通义万相(WanX)是阿里云通义大模型家族中的视觉生成核心成员,从 2023 年 7 月上线至今,经历了从静态图像生成到电影级视频生成的完整技术跃迁。它不仅是国内最早一批 AI 绘画模型,更在 2025 年通过开源策略成为全球最受欢迎的视频生成模型之一,累计下载量突破 500 万次。