·AI技术
1 分钟0
SenseNova U1.5深度解析:去VE/VAE的原生统一多模态,4K图像生成与精准编辑的技术突破
引言 2026年4月,商汤科技发布并开源了 SenseNova U1 系列原生理解生成统一模型,首次完整展示了基于自研 NEO-unify 架构的原生统一多模态路线。四个月后的8月21日,商汤正式开源 SenseNova U1.5 Lite,从"验证架构是否可行"迈向"真实创作场景好用"。
引言 2026年4月,商汤科技发布并开源了 SenseNova U1 系列原生理解生成统一模型,首次完整展示了基于自研 NEO-unify 架构的原生统一多模态路线。四个月后的8月21日,商汤正式开源 SenseNova U1.5 Lite,从"验证架构是否可行"迈向"真实创作场景好用"。
引言 通义万相(WanX)是阿里云通义大模型家族中的视觉生成核心成员,从 2023 年 7 月上线至今,经历了从静态图像生成到电影级视频生成的完整技术跃迁。它不仅是国内最早一批 AI 绘画模型,更在 2025 年通过开源策略成为全球最受欢迎的视频生成模型之一,累计下载量突破 500 万次。
引言 Boogu-Image-0.1 是 2026 年 7 月发布的开源统一多模态图像生成模型,在 Boogu Arena 上取得开源第一的成绩,仅次于 GPT-Image-2 和 Nano-Banana-Pro。其核心创新不是架构革命,而是一套完整的 Agentic Image Gen
Boogu-Image-0.1 论文解析:开源统一多模态图像生成的新范式 > 论文:Boogu-Image-0.1: Boosting Open-Source Unified Multimodal Understanding and Generationhttps://arxiv.org
Boogu-Image-0.1 论文完整翻译 > 原文:Boogu-Image-0.1: Boosting Open-Source Unified Multimodal Understanding and Generationhttps://arxiv.org/abs/2607.1312