BackAI 每日调研 · 2026年10月05日|Reflection AI发布5010亿参数开源Beam大模型、腾讯阿里多模态模型开源
今日速览
- 英伟达投创企Reflection AI发布5010亿参数开源大模型Beam,性能逼近头部厂商旗舰
- 腾讯开源80B参数混元生图3.0,为目前参数量最大的开源生图模型
- 阿里开源通义万相Wan2.2-S2V,单图加音频即可生成电影级数字人视频
- 自变量机器人完成数亿元Pre-A++轮融资,加速具身大模型训练迭代
- 紫东太初5.0-9B大模型9项国际基准拿8项第一,10B档位具身能力领先
大模型
厂商动态
- Reflection AI发布5010亿参数开源大模型Beam:当地时间10月5日,英伟达投资的初创企业Reflection AI发布首款开放权重大模型Beam,总参数量达5010亿,采用稀疏激活架构,单任务仅激活230亿参数,兼顾推理效率与成本控制。该模型为纯文本混合专家模型,聚焦代码生成与智能体任务,性能对标智谱GLM-5.2,并逼近千问3.8-Max。
- 小米MiMo-V2.6、OpenAI GPT-6.1 Sol、谷歌Gemini 4 Argon等近5天已报道,当日无新增进展,暂不展开。
arXiv论文
- 当日无新增大模型方向未报道学术成果,现有研究延续层级连续扩散语言模型、JIT-Agent框架等方向。
AI应用
厂商动态
arXiv论文
多模态
厂商动态
- 腾讯开源混元生图3.0:发布并开源原生多模态生图模型混元图像3.0,参数规模达80B,是目前参数量最大的开源生图模型,也是首个开源工业级原生多模态生图模型,效果对标业界头部闭源模型。
- 阿里开源通义万相Wan2.2-S2V:全新多模态视频生成模型通义万相Wan2.2-S2V正式发布并开源,仅需提供一张静态图片和一段音频,即可生成面部表情自然、口型与音频高度一致、肢体动作流畅的电影级数字人视频,支持分钟级长视频稳定生成。
- 上海AI Lab开源InternLumina-U2:16B MoE统一多模态模型,同时支持华为昇腾部署,采用encoder-free架构,降低落地门槛。
- 10月4日曾报道紫东太初开源ZDTaichu5.0-9B,现补充:该模型为10B参数档位空间具身能力最强的通用多模态大模型,支持单图、多图、长序列视频及任意分辨率视觉输入,适配具身智能场景需求。
arXiv论文
Omni 全模态
厂商动态
- 当日无新增全模态模型发布动态,Qwen3.8-Omni-Flash、Gemini Omni等近5天已报道,无新增进展。
arXiv论文
具身智能
厂商动态
- 自变量机器人完成数亿元Pre-A++轮融资:融资由光速光合与君联资本领投,北京机器人产业基金、神骐资本跟投,资金将用于下一代统一具身智能通用大模型的训练与场景落地。
- 新松松羿力量版具身机器人、全国产化电子架构具身机器人等近5天已报道,当日无新增进展。
arXiv论文
本周趋势观察
- 开源大模型参数竞赛进入新阶段:5010亿参数的Beam大模型采用稀疏激活架构,兼顾大模型性能与推理成本,标志着开源模型开始系统性挑战闭源旗舰模型的代码、智能体任务能力,后续可能引发头部厂商加速开放高参数模型权重。
- 多模态生成向工业级落地迈进:腾讯混元生图3.0、阿里Wan2.2-S2V均为原生多模态架构,摆脱了传统“语言+视觉模块拼接”的技术路径,在生图、数字人视频生成上达到闭源模型水平,开源后将快速降低AIGC产业应用门槛。
- 具身智能产业进入资本+技术双加速期:继上周国产具身机器人密集发布后,本周创企完成大额融资,同时VLA工程平台、智能体自训练等学术成果落地加速,产业链从硬件制造向模型层、工具层延伸的趋势明确。