今日速览
- 上海AI Lab开源16B MoE统一多模态模型InternLumina-U2,支持华为昇腾落地
- 自变量机器人完成数亿元Pre-A++轮融资,加速具身智能大模型训练与场景落地
- 全球首台搭载全国产化电子架构的具身智能机器人正式亮相
- 具身智能领域新增Agent自提升、世界模型优化方向arXiv研究成果
- Omni全模态领域当日无新增厂商动态,学术研究聚焦多模态Agent决策优化
大模型
厂商动态
10月5日曾报道Reflection AI发布5010亿参数开源Beam大模型,当日无新增实质性进展,其余大模型厂商动态近5天已充分报道,暂不展开。
arXiv论文
当日无新增大模型方向未报道学术成果。
AI 应用
厂商动态
- Liquid AI发布d1决策模型并新增图像输入能力:目前可通过console.liquid.ai和d1 Playground使用,支持文本与图像多模态输入。
- Together AI推出Together Link:可一键在现有编码智能体中接入开源模型,实现降费超50%。
arXiv论文
暂未捕获到该方向当日新增未报道学术成果。
多模态
厂商动态
10月5日曾报道腾讯混元生图3.0、阿里通义万相Wan2.2-S2V开源,现补充当日新增动态:
- 上海AI Lab开源InternLumina-U2:16B MoE架构的encoder-free统一多模态模型,同时支持华为昇腾落地,降低国内开发者部署门槛。
- 10月4日曾报道紫东太初ZDTaichu5.0-9B大模型登榜,当日无新增进展。
arXiv论文
当日无新增多模态方向未报道学术成果。
Omni 全模态
厂商动态
暂未捕获到该方向当日新增未报道厂商动态。
arXiv论文
- Omni-Decision: Evidence-Ledger Planning for Omni-Modal Agents:提出基于证据账本的全模态智能体规划框架,提升多模态输入下的复杂任务决策可靠性。
具身智能
厂商动态
- 全球首台搭载全国产化电子架构的具身智能机器人亮相:9月28日正式发布,实现核心电子部件全栈国产化,降低具身机器人供应链依赖风险。
- 自变量机器人完成数亿元Pre-A++轮融资:本轮融资由光速光合与君联资本领投,资金将用于下一代统一具身智能通用大模型的训练与场景落地。
arXiv论文
- Reconstruct, Practice, Go Real: Guided Self-Improvement for Embodied Agents:提出具身智能体引导式自提升框架,通过“重建-练习-实做”三步流程,降低真实场景部署的样本需求。
- World Models for Embodied Intelligence: From Plausible to Controllable to Actionable:梳理具身世界模型的技术演进路径,提出从内容可信到动作可控再到决策可用的三阶发展框架。
本周趋势观察
本周AI领域呈现三大清晰趋势:一是开源大模型竞争从参数规模转向“效率+场景适配”,Reflection的稀疏激活大模型、上海AI Lab的昇腾适配多模态模型均指向落地优先级提升;二是具身智能产业进入资本与技术双加速阶段,周内既有国产硬件架构突破,也有初创企业大额融资落地,下游工业场景落地节奏明显加快;三是多模态技术从“单模态能力堆叠”向原生统一架构演进,本周开源的生图、视频生成模型均采用原生多模态设计,生成质量与语义理解能力较上一代拼接架构有显著提升。