Back

AI 每日调研 · 2026年09月18日|阿里发布Qwen3.8-Omni、移动云推国产异构推理系统

今日速览

  1. 阿里巴巴推出新一代原生全模态模型Qwen3.8-Omni-Flash,支持文本、图像、音频、视频输入及1M上下文,音视频Agent成本下降九成。
  2. 移动云联合多家机构发布国内首个国产GPU+类脑芯片大模型异构混合推理系统,为国产算力支撑大模型推理提供新路径。
  3. 紫东太初开源ZDTaichu5.0-9B通用多模态大模型,为10B参数内空间具身能力最强模型,同时公开数据生产方案。
  4. TypeSafe推出专注校准决策的Jev模型,输出token免费,可有效降低幻觉,创始人为RLHF技术发明者。
  5. 清华发布青年最关注AI技术榜单,具身智能基础模型、多模态推理与生成大模型等技术上榜。

大模型

厂商动态

arXiv动态

当日未捕获到大模型领域新增的高相关独立论文成果,相关研究可参考跨领域通用技术论文。


AI 应用

厂商动态

  • 华为云发布企业级AI产品矩阵:华为全联接大会2026上,华为云CEO周跃峰公布:灵衢昇腾950智算集群服务9月30日国内商用、11月30日海外商用;企业级智能体平台智果AgentArts及开源版openJiuwen已服务100余家企业,智果AgentArts将于12月30日正式发布。
  • 网易有道发布LobsterAI 2.0及多场景Agent生态:9月16日有道AI Open Day上,公司集中展示覆盖办公、学习、营销等场景的AI Agent产品矩阵,开源办公Agent成为核心亮点。
  • OpenAI推出金融服务解决方案:集成GPT-6 Astra与金融领域数据,配套专用工具提升金融团队研究、分析、运营及客户服务效率。
  • Meta推出Muse Image、Muse Video生成工具:Muse Image已在美国Meta AI app、meta.ai、Instagram Stories及部分国家WhatsApp上线,后续将扩展至Facebook。

arXiv动态


多模态

厂商动态

  • 紫东太初开源ZDTaichu5.0-9B通用多模态大模型:9月15日正式开源该模型,参数规模9B,为10B参数内空间具身能力最强的通用多模态模型,通用能力处于第一梯队;本次不仅开放权重,还公开数据生产详细方案,已在科研自动化、智能制造实体场景完成验证。
  • 智象未来提出AI视频向完整作品交付演进:服贸会AIGC创新应用交流会上,智象未来COO王科表示,国内多模态AIGC行业已告别单纯比拼画质、时长的阶段,技术竞争转向全链路系统能力,AI视频正从生成素材向完整作品交付升级。
  • 琶洲实验室推出多模态脑机AI轮椅:2026广东省科普创新展上亮相的该系统,可通过脑机接口实时采集用户脑电信号,转化为前进、后退、旋转等控制指令,为特殊人群提供更便捷的移动支持。

arXiv动态


Omni 全模态

厂商动态

  • 阿里发布Qwen3.8-Omni-Flash原生全模态模型:9月18日千问AI平台正式上线该模型,可同时处理文本、图像、音频、视频输入,支持1M token上下文;在保持同尺寸纯文本模型能力的基础上,全模态能力较上一代显著提升,配套Realtime API将音视频Agent成本降低九成,支持超过10小时音频理解、400秒720P音视频理解,覆盖60+种语言音频输入、30+种语言语音输出。
  • Google DeepMind Gemini Omni支持高分辨率视频生成与编辑,可通过自然对话实现视频修改创作。
  • Meta Llama 4系列模型内置原生多模态能力,支持接近无限长度上下文窗口,适配大规模场景部署。

arXiv动态


具身智能

厂商动态

arXiv动态


本周趋势观察

本周AI领域呈现三条明确的演进主线:一是全模态模型从能力堆叠走向成本普惠,阿里Qwen3.8-Omni-Flash将音视频Agent成本降低九成,标志着全模态能力从少数高端场景开始向大众应用普及,1M上下文+多模态统一处理的架构逐渐成为行业标配。二是国产算力自主可控路径进一步清晰,移动云国产GPU+类脑芯片异构推理系统的发布,验证了混合架构支撑大模型推理的可行性,为解决大模型规模化落地的算力卡脖子问题提供了新的技术选项。三是具身智能加速从实验室走向真实场景,户外全自主直播、行业级评测体系发布、底层模型训练方法突破同步出现,叠加行业融资上半年突破900亿元,具身智能的工程化落地节奏明显加快,2026年下半年有望在工业、服务业场景出现首批规模化商用案例。

评论