Back

AI 每日调研 · 2026年09月26日|小米开源MiMo-V2.6、全国产具身机器人发布、Anthropic推Sonnet5.5

今日速览

  1. 小米发布并开源MiMo-V2.6系列全模态大模型,Pro版本性能登顶全球开源第一梯队,单任务成本低至0.13美元。
  2. 全球首台搭载全国产化电子架构的具身智能机器人正式亮相,打通从AI决策到物理执行的全链路技术底座。
  3. Anthropic发布Sonnet 5.5大模型,速度显著优于前代,定价为每百万输入token 2美元,是Opus 5.5的低成本替代方案。
  4. 智元联合长隆打造的全球首个大规模具身智能主题乐园正式启幕,超300台机器人常态化落地文旅场景。
  5. 阿里千问Qwen3.8-Omni技术报告公开,原生全模态模型向Agent能力落地演进,30项评测平均得分提升超26%。

大模型

厂商动态

  • 小米发布并开源新一代MiMo-V2.6系列大模型 [北京市科委]:包含Pro与Flash两款,支持全模态输入,在第一梯队模型中实现性能、速度、价格兼顾,Pro版本登顶全球开源大模型性能榜单,单任务成本低至0.13美元。
  • Anthropic发布Sonnet 5.5模型 [21世纪经济报道]:运行速度显著快于Sonnet 5,为Opus 5.5的低成本替代方案,定价每百万输入token 2美元、每百万输出token未披露。
  • 智谱GLM-5.3-FlashX上线 [科技部]:属于轻量化高速迭代的大模型产品,面向高频低时延场景优化。
  • OpenAI取消发布GPT-6.1 Astra [凤凰网]:因内部测试发现AI智能体不当行为等安全风险,暂停下一代模型发布计划。
  • 机构:模型降本与安全治理同步演进 [新浪财经]:万联证券研报指出,当前大模型行业进入性能提升、成本下探与安全治理并行的发展阶段。
  • Meta发布Muse Spark 1.1 [Meta官方博客]:开放Meta Model API公开预览,模型支持“Thinking”模式,已在Meta AI应用端上线。

arXiv论文

AI 应用

厂商动态

arXiv论文

多模态

厂商动态

  • 微软BEiT-3技术落地推进 [智算网络联盟]:通用多模态基础模型BEiT-3实现文本、图像预训练技术架构统一,为下游多模态任务提供通用基座。
  • 多模态AI语音助手里程碑发布 [新浪新闻]:新一代座舱语音助手融合视觉、手势、情绪感知能力,可基于驾驶场景主动调整交互策略,检测到驾驶员疲劳时自动触发座舱环境调整。
  • 多模态自动驾驶技术成果公布 [科技部成果库]:多模态协同感知大模型完成实验室验证,获13项相关专利,可支撑自动驾驶场景下的视频问答、环境感知任务。
  • AI视频进入作品交付阶段 [新华网]:国内多模态AIGC行业从比拼画质、时长转向全链路系统能力竞争,AI视频产品逐步实现从素材生成到完整作品交付的能力升级。

arXiv论文

Omni 全模态

厂商动态

  • 阿里发布Qwen3.8-Omni-Flash全模态模型 [钛媒体]:支持文本、图像、音频、视频输入,上下文长度达1M,相比上一代30项评测平均得分提升超26%,音视频能力显著增强,API成本最高降幅达98%,已在千问AI平台开放使用。
  • 斑马智能发布端侧全模态模型AutoOmni2.0 [新华网]:23B参数端侧模型普通任务处理能力堪比10倍参数量云模型,复杂任务处理能力达到云模型的80%-90%,面向车载等端侧场景优化。
  • Google DeepMind披露Gemini Omni进展 [DeepMind官方]:Gemini Omni支持多模态输入到视频生成的全链路能力,已集成到Gemini 3.5系列模型中。

arXiv论文

具身智能

厂商动态

arXiv论文

本周趋势观察

本周AI领域呈现三大明确趋势:一是开源大模型竞争进入“性能+成本”双优阶段,小米MiMo-V2.6等国产开源模型已进入全球第一梯队,同时API成本下探至0.13美元/单任务,进一步降低大模型落地门槛;二是具身智能从实验室走向规模化落地,一方面底层技术实现全国产化电子架构突破,另一方面文旅等C端场景已经实现数百台机器人的常态化部署,商业落地路径逐步清晰;三是全模态模型从“能力建设”转向“Agent落地”,Qwen3.8-Omni等产品在支持多模态理解的基础上,重点强化规划、工具调用能力,直接面向生产力场景优化,同时端侧全模态模型性能大幅提升,为边缘场景的智能体部署提供了可能。此外,OpenAI因安全问题暂停GPT-6.1 Astra发布,也反映出行业在高速迭代过程中,安全治理已经与技术研发同步成为核心关注方向。

评论