Back

AI 每日调研 · 2026年10月01日|国内首个通用具身智能训练平台上线


今日速览

  1. 国内首个通用具身智能训练平台正式对外开放,支持多形态智能体"看学做"一站式训练
  2. Cohere Embed 5嵌入模型正式上线,官方已发布完整技术细节与可用性说明
  3. 多模态领域arxiv新增《Gestalt: Large Multimodal Interplay Model》成果,聚焦跨模态交互优化
  4. 全模态领域最新研究围绕物理世界推理、Agent决策规划方向展开技术探索
  5. 生成式AI应用渗透加速,我国上半年用户规模已突破7亿人

大模型

厂商动态

  • Cohere 9月30日正式发布Embed 5嵌入模型,官方已更新完整Release Notes,包含技术参数、可用范围等细节[来源:Cohere]
  • 9月29日曾报道OpenAI推出GPT-6.1 Sol,现补充:官方明确其Token价格不到Astra标准价格的一半,能力接近Astra,可支撑高难度编程与专业工作场景需求[来源:OpenAI Research]
  • 小米MiMo-V2.6系列、Anthropic Sonnet 5.5、OpenAI暂停GPT-6.1 Astra发布等动态近5天已连续报道,当日无新增信息,暂不展开

arXiv 论文


AI 应用

厂商动态

  • 中国互联网络信息中心发布《生成式人工智能应用发展报告(2026)》[来源:数字中国建设峰会],截至2026年上半年我国生成式AI用户规模突破7亿,36.1%网民使用手机自带AI助手,35.5%使用移动端AI应用
  • 阿里开源Qwen-Image-Layered图像生成模型,首次实现模型内PS级图层理解与生成,可完成近乎零漂移的AI图像精准编辑,解决生图一致性难题
  • Mistral上线OCR 4.1文档理解模型,定价为每1000页4美元,号称当前全球精度最高的文档提取模型[来源:Mistral Pricing]
  • OpenAI推出面向金融行业的ChatGPT解决方案,搭载GPT-6 Astra模型与专属金融数据工具,覆盖研究、分析、运营等场景[来源:OpenAI金融行业方案]

arXiv 论文


多模态

厂商动态

arXiv 论文


Omni 全模态

厂商动态

  • NVIDIA官方文档已支持Qwen3-Omni全模态模型的训练与部署,提供开箱即用的微调配方与Hugging Face模型卡适配
  • 9月23日曾报道斑马智能发布AutoOmni2.0端侧全模态模型,现补充:该模型为23B混合专家架构,普通任务处理能力堪比10倍参数量云模型,复杂任务性能达到云模型的80%[来源:新华网]
  • 谷歌Gemini Omni开放视频生成与编辑能力,支持多模态输入直接生成高保真视频内容[来源:Google DeepMind]

arXiv 论文


具身智能

厂商动态

  • 国内首个通用具身智能训练平台正式对外开放,集成仿真训练、真机部署、数据闭环能力,支持工业机械臂、服务机器人、人形机器人等多形态智能体,可实现"看一眼、学一遍、做一遍"的技能学习,无需固定示教路径
  • 新松公司发布松羿力量版轮式具身智能机器人,负载达15千克,适配搬运、检测、分拣等工业场景,支持即插即用与多机协同作业[来源:北国网]
  • 9月28日曾报道东土科技发布全国产化电子架构具身智能机器人,现补充:该架构以确定性计算与网络技术为基础,实现控制与AI计算的隔离融合,已通过国家工业信息安全发展研究中心测试,可完整替代国外同类方案[来源:东方财富网]

arXiv 论文


本周趋势观察

本周AI领域呈现三个明确的落地导向:一是大模型竞争从参数、性能比拼转向性价比与场景适配,OpenAI GPT-6.1 Sol、Cohere Embed 5等产品均以"同等能力更低成本"为核心卖点,产业侧对大模型的采购决策愈发理性;二是具身智能从单点技术突破转向体系化落地,通用训练平台、全国产电子架构、场景规模化部署三条路径并行,2026年Q4有望迎来工业场景具身机器人的密集落地期;三是多模态/全模态技术的价值落点从"理解"转向"执行",Qwen3.8-Omni-Flash、Gemini Omni等产品均强化Agent任务规划、工具调用能力,全模态模型正在从内容交互入口升级为生产力执行入口。

评论