大模型记忆算法深度综述:从KV Cache到持久化记忆,AI如何从"过目即忘"到"长期进化"
> 当 AI 连你上周说过的话都记不住时,再强的推理能力也只是一次性的聪明。记忆,正在成为大模型架构设计的第一性维度。 引言 2026年8月,清华大学联合新加坡国立大学、博世人工智能研究院发布综述论文《Memory for Large Language Models》,首次从模型底层架构与
共 21 篇文章
> 当 AI 连你上周说过的话都记不住时,再强的推理能力也只是一次性的聪明。记忆,正在成为大模型架构设计的第一性维度。 引言 2026年8月,清华大学联合新加坡国立大学、博世人工智能研究院发布综述论文《Memory for Large Language Models》,首次从模型底层架构与
理解与生成统一(Unified Multimodal Model, UMM)是 2024-2026 年多模态 AI 领域最活跃的研究方向之一。从 Meta 的 Chameleon 到字节的 BAGEL、商汤的 SenseNova U1,技术迭代以月为单位。本文给出一条从基础到前沿的完整学习路径,涵盖
2026年8月13日深夜,DeepSeek在发布V4 Pro正式版、宣布V4系列API改为峰谷分时计价几个小时后,悄悄抛出了一个开发者预览版项目:DeepSeek Harness(命令行叫 `dsh`)。 它用MIT协议开源,仓库挂在 `github.com/deepseek-ai/dee
脉冲神经网络(SNN)深度综述:从生物启发到类脑智能的技术演进 引言 在大语言模型参数规模指数级增长的今天,算力和能耗压力成为AI发展的核心瓶颈。脉冲神经网络(Spiking Neural Network, SNN)作为第三代神经网络,凭借事件驱动、超低功耗、稀疏激活等
2026年8月大模型行业全景扫描:模型密集发布、Agent安全升级与开放权重扩张 引言 2026年8月初,大模型行业迎来密集发布期。Anthropic、Google、字节、MiniMax、DeepSeek 等头部厂商接连发布新模型,能力竞争向专业任务、具身智能与全模态生成延伸。与此同时
Omni模型全景解析:从多模态到全模态的技术演进与产业格局 引言 2026年,大模型行业正经历一场深刻的范式转移——从"多模态"走向"Omni"。 "Omni" 意指"全能",指能够同时处理和理解多种模态(文本、图像、音频、视频)的模型,实现"从任意输入生成任意输出"。这不仅
DeepSeek V4 Flash 深度解析:后训练驱动的 Agent 能力跃升与极致性价比 2026年7月31日,DeepSeek 正式上线了 V4-Flash 正式版 API。这次升级没有改动模型架构,纯粹靠后训练(Post-Training)就把 Agent 能力拉高了一大截,多项基准测
MiniMax H3 深度解析:首款开源全模态生成模型的技术突破与产业影响 2026年7月31日,MiniMax(稀宇科技)正式发布新一代全模态生成模型 MiniMax H3,并宣布将于近期开源。这是 MiniMax 从"特化任务模型"迈向"通用多模态智能"的重要里程碑,也是其首款开源
大模型 API 缓存机制深度解析:Prompt Caching 的技术原理与安全隔离 引言 2026 年,大模型 API 的定价策略中出现了一个有趣的现象:缓存命中的输入 token 价格仅为正常价格的 10%。这意味着,如果你的请求命中了缓存,成本可以降低 90%。 这个机
Kimi K3 全面开源深度解析:2.8万亿参数模型的技术突破与产业影响 引言 2026年7月27日晚间,月之暗面(Moonshot AI)正式开源了 Kimi K3 模型的完整权重、技术报告、推理代码及许可证,同时开放了支撑模型训练的三大关键基础设施技术:MoonEP、FlashKD
大模型训练数据深度解析:预训练、SFT、RL 都需要什么数据 > 数据是 AI 的燃料,但不同阶段需要不同"标号"的燃料。 2026 年,大模型训练已经从"大力出奇迹"进入"精细调数据"阶段。GPT-4o、Kimi K3、Qwen3.8 等旗舰模型的训练数据规模达到 TB 级,但数据质量
> 当 AI 视频生成从"离线创作"走向"实时交互",两条技术路线正在激烈碰撞:严格因果的 Causal 方案 vs 缓冲区机制的 Streaming DiT 方案。本文深度解析两者的架构差异、训练范式与适用场景。 --- 一、为什么需要流式视频生成? 传统视频扩散模型(如 CogVid
2026年7月16日,月之暗面(Moonshot AI)发布了其最新旗舰模型 Kimi K3 的官方博客。这篇题为《Kimi K3: Open Frontier Intelligence》的文章,不仅披露了模型的技术细节,更展现了 Kimi 团队对 AI 发展方向的深度思考。 本文将从技术
2026年7月,中国大模型迎来"双雄对决": - 7月16日:月之暗面发布 Kimi K3,2.8万亿参数 - 7月19日:阿里通义发布 Qwen3.8-Max-Preview,2.4万亿参数 两个模型几乎同时发布,参数量都突破2万亿,都宣称对标 Claude F
Kimi Linear 论文深度解读:KDA 线性注意力架构的技术突破 > 论文信息:Kimi Linear: An Expressive, Efficient Attention Architecture > 作者:Kimi Team Moonshot AI >
全球AI算力格局深度解析:六大阵营与中美博弈 > 算力,是AI时代的石油。2026年,这场围绕算力的军备竞赛已进入白热化阶段。 --- 一、全球算力总览:万亿美元级的军备竞赛 2026年,全球AI算力市场呈现几个关键数据: | 指标 | 数值 | |------|------|
引言 2026年7月17日至20日,第八届世界人工智能大会(WAIC 2026)在上海盛大举行。本届大会以"智能伙伴,共创未来"为主题,由外交部、科技部、工信部等国家部委与上海市联合主办,展览面积首次突破10万平方米,吸引1100余家企业参展,3000余项展品
引言 通义万相(WanX)是阿里云通义大模型家族中的视觉生成核心成员,从 2023 年 7 月上线至今,经历了从静态图像生成到电影级视频生成的完整技术跃迁。它不仅是国内最早一批 AI 绘画模型,更在 2025 年通过开源策略成为全球最受欢迎的视频生成模型之一,累计下载量突破 500 万次。
引言 Boogu-Image-0.1 是 2026 年 7 月发布的开源统一多模态图像生成模型,在 Boogu Arena 上取得开源第一的成绩,仅次于 GPT-Image-2 和 Nano-Banana-Pro。其核心创新不是架构革命,而是一套完整的 Agentic Image Gen
Boogu-Image-0.1 论文完整翻译 > 原文:Boogu-Image-0.1: Boosting Open-Source Unified Multimodal Understanding and Generationhttps://arxiv.org/abs/2607.1312
Kimi K3 全面解析:全球首个开源三万亿模型的技术突破 2026年7月17日凌晨,月之暗面(Moonshot AI)正式发布了其迄今能力最强的模型——Kimi K3。这是全球首个达到三万亿参数级别的开源模型,标志着中国AI在大模型规模上再次刷新纪录。 核心参数一览 | 指