全部标签

#OpenAI

5 篇文章

·技术
1 分钟0

全双工语音模型精读⑦:OpenAI gpt-realtime 与 GPT-Live——从端到端 S2S API 到全双工前台/后台委派

> 全双工语音模型系列精读第 7 篇。本文基于 OpenAI 官方博客与官方帮助文档,梳理 OpenAI 语音线两代产品:gpt-realtime(2025-08-28 GA)与 GPT-Live(2026-07-08)。配套总览见《全双工语音大模型全景调研》。 一、OpenAI 语音线的两

·技术
1 分钟0

大模型缓存命中机制深度解析:不只是前缀匹配,三层缓存体系让Token成本断崖式下降

引言 如果你看过自己团队的大模型 Token 消耗看板,多半会注意到一个现象:主力模型的缓存命中率常年挂在 90% 上下,而且越是高频使用、跑得越久的模型,命中率越稳。 这不是某一家的"黑科技"。从 OpenAI、Anthropic 到 DeepSeek、Google,所有主流大模型 AP

·AI, 大模型, 行业动态
1 分钟0

2026年8月大模型行业全景扫描:模型密集发布、Agent安全升级与开放权重扩张

2026年8月大模型行业全景扫描:模型密集发布、Agent安全升级与开放权重扩张 引言 2026年8月初,大模型行业迎来密集发布期。Anthropic、Google、字节、MiniMax、DeepSeek 等头部厂商接连发布新模型,能力竞争向专业任务、具身智能与全模态生成延伸。与此同时

·AI, 技术架构
1 分钟0

大模型 API 缓存机制深度解析:Prompt Caching 的技术原理与安全隔离

大模型 API 缓存机制深度解析:Prompt Caching 的技术原理与安全隔离 引言 2026 年,大模型 API 的定价策略中出现了一个有趣的现象:缓存命中的输入 token 价格仅为正常价格的 10%。这意味着,如果你的请求命中了缓存,成本可以降低 90%。 这个机