文件列表:
中信证券经纪(香港):韩国科技行业:Deepseek新模型效率提升-260915.pdf |
下载文档 |
资源简介
>
中信证券财富管理与中信里昂研究观点一致。根据中信里昂研究在2026年9月13日发布的题为《Deepseeknewmodelefficiencygains》的报告,DeepSeek于9月10日发布的最新模型DeepSeek-V4.1-Flash,将基于HBM的KV缓存需求降低了75%(至890bytes/token),并将eSSD缓存需求降低了87.5%,这似乎对内存股构成了压力。需要注意的是,这一改进仅适用于KV缓存效率,并不代表GPU总内存或存储需求的削减。历史表明,对内存效率提升会降低内存需求的担忧是没有根据的。AI模型一直在持续提高效率,DeepSeek从V1到V4将每token内存效率提升了约110x。然而,随着更低成本推动更广泛使用,内存需求仍在持续增长。随着token量激增(8月token需求翻倍),模型效率的提升以及内存/计算性能的进步预计将继续推动整体内存需求。中信里昂维持对内存股的正面看法。
75%的降幅具体适用于推理期间的KV缓存,而不适用于模型权重、训练内存或更广泛的HBM占用。如果推理变得更便宜,开发者就会运行更多智能体、更长上下文以及更多推理工作负载。处理的t
加载中...
已阅读到文档的结尾了


