站内关键词搜索入口

1月7日全球存储概念股集体暴涨,啥情况?英伟达新存储平台了解下

今日,全球存储概念股集体暴涨,这一涨势从美股蔓延至A股 。其中,美股方面,闪迪大涨了27% ,西部数据涨超了16% ,美光涨了10% 。而在A股 ,恒坤新材实现了20CM涨停 ,安集科技大幅走强 ,长川科技大幅走强 ,普冉股份大幅走强 ,聚辰股份也大幅走强 。《科创板日报》于1月7日对此进行了报道 。

在这背后,黄仁勋于CES发布了演讲,还推出了新品,这再次推高了本就火热的存储行情。

他宣称,存储,“当下依旧十足是一个全然并未被开拓的市场”。AI予以驱动的存储需要已比现有基本设施的容量超出。“我们现今所处理的上下文内存、token内存,以及KV缓存的数目均太过庞大,往昔的存储系统根本就难以满足需要。”。

AI正重塑整个计算栈,现在,这其中也涵盖存储。AI已不是一次性问答的聊天机器人,而是能理解物理世界,能进行长周期推理,还能保持事实一致性,会调用工具做完真实工作的智能协作者呐,且具备短期与长期记忆能力。

之后呢,他宣告英伟达将会推出来自 -4 驱动之下的新一代这类 AI 原生样子的储存基础设施结构,去重新构建面向着下一阶段的 AI 的存储架构模样,并且运用“革命性”这样的一个词汇来描述这一项创新情况 。

▌新存储平台是什么?

全称为英伟达推理情境内存存储平台的,是英伟达的存储新平台 。

1月7日全球存储概念股集体暴涨,啥情况?英伟达新存储平台了解下(图1)

依据官方所做的介绍,这个平台借助扩展GPU能够使用的内存容量之方式,为上下文被记忆的情况提供基础设施方面的支持,达成跨节点的高速共享 。

从架构角度来讲,这个平台事实上是针对AI推理特意构建了一层具备高速特性、有着低能耗表现的“上下文记忆”存储层面,把原本仅仅能够放置在昂贵且数量有限的GPU HBM的KV cache(即KV缓存),拓展至NVMe闪存以及跨机群共享这儿。

与传统存储方案相较,能够把每秒能够处理的token数量提高,最高可提升至五倍,并且达成最高五倍的能效优化效果 。

▌有何突出?

首次把AI推理KV缓存当作独立基础设施层来进行设计的,是本次英伟达的新平台。

在此之前,通常KV缓存存在着三个可供选择的路径,其一为GPU的HBM,其特点是速度快,然而价格昂贵且容量非常小;其二是CPU内存,其速度稍慢且规模受到限制;其三是SSD/存储,其优势是价格便宜,不过延迟情况无法控制。

黄仁勋在CES的演讲中,用“革命性的”来形容这一项创新。

1月7日全球存储概念股集体暴涨,啥情况?英伟达新存储平台了解下(图2)

他表明,这从本质上来说,是在内置有极度快速的KV缓存上下文存储系统的机架当中直接添入。整个行业这般兴奋不已的缘故在于,针对当今所有开展大规模Token生成的机构企业来讲,KV缓存都是一个让人苦恼的难题。故而,我们要打造一个全新的平台,一个全新的处理器去运行整个KV缓存上下文内存管理系统,并且把它安置在距离机架其余部分极为接近的地方,这个构思是具备十足革命性的。

▌AI推理瓶颈转向上下文存储

在对新平台所作的介绍当中,“KV缓存”这个词汇频繁地出现,从一定层面来讲,这也是推动英伟达去开发新平台的关键缘由之一。

黄仁勋在最新的那一场CES演讲里着重表明,AI推理方面的瓶颈正从计算这一范畴朝着上下文存储转变,随着模型规模有所提高以及用户使用量出现增长,当AI处理那些需要多轮对话、多步推理的复杂任务之际,就会产生数量庞大的上下文数据,然而传统网络存储针对短期上下文来讲效能过低,这般一来AI存储架构就需要进行重新构建 。

普通存在形式为KV缓存的这种海量上下文数据,对推理准确性很关键,对用户体验很关键,对交互连续性也很关键,而交互连续性也就是备受追捧的“个性化AI”所具备的能力 。

“推理时代”情形里,KV缓存显存所占用量,会跟着Token数量呈线性方式增长,并且,KV Cache的优化成果,同样和文本长度呈现正相关关系。

(科创板日报 郑远方)

分享更多
8

您可能还会对下面的文章感兴趣: