CXL memory loading into server
解决方案 > Integrated Memory

面向 AI 基础设施的 Integrated Memory 解决方案

Penguin Solutions 提供基于 CXL 的内存扩展、DRAM 模块和闪存存储,适用于内存容量、带宽和延迟瓶颈可能限制 AI 性能的数据密集型环境。

联系我们
内存解决方案

赋能 AI 建模与
大规模推理

随着推理和代理式 AI 工作负载变得更加持久且上下文丰富,内存正日益成为主要的性能和可扩展性瓶颈之一。由于数据匮乏,即使是最快的图形处理器 (GPU) 也会变慢,在等待内存和存储跟上进度的同时,在处理 Token 之间处于闲置状态。

训练 AI 模型并进行大规模推理需要计算单元与内存之间传输海量数据。对于越来越多的 AI 部署而言,一旦容量、带宽或延迟无法满足需求,集群中每个处理器的闲置时间就会迅速累积。但瓶颈并非 GPU,而是为 GPU 提供数据的内存和存储。

Penguin Solutions 通过专为计算密集型环境构建的集成内存产品组合解决了这一挑战,其中包括:基于 Compute Express Link® (CXL) 的内存,可将容量扩展至远超传统服务器内存的限制;DRAM 模块,可提供活跃工作负载所需的高带宽、低延迟性能;以及闪存存储,为驱动每个模型的数据流水线提供可靠、大容量的基础。这些内存解决方案共同赋予组织灵活性,能够根据工作负载的形态扩展性能的各个维度。

有了 Penguin Solutions,基础设施将与您的 AI 雄心同步发展,而非成为其束缚。随着各组织将建模和推理推向新高度,Penguin Solutions 提供了内存和存储基础,助力您的 AI 计划从试点走向生产。

联系我们
Data center

基于 CXL 的内存

CXL® 内存解决方案为现代计算环境提供了灵活且可扩展的内存架构。通过利用 CXL 技术来扩展系统内存能力,企业能够支持更大的工作负载,提高资源效率,并充分利用动态基础设施设计。

基于 CXL 的解决方案特别适用于 AI 训练和推理、内存数据库以及需要访问大内存空间的高级分析工作负载。它们还解决了数据中心在可组合性和分布式系统资源分配方面不断演进的以内存为中心的策略需求。

对于大规模 AI 推理,CXL 内存可以将键值 (KV) 缓存从 GPU 内存卸载到专用的高容量设备中,从而缩短首字延迟 (TTFT),并使 GPU 从内存瓶颈中解放出来。Penguin Solutions 的 MemoryAI™ KV Cache Server 通过可在集群间访问的内存池,将这一架构投入到生产实践中。

探索基于 CXL 的内存
CXL products

DRAM 模块

DRAM 模块为企业级服务器和 High-Performance Computing (HPC) 系统中的活跃处理工作负载提供高速、低延迟的系统内存。DRAM 直接安装在服务器内存通道中,能够为执行计算密集型任务的中央处理器 (CPU) 和加速器提供快速的数据访问。

这些内存模块广泛应用于 AI 模型训练、虚拟化、科学计算以及事务型企业应用程序,在这些领域,持续的正常运行时间和响应能力对于工作负载的执行至关重要。

Penguin Solutions DRAM 专为应对最严苛的计算环境而设计,可提供生产级 AI 所需的可靠性和高性能。

探索 DRAM 模块
ZDIMM

闪存存储

闪存存储解决方案为企业和数据密集型计算环境提供大容量、非易失性的数据存储。通过采用固态硬盘 (SSD) 技术,它们支持快速的数据检索,并在广泛的应用场景中实现可靠的长期数据留存。

闪存存储常用于 AI 数据流水线、大规模分析、应用程序托管和企业数据库。这些存储解决方案使组织能够高效管理不断增长的数据量,同时在关键工作负载中保持强大的性能和可靠性。

Penguin Solutions 闪存存储在国防和航空航天领域的严苛、安全存储应用中已得到验证,它将同样出色的耐用性和可靠性带入您组织的大规模 AI 工作负载中。

探索闪存存储
M400 SSDs
Empty memory banks on motherboard
申请回电

与 Penguin Solutions 的专家交流

Penguin Solutions 通过专为规模化设计的内存和存储技术,为现代 AI、HPC 和企业环境提供动力。其核心是基于 CXL 的内存技术,该技术突破了容量限制,使处理高要求的 AI 工作负载成为可能。

立即沟通