AI 和 HPC 数据中心
容错解决方案
集成内存
政府、新云服务商、电信运营商和企业需要对数据、模型、基础设施和运营拥有更强的掌控力,从而安全、高效地部署和扩展主权 AI。
实现对数据、模型和 AI 输出的管辖权控制,对于满足合规性要求、支持数据驻留规则以及保护知识产权 (IP) 和敏感信息至关重要。
支持 AI 创新需要可扩展的高性能基础设施,同时必须保持安全性,并降低关键系统、共享数据和企业运营所面临的风险。
运营主权 AI 环境需要强大的治理能力和持续的优化,以确保随着工作负载和监管要求的演变,系统能够保持高性能、高可用性并有效降低风险。
凭借在数据中心 AI 基础设施与内存解决方案交叉领域的深厚设计专长,Penguin Solutions 助力各组织部署并运营全栈式主权 AI 工厂,以支持安全性、合规性、高性能及数字独立性。
主权 AI 部署需要集成的基础设施、软件和服务,以实现技术独立、自主可控和持续创新。Penguin Solutions OriginAI® 基础设施解决方案提供经过验证的 AI 工厂参考设计,适用于可扩展的全栈式 AI 训练和推理工作负载。
通过整合计算、内存、存储、网络、安全和智能集群管理软件,OriginAI 提供了生产就绪的基础,帮助各组织加速部署,同时支持合规性、高性能和长期增长。
设计并建立主权 AI 环境十分复杂。Penguin Solutions 通过专家主导的设计、构建、部署和管理服务降低了这种复杂性,从而加快实施速度,并减少因延误、返工或基础设施决策失误带来的风险。
Penguin Solutions 的专家团队已经部署并正在积极管理多个主权 AI 环境,其中包括 SK Telecom Haein 集群——韩国最大的主权 AI 集群之一。
主权 AI 环境一旦部署,必须保持高效、安全、可用且具备适应性。随着工作负载、治理要求和用户需求的发展,运营专长对于维持长期性能和合规性至关重要。
借助 ClusterWareAI™ AI 工厂平台操作系统软件 以及我们的 专家服务, Penguin Solutions 可管理日常运营并简化集群管理,同时在工作负载演进过程中提高资源可用性并维持高性能表现。


建立具备所需控制力、政策合规性和性能的 AI 主权环境,以支持国家倡议、研究和公共部门的运营。

将国家级网络、数据流和监管关系转化为 AI 主权服务,帮助政府和企业获取安全、区域内的 AI 能力。

构建基础设施即服务的 AI 主权环境,利用经过验证的架构、快速部署能力和运营专长,旨在支持安全的多租户 AI 工作负载。

在支持大规模部署企业 AI 计划的同时,保持对关键数据的控制,保护知识产权并降低第三方风险。
Penguin Solutions 与 SK Telecom 携手合作,设计、构建、部署并持续管理着 Haein,这是一个用于 GPU 即服务的国家级主权 AI 平台。Haein 位于 SK Broadband 的 Gasan AI 数据中心,集成了 1,032 个 NVIDIA B200 GPU、10 PB 高性能存储以及 50 英里网络连接,旨在支持韩国 AI 生态系统中严苛的 AI 工作负载,同时强化数据主权和国内运营控制。
该集群在 60 天内投入生产,启动时 100% 的节点均处于目标性能范围内,并且在运行一年后,根据内部性能数据,其硬件可用性保持在 99% 以上,SLA 合规率达到 100%。
在专业的国内运营团队支持下,Haein 提供了一个现实世界的范例,展示了如何快速部署主权 AI 基础设施,并实现大规模、可靠的持续运营成功。


OriginAI® 是一种AI工厂基础设施解决方案,它基于成熟的、预定义的AI架构构建,可扩展至数百个乃至超过16,000个GPU集群。OriginAI将这些经过验证的技术与Penguin智能、直观的集群管理软件和专业服务相结合。

简化 AI 集群的部署和管理,以快速实现高生产力。裸机硬件、网络和软件资源被转化为高性能集群环境,从而简化管理复杂性并优化资源可用性。

Penguin Solutions 设计并部署了大型 NVIDIA DGX 集群,配备高速 NVIDIA InfiniBand 网络和优化的存储。我们与大多数存储供应商建立了合作关系并拥有专业知识,使我们能够为每位客户提供定制化解决方案。
立即联系我们,了解 Penguin Solutions 如何帮助政府、云服务商、电信运营商和企业自信地构建并运营其主权 AI 基础设施。