Centros de datos de IA y HPC
Soluciones tolerantes a fallos
Memoria integrada
A medida que los modelos de lenguaje extenso (LLM) y la IA generativa se vuelven más sofisticados, requieren una integración fluida y de alto rendimiento de computación, memoria y almacenamiento que las arquitecturas actuales tienen dificultades para ofrecer.

Las cargas de trabajo de inteligencia artificial (AI) avanzan a un ritmo fenomenal, lo que ejerce una presión sin precedentes sobre la infraestructura informática tradicional. El desafío central radica en las enormes huellas de memoria y la naturaleza intensiva de datos de la AI moderna. Las interconexiones tradicionales crean cuellos de botella en el rendimiento que limitan la eficiencia con la que los procesadores pueden acceder a las grandes cantidades de datos que necesitan.
Compute Express Link (CXL) ha surgido como una solución transformadora. Es una interconexión industrial abierta diseñada para cerrar estas brechas de rendimiento, permitiendo una utilización más eficiente de los recursos y allanando el camino para la próxima generación de sistemas de AI.
Las cargas de trabajo actuales de AI y aprendizaje automático presentan desafíos de infraestructura únicos que exponen las limitaciones de las arquitecturas heredadas y aisladas.
Estos problemas afectan directamente al rendimiento, la escalabilidad y los costes; los desafíos de infraestructura incluyen:
Las arquitecturas tradicionales basadas en PCIe no pueden resolver completamente estos problemas debido a su falta de coherencia de memoria y a su mayor latencia. CXL se desarrolló específicamente para abordar estas deficiencias.
CXL es un protocolo de interconexión de alta velocidad y coherencia de caché construido sobre la capa física PCIe. Aunque utiliza las mismas conexiones físicas, está diseñado específicamente para las exigencias de la computación heterogénea. Proporciona una interfaz unificada que permite a las CPU, GPU, aceleradores y dispositivos de memoria compartir memoria de manera eficiente y coherente.
Su funcionalidad principal se habilita a través de tres protocolos distintos:
Juntos, estos protocolos crean un marco potente y flexible para construir arquitecturas desagregadas, componibles y centradas en la memoria.
Al eliminar las barreras rígidas entre la computación, la memoria y los periféricos, CXL permite un enfoque más dinámico y potente para construir y gestionar sistemas destinados a cargas de trabajo de AI.
a menudo fallan debido a la memoria insuficiente en un nodo individual, pero CXL soluciona este problema permitiendo que la memoria se agrupe y se comparta entre dispositivos. Permite la creación de grandes grupos de memoria que pueden asignarse dinámicamente a diferentes procesadores o aceleradores según sea necesario. Además, permite que las CPU y las GPU compartan un grupo de memoria unificado sin necesidad de copias de datos redundantes. Este enfoque reduce la memoria desaprovechada y disminuye significativamente el costo total de propiedad (TCO) al mejorar la utilización de los recursos.
Los sistemas de AI se benefician de una combinación de DRAM de gran ancho de banda para el rendimiento y niveles de memoria más rentables para la capacidad. CXL hace que esta arquitectura sea fluida al utilizar DRAM rápida como nivel principal para operaciones críticas de rendimiento, mientras conecta expansores de memoria basados en CXL como un segundo nivel de mayor capacidad y menor costo. Esto facilita una migración de datos fluida entre niveles para equilibrar la velocidad, la capacidad y la eficiencia de costos.
CXL es una tecnología fundamental para los sistemas componibles, donde los recursos de computación, memoria y almacenamiento pueden desagregarse y aprovisionarse bajo demanda para adaptarse a una carga de trabajo específica. Esto le permite asignar de forma flexible la cantidad precisa de aceleración y memoria necesaria para una tarea determinada y escalar dinámicamente los recursos de memoria para clústeres de inferencia de AI sin tener que sobreaprovisionar hardware. El resultado es una CDI de centro de datos más ágil y receptiva que puede adaptarse a las demandas cambiantes de las aplicaciones.
La adopción de CXL proporciona ventajas tangibles para cualquiera que construya o implemente sistemas de AI.
En toda la industria tecnológica, los proveedores de servidores, los fabricantes de GPUs y aceleradores, y los principales proveedores de la nube están integrando CXL en sus hojas de ruta de productos. Mientras tanto, el CXL Consortium continúa avanzando en el estándar, con CXL 2.0 y 3.0 ampliando las capacidades para incluir conmutación de tejido, agrupación de memoria mejorada y coherencia global para soportar entornos informáticos aún más grandes y complejos.
En resumen, la AI requiere un cambio fundamental en la forma en que arquitectamos los sistemas informáticos. El modelo tradicional de recursos aislados ya no es suficiente. CXL proporciona la columna vertebral esencial para esta transformación, permitiendo las arquitecturas centradas en la memoria y componibles necesarias para la inteligencia artificial de próxima generación. Al cerrar las brechas críticas en la infraestructura actual, CXL está destinado a convertirse en una tecnología fundamental para el futuro de la computación.
SMART Modular Technologies ayuda a clientes de todo el mundo a implementar AI y High-Performance Computing (HPC) mediante el diseño, desarrollo y empaquetado avanzado de soluciones de memoria integrada. Nuestra cartera abarca desde las tecnologías de memoria de vanguardia como CXL hasta productos de almacenamiento Flash y DRAM estándar y heredados. Durante más de tres décadas, hemos proporcionado soluciones de memoria y almacenamiento estándar, RUGGED y personalizadas que satisfacen las necesidades de diversas aplicaciones en mercados de alto crecimiento. Contáctenos hoy para obtener más información.

En Penguin, nuestro equipo diseña, construye, implementa y administra soluciones empresariales de HPC e IA de alto rendimiento y alta disponibilidad, lo que permite a los clientes lograr sus innovaciones revolucionarias.
Comuníquese hoy mismo y analicemos las necesidades de su proyecto de solución de infraestructura.