D-Matrix integra XPUs Raptor en infraestructura NVIDIA

D-Matrix integra XPUs Raptor en infraestructura NVIDIA

⏱ Tiempo de lectura: 4 min

D-Matrix anunció el 10 de septiembre de 2026 una colaboración multianual con NVIDIA para integrar sus procesadores de inferencia Raptor XPU de próxima generación en la arquitectura MGX de NVIDIA mediante NVLink Fusion. La disponibilidad inicial en racks integrados está prevista para el cuarto trimestre de 2027. El acuerdo permite a D-Matrix acceder al ecosistema de fábricas de IA de NVIDIA, posicionando sus aceleradores personalizados junto a la infraestructura de GPU de la empresa.

Integración de XPUs en arquitectura líquida de NVIDIA

D-Matrix trabajará con NVIDIA para incorporar los XPUs Raptor directamente en el diseño de referencia más reciente de NVIDIA, que incluye CPUs Vera, switches NVLink, DPUs BlueField-4, adaptadores ConnectX-9 SuperNIC y redes Ethernet Spectrum-X. El rack utiliza bandejas modulares sin cables construidas con el ecosistema MGX de NVIDIA. Esta arquitectura de refrigeración líquida permite a D-Matrix reducir tiempo y riesgo al escalar su silicio de inferencia a despliegues masivos. Sid Sheth, cofundador y CEO de D-Matrix, describió la colaboración como un momento definitorio para la compañía. Accede a nuestra sección de Hardware para explorar más avances en aceleradores especializados.

Especificaciones técnicas y socios del ecosistema

NVLink Fusion proporciona una latencia 3 veces inferior a Ethernet estándar, tasas de paquetes 10 veces superiores y un ancho de banda de 3 TB/s por XPU mediante NVLink de sexta generación. El sistema soporta dominios de escala de 72 XPUs con baja latencia. D-Matrix se asocia con Astera Labs para conectividad personalizada de alto rendimiento. Los XPUs Raptor, sucesores de la plataforma Corsair, emplean un enfoque único de apilamiento 3D DRAM que combina un chip de memoria DRAM con un chip de computación SRAM en un paquete de dos niveles. El XPU está diseñado para aplicaciones sensibles a latencia como asistentes de codificación de IA, chatbots en tiempo real y agentes de voz. Fuente: www.unite.ai

Desagregación heterogénea de cargas de trabajo

Los racks D-Matrix operarán junto a sistemas NVIDIA basados en GPU, incluyendo Vera Rubin NVL72, en despliegues de inferencia desagregada. Esta arquitectura permite a operadores dividir cargas de trabajo entre XPUs Raptor y GPUs Vera para optimizar cada fase de inferencia. En aplicaciones populares como codificación de IA, la fase de prefill computacionalmente intensiva ejecuta en GPUs mientras que la fase de decodificación sensible a latencia corre en XPUs. Los racks están diseñados para servicios premium de tokens con latencia ultra baja. El soporte incluye software como NCCL para cargas distribuidas, Dynamo y NIXL para desagregación, y Mission Control para gestión de clusters.

Qué cambia con esta información

La integración de D-Matrix en el ecosistema NVLink Fusion amplía las opciones de aceleración personalizadas dentro de la infraestructura de NVIDIA, permitiendo a laboratorios de IA e hipernubes optimizar costos y latencia en cargas de inferencia específicas. Raptor llegará con más de 100 patentes respaldando su arquitectura de memoria.

Dato Detalle
Producto Raptor XPU (próxima generación de D-Matrix)
Arquitectura Apilamiento 3D DRAM: chip de memoria DRAM + chip de computación SRAM
Integración NVLink Fusion en racks MGX de NVIDIA con refrigeración líquida
Latencia 3x inferior a Ethernet; 10x tasas de paquetes superiores
Ancho de banda 3 TB/s por XPU vía NVLink sexta generación
Escala Dominios de 72 XPUs en baja latencia
Socios Astera Labs (conectividad), NVIDIA (arquitectura rack)
Casos de uso Asistentes de codificación IA, chatbots tiempo real, agentes de voz
Estado de Raptor Tape-out previsto antes de fin de 2026
Disponibilidad Q4 2027 en racks MGX integrados
Patentes Más de 100 patentes respaldando la plataforma

Preguntas frecuentes sobre D-Matrix y NVLink Fusion

¿Qué es NVLink Fusion y cómo beneficia a D-Matrix?

NVLink Fusion es la plataforma de NVIDIA para integrar XPUs y CPUs personalizados con redes NVLink, arquitectura rack MGX y la plataforma completa de fábrica de IA. Permite a socios como D-Matrix conectar silicio personalizado con infraestructura NVIDIA sin diseñar toda la arquitectura de sistema.

¿Cuándo estarán disponibles los XPUs Raptor?

La disponibilidad inicial en racks integrados está prevista para el cuarto trimestre de 2027. D-Matrix espera que Raptor se complete (tape-out) antes del cierre de 2026 y está siendo evaluado activamente por hipernubes y laboratorios fronterizos.

¿Qué ventajas ofrece la desagregación heterogénea de cargas?

Permite dividir fases de inferencia: GPUs Vera manejan prefill computacionalmente intenso, mientras XPUs Raptor optimizan decodificación sensible a latencia. Esto reduce costos por token y latencia en aplicaciones como IA coding y chatbots en tiempo real.

Qué falta por confirmar

No se especifica en el texto fuente recibido: benchmarks públicos de rendimiento vs. alternativas, precios de despliegue, casos de cliente confirmados previos a Q4 2027, o detalles de consumo energético del apilamiento 3D DRAM en producción.

En Inteligencia Artificial esta colaboración señala una estrategia clara de NVIDIA de convertirse en ecosistema de interconexión para silicio especializado, reduciendo barreras de integración para startups de aceleradores. ¿Veremos que D-Matrix captura una porción significativa de inferencia desagregada en 2028?

Deja una respuesta

Subir