D-Matrix integra XPUs Raptor en infraestructura NVIDIA

⏱ Tiempo de lectura: 4 min
D-Matrix anunció el 10 de septiembre de 2026 una colaboración multianual con NVIDIA para integrar sus procesadores de inferencia Raptor XPU de próxima generación en la arquitectura MGX de NVIDIA mediante NVLink Fusion. La disponibilidad inicial en racks integrados está prevista para el cuarto trimestre de 2027. El acuerdo permite a D-Matrix acceder al ecosistema de fábricas de IA de NVIDIA, posicionando sus aceleradores personalizados junto a la infraestructura de GPU de la empresa.
Integración de XPUs en arquitectura líquida de NVIDIA
D-Matrix trabajará con NVIDIA para incorporar los XPUs Raptor directamente en el diseño de referencia más reciente de NVIDIA, que incluye CPUs Vera, switches NVLink, DPUs BlueField-4, adaptadores ConnectX-9 SuperNIC y redes Ethernet Spectrum-X. El rack utiliza bandejas modulares sin cables construidas con el ecosistema MGX de NVIDIA. Esta arquitectura de refrigeración líquida permite a D-Matrix reducir tiempo y riesgo al escalar su silicio de inferencia a despliegues masivos. Sid Sheth, cofundador y CEO de D-Matrix, describió la colaboración como un momento definitorio para la compañía. Accede a nuestra sección de Hardware para explorar más avances en aceleradores especializados.
Especificaciones técnicas y socios del ecosistema
NVLink Fusion proporciona una latencia 3 veces inferior a Ethernet estándar, tasas de paquetes 10 veces superiores y un ancho de banda de 3 TB/s por XPU mediante NVLink de sexta generación. El sistema soporta dominios de escala de 72 XPUs con baja latencia. D-Matrix se asocia con Astera Labs para conectividad personalizada de alto rendimiento. Los XPUs Raptor, sucesores de la plataforma Corsair, emplean un enfoque único de apilamiento 3D DRAM que combina un chip de memoria DRAM con un chip de computación SRAM en un paquete de dos niveles. El XPU está diseñado para aplicaciones sensibles a latencia como asistentes de codificación de IA, chatbots en tiempo real y agentes de voz. Fuente: www.unite.ai
Desagregación heterogénea de cargas de trabajo
Los racks D-Matrix operarán junto a sistemas NVIDIA basados en GPU, incluyendo Vera Rubin NVL72, en despliegues de inferencia desagregada. Esta arquitectura permite a operadores dividir cargas de trabajo entre XPUs Raptor y GPUs Vera para optimizar cada fase de inferencia. En aplicaciones populares como codificación de IA, la fase de prefill computacionalmente intensiva ejecuta en GPUs mientras que la fase de decodificación sensible a latencia corre en XPUs. Los racks están diseñados para servicios premium de tokens con latencia ultra baja. El soporte incluye software como NCCL para cargas distribuidas, Dynamo y NIXL para desagregación, y Mission Control para gestión de clusters.
Qué cambia con esta información
La integración de D-Matrix en el ecosistema NVLink Fusion amplía las opciones de aceleración personalizadas dentro de la infraestructura de NVIDIA, permitiendo a laboratorios de IA e hipernubes optimizar costos y latencia en cargas de inferencia específicas. Raptor llegará con más de 100 patentes respaldando su arquitectura de memoria.
| Dato | Detalle |
|---|---|
| Producto | Raptor XPU (próxima generación de D-Matrix) |
| Arquitectura | Apilamiento 3D DRAM: chip de memoria DRAM + chip de computación SRAM |
| Integración | NVLink Fusion en racks MGX de NVIDIA con refrigeración líquida |
| Latencia | 3x inferior a Ethernet; 10x tasas de paquetes superiores |
| Ancho de banda | 3 TB/s por XPU vía NVLink sexta generación |
| Escala | Dominios de 72 XPUs en baja latencia |
| Socios | Astera Labs (conectividad), NVIDIA (arquitectura rack) |
| Casos de uso | Asistentes de codificación IA, chatbots tiempo real, agentes de voz |
| Estado de Raptor | Tape-out previsto antes de fin de 2026 |
| Disponibilidad | Q4 2027 en racks MGX integrados |
| Patentes | Más de 100 patentes respaldando la plataforma |
Preguntas frecuentes sobre D-Matrix y NVLink Fusion
¿Qué es NVLink Fusion y cómo beneficia a D-Matrix?
NVLink Fusion es la plataforma de NVIDIA para integrar XPUs y CPUs personalizados con redes NVLink, arquitectura rack MGX y la plataforma completa de fábrica de IA. Permite a socios como D-Matrix conectar silicio personalizado con infraestructura NVIDIA sin diseñar toda la arquitectura de sistema.
¿Cuándo estarán disponibles los XPUs Raptor?
La disponibilidad inicial en racks integrados está prevista para el cuarto trimestre de 2027. D-Matrix espera que Raptor se complete (tape-out) antes del cierre de 2026 y está siendo evaluado activamente por hipernubes y laboratorios fronterizos.
¿Qué ventajas ofrece la desagregación heterogénea de cargas?
Permite dividir fases de inferencia: GPUs Vera manejan prefill computacionalmente intenso, mientras XPUs Raptor optimizan decodificación sensible a latencia. Esto reduce costos por token y latencia en aplicaciones como IA coding y chatbots en tiempo real.
Qué falta por confirmar
No se especifica en el texto fuente recibido: benchmarks públicos de rendimiento vs. alternativas, precios de despliegue, casos de cliente confirmados previos a Q4 2027, o detalles de consumo energético del apilamiento 3D DRAM en producción.
En Inteligencia Artificial esta colaboración señala una estrategia clara de NVIDIA de convertirse en ecosistema de interconexión para silicio especializado, reduciendo barreras de integración para startups de aceleradores. ¿Veremos que D-Matrix captura una porción significativa de inferencia desagregada en 2028?

Deja una respuesta
Lo siento, debes estar conectado para publicar un comentario.