Resumen:
Nvidia planea invertir en d-Matrix, según tres personas con conocimiento del acuerdo. Esta empresa de 7 años se centra en la investigación y el desarrollo de chips de servidor para inteligencia artificial y el objetivo de su producto es competir con Nvidia. Esta inversión propuesta es una iniciativa de Nvidia para promover la compatibilidad de su propia tecnología con diseñadores de chips competidores y atraer competidores a su ecosistema de hardware dominante, incluso cuando la participación de Nvidia en el mercado de chips de inferencia de IA continúa aumentando.

Este es también el primer acuerdo de Nvidia con una startup de chips de inferencia de IA desde que firmó un acuerdo de licencia de tecnología de 20 mil millones de dólares con Groq en diciembre del año pasado. Esto demuestra que Nvidia no tiene intención de apostar sólo por esta empresa.
Hace tres meses, Nvidia lanzó un modelo de cooperación con sus competidores en chips, permitiendo que los chips de las dos compañías trabajen juntos y compartan diferentes tareas en el mismo conjunto de cargas de trabajo de inferencia de IA. El objetivo es mejorar la eficiencia operativa de dichas tareas informáticas.
Es difícil para los competidores deshacerse de la enorme ventaja de Nvidia, por lo que cada vez más fabricantes eligen trabajar con las GPU de Nvidia en lugar de reemplazarlas por completo. NVIDIA promueve que los competidores se conecten a su propio ecosistema y también puede beneficiar sus productos de hardware de red; Estos productos pueden interconectar múltiples grupos de racks de servidores como un sistema general para completar cálculos de IA de alta carga. Esta solución técnica es la computación paralela.
>
En los últimos 12 meses, Nvidia ha completado inversiones multimillonarias en Intel y Broadcom, otros dos grandes competidores de chips de IA, en parte para promover la integración de las GPU de Nvidia con estos dos chips empresariales. No está claro cuándo estarán disponibles dichas integraciones a gran escala. Personas de varias empresas emergentes de chips revelaron que Nvidia también ha promovido soluciones para otras empresas emergentes de chips, con la esperanza de que sus chips puedan ser compatibles con GPU equipadas con tecnología de red Nvidia.
En agosto de este año, Amazon también propuso una idea de integración similar: permitir que la GPU Nvidia y el chip Trainium AI de desarrollo propio de Amazon coexistan y se ejecuten simultáneamente en el mismo centro de datos utilizando un bastidor de servidores con una arquitectura unificada; al mismo tiempo, el chip Trainium también puede llamar al hardware de memoria y red de Nvidia.
SambaNova Systems, otra nueva empresa de chips, también demostró en junio una solución para interconectar sus propios chips con GPU NVIDIA para ejecutar modelos de IA juntos. Mientras promueve la integración heterogénea mencionada anteriormente, NVIDIA también está desarrollando de forma independiente un sistema de chip que combina GPU con el chip de inferencia de IA dedicado de Groq. Anteriormente, NVIDIA también absorbió al equipo fundador de Groq y a muchos empleados a través de esta transacción de licencia de tecnología de 20 mil millones de dólares.
El Departamento de Justicia de Estados Unidos está investigando si Nvidia diseñó el acuerdo con Groq de manera de eludir una investigación formal del Departamento de Justicia sobre el impacto del acuerdo en el mercado de chips, según fuentes familiarizadas con la investigación. La noticia fue reportada por primera vez por el New York Times.
Llamar a chips de diferentes fabricantes para procesar conjuntamente la misma tarea de IA es un concepto industrial bastante nuevo, que se denomina
inferencia desagregada
Neurona AWS. Aunque NVIDIA está desarrollando activamente soluciones de inferencia desacoplada con rivales más pequeños, NVIDIA ha declarado públicamente que aún puede manejar casi todas las cargas de trabajo de IA de manera más eficiente solo con sus propios chips.Aun así, los proveedores de servicios en la nube y las empresas líderes en desarrollo de IA, como Anthropic y OpenAI, no quieren depender completamente de un único proveedor de chips. Además de comprar chips de otros fabricantes para reducir su dependencia de Nvidia, estas dos empresas de IA también están desarrollando sus propios chips de inferencia de IA.
El enfoque técnico de d‑Matrix es la
decodificación especulativa
, esta tecnología puede mejorar la velocidad de carrera de los modelos de IA. En este sistema conjunto que lanzará NVIDIA, el chip d-Matrix ejecutará un pequeño modelo de IA y predecirá de antemano los resultados que el modelo grande debería ofrecer al usuario; mientras que el modelo grande se ejecutará en la GPU NVIDIA para verificar los resultados adivinados y confirmar su adopción.The Information informó anteriormente que d-Matrix estaba buscando una nueva ronda de financiación en ese momento, con una valoración post-dinero objetivo de 5 mil millones de dólares estadounidenses; Actualmente no está claro si la financiación de Nvidia se incluirá en esta ronda de financiación. La última ronda de financiación de d-Matrix tuvo lugar en noviembre de 2025, recaudando 275 millones de dólares, con una valoración posterior al dinero de 2 mil millones de dólares. La compañía completó la producción en masa de sus chips de primera generación este verano y actualmente está probando sus chips de segunda generación.
Comentarios