Anthropic ha restringido que los chips AI de Huawei utilicen Claude Opus 5.5 para desarrollar modelos de vanguardia

📅 2026-09-24

Resumen:

Además de mejorar las capacidades del modelo, también se descubrió que el último Claude Opus 5.5 de Anthropic agregó un mecanismo de restricción especial para escenarios de desarrollo de modelos de lenguajes grandes y de vanguardia. Cuando los usuarios usan Opus 5.5 para desarrollar el kernel subyacente para una nueva generación de modelos de IA, es posible que el sistema no use directamente el último Opus 5.5, sino que recurra automáticamente al Opus 5 con capacidades inferiores. Lo que es más notable es que actualmente se descubre que este conjunto de restricciones parece apuntar a algunos aceleradores de inteligencia artificial de Huawei y Amazon.

Anthropic explicó en el documento de soporte de Opus 5.5 que el modelo tiene un clasificador dedicado para el "desarrollo LLM de vanguardia" y cubre una gama limitada de tareas, como el desarrollo del kernel para algunos aceleradores de aprendizaje automático. El propósito de este tipo de clasificador es determinar si la solicitud actual del usuario implica el desarrollo del modelo de lenguaje grande de vanguardia en sí. Una vez que se activen las condiciones relevantes, Claude retrocederá automáticamente del Opus 5.5 al Opus 5.

El llamado núcleo de IA se refiere a una serie de operaciones informáticas en el nivel más bajo cuando se ejecuta un modelo de inteligencia artificial. El núcleo es responsable de decidir cómo el modelo utiliza los recursos informáticos y la memoria del chip y cómo realizar diversas operaciones matemáticas. Debido a que estas operaciones determinan directamente cómo se asignan los cálculos matemáticos al procesador real, el diseño del núcleo afecta directamente la velocidad de ejecución, el uso de la memoria, la precisión y el costo de inferencia de los modelos de lenguaje grandes. Para entrenar y ejecutar los modelos de IA más avanzados, la optimización del kernel para aceleradores de IA específicos suele ser un paso crítico.

Esta limitación fue descubierta por primera vez por los usuarios en la documentación de soporte después del lanzamiento oficial de Opus 5.5. Anthropic ha utilizado previamente clasificadores en algunos modelos para identificar solicitudes potencialmente riesgosas, y esta vez ha aplicado mecanismos similares al desarrollo de modelos de IA de vanguardia.

Anthropic dejó claro que estas restricciones no afectarán a la gran mayoría de las tareas tradicionales de inteligencia artificial, investigación de aprendizaje automático y programación ordinaria. Solo cuando está involucrada una pequeña cantidad de capacidades de desarrollo de LLM de vanguardia, el sistema puede activar el mecanismo de reversión. Por lo tanto, para los desarrolladores comunes, el uso de Opus 5.5 en la programación diaria, el desarrollo de aplicaciones de inteligencia artificial y la investigación de aprendizaje automático básicamente no se verá afectado.

Pero después de más pruebas, algunos usuarios descubrieron que Opus 5.5 parece reconocer específicamente algunos chips de IA. Según los resultados de las pruebas públicas actuales, este conjunto de clasificadores involucra al menos el Ascend 950DT de Huawei y el chip de IA Trainium3 de desarrollo propio de Amazon. Dicho esto, si los desarrolladores usan Opus 5.5 para desarrollar núcleos subyacentes para modelos de lenguajes grandes y de vanguardia para estos chips, los modelos pueden cambiar automáticamente a Opus 5.

No es de extrañar que los chips de Huawei estén incluidos en esta restricción. En los últimos años, Anthropic ha aumentado su guardia contra la capacidad de las entidades chinas de obtener sus modelos y considera que la destilación de modelos es una cuestión importante de seguridad nacional y de seguridad. La llamada destilación de modelos se refiere a llamar a un modelo más capaz en grandes cantidades, extraer sus características de comportamiento y capacidad y luego usar estos datos para entrenar otro modelo. El reciente informe de inteligencia de amenazas de Anthropic reveló que la compañía descubrió que varias organizaciones relacionadas con China llevaron a cabo actividades de destilación no autorizadas contra los modelos de la serie Opus de Claude y, por lo tanto, fortalecieron aún más los mecanismos de protección del proceso de inferencia, interceptación de solicitudes y identificación de cuentas.

Anthropic también ha agregado medidas anti-destilación más estrictas en Opus 5.5, incluida la restricción de que los usuarios de API modifiquen el contexto de conversación anterior del modelo para evitar extraer la información de razonamiento interno del modelo manipulando repetidamente el contexto. La compañía afirmó que tales medidas están dirigidas principalmente a actividades de extracción de capacidad industrial a gran escala, más que al uso normal por parte de usuarios comunes.

Por lo tanto, cuando Opus 5.5 detecta solicitudes de desarrollo de modelos de vanguardia que involucran el acelerador de inteligencia artificial de Huawei, el mecanismo de restricción puede tener antecedentes técnicos y geográficos obvios. Sin embargo, actualmente no hay pruebas suficientes para demostrar si Anthropic diseñó este conjunto de reglas específicamente para Huawei o si incluye tipos específicos de aceleradores de IA en su conjunto dentro del alcance de las restricciones.

Lo realmente sorprendente es que Amazon Trainium 3 también parece verse afectado de la misma manera.

Amazon no es sólo una gran empresa global de computación en la nube, sino también un importante socio e inversor de Anthropic. El modelo Claude de Anthropic se proporciona a clientes empresariales a través de Amazon Web Services, mientras que la serie Trainium es un chip de inferencia y entrenamiento de IA desarrollado independientemente por Amazon para reducir la dependencia de la computación de inteligencia artificial en la nube de las GPU de Nvidia. Por lo tanto, si Opus 5.5 restringe Trainium3 para el desarrollo de un modelo de kernel de vanguardia, Amazon podría verse afectado por el mismo conjunto de restricciones técnicas que Huawei.

No está claro si esta situación fue intencionada por Anthropic o si el clasificador cometió un error de cálculo inesperado al identificar un chip de IA específico. Las pruebas relevantes muestran que Opus 5.5 parece ser capaz de identificar diferentes plataformas de hardware y decidir si permite el último modelo según el contenido de la solicitud, pero Anthropic no explicó públicamente por qué Trainium3 activaría restricciones al mismo tiempo que Huawei 950DT.

Esta situación es particularmente notable porque Anthropic ha enfatizado anteriormente que sus modelos se pueden proporcionar ampliamente a través de plataformas en la nube como AWS, y Opus 5.5 ha aterrizado oficialmente en plataformas como Amazon Web Services, Google Cloud y Microsoft Azure. Si esta limitación se extiende a más aceleradores de IA para entrenar modelos avanzados en el futuro, entonces las asociaciones entre empresas de computación en la nube y empresas de modelos de IA pueden requerir una coordinación más compleja entre las capacidades del modelo, el soporte de hardware y las limitaciones de seguridad.

Desde una perspectiva técnica, el enfoque de Anthropic esta vez también refleja una nueva tendencia: a medida que el modelo de IA en sí comienza a ayudar a los humanos a diseñar y optimizar la próxima generación de modelos de IA, los fabricantes de modelos deben comenzar a distinguir entre los dos tipos de tareas: "usar IA para desarrollar aplicaciones" y "usar IA para desarrollar una IA más fuerte".

Para los programadores comunes, permitir que Opus 5.5 ayude a escribir aplicaciones, depurar código o realizar experimentos de aprendizaje automático generalmente no genera restricciones especiales. Pero si se utiliza el mismo modelo para desarrollar el núcleo informático subyacente de la próxima generación de modelos de lenguajes grandes de vanguardia, Anthropic puede considerar que esto ha entrado en otro nivel de riesgo y hacer que la solicitud vuelva automáticamente al modelo anterior.

Esto significa que el modelo de IA en sí se está convirtiendo gradualmente en parte de la infraestructura de I+D de IA. En el pasado, restringir el uso de modelos significaba principalmente restringir ciertos contenidos peligrosos o áreas sensibles; Ahora, los fabricantes de modelos están empezando a considerar más a fondo cuestiones como "quién puede utilizar los últimos modelos para fabricar modelos de próxima generación" y "si los últimos modelos deberían ayudar a los competidores a optimizar su propia infraestructura informática de IA".

Actualmente, Anthropic no ha declarado públicamente por qué Trainium3 activa restricciones al mismo tiempo que Huawei 950DT, ni ha dejado claro si este mecanismo seguirá existiendo en futuras versiones. A medida que más y más empresas comiencen a desarrollar sus propios aceleradores de IA, es probable que esta limitación en hardware específico y tareas de desarrollo de modelos de vanguardia se convierta en un nuevo problema que los fabricantes de modelos de IA deben enfrentar al hacer concesiones entre seguridad, prevención de la destilación de capacidades y ecología del hardware.

Etiquetas relacionadas

Artículos relacionados

Comentarios

0/500
Captcha (click to refresh)
Sin comentarios