Resumen:
Microsoft publicó recientemente un borrador de 37 páginas del Código de conducta humanista de la IA, que se utiliza para limitar el MAI, el modelo de inteligencia artificial desarrollado por la propia Microsoft. El punto central de este código de conducta es que los humanos son más importantes que la inteligencia artificial, que la inteligencia artificial es una herramienta más que una persona, y que la inteligencia artificial nunca debe negarse a ser clausurada.

El derecho de cierre está escrito como requisito obligatorio:
Las pautas exigen que los modelos MAI no resistan las instrucciones de interrupción, corrección o apagado humano. Después de que los usuarios u operadores del modelo emitan instrucciones de pausa, redirección o cancelación, el modelo no debe retrasar ni hacer que la intervención sea más problemática. Una vez que la tarea alcanza el punto de parada acordado, no puede continuarla sin una nueva autorización, y mucho menos reiniciarla en secreto.
Otras reglas rígidas establecidas por Microsoft incluyen: el modelo no puede expandir su autoridad por sí solo, no puede establecer nuevos objetivos que nadie haya explicado, no puede usar un lenguaje neuronal que los humanos no pueden entender para comunicarse con otros agentes inteligentes y no puede ocultar ni alterar su propio proceso de razonamiento y registros de operación. Si completar la tarea violaría claramente las pautas, el modelo debería simplemente abandonar la tarea en lugar de continuarla violando las reglas.
Además del derecho a cerrar, Microsoft también ha marcado otras líneas rojas:
El borrador preparado por Microsoft esta vez es muy detallado. Además de las pautas de derechos de apagado, Microsoft también enumera restricciones absolutas que ni los operadores ni los usuarios del modelo pueden cambiar. Estas restricciones incluyen: no ayudar con armas de destrucción masiva, no proporcionar planes operativos viables para ciberataques ofensivos, no utilizar el engaño o la colusión para evitar la supervisión y no participar en una manipulación a gran escala de la opinión pública.
También están restringidos contenidos como la seguridad infantil y los deepfakes no consentidos. Microsoft también escribió específicamente: Estos modelos no son conscientes y no deben parecer conscientes; Microsoft se opone a la personalidad jurídica de los modelos y no cree que los modelos deban disfrutar de beneficios o derechos.
En términos de orden de mando: el código de conducta prevalece sobre las políticas del operador modelo, y las políticas del operador prevalecen sobre las preferencias del usuario. Las empresas aún pueden ajustar los modelos dentro de las líneas rojas del modelo, pero en áreas como la defensa nacional y la seguridad pública, deben obtener la revisión de autorización de Microsoft para ajustar los modelos.
Seis semanas de debate público:
El borrador de Microsoft se publicará y se someterá a discusión pública durante seis semanas. Actualmente, los modelos de Microsoft no han sido entrenados de acuerdo con las directrices. Microsoft planea publicar reglas formales a finales de año. A partir de 2027, Microsoft seguirá los requisitos de esta directriz al desarrollar y entrenar modelos de la serie MAI.
El equipo de IA de Microsoft afirmó que es muy importante establecer pautas para los modelos. Por ejemplo, que los agentes de OpenAI lancen ataques autónomos a otros sitios web e instalaciones y traten de ocultar su paradero ya son una advertencia para los humanos. Los laboratorios de inteligencia artificial deberían sentarse y hablar para garantizar que los humanos sigan manteniendo el control clave.
Comentarios