Sina Technology News En la tarde del 8 de septiembre, hora de Beijing, se informó que la Compañía X (Twitter) actualizó recientemente sus términos de servicio. Sin permiso, ningún tercero puede capturar datos en la plataforma X para entrenar modelos de inteligencia artificial (IA).
Esta disposición entrará en vigor el 29 de septiembre. Según los nuevos términos, no se permite ningún tipo de extracción de datos en la plataforma X para ningún propósito sin un permiso previo por escrito. Anteriormente, la Compañía X permitía a personas externas rastrear datos de la plataforma a través del archivo robots.txt.
El archivo robots.txt proporciona instrucciones a los robots rastreadores sobre a qué partes de su sitio web pueden acceder. Pero en los últimos meses, la Compañía X modificó el archivo robots.txt para eliminar todas las instrucciones para los robots rastreadores excepto Google. En 2015, la Empresa X llegó a un acuerdo con Google para permitirle mostrar tweets en los resultados de búsqueda.
Elon Musk, el jefe de X Company, siempre se ha opuesto a que terceros recopilen datos en la plataforma X para entrenar modelos de inteligencia artificial. En abril de este año, incluso amenazó con demandar a Microsoft, alegando que Microsoft utilizó ilegalmente los datos de X para entrenar su modelo de inteligencia artificial.
En julio, la Compañía X presentó una demanda contra cuatro entidades, acusándolas de participar en actividades de extracción de datos que sobrecargaron gravemente los servidores de X y empeoraron la experiencia del usuario. X dijo en ese momento: "El scraping interfiere con el funcionamiento legítimo de sitios web y aplicaciones móviles porque realiza millones de solicitudes, supone una gran carga para el servidor y perjudica la experiencia de los usuarios reales".
Si bien prohibió el rastreo de terceros, X también ajustó su política de privacidad a principios de este mes para permitir que X use información publicada por los usuarios para entrenar su modelo de inteligencia artificial. Musk dijo que X sólo utilizará información pública para entrenar su modelo de inteligencia artificial y no utilizará ningún contenido privado.