Con el apoyo del lanzamiento del chatbot ChatGPT en noviembre de 2022, 2023 se ha convertido en un punto de inflexión en la historia del desarrollo de la IA (inteligencia artificial). El entorno activo de código abierto y los modelos multimodales han promovido conjuntamente el progreso de la investigación de la IA. A medida que la IA generativa continúa pasando del laboratorio a la realidad, las actitudes hacia la tecnología se vuelven cada vez más maduras. Los expertos de la industria también han ofrecido algunas perspectivas para las tendencias de desarrollo de la IA en 2024. Aquí, el reportero de The Paper analizó exhaustivamente cuestiones relevantes y resumió las cinco principales tendencias de desarrollo de la IA en 2024:
En la segunda mitad de 2022, el software de gráficos de IA encendió por primera vez la popularidad de la IA generativa, y esta moda alcanzó su punto máximo con el lanzamiento de ChatGPT.
Las búsquedas de "IA generativa" aumentarán en 2023. Fuente: ExplodingTopics
Antes de que la IA generativa ganara fuerza, la mayoría de las aplicaciones de IA utilizaban IA predictiva. Como sugiere el nombre, la IA predictiva predice tendencias o proporciona información basada en datos existentes, en lugar de generar contenido completamente nuevo. Por el contrario, la IA generativa utiliza el aprendizaje automático para aprender patrones de "pensamiento" a partir de datos de entrenamiento para crear resultados originales.
El experto en investigación de IA generativa y Deepfake, Henry Adjer, señaló: "Todavía estamos en las primeras etapas de esta revolución generativa; en el futuro, los medios y contenidos sintéticos serán omnipresentes en la vida diaria y se democratizarán. Esto no es sólo una simple novedad, sino que impulsará avances revolucionarios en entretenimiento, educación y suministro".
Los modelos tradicionales de IA se centran en procesar información desde una única modalidad. Ahora, a través del aprendizaje profundo multimodal, podemos entrenar modelos para descubrir relaciones entre diferentes tipos de modalidades, lo que significa que estos modelos pueden "traducir" texto en imágenes, imágenes en videos, texto en audio, etc.
Los modelos multimodales han recibido una atención entusiasta desde el año pasado, lo que permite a los usuarios interactuar con la IA de manera más eficiente. Por eso causó sensación el vídeo promocional del modelo grande Gemini publicado por Google en diciembre del año pasado: en el vídeo, Gemini parece ser capaz de reconocer imágenes en tiempo real y también generará audio e imágenes para ayudar a responder.
Captura de pantalla del vídeo promocional de Google Gemini.
Sin embargo, Google admitió más tarde que el vídeo promocional había sido objeto de alguna edición. Sin embargo, al menos nos muestra cómo será la IA multimodal en el futuro.
Creo que muchas personas habitualmente abren herramientas de inteligencia artificial como ChatGPT cuando están trabajando y les permiten actuar como "secretarias" para ayudarlos en su trabajo en cualquier momento.
ChatGPT se está convirtiendo en el "socio de oficina" más popular.
En el Foro de Davos en enero de este año, Sam Altman, fundador y director ejecutivo del gigante emergente de la IA OpenAI, enfatizó que la revolución tecnológica provocada por la IA es diferente del pasado, pero la IA no reemplazará muchos puestos de trabajo como la gente temía, sino que se convertirá en una "herramienta increíble para mejorar la productividad".
Para ese futuro, una cosa es segura: como trabajadores, necesitaremos adaptarnos y adquirir nuevas habilidades relacionadas con la IA.
En los últimos años, los usuarios han sentido el encanto del "empuje personalizado": desde las redes sociales hasta los sitios web de vídeos, algoritmos cada vez más complejos parecen saber siempre lo que los usuarios quieren ver y mostrar el contenido adecuado en el momento adecuado. La IA está acelerando la transformación de varios medios de "populares" a "nichos", y el objetivo final es lograr una verdadera interacción uno a uno.
Victor Riparbelli, director ejecutivo de la startup de inteligencia artificial Synthesia, dijo: "Predecimos que en un futuro no muy lejano, la comunicación de masas se convertirá cada vez más en una cosa del pasado. Los medios y contenidos sintéticos crearán nuevas formas de comunicación personalizadas, y el panorama de los medios (tradicionales) cambiará por completo".
Finalmente, como era de esperar, 2024 será un año crítico para la regulación de la IA. La cada vez más potente IA también ha planteado muchos nuevos desafíos a las autoridades reguladoras, como la clásica frase de "Spider-Man" de Marvel: "Un gran poder conlleva una gran responsabilidad".
Gillian Crossan, jefa de consultoría de riesgos y responsable del sector tecnológico global de Deloitte, cree que la IA ha vuelto a llamar la atención sobre el "derecho al olvido": "Cuando estos grandes modelos utilizan grandes cantidades de datos para aprender, ¿cómo se puede garantizar que sean controlables y que su propia información pueda ser olvidada por ellos?"
Se puede decir que la UE ha tomado una posición de liderazgo en la regulación de la IA. Según los informes, los negociadores del Parlamento Europeo y los países de la UE llegaron a un acuerdo sobre la regulación de la IA en diciembre del año pasado. En el futuro, los sistemas de IA se clasificarán en diferentes grupos de riesgo: cuanto mayor sea el riesgo potencial de una aplicación, mayores deberán ser sus requisitos. La UE espera que estas reglas se reproduzcan en todo el mundo.