Las empresas de tecnología más grandes del mundo están en conversaciones con los principales medios de comunicación para lograr acuerdos históricos sobre el uso de contenido de noticias para entrenar la tecnología de inteligencia artificial.
OpenAI, Google, Microsoft y Adobe se han reunido con ejecutivos de noticias en los últimos meses para discutir cuestiones de derechos de autor en torno a sus productos de IA, como chatbots de texto y generadores de imágenes, según varias personas familiarizadas con las conversaciones.
Estas personas dijeron que los editores, incluidos News Corp, Axel Springer, el New York Times y The Guardian, han estado en conversaciones con al menos una de las compañías tecnológicas.
Los involucrados en las discusiones, que aún se encuentran en las primeras etapas, agregaron que los acuerdos podrían implicar que a las organizaciones de medios se les pague una tarifa de suscripción por su contenido para desarrollar la tecnología que sustenta los chatbots como ChatGPT de OpenAI y Bard de Google.
Las conversaciones se producen cuando los grupos de medios expresan su preocupación por la amenaza que representa para la industria el aumento de la IA, así como los temores sobre el uso de su contenido por parte de OpenAI y Google sin acuerdos establecidos. Algunas empresas, como Stability AI y OpenAI, se enfrentan a acciones legales de artistas, agencias de fotografía y codificadores, que alegan infracciones contractuales y de derechos de autor.
Hablando en mayo en INMA, una conferencia de prensa, el director ejecutivo de News Corp, Robert Thomson, resumió la indignación de la industria diciendo: “[media’s] la PI colectiva está amenazada y por lo que deberíamos pedir a gritos una compensación».
Agregó que la IA fue «diseñada para que el lector nunca visite un sitio web de periodismo, socavando fatalmente ese periodismo».
Un acuerdo establecería el modelo para las organizaciones de noticias en sus tratos con las empresas de IA generativa en todo el mundo.
«Los derechos de autor son un tema crucial para todos los editores», dijo el Financial Times, que también está discutiendo el tema. «Como negocio de suscripción, necesitamos proteger el valor de nuestro periodismo y nuestro modelo de negocio. Participar en un diálogo constructivo con las empresas relevantes, como lo somos nosotros, es la mejor manera de lograrlo».
Los ejecutivos de la industria de los medios quieren evitar los errores de la primera era de Internet, cuando se ofrecían muchos artículos en línea de forma gratuita que, en última instancia, socavaron sus modelos comerciales. Los grandes grupos tecnológicos como Google y Facebook luego accedieron a esa información para ayudar a construir negocios publicitarios en línea multimillonarios.
A medida que ha crecido la popularidad de la IA generativa, también lo han hecho las preocupaciones de la industria de las noticias, dada la capacidad de la tecnología para producir franjas convincentes de texto similar al humano.
Google anunció recientemente una función de búsqueda generativa, que devuelve un cuadro de información escrito por IA sobre su formato tradicional de enlaces web. Se lanzó en los EE. UU. y se está preparando para su lanzamiento en todo el mundo.
Algunas discusiones actualmente involucran tratar de encontrar un modelo de precios para el contenido de noticias utilizado como datos de entrenamiento para modelos de IA. Una cifra que habían discutido los editores es entre $5 y $20 millones al año, según un ejecutivo de la industria.
Mathias Döpfner, director ejecutivo del propietario de Politico, Axel Springer, que se reunió con las principales empresas de inteligencia artificial Google, Microsoft y OpenAI, dijo que su primera opción sería crear un modelo «cuantitativo» similar al desarrollado por la industria de la música que ve estaciones de radio, clubes nocturnos. y los servicios de transmisión pagan a los sellos discográficos cada vez que se reproduce una pista. Eso requeriría primero que las empresas de IA divulguen su uso del contenido de los medios, algo que actualmente no están haciendo.
Döpfner, cuya empresa de medios con sede en Berlín también es propietaria del tabloide alemán Bild y del periódico de gran formato Die Welt, dijo que un acuerdo anual para el uso ilimitado del contenido de una empresa de medios sería una «segunda mejor opción», porque ese modelo sería más difícil para las pequeñas empresas regionales. o medios de comunicación locales para aprovechar.
«Necesitamos una solución para toda la industria», dijo Döpfner. «Tenemos que trabajar juntos en esto».
Google ha estado liderando las negociaciones con los medios de comunicación del Reino Unido, reuniéndose con The Guardian y NewsUK. La empresa propiedad de Alphabet tiene asociaciones de larga data con muchas organizaciones de medios para usar datos de contenido, como artículos, para garantizar que esté optimizado para aparecer en su motor de búsqueda. La empresa ha utilizado los datos para entrenar sus grandes modelos de lenguaje, según dos personas familiarizadas con el arreglo.
«Google ha puesto sobre la mesa un acuerdo de licencia», dijo un ejecutivo de un grupo periodístico. «Han aceptado el principio de que tiene que haber pago. . . pero no hemos llegado al punto de hablar de ceros. Han reconocido que hay una conversación de dinero que debemos tener en los próximos meses, que es el primer paso».
Google no hizo comentarios sobre las discusiones financieras. Sin embargo, la empresa de búsqueda dijo que estaba teniendo «conversaciones continuas» con medios de comunicación, grandes y pequeños, en los EE. UU., el Reino Unido y Europa, y ya entrenó a su IA en «información disponible públicamente», que podría incluir sitios web de pago.
El gigante de Silicon Valley agregó que otra opción que estaba considerando era cómo dar a los editores más «opciones y control» sobre si su contenido se convirtió en parte de un conjunto de datos de entrenamiento para IA, similar a cómo permite que los sitios web opten por que su contenido no se use en buscar.
Desde el lanzamiento de ChatGPT en noviembre, el jefe de OpenAI, Sam Altman, se ha reunido con News Corp y el New York Times, según personas familiarizadas con las discusiones. La empresa reconoció que había mantenido conversaciones con editores y asociaciones editoriales de todo el mundo sobre cómo podrían trabajar juntos.
Desarrollar un modelo financiero para el uso de contenido de noticias para capacitar a la IA será extremadamente difícil, según los líderes editoriales. Altos ejecutivos de una importante editorial estadounidense dijeron que la industria de las noticias estaba trabajando de forma retroactiva porque las empresas tecnológicas habían lanzado estos productos sin consultarlas.
«No hubo discusión, así que ahora tenemos que intentar que nos paguen después de que sucedió», dijo el ejecutivo. «La forma en que lanzaron estos productos, el secreto total, el hecho de que no hay transparencia, ninguna comunicación antes de que sucediera, hay razones para ser bastante pesimista».
La analista de medios Claire Enders dijo que las conversaciones eran «muy complicadas en este momento» y agregó que, dado que cada organización adopta su propio enfoque, un acuerdo comercial único para los grupos de medios era poco probable y podría ser contraproducente.
Enders agregó: «Los chatbots no serán herramientas creíbles si están literalmente entrenados principalmente en las cloacas de la misoginia y el racismo que componen la mayor parte del texto abierto y accesible».
Las empresas de tecnología que construyen IA están dispuestas a centrarse en su utilidad para impulsar la eficiencia dentro de las salas de redacción y mejorar el periodismo y están felices de pagar millones para preservar las relaciones duraderas con la industria, dijeron las personas involucradas en las conversaciones.
Brad Smith, vicepresidente de Microsoft, dijo que estaba «en los primeros días de las conversaciones con los medios y los editores, y parte de eso es simplemente ayudar a todos a aprender cómo se entrenan los modelos».
«Creo que nuestra mayor oportunidad es trabajar primero con los editores para pensar cómo pueden usar la IA para generar más ingresos», agregó.
El director ejecutivo de Adobe, Shantanu Narayen, dijo que se había reunido con Disney, Sky y el Daily Telegraph del Reino Unido en las últimas semanas para discutir cómo podría desarrollar modelos personalizados para que las empresas usen su IA generativa para imágenes.
El modelo de Adobe está entrenado en imágenes en su propia biblioteca de imágenes de archivo, así como en contenido de dominio público y con licencia abierta donde los derechos de autor han expirado. Narayen dijo que las ofertas y los precios a medida dependerían de la empresa, pero los clientes podrían agregar su contenido patentado a la herramienta.
Döpfner de Axel Springer expresó su optimismo de que se lograrían acuerdos porque tanto las organizaciones de medios como los responsables políticos han captado la escala del desafío más rápido que durante la última gran ola de disrupción tecnológica.
Las empresas de inteligencia artificial «saben que se avecina una regulación y le temen», dijo, y agregó: «A todas las partes les interesa encontrar una solución para un ecosistema saludable». Si no hay incentivo para crear propiedad intelectual, no hay nada que rastrear. Y la inteligencia artificial se convertirá en estupidez artificial».

