Gannett, propietario de USA Today, interpuso una demanda contra OpenAI por más de US$250 millones, alegando infracción intencional.

La empresa matriz de USA Today y 13 de sus entidades demandaron a OpenAI en Nueva York el jueves, acusándola de copiar ilegalmente cientos de miles de artículos de 19 publicaciones para entrenar y operar sus modelos, y luego reproducir o reempaquetar esos reportajes para los usuarios de ChatGPT.

Datos clave

  • USA Today Co., Inc. y 13 entidades afiliadas reclaman a OpenAI más de US$250 millones en concepto de daños y perjuicios, incluyendo hasta US$150.000 por cada obra infringida intencionadamente y hasta US$25.000 por cada vez que OpenAI eliminó información protegida por derechos de autor, según la demanda presentada el jueves ante un tribunal federal de Nueva York.
  • La demanda alega que sus documentos constituyen más de 160.000 entradas en WebText, un conjunto de datos que OpenAI creó para entrenar su modelo GPT-2, y más de 122 millones de tokens en una instantánea de Common Crawl de 2019 llamada C4, incluidos 23 millones de tokens de usatoday.com .
  • La documentación adjunta proporciona ejemplos en los que GPT-5.6 recuperó artículos de medios como el Indianapolis Star y el Detroit Free Press y produjo resúmenes detallados cuando se le solicitó que parafraseara y utilizara una estructura similar.
  • Los demandantes acusan a OpenAI de infracción deliberada, alegando que su participación en el entrenamiento de los modelos significa que “sabía o debería haber sabido” que los modelos estaban copiando contenido “a gran escala durante el entrenamiento” sin permiso, lo que en última instancia llevó a codificar obras y luego mostrarlas a los usuarios en los resultados de búsqueda, y agregan que sus acuerdos de pago con otras organizaciones de noticias demuestran que sabe que requieren una licencia.
  • La demanda alega que la conducta ilícita de OpenAI ha causado y sigue causando un daño financiero sustancial a las publicaciones que dependen de que los lectores visiten sus sitios web y paguen por su contenido para financiar los cientos de millones de dólares que invierten en reportajes.
  • La demanda también solicita una orden judicial para destruir los modelos GPT y los conjuntos de entrenamiento que utilizan contenido de las 19 publicaciones involucradas, así como un juicio con jurado.

ANTECEDENTES CLAVE

Los demandantes de USA Today poseen los derechos de autor del contenido publicado por USA TODAY, The Tennessean, Indy Star, The Bergen Record, The Enquirer, Asbury Park Press, Democrat & Chronicle, The Knoxville News-Sentinel, Naples Daily News, The Oklahoman, Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, The Des Moines Register, Detroit Free Press, The Detroit News, The Palm Beach Post y Star News. La demanda representa el último avance en la disputa entre editores y empresas de IA por material protegido por derechos de autor, muchas de las cuales se han consolidado en Nueva York. Publicaciones y medios de comunicación han presentado quejas, incluido The New York Times, que demandó tanto a la empresa de IA como a Microsoft en diciembre de 2023 por presunta infracción de derechos de autor, problemas de marcas registradas, apropiación indebida y falsa atribución como resultado del uso de sus reportajes para entrenar modelos como ChatGPT. La demanda presentada el jueves alega que OpenAI utiliza ilegalmente su contenido para entrenar a ChatGPT, pero también aborda la cuestión de que la empresa reproduce o redistribuye el trabajo, lo que, según los demandantes, reduce la audiencia de las publicaciones.

TANGENTE

En la demanda presentada el jueves, los demandantes citan una declaración del director de ChatGPT de OpenAI, Nick Turley, quien afirmó que los editores se enfrentan a una “amenaza existencial” por parte de los productos de OpenAI, que estos “son en gran medida sustitutivos, sin más” y que “se volverán cada vez más sustitutivos a medida que mejoren”. La demanda también indica que un ingeniero de software de OpenAI escribió que “por muy prominentemente que mostremos los enlaces, los usuarios no harán clic”, y cita otras declaraciones, incluidos documentos internos de OpenAI que supuestamente afirman que ChatGPT es el “quiosco de prensa moderno” que evitará que la gente necesite usar un motor de búsqueda. Los demandantes afirman que estas declaraciones demuestran, en palabras de la propia OpenAI, cómo ChatGPT perjudica económicamente a las publicaciones, dificultando la captación y retención de clientes de pago y los acuerdos de licencia con otros editores.

CITA CRUCIAL

«OpenAI optó deliberadamente por utilizar obras protegidas por derechos de autor sin permiso, haciendo caso omiso de los derechos de los autores y editores cuyo sustento depende del respeto a sus creaciones. OpenAI no se limitó a robar las obras protegidas por derechos de autor utilizadas para entrenar sus modelos; lo hizo mediante programas diseñados para eliminar la Información de Gestión de Derechos de Autor (CMI, por sus siglas en inglés), que indicaba que las obras estaban protegidas por derechos de autor válidos», reza la demanda.

Este artículo fue publicado originalmente por Forbes US