La empresa matriz de USA Today y 13 entidades afiliadas presentaron este jueves 8 de octubre una demanda contra OpenAI ante un tribunal federal de Nueva York. La acusan de copiar ilegalmente cientos de miles de artículos de 19 medios para entrenar y operar sus modelos de inteligencia artificial, y de reproducir o reformular esos contenidos en las respuestas de ChatGPT. Los demandantes reclaman más de US$ 250 millones en concepto de daños y perjuicios.
La presentación judicial solicita indemnizaciones de hasta US$ 150.000 por cada obra infringida intencionalmente y hasta US$ 25.000 por cada ocasión en que OpenAI habría eliminado información que identifica los derechos de autor de las obras. Además del resarcimiento económico, los demandantes exigen un juicio con jurado y una orden judicial para destruir los modelos GPT y los conjuntos de datos de entrenamiento que utilicen contenido de los demandantes.
La demanda también detalla cómo OpenAI habría utilizado los artículos de estos medios para entrenar sus modelos de inteligencia artificial. Según la presentación judicial, más de 160.000 artículos de los medios involucrados fueron incluidos en WebText, una base de datos utilizada para el desarrollo de GPT-2. Además, se identificaron más de 122 millones de tokens en C4, otro conjunto de datos elaborado a partir de páginas web recopiladas en 2019. De ese total, 23 millones corresponden al sitio web de USA Today.

Los demandantes también presentaron ejemplos del funcionamiento de GPT-5.6. La documentación muestra casos en los que el modelo recuperó artículos de medios como el Indianapolis Star y el Detroit Free Press y generó resúmenes detallados cuando los usuarios le solicitaron que parafraseara los textos y mantuviera una estructura similar a la original.
Las acusaciones por el uso de artículos periodísticos
La demanda sostiene que OpenAI sabía, o debería haber sabido, que sus modelos copiaban contenidos protegidos por derechos de autor a gran escala durante el entrenamiento. Según los demandantes, los modelos copiaron y codificaron esas obras durante el entrenamiento, para luego reproducirlas en los resultados que recibían los usuarios.
Los medios también mencionan los acuerdos pagos que OpenAI mantiene con otras organizaciones periodísticas. Consideran que esos contratos demuestran que la compañía reconoce la necesidad de obtener licencias para utilizar contenidos protegidos por derechos de autor.
Otro de los puntos centrales del reclamo es el supuesto perjuicio económico atribuido a los medios. Según la demanda, los medios invierten cientos de millones de dólares en producir información y dependen de que los lectores visiten sus sitios web y paguen por acceder a sus contenidos para financiar ese trabajo.

Los demandantes aseguran que la reproducción o reformulación de artículos mediante ChatGPT reduce las visitas a los artículos originales. Sostienen que esta práctica afecta sus ingresos y dificulta tanto la captación como la retención de clientes pagos.
Los antecedentes judiciales y las declaraciones que comprometen a OpenAI
La demanda involucra a 19 medios estadounidenses. Entre ellos se encuetran USA Today, The Tennessean, Indy Star, The Bergen Record, The Enquirer, Asbury Park Press, Democrat & Chronicle, The Knoxville News-Sentinel, Naples Daily News, The Oklahoman, Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, The Des Moines Register, Detroit Free Press, The Detroit News, The Palm Beach Post y Star News.
El reclamo se suma a otras disputas entre empresas periodísticas y desarrolladores de inteligencia artificial por el uso de material protegido. Uno de los antecedentes más importantes es la demanda que The New York Times presentó contra OpenAI y Microsoft en diciembre de 2023.
En aquella presentación, el diario estadounidense acusó a las dos compañías de presuntas infracciones de derechos de autor, problemas relacionados con marcas registradas, apropiación indebida y atribución falsa de contenidos utilizados para entrenar modelos de inteligencia artificial como ChatGPT.

En el caso de USA Today, las acusaciones también abarcan la reproducción y la redistribución de los artículos. Los demandantes sostienen que esta práctica perjudica la audiencia de los medios, ya que permite acceder a sus contenidos sin necesidad de ingresar a las publicaciones originales.
La presentación incorpora declaraciones atribuidas a integrantes de OpenAI. Una de ellas corresponde a Nick Turley, responsable de ChatGPT, quien afirmó que los editores enfrentan una "amenaza existencial" por parte de los productos de la compañía. Turley también sostuvo que esas herramientas "son en gran medida sustitutivas" y que "se volverán cada vez más sustitutivas a medida que mejoren". Los demandantes citaron estas palabras para argumentar que OpenAI reconoce el efecto que sus productos pueden tener en los medios.
La demanda también recoge una declaración atribuida a un ingeniero de software de OpenAI, quien escribió que "por muy prominentemente que mostremos los enlaces, los usuarios no harán clic". A su vez, menciona documentos internos que supuestamente describen a ChatGPT como el "quiosco de prensa moderno", capaz de evitar que las personas necesiten utilizar un motor de búsqueda.

Para los demandantes, estas declaraciones demuestran que la propia compañía conoce el perjuicio económico que sus productos pueden causar a las publicaciones. En particular, señalan las dificultades para atraer y retener suscriptores de pago y negociar acuerdos de licencia con otros editores.
La acusación también cuestiona los procedimientos empleados para obtener los artículos. "OpenAI optó deliberadamente por utilizar obras protegidas por derechos de autor sin permiso, haciendo caso omiso de los derechos de los autores y editores cuyo sustento depende del respeto a sus creaciones", sostiene la presentación judicial.
El documento agrega que la compañía utilizó programas diseñados para eliminar la información de gestión de derechos de autor (CMI), es decir, los datos que identifican la protección legal de las obras. Según los demandantes, OpenAI habría eliminado esa información al incorporar los artículos a sus sistemas de entrenamiento.
*Esta nota fue publicada originalmente en Forbes.com.