Seattle Times y Newsday demandan a OpenAI y Microsoft por usar sus noticias sin permiso
Los diarios estadounidenses se suman a la lista de medios que acusan a OpenAI de entrenar sus modelos con contenido protegido por copyright y reproducir fragmentos en las respuestas de ChatGPT. Un nuevo capítulo en la batalla legal entre periodismo tradicional y la IA generativa.
Seattle Times y Newsday se convirtieron en los últimos medios en llevar a OpenAI y Microsoft a la Justicia por presunto uso no autorizado de su contenido periodístico para entrenar modelos de inteligencia artificial.
Según la demanda, las compañías usaron miles de artículos de ambos diarios como datos de entrenamiento sin pedir permiso ni pagar derechos. Peor aún: los modelos de OpenAI, como ChatGPT, reproducen pasajes textuales de sus notas cuando un usuario hace consultas relacionadas, lo que configura una violación directa de copyright.
Esta acción judicial es similar a las ya presentadas por otros grandes medios estadounidenses como The New York Times, que también alegan que sus archivos periodísticos fueron utilizados a gran escala para “alimentar” los sistemas de IA sin compensación.
¿Qué significa esto para el negocio de la información?
Para un emprendedor o startup que genera contenido, el caso es clave. Si los tribunales terminan dando la razón a los medios, podría establecer un precedente fuerte sobre la propiedad del texto usado para entrenar LLMs. Eso impactaría directamente en herramientas que hoy muchos usan para resumir noticias, generar borradores o crear contenido derivado.
En LATAM, donde muchos emprendedores digitales dependen de contenido para SEO, newsletters o redes, el fallo podría obligar a replantear el uso de IA para “reescribir” artículos ajenos. La lección es clara: entrenar o generar con datos protegidos sin licencia tiene cada vez más riesgos legales.
Desde el lado de OpenAI y Microsoft, la defensa habitual es que el uso de material publicado en internet para entrenamiento califica como “uso justo” (fair use), similar a cómo un humano lee noticias para aprender. Los demandantes responden que la reproducción casi literal de párrafos va más allá del aprendizaje y roza el plagio automatizado.
El contexto argentino
Aunque la demanda se tramita en Estados Unidos, el impacto llega a la Argentina. Varias startups locales y pymes usan herramientas de OpenAI para generar resúmenes o ideas de contenido. Si la Justicia norteamericana impone restricciones fuertes o exige licencias, es probable que el precio de esas APIs suba o que se limiten las funcionalidades de scraping y resumen de noticias.
Además, en un país donde la ley de propiedad intelectual es clara sobre reproducción sin autorización, este precedente puede alentar demandas locales o, al menos, mayor cautela entre quienes usan IA para negocios de contenido.
Vamos a los números: según estimaciones de la industria, entrenar un modelo como GPT-4 requirió billones de tokens, muchos de ellos extraídos de sitios de noticias. Para un diario mediano como Seattle Times, perder el control de su archivo equivale a regalar años de inversión en periodismo de calidad.
El veredicto de este y otros casos similares definirá si el modelo de negocio actual de la IA generativa es sostenible o si tendrá que pasar a un esquema de licencias pagas con los creadores de contenido. Mientras tanto, la recomendación práctica para emprendedores es clara: usá IA para generar ideas o estructurar, pero verificá siempre las s primarias y evitá reproducir texto protegido de forma literal.
Ojo con esto: muchos “prompts mágicos” que hoy circulan para resumir noticias podrían volverse un problema legal si se demuestra que el output viola copyright de manera sistemática.