Ir al contenido principal
Volver al Glosario

Derechos de autor y entrenamiento de IA

El debate legal —hoy en tribunales reales, no sólo académico— sobre si usar obras protegidas por derechos de autor (textos, imágenes, código) para entrenar un modelo de IA, sin autorización del titular, constituye infracción de propiedad intelectual.

Última revisión:
Fuentes:
2 fuentes · 2 verificadas

Entrenar un modelo de lenguaje o de imágenes requiere enormes volúmenes de texto o imágenes reales, y buena parte de ese material —noticias, libros, fotografías de stock, código publicado— está protegido por derechos de autor. La pregunta legal es simple de enunciar y muy difícil de resolver: ¿copiar una obra para que un modelo "aprenda" de ella, sin reproducirla literalmente al usuario final, cuenta como infracción, o cae dentro de una excepción como el "uso justo" (fair use) del derecho estadounidense?

El caso más seguido públicamente es The New York Times contra OpenAI y Microsoft, presentado en diciembre de 2023 ante un tribunal federal de Manhattan. El diario alega que las empresas usaron millones de sus artículos sin autorización ni pago para entrenar sus modelos, y que en ciertos casos el modelo reproducía pasajes casi literales de sus artículos, o le atribuía falsamente recomendaciones a Wirecutter (el sitio de reseñas del Times), dañando su reputación. El Times pide, entre otras cosas, la destrucción de los modelos entrenados con su contenido y miles de millones de dólares en daños; OpenAI respondió que su uso del material constituye fair use. En 2025 el juez a cargo rechazó la mayoría de las mociones de OpenAI para desestimar el caso, por lo que el grueso de las demandas de infracción de copyright sigue en curso.

Un caso paralelo, pero ya con sentencia, es Getty Images contra Stability AI en el Reino Unido, iniciado en enero de 2023 por el uso de fotografías de stock de Getty para entrenar el modelo de generación de imágenes Stable Diffusion. El 4 de noviembre de 2025 la Corte Superior de Inglaterra falló mayoritariamente a favor de Stability AI: Getty abandonó durante el juicio sus reclamos principales de infracción de copyright, y el tribunal sólo encontró infracción de marca registrada limitada, por la aparición de la marca de agua de Getty en imágenes generadas por versiones tempranas del modelo; sí estableció que las obras de Getty fueron usadas para entrenar el modelo.

Estos dos casos muestran algo importante: no hay todavía una respuesta única, ni siquiera dentro de un mismo país. Cada resultado depende de detalles concretos —dónde ocurrió el entrenamiento, qué tan literal fue la reproducción, qué reclamo específico se probó— más que de un principio general sobre "IA y copyright" ya zanjado.

Mientras los tribunales deciden caso por caso, la industria ha ido creando su propia respuesta comercial: acuerdos de licenciamiento entre laboratorios de IA y editoriales, bancos de imágenes o plataformas de código, que pagan por el uso de contenido para entrenamiento en vez de esperar un fallo judicial que fije la regla general.

¿Por qué te importa?

Si entrenar con una obra sin permiso termina siendo infracción, el modelo de negocio de gran parte de la IA generativa actual —entrenada con volúmenes masivos de contenido protegido— tendría que rehacerse sobre licencias pagadas; si no lo es, buena parte de la industria creativa (periodismo, fotografía, ilustración) pierde control sobre cómo se usa su trabajo.

Ejemplos

  • The New York Times v. Microsoft and OpenAI (demanda presentada el 27 de diciembre de 2023, en curso a 2025 tras el rechazo judicial de la mayoría de las mociones de desestimación).
  • Getty Images v. Stability AI (Reino Unido; demanda iniciada en enero de 2023, fallo del 4 de noviembre de 2025 mayoritariamente favorable a Stability AI).

Términos relacionados

Debate y controversia

Es, en sí mismo, un debate legal abierto y no resuelto: los propios tribunales han llegado a resultados distintos según el caso, y no existe todavía jurisprudencia consolidada sobre si entrenar con obras protegidas sin autorización es o no una infracción. La industria de IA generativa sostiene que el entrenamiento transforma la obra y no la sustituye en el mercado (por lo que calificaría como fair use); editoriales, bancos de imágenes y autores sostienen que se trata de una copia masiva no autorizada con fines comerciales.

Fuentes

Aparece en los dossiers

Un medio de señales del futuro: observa lo que está cambiando en tecnología, ciencia, regulación y sociedad, y lo publica como noticia, análisis o tesis de futuro. Cada pieza cita sus fuentes.

© 2026 HumanOS Future · medio de Sinapsis SpA. Las piezas de tipo tesis y opinión no son hechos consumados.