info@josefelgueroso.com
2025-07-14
Los sistemas de inteligencia artificial están transformando rápidamente la forma en que se crea, accede y utiliza la información, pero su desarrollo plantea preguntas complejas sobre el uso legítimo de obras protegidas por derechos de autor en los datos de entrenamiento. A medida que los modelos de IA generativa se vuelven más sofisticados, los tribunales y los responsables de formulación de políticas se enfrentan a la cuestión de si el uso de contenidos protegidos para entrenar IA constituye infracción de derechos de autor o se encuentra dentro de los límites del uso legítimo. Este artículo examina los normas jurídicas en evolución que rigen estas cuestiones, centrándose en decisiones recientes de juzgados federales y un informe de la Oficina de Derechos de Autor de EE.UU.
La doctrina del uso legítimo es un principio fundamental de la legislación estadounidense sobre derechos de autor, codificado en 17 U.S.C. § 107. Permite ciertos usos de obras protegidas por derechos de autor sin el consentimiento del titular de los derechos, equilibrando los intereses de los creadores con el interés público en el acceso, la innovación y la libre expresión. El uso legítimo es una defensa afirmativa contra la infracción de derechos de autor y se evalúa caso por caso, guiado por cuatro factores.
El uso legítimo existe para fomentar la creatividad, la investigación académica y la innovación al permitir usos limitados y socialmente valiosos de material protegido por derechos de autor. Es intencionalmente flexible, permitiendo a los tribunales adaptar su aplicación a nuevas tecnologías y necesidades sociales en evolución. La doctrina es crucial en contextos como la crítica, el comentario, el reportaje periodístico, la enseñanza, la investigación y, más recientemente, el desarrollo tecnológico, incluyendo la inteligencia artificial.
Los tribunales analizan el uso legítimo sopesando cuatro factores no exclusivos, considerando la totalidad de las circunstancias:
Ningún factor individual es determinante: los tribunales pesan todos los factores juntos a la luz de los propósitos de la ley de derechos de autor. El análisis es altamente contextual y puede evolucionar a medida que emergen nuevas tecnologías y usos. El Tribunal Supremo y los tribunales inferiores han enfatizado repetidamente que el uso legítimo no es una lista de verificación mecánica, sino una doctrina flexible y equitativa que se adapta a las circunstancias cambiantes.
Esta decisión abordó si el uso de notas editoriales protegidas por derechos de autor para entrenar una herramienta de IA jurídica constituía infracción de derechos de autor o uso legítimo. El juez determinó que Ross Intelligence era responsable por infracción directa de derechos de autor, rechazando su defensa de uso legítimo. La decisión aclaró que el contenido editorial, incluso si se deriva de fuentes de dominio público, puede estar protegido por derechos de autor, y que usar dicho contenido para entrenamiento comercial de IA—especialmente cuando la herramienta de IA compite con el original—no constituye uso legítimo.
Este informe de política integral analiza la aplicación de la ley de derechos de autor y el uso legítimo al uso de obras protegidas por derechos de autor en el entrenamiento de IA generativa. Examina prácticas técnicas, teorías legales y consideraciones de política normativa, proporcionando un marco para evaluar si el entrenamiento de IA con obras protegidas por derechos de autor es infractor o uso legítimo. El informe no toma una posición categórica pero destaca la complejidad y naturaleza específica de los hechos del panorama legal actual.
Esta decisión evaluó si el uso de libros protegidos por derechos de autor por parte de Anthropic—adquiridos tanto por compra como a través de bibliotecas en la sombra—para entrenar modelos de IA generativa era uso legítimo. El juez distinguió entre diferentes usos: sostuvo que usar libros legalmente adquiridos para entrenamiento de IA era uso legítimo debido a la naturaleza altamente transformadora del uso, pero que mantener una biblioteca permanente de copias pirateadas no estaba excusado por el uso legítimo.
Esta decisión abordó si el uso de libros protegidos por derechos de autor por parte de Meta—descargados de bibliotecas en la sombra—para entrenar sus modelos de lenguaje de gran tamaño Llama constituía uso legítimo. El juez concluyó que el uso de Meta era altamente transformador, pero enfatizó que el factor más importante del uso legítimo es el daño al mercado. El juez otorgó juicio sumario a favor de Meta, al no encontrar pruebas de que Llama pudiera producir porciones sustanciales de las obras de los demandantes o que el entrenamiento de IA hubiera causado daño al mercado a los demandantes específicos. Sin embargo, la decisión notó que casos futuros con mejores pruebas de dilución del mercado podrían llevar a un resultado diferente.
| Tema | Acuerdo | Desacuerdo |
|---|---|---|
| Protección por Derechos de Autor en Datos de Entrenamiento |
▪ Todas las fuentes reconocen que el contenido editorial original y creativo (como notas editoriales o libros de autor) está protegido por derechos de autor, incluso si se deriva de materiales de dominio público. ▪ Existe consenso en que el umbral de originalidad es bajo, pero presente para contenido curado o sintetizado. |
▪ La decisión Thomson Reuters v. Ross afirma los derechos de autor en contenido editorial usado para entrenamiento de IA, mientras que el informe de la Oficina de Derechos de Autor y las opiniones de los juzgados de distrito de California reconocen el tema pero se enfocan más en la naturaleza de los usos posteriores y el contexto fáctico. |
| Uso Transformador y Uso Legítimo |
▪ Todas las fuentes coinciden en que la naturaleza transformadora del entrenamiento de IA—si añade nuevo propósito o significado—es un criterio central bajo el primer factor de uso legítimo. ▪ Existe consenso en que la copia para entrenamiento de IA puede ser transformadora si permite nuevos usos o funcionalidades no previstas por la obra original. |
▪ Bartz v. Anthropic y Kadrey v. Meta concluyen que el entrenamiento de IA con libros es "la quintaesencia de la transformación" cuando los contenidos generados por IA no reproducen ni sustituyen a los originales. ▪ Thomson Reuters v. Ross, por el contrario, no encuentra uso transformador donde el sistema de IA compite directamente con la obra original y sirve la misma función de mercado. ▪ El informe de la Oficina de Derechos de Autor indica que la transformación depende significativamente de los hechos y puede no estar siempre presente, especialmente si el uso no es necesario o los contenidos generados por IA son sustitutivos. |
| Daño al Mercado y Licencias |
▪ Todas las fuentes enfatizan el cuarto factor de uso legítimo—daño al mercado—como crítico. ▪ Existe acuerdo general en que la sustitución real o potencial del mercado, incluyendo oportunidades de licencias perdidas, pesa contra el uso legítimo. |
▪ Thomson Reuters v. Ross sostiene que la competencia directa en el mismo mercado y las oportunidades de licencias perdidas para datos de entrenamiento de IA son decisivas contra el uso legítimo. ▪ Kadrey v. Meta no encuentra daño al mercado sin pruebas de que los contenidos generados por IA sustituyan a los originales o que un mercado de licencias para datos de entrenamiento sea uno que los titulares de derechos de autor tengan derecho a controlar. ▪ Bartz v. Anthropic concluye de manera similar que no hay daño al mercado donde no hay pruebas de sustitución por los contenidos generados por IA, pero distingue entre copias de fuentes legales y pirateadas. ▪ El informe de la Oficina de Derechos de Autor destaca la incertidumbre y los mercados de licencias en evolución, indicando que se están considerando modelos de licencias voluntarias y legales. |
| Uso de Obras Pirateadas o Legalmente Adquiridas |
▪ Todas las fuentes coinciden en que el uso de obras legalmente adquiridas para entrenamiento de IA es más defendible bajo uso legítimo que el uso de copias pirateadas o no autorizadas. |
▪ Bartz v. Anthropic traza una línea clara: entrenar con libros legalmente adquiridos es uso legítimo, pero construir una biblioteca permanente de libros pirateados no está excusado por el uso legítimo. ▪ Kadrey v. Meta no aborda directamente el tema de la piratería pero se enfoca en la ausencia de sustitución por los contenidos generados por IA y daño al mercado. ▪ El informe de la Oficina de Derechos de Autor discute los desafíos legales y prácticos de obtener datos de entrenamiento, incluyendo la prevalencia de fuentes no autorizadas. |
| Alcance y Flexibilidad del Uso Legítimo |
▪ Todas las fuentes reconocen que el uso legítimo es una doctrina flexible y específica de hechos que debe adaptarse al cambio tecnológico. ▪ Los tribunales y responsables de políticas coinciden en que ningún factor individual es determinante; el análisis es integral. |
▪ Las fuentes difieren en cuánto peso asignan a cada factor y las circunstancias bajo las cuales el entrenamiento de IA será o no será considerado uso legítimo. ▪ El informe de la Oficina de Derechos de Autor es más cauteloso, enfatizando la naturaleza evolutiva e inestable de las normas jurídicas, mientras que las opiniones de los juzgados de distrito llegan a conclusiones más categóricas basadas en las pruebas de cada caso. |
Esta sección destila los patrones fácticos clave de la jurisprudencia reciente y el análisis de políticas con respecto al uso de obras protegidas por derechos de autor en el entrenamiento de IA. Los siguientes puntos resumen qué circunstancias típicamente favorecen una conclusión de uso legítimo, y cuáles pesan en su contra.
| Escenario Fáctico | Tiende Hacia Uso Legítimo | Tiende Hacia Uso Ilegítimo |
|---|---|---|
| Entrenamiento transformador de IA, sin sustitución por los contenidos generados por IA | ✔️ | |
| Competencia directa con el mercado original | ✔️ | |
| Adquisición legal de obras | ✔️ | |
| Uso de copias pirateadas/no autorizadas | ✔️ | |
| Sin pruebas de daño al mercado | ✔️ | |
| Daño sustancial al mercado/licencias | ✔️ | |
| Los contenidos generados por IA repiten contenido original | ✔️ | |
| Obras fácticas o publicadas | ✔️ | |
| Obras altamente creativas/inéditas | ✔️ |