Anthropic pagará millones a autores por usar sus libros sin permiso para entrenar a Claude

Anthropic aceptó pagar una cifra millonaria para resolver una demanda colectiva presentada por autores y editoriales que acusan a la empresa de haber utilizado sus obras sin autorización en el entrenamiento de su modelo conversacional, Claude. El pacto, aprobado por un juez federal, reaviva el debate sobre cómo las compañías de inteligencia artificial obtienen y conservan el material que alimenta sus sistemas.

La resolución implicará un desembolso significativo y varios protagonistas del caso han reaccionado de formas distintas: algunos demandantes aceptaron la compensación mientras otros han decidido impugnarla y buscar alternativas legales. El episodio pone en primer plano prácticas como la digitalización masiva de libros, el llamado Project Panama y los límites del uso justo en la era de la IA.

Detalles del acuerdo: cuánto recibirá cada parte y qué quedó pendiente

Según lo aprobado por el tribunal, Anthropic pagará un total de 1.500 millones de dólares para compensar a la mayoría de los autores y editoriales que formaron parte de la demanda. El reparto no fue uniforme y varias decisiones individuales marcaron el proceso:

  • El acuerdo cubre al 91 % de los demandantes originales que participaron en la negociación colectiva.
  • Los abogados representantes recibirán 101 millones de dólares, una cifra menor a la que inicialmente solicitaron (187,5 millones de dólares).
  • Un segmento de los demandantes rechazó la oferta y optó por presentar demandas separadas, alegando que la cifra propuesta es insuficiente frente a los posibles daños reclamables en un juicio.

La jueza que validó el arreglo estimó que la propuesta constituye una compensación razonable dada la complejidad y el alcance del litigio, aunque la postura de quienes la rechazan abre la puerta a nuevos litigios y apelaciones.

Qué alegaron los autores: uso de copias digitales y alcance de la supuesta piratería

Los demandantes sostuvieron que Anthropic recurrió a copias no autorizadas de millones de libros para entrenar a Claude, su modelo de lenguaje. Las estimaciones que circulan en el expediente mencionan aproximadamente 7 millones de títulos que habrían sido digitalizados o utilizados sin consentimiento explícito de los titulares de derechos.

Entre las acusaciones principales se encontraban:

  • La adquisición y uso de versiones digitales obtenidas sin las licencias correspondientes.
  • La conservación de esas copias una vez finalizado el entrenamiento del modelo, hecho que la corte consideró relevante para la infracción.
  • Que ciertas copias circulaban en condiciones análogas a la piratería al no haberse respetado los derechos de autor.

Aunque el juicio inicial evaluó la defensa de Anthropic basada en el principio de uso justo, el tribunal hizo una distinción entre la utilización temporal para el entrenamiento y la retención permanente de material protegido, responsabilizando a la compañía por esta última práctica.

El papel de Project Panama y la controversia sobre la adquisición de material

Documentos y testimonios relacionados con el caso sacaron a la luz una operación interna bautizada como Project Panama. Según esas revelaciones, Anthropic habría llevado a cabo un proceso de compra, digitalización y, en algunos casos, destrucción de ejemplares físicos como parte de su estrategia para obtener datos de alta calidad.

Aspectos clave de Project Panama:

  • Compra masiva de libros en formato físico con el fin de escanearlos y utilizarlos en entrenamiento de modelos.
  • Digitalización a gran escala que generó versiones electrónicas de obras protegidas.
  • Medidas para controlar la circulación de las copias físicas tras la digitalización.

La existencia de esta iniciativa despertó preocupación entre autores y editores por la transparencia en la adquisición de contenido y por las implicaciones éticas de destruir ejemplares físicos para obtener datos.

Cómo influyó la decisión judicial y qué precedentes marca para la industria de la IA

El juez a cargo del expediente analizó la demanda en dos planos: aceptó que parte del uso para entrenamiento encaja con la doctrina de uso justo, pero encontró responsabilidad en el almacenamiento y el manejo posterior de las copias digitales. La aprobación del acuerdo por la magistrada Araceli Martinez-Olguin también fue señalada por medios como una de las mayores resoluciones económicas en un pleito por derechos de autor en Estados Unidos.

Posibles consecuencias para empresas de IA:

  1. Mayor escrutinio sobre métodos de recolección de datos y la cadena de custodia de los archivos digitalizados.
  2. Cambios en las políticas internas para evitar la retención innecesaria de material con derechos de autor.
  3. Impulso a acuerdos de licencia masiva entre editores y desarrolladores de modelos para reducir riesgos legales.
  4. Un aumento en litigios similares, ya que varios autores y editoriales observan el resultado como un precedente relevante.

Reacciones y próximos pasos legales

Diversos actores reaccionaron con escepticismo y alivio a partes iguales: algunos autores aceptaron la compensación y cerraron su capítulo legal, mientras que otros anunciaron que seguirán persiguiendo reclamaciones individuales que, según ellos, podrían producir una indemnización mayor en juicio. Las firmas que representan a los demandantes justificaron sus honorarios en función de la magnitud y duración del litigio.

Implicaciones para la regulación y las prácticas de recopilación de datos

Este caso subraya la necesidad de normas más claras sobre la extracción y conservación de contenidos usados para entrenar modelos de IA. Reguladores, editores y desarrolladores enfrentan presiones convergentes para definir estándares que equilibren innovación y protección de la propiedad intelectual.

Temas que están en discusión:

  • Transparencia en las fuentes de datos utilizadas por las IA.
  • Modelos de licenciamiento comercial que permitan el acceso legal a bibliotecas y catálogos.
  • Mecanismos de auditoría para verificar que los datos se usan y almacenan conforme a la ley.

Artículos similares

Califica este artículo
Lea también  Claude Code se vuelve hacker automático con nueva herramienta

Deja un comentario

Share to...