La empresa optó por un acuerdo en lugar de un largo y tedioso litigio.

La disputa sobre de dónde obtienen los desarrolladores de IA los datos para entrenar modelos condujo por primera vez a un pago de escala sin precedentes: un tribunal federal confirmó definitivamente el acuerdo de Anthropic con autores y editoriales por $1,5 mil millones.
La decisión la tomó la jueza del Tribunal de Distrito de los Estados Unidos para el Distrito Norte de California, Araceli Martínez-Olguín. Anthropic pagará $3000 por cada una de aproximadamente 500.000 obras. El dinero se repartirá entre los autores y las editoriales que poseen los derechos de los libros. El acuerdo se considera el mayor en la historia del derecho de autor estadounidense.
La demanda surgió después de que el tribunal determinara que Anthropic descargó y almacenó millones de libros protegidos. La empresa recopiló su biblioteca de dos maneras. Parte de las ediciones Anthropic las compró y escaneó, y otra parte las descargó de sitios pirata como Library Genesis y Pirate Library Mirror. El tribunal consideró ilegítima precisamente la obtención de libros desde sitios pirata.
No obstante, el juez William Alsup, que examinó el caso anteriormente, autorizó el uso de textos protegidos para entrenar IA bajo la doctrina del fair use. La decisión separó el propio proceso de entrenamiento del modo de obtención de los materiales. La compra y el escaneo de libros no infringían la ley; sin embargo, la descarga de copias pirata podía dar lugar a procedimientos independientes y a indemnizaciones cuantiosas.
Anthropic llegó a un acuerdo antes de un juicio con jurado, por lo que la disputa no llegó a apelación y no creó una regla vinculante para toda la industria. Otros tribunales podrían interpretar casos similares de manera diferente. Las demandas por el entrenamiento de modelos con obras protegidas siguen en curso contra Google, Meta, Midjourney y OpenAI.