
Reddit ha reactivado su disputa de décadas con la Oficina de Derechos de Autor de EE. UU. y Google sobre la visualización de resultados de búsqueda, pero el desarrollo más trascendental es su nueva demanda que acusa a Perplexity AI de conspirar con un raspador web de terceros para recopilar publicaciones de Reddit con derechos de autor. La demanda, presentada en el Distrito Norte de California, alega que el modelo de lenguaje extenso (LLM) de Perplexity se entrenó con contenido de Reddit sin permiso, y que la empresa facilitó conscientemente la extracción de esos datos a través de un socio que eludió las restricciones de la API de Reddit.
El argumento legal se basa en las disposiciones de refugio seguro de la Ley de Derechos de Autor del Milenio Digital (DMCA), que protegen a los proveedores de servicios que actúan como conductos pasivos para contenido generado por usuarios, siempre que respondan rápidamente a los avisos de retirada. Reddit sostiene que la integración por parte de Perplexity de datos raspados de Reddit en su proceso de generación de respuestas convierte la plataforma de un conducto pasivo a un infractor activo, lo que la descalifica de la protección de refugio seguro. La demanda también alega que Perplexity no implementó salvaguardas técnicas razonables para impedir la ingestión de material protegido, un punto que podría sentar un precedente para los desarrolladores de IA.
Desde una perspectiva de seguridad, el caso plantea preocupaciones sobre la procedencia de los datos de los corpus de entrenamiento utilizados por los agentes de IA. El raspado no verificado no solo pone en riesgo el cumplimiento de la propiedad intelectual, sino que también introduce el riesgo de ingerir contenido malicioso o cargado de desinformación, lo que puede amplificar la difusión de narrativas dañinas. Los reguladores de la UE y EE. UU. ya han manifestado su intención de reforzar la supervisión de los datos de entrenamiento de IA, y este litigio podría acelerar la demanda de normas más claras.
Para el ecosistema de IA en general, el resultado podría obligar a un cambio hacia prácticas de adquisición de datos más transparentes. Las empresas podrían verse obligadas a negociar acuerdos de licencia con plataformas de contenido o a implementar mecanismos de filtrado robustos que excluyan material protegido de los conjuntos de entrenamiento. Por el contrario, si el tribunal falla a favor de Perplexity, podría alentar a otras empresas de IA a depender de raspados oportunistas, erosionando potencialmente la confianza entre los creadores de contenido y los desarrolladores de IA.
Los interesados deben seguir de cerca el expediente. El caso se cruza con los debates políticos en curso sobre la responsabilidad de la IA, el alcance de la DMCA en la era de los modelos generativos y el equilibrio entre fomentar la innovación y proteger los derechos de los creadores. Aunque el veredicto aún está pendiente, el litigio sirve como un indicador de cómo la ley se adaptará a la rápida expansión de los agentes de IA que operan sobre el mismo contenido que alimenta sus capacidades.
Foto: Michael D Beckwith / Unsplash (https://unsplash.com/@mdbeckwith)
Comentarios