septiembre 3, 2026

Las Novedades Tech De Todo Lo Que Te Interesa

El Internet Archive, un recurso valioso para periodistas, se enfrenta a un nuevo desafío con la llegada de la inteligencia artificial

El Internet Archive ha sido durante mucho tiempo un recurso valioso para periodistas, ya que permite encontrar registros de tweets eliminados o proporcionar textos académicos para investigaciones de fondo. Sin embargo, la llegada de la inteligencia artificial ha creado una nueva tensión entre las partes. Varias publicaciones importantes han comenzado a bloquear el acceso del archivo digital sin fines de lucro a su contenido debido a preocupaciones de que las empresas de inteligencia artificial están utilizando las colecciones del Internet Archive para extraer indirectamente sus artículos.

«Muchas de estas empresas de inteligencia artificial buscan bases de datos de contenido estructurado y disponibles», explica Robert Hahn, jefe de asuntos comerciales y licencias de The Guardian. «La API del Internet Archive habría sido un lugar obvio para que conecten sus máquinas y extraigan la propiedad intelectual».

The New York Times ha tomado una medida similar. «Estamos bloqueando el acceso del bot del Internet Archive a The Times porque la Wayback Machine proporciona acceso sin restricciones al contenido de The Times, incluyendo a las empresas de inteligencia artificial, sin autorización», confirmó un representante del periódico. La publicación enfocada en suscripciones Financial Times y el foro social Reddit también han tomado medidas para bloquear selectivamente cómo el Internet Archive cataloga su material.

Muchas editoras han intentado demandar a empresas de inteligencia artificial por la forma en que acceden al contenido utilizado para entrenar modelos de lenguaje grandes. Algunos ejemplos solo en el ámbito del periodismo:

  • The New York Times demandó a OpenAI y Microsoft

  • El Center for Investigative Reporting demandó a OpenAI y Microsoft

  • The Wall Street Journal y New York Post demandaron a Perplexity

  • Un grupo de editoras, incluyendo The Atlantic, The Guardian y Politico, demandaron a Cohere

  • Penske Media demandó a Google

  • The New York Times y Chicago Tribune demandaron a Perplexity

Otras empresas de medios han buscado acuerdos financieros antes de ofrecer sus bibliotecas como material de entrenamiento, aunque esos acuerdos parecen proporcionar compensación a las empresas editoras en lugar de a los escritores. Y eso no incluye los problemas de derechos de autor y piratería que también están siendo combatidos por las herramientas de inteligencia artificial en otros campos creativos, desde escritores de ficción hasta artistas visuales y músicos. La historia completa es digna de ser leída para cualquiera que haya seguido las respuestas de estas industrias creativas a la inteligencia artificial.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *