Tabla de contenidos
ToggleEn breve
- El fallo obliga a OpenAI a proporcionar 20 millones de registros de chat después de meses de disputas sobre privacidad, preservación y alcance.
- La jueza Ona T. Wang dictaminó que el tamaño de la muestra es «proporcional» a lo que requiere el caso para demostrar si los resultados de ChatGPT reprodujeron el contenido del Times.
- El caso se suma a una creciente ola de desafíos en materia de derechos de autor que apuntan a cómo los laboratorios de IA obtienen y utilizan datos de entrenamiento.
Un juez federal ordenó a OpenAI entregar aproximadamente 20 millones de registros de ChatGPT no identificados a Los New York Times y otros actores, profundizando la exposición de la empresa de desarrollo de IA a una variedad de disputas sobre derechos de autor y gobernanza de datos.
Publicado el miércoles en Nueva York, la orden rechaza la oferta de OpenAI de bloquear la producción de registros de chat de usuarios y ordena a la empresa que pase los registros bajo un marco de protección.
El resultado podría dar forma a la forma en que empresas de tecnología como OpenAI, Anthropic y Perplexity obtienen datos de capacitación, otorgan licencias de contenido y construyen barreras de seguridad alrededor y sobre lo que sus sistemas pueden producir.
Si bien el tribunal «reconoce que las consideraciones de privacidad de los usuarios de OpenAI son sinceras», dichas consideraciones «son sólo un factor en el análisis de proporcionalidad y no pueden predominar cuando hay una relevancia clara y una carga mínima», escribió la jueza estadounidense Ona T. Wang.
Descifrar Se ha contactado a ambas partes para hacer comentarios.
El pedido proviene del Times en funcionamiento. causaque alega que los modelos OpenAI fueron entrenados en contenido de noticias protegido por derechos de autor sin permiso. Se adelantó por primera vez en diciembre de 2023.
En enero del año pasado, OpenAI desafiado Las afirmaciones del NYT y contrademandaron, alegando que la publicación no estaba «contando la historia completa».
Posteriormente, el tribunal determinó que los 20 millones de muestras de registros de chat en cuestión son «proporcionales a las necesidades del caso» para evaluar si los resultados de ChatGPT copiaron el material del NYT.
Durante el año pasado, la disputa se intensificó, con actores presionando por un amplio acceso a los datos de producción y OpenAI advirtiendo que la producción expansiva de estos materiales aumenta la privacidad y las cargas operativas.
En junio, OpenAI enfrentó otro revés cuando el tribunal ordenado La empresa debe conservar una amplia gama de datos de usuarios de ChatGPT para la causa, incluidos los usuarios de chat que pueden haber sido eliminados.
Meses después, en octubre, la disputa estalló nuevamente, con el tribunal la marca Presentación de OpenAI del 20 de octubre (ECF 679) que impugna la producción de la muestra de 20 millones de registros y ordena a ambas partes que presenten aclaraciones sobre por qué no están de acuerdo.
En ese momento, el juez presionó a las partes para que explicaran cómo la pelea se relacionaba con preocupaciones anteriores sobre los registros eliminados y si OpenAI estaba revirtiendo acuerdos anteriores sobre lo que anteriormente afirmó que cambiaría.
A finales del mes pasado, OpenAI presentó una objeción formal pidiendo al juez de distrito que anulara la orden de descubrimiento del juez.
La empresa argumentó que el fallo era «claramente equivocado» y «desproporcionado», ya que obligaría a la empresa a revelar millones de conversaciones privadas de usuarios, según un documento judicial compartido con Descifrar por un representante de OpenAI.
La disputa surge como parte de una ofensiva más amplia contra los laboratorios de inteligencia artificial, en la que autores, organizaciones de noticias, editores de música y repositorios de códigos buscan probar hasta qué punto se extiende la ley de derechos de autor existente cuando los modelos ingieren y reproducen material protegido.
Los tribunales de Estados Unidos y Europa están llegando a acuerdos solicitudes similares.
Generalmente inteligente Hoja informativa
Un viaje semanal de IA narrado por Gen, un modelo de IA generativa.

