OpenAI and Midjourney × Automattic Inc.
En febrero de 2024, se informó que Automattic, la empresa matriz de Tumblr y WordPress.com, estaba finalizando un acuerdo para vender datos públicos de usuarios a OpenAI y Midjourney para el entrenamiento de IA. [25, 28] El anuncio generó preocupación entre los usuarios, particularmente después de que documentos internos sugirieran que se habían recopilado datos que no estaban destinados a ser compartidos, como publicaciones privadas y contenido de blogs eliminados. [26, 27] En respuesta, Automattic publicó una declaración confirmando que trabaja con empresas de IA seleccionadas e introdujo un interruptor de exclusión voluntaria para los usuarios. [26]
The asset
Una operación para vender un corpus de contenido público generado por usuarios de las propiedades de Automattic, Tumblr y WordPress.com, para ser utilizado en el entrenamiento de modelos de IA.
The record
- Seller status
- Going concern
- Sector
- social network / blogging platform
- Modalities
- text, images
- Jurisdiction
- US
- Personal data
- Los usuarios están incluidos por defecto para que sus datos sean compartidos, pero la empresa introdujo una configuración para permitir a los usuarios excluirse. Los informes indicaron que el conjunto de datos inicial recopilado para el acuerdo incluía publicaciones privadas, contenido de cuentas eliminadas y otros datos que no estaban destinados a ser compartidos.
What it means if you hold data
Este acuerdo ilustra los complejos problemas de PII y consentimiento del usuario involucrados en la concesión de licencias de UGC para el entrenamiento de IA. La decisión de hacer que el intercambio de datos sea una función de exclusión voluntaria en lugar de una función de inclusión voluntaria, y la inclusión informada de datos privados, resaltan el potencial de conflicto entre los operadores de plataformas y sus comunidades de usuarios sobre los derechos de los datos.