OpenAI and Midjourney × Automattic Inc.
En février 2024, il a été rapporté qu'Automattic, la société mère de Tumblr et WordPress.com, finalisait un accord pour vendre des données publiques d'utilisateurs à OpenAI et Midjourney pour l'entraînement de l'IA. [25, 28] L'annonce a suscité des inquiétudes chez les utilisateurs, particulièrement après que des documents internes aient suggéré que des données non destinées au partage, telles que des publications privées et du contenu de blogs supprimés, avaient été compilées. [26, 27] En réponse, Automattic a publié une déclaration confirmant qu'elle travaille avec certaines entreprises d'IA et a introduit un bouton de désactivation pour les utilisateurs. [26]
The asset
Une transaction visant à vendre un corpus de contenu public généré par les utilisateurs provenant des propriétés d'Automattic, Tumblr et WordPress.com, destiné à l'entraînement de modèles d'IA.
The record
- Seller status
- Going concern
- Sector
- social network / blogging platform
- Modalities
- text, images
- Jurisdiction
- US
- Personal data
- Les utilisateurs sont activés par défaut pour le partage de leurs données, mais l'entreprise a introduit un paramètre permettant aux utilisateurs de se désactiver. Les rapports indiquaient que le jeu de données initial compilé pour l'accord incluait des publications privées, du contenu de comptes supprimés et d'autres données non destinées au partage.
What it means if you hold data
Cet accord illustre les problèmes complexes liés aux données personnelles identifiables (PII) et au consentement des utilisateurs impliqués dans la licence de contenu généré par les utilisateurs (UGC) pour l'entraînement de l'IA. La décision de faire du partage de données une fonctionnalité de désactivation plutôt qu'une fonctionnalité d'activation, et l'inclusion signalée de données privées, soulignent le potentiel de conflit entre les opérateurs de plateformes et leurs communautés d'utilisateurs concernant les droits sur les données.