OpenAI and Midjourney × Automattic Inc.
En février 2024, il a été rapporté qu'Automattic, la société mère de Tumblr et WordPress.com, finalisait un accord pour vendre des données publiques d'utilisateurs à OpenAI et Midjourney pour l'entraînement de l'IA. [25, 28] L'annonce a suscité des inquiétudes chez les utilisateurs, en particulier après que des documents internes aient suggéré que des données non destinées au partage, telles que des publications privées et du contenu de blogs supprimés, avaient été compilées. [26, 27] En réponse, Automattic a publié une déclaration confirmant qu'elle travaille avec certaines entreprises d'IA et a introduit un interrupteur d'exclusion volontaire pour les utilisateurs. [26]
The asset
Un accord pour vendre un corpus de contenu public généré par les utilisateurs des propriétés d'Automattic, Tumblr et WordPress.com, à utiliser pour l'entraînement de modèles d'IA.
The record
- Seller status
- Going concern
- Sector
- social network / blogging platform
- Modalities
- text, images
- Jurisdiction
- US
- Personal data
- Les utilisateurs sont inclus par défaut pour le partage de leurs données, mais l'entreprise a introduit un paramètre pour permettre aux utilisateurs de se désinscrire. Les rapports indiquaient que l'ensemble de données initial compilé pour l'accord comprenait des publications privées, du contenu de comptes supprimés et d'autres données non destinées au partage.
What it means if you hold data
Cet accord illustre les problèmes complexes liés aux données personnelles identifiables (PII) et au consentement de l'utilisateur impliqués dans la licence de contenu généré par les utilisateurs (UGC) pour l'entraînement de l'IA. La décision de faire du partage de données une fonctionnalité d'exclusion volontaire plutôt qu'une fonctionnalité d'adhésion, et l'inclusion signalée de données privées, soulignent le potentiel de conflit entre les opérateurs de plateformes et leurs communautés d'utilisateurs concernant les droits sur les données.