e& et AWS concluent une alliance stratégique de 1 milliard de dollars pour l'infrastructure de données IA
L'accord de 10 ans basé aux Émirats arabes unis se concentre sur le cloud souverain et les actifs de données prêts pour l'IA pour le Moyen-Orient.
La société de télécommunications basée aux Émirats arabes unis, e& (anciennement Etisalat), a finalisé un accord stratégique d'une valeur de 1 milliard de dollars (https://www.reuters.com/technology/etisalat-aws-sign-1-billion-deal-cloud-services-2024-06-20/) avec Amazon Web Services (AWS) pour accélérer le développement d'actifs de données basés sur l'IA et la souveraineté du cloud au Moyen-Orient. Cette alliance de 10 ans (https://www.arabianbusiness.com/industries/technology/e-and-aws-sign-1bn-agreement-to-accelerate-cloud-driven-ai-innovation/) représente un changement fondamental dans la manière dont les acteurs régionaux positionnent leurs réseaux de données propriétaires comme la couche fondamentale des écosystèmes d'IA souverains.
Les données souveraines, le nouvel actif stratégique
Ce partenariat est centré sur l'exploitation de la région AWS Moyen-Orient (Émirats arabes unis), qui fournit une infrastructure localisée répondant à des exigences strictes en matière de résidence des données. Pour e&, l'objectif va au-delà du stockage cloud traditionnel ; il s'agit de créer un pipeline de données à haute vélocité pour les applications d'IA générative. En intégrant la puissance de calcul d'AWS aux vastes ensembles de données de télécommunications d'e&, les deux entités visent à fournir des solutions d'IA spécialisées pour les secteurs gouvernemental et d'entreprise. Cet accord souligne une tendance croissante où les champions nationaux sécurisent des infrastructures de plusieurs milliards de dollars pour garantir que leurs actifs de données nationaux restent sous juridiction locale tout en étant traités par des outils d'IA de niveau mondial.
OpenAI et TIME : Le modèle de licence d'archives premium
Parallèlement à l'essor des infrastructures, le marché des données d'entraînement de haute qualité a vu un nouvel acteur majeur. OpenAI a conclu un accord de licence de contenu pluriannuel (https://variety.com/2024/digital/news/openai-time-magazine-content-licensing-deal-1236053351/) avec TIME Magazine. En vertu de cet accord, OpenAI aura accès aux archives de TIME, vieilles de 101 ans (https://www.theverge.com/2024/6/20/24182525/openai-time-magazine-licensing-deal-ai-training/), pour entraîner ses grands modèles linguistiques et fournir des réponses citées dans ChatGPT. Bien que les termes financiers spécifiques restent confidentiels, les analystes citent l'accord de News Corp d'une valeur estimée à 250 millions de dollars (https://www.nytimes.com/2024/05/22/business/media/news-corp-openai-deal.html) comme référence pour le marché du contenu premium. Ce partenariat signale un éloignement du web scraping controversé vers une économie de données structurée et basée sur les permissions, où les marques médiatiques historiques peuvent monétiser leur propriété intellectuelle historique en tant que matériel d'entraînement de haute fidélité.
Défense et Entreprise : Levées de fonds axées sur les données
La demande de traitement de données spécialisé entraîne également des afflux de capitaux importants dans des secteurs de niche de l'IA. Helsing, une entreprise européenne d'IA pour la défense, a récemment clôturé une levée de fonds de série C d'un montant déclaré de 450 millions d'euros (487 millions de dollars) (https://techcrunch.com/2024/06/20/defense-ai-startup-helsing-raises-487m-at-a-5-4b-valuation/). L'investissement, qui porte la valorisation estimée de l'entreprise à 5 milliards d'euros (https://www.bloomberg.com/news/articles/2024-06-20/defense-ai-startup-helsing-raises-450-million-in-fresh-funding/), se concentre sur le traitement des données en temps réel pour le renseignement sur le champ de bataille. De même, l'infrastructure de gestion de ces ensembles de données mûrit ; Encord, une plateforme de curation de données pour l'IA, a clôturé cette semaine une levée de fonds de série B d'un montant déclaré de 30 millions de dollars (https://techcrunch.com/2024/06/19/encord-raises-30m-to-help-enterprises-with-the-messy-work-of-data-for-ai/). Ces chiffres soulignent que le « goulot d'étranglement des données » – la difficulté à nettoyer et à étiqueter les informations propriétaires – est désormais une cible principale pour le capital-risque.
Réglementation et risques juridiques du courtage de données
Cependant, la monétisation rapide des actifs de données fait l'objet d'un examen juridique croissant. Dans une décision réglementaire importante, le procureur général du Texas, Ken Paxton, a poursuivi Oracle (https://www.reuters.com/legal/texas-sues-oracle-over-sale-personal-data-2024-06-21/), alléguant que le géant de la technologie avait vendu les données personnelles de millions d'individus sans consentement adéquat. Le procès vise le rôle d'Oracle en tant que courtier de données, affirmant qu'il a créé des profils détaillés à vendre à des tiers. Ce litige sert de sombre rappel aux investisseurs en actifs de données : la valeur d'un ensemble de données est de plus en plus liée à sa provenance et à la clarté de sa chaîne de consentement. Alors que les régulateurs répriment la collecte de données non autorisée, le marché devrait se consolider autour d'ensembles de données « propres » et de modèles de licence transparents, tels que celui pionnier de Perplexity AI, qui a récemment lancé un programme de partage des revenus (https://www.theverge.com/2024/6/20/24182587/perplexity-ai-revenue-share-program-publishers/) pour les éditeurs.
Pourquoi c'est important pour les propriétaires de données
Pour les propriétaires de données, l'accord e&–AWS d'une valeur de 1 milliard de dollars et le pacte de licence TIME démontrent que les ensembles de données propriétaires ne sont plus de simples sous-produits opérationnels – ce sont des actifs liquides à haut rendement. Que ce soit par le biais de partenariats d'infrastructure souveraine ou de licences directes aux développeurs de LLM, le chemin vers la monétisation nécessite désormais deux choses : une archive historique massive ou un environnement de traitement sécurisé et localisé. Comme le montre l'affaire Texas–Oracle, les actifs de données les plus précieux en 2026 seront ceux qui sont non seulement vastes, mais aussi juridiquement irréfutables.
Data Academy
Go deeper with our guides
Acheter de la donnée sans se tromper
La due diligence acheteur en 6 points
Read the guide →3 min readVotre expertise vaut de l'or pour l'IA
Le raisonnement d'expert, nouvelle matière première
Read the guide →3 min readVos vidéos d'atelier valent une fortune
La pénurie de données du monde physique
Read the guide →From the marketplace
Explore live data opportunities
Opportunité de jeu de données de capteurs industriels — Bess Germany
View opportunity →IndustrielSybotx — Opportunité de jeu de données de capteurs industriels
View opportunity →IndustrielAlthensensors — Opportunité de jeu de données de capteurs industriels
View opportunity →News & Insights
Latest from the briefing
- Pourquoi les données rares sous licence sont la clé de la conformité à l'AI Act de l'UE
- Comment valoriser des jeux de données d'images spécialisés pour les modèles de vision IA
- Comment valoriser et vendre des ensembles de données de langues rares et de langues des signes
- Comment valoriser et licencier des vidéos égocentriques d'atelier pour l'IA en robotique
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →