OpenAI en Time sluiten meerjarige licentieovereenkomst voor data
OpenAI verkrijgt toegang tot 101 jaar aan Time-archieven om ChatGPT te verfijnen en modellen van de volgende generatie te trainen.
OpenAI heeft officieel een meerjarige licentieovereenkomst voor content gesloten met Time Magazine, waardoor het AI-gigant toegang krijgt tot meer dan 101 jaar aan gearchiveerde rapportages om zijn generatieve modellen te verfijnen en de realtime antwoorden van ChatGPT te verbeteren. Hoewel de specifieke financiële voorwaarden niet bekend zijn gemaakt, suggereren industriële benchmarks dat de deal de waarderingstrend volgt van OpenAI's eerdere meerjarige partnerschap met News Corp ter waarde van $250 miljoen (https://www.cnbc.com/2024/05/22/news-corp-strikes-multiyear-deal-with-openai.html). Deze nieuwste acquisitie van premium redactionele data stelt OpenAI in staat om de journalistiek van Time met de juiste citaten en links weer te geven, terwijl het tegelijkertijd het eeuwoude archief gebruikt voor back-end modeltraining.
De Strategische Pivot naar Gelicentieerde Redactionele Assets
Het partnerschap met Time is geen geïsoleerd evenement, maar een kernpilaar van OpenAI's strategie om juridische risico's te beperken en tegelijkertijd data van hoge kwaliteit te beveiligen. Door archieven te licentiëren die teruggaan tot 1923, koopt OpenAI effectief een gecureerde geschiedenis van de 20e en 21e eeuw. Deze stap volgt op een reeks vergelijkbare acquisities met hoge inzet, waaronder deals met Vox Media en The Atlantic, evenals internationale uitgevers zoals Axel Springer en Le Monde. De markt voor geverifieerde, door mensen geschreven data heeft een koortsachtig hoogtepunt bereikt nu AI-ontwikkelaars onder druk staan om af te stappen van ongeautoriseerde web-scraping praktijken die massale auteursrechtelijke geschillen hebben uitgelokt.
Voor Time vertegenwoordigt de deal een cruciale monetisatie van zijn legacy-assets. De publicatie krijgt toegang tot de technologie van OpenAI om nieuwe tools voor zijn lezers te ontwikkelen, wat duidt op een diepere integratie tussen traditionele media en AI-infrastructuur. Deze trend wordt elders in de markt weerspiegeld; bijvoorbeeld, SoftBank investeerde onlangs $200 miljoen (https://www.bloomberg.com/news/articles/2024-06-24/softbank-invests-200-million-in-ai-medical-firm-tempus-ai) in Tempus AI, een bedrijf dat zich richt op het benutten van enorme bibliotheken met klinische data om precisiegeneeskunde aan te drijven. Of het nu in de journalistiek of de gezondheidszorg is, de waarde van de onderliggende dataset is nu de primaire drijfveer voor kapitaaltoewijzing.
Juridische Druk en het Einde van Gratis Scraping
De urgentie achter OpenAI's licentie-offensief wordt onderstreept door een verhardend juridisch klimaat. Deze week nog hebben 's werelds grootste platenlabels, waaronder Sony Music en Universal Music Group, een grote rechtszaak aangespannen tegen AI-muziekstartups Suno en Udio, waarbij de ongeautoriseerde inzet van auteursrechtelijk beschermde opnames voor het trainen van hun systemen wordt geclaimd. De labels eisen schadevergoedingen tot wel $150.000 (https://www.reuters.com/legal/major-record-labels-sue-ai-firms-suno-udio-over-copyright-infringement-2024-06-24/) per inbreukmakend werk. Deze rechtszaken benadrukken de existentiële dreiging voor AI-bedrijven die zich beroepen op "fair use" argumenten voor grootschalige data-inname zonder compensatie.
Tegelijkertijd werven infrastructuuraanbieders enorme financieringsrondes om de verwerking van deze gelicentieerde datasets te ondersteunen. Etched, een gespecialiseerde chipfabrikant, haalde $120 miljoen (https://techcrunch.com/2024/06/25/etched-raises-120m-to-build-a-chip-that-only-runs-transformer-models/) aan Series A-financiering op om hardware te bouwen die specifiek is ontworpen om Transformer-modellen efficiënter te laten draaien. Naarmate de industrie volwassener wordt, verschuift de focus van generieke rekenkracht naar gespecialiseerde systemen die in staat zijn om maximale waarde te halen uit de specifieke, hoogwaardige datasilo's die worden ontsloten door deals zoals het OpenAI-Time-pact.
Regelgeving wordt Wereldwijd Strenger
Het regelgevende landschap dwingt ook tot een transparantere aanpak van data-acquisitie. De AI Act van de Europese Unie nadert de volledige implementatie, waardoor ontwikkelaars van algemene AI-modellen gedetailleerde samenvattingen moeten verstrekken van de data die voor training is gebruikt. Dit transparantievereiste maakt het voor bedrijven steeds moeilijker om het gebruik van gescrapte of illegale content te verbergen. In deze context is een directe licentieovereenkomst niet alleen een contentstrategie; het is een nalevingsnoodzaak.
De markt ziet een bifurcatie tussen "schone" modellen getraind op gelicentieerde data en "hoog-risico" modellen die blijven vertrouwen op controversiële scraping. Investeerders geven duidelijk de voorkeur aan de eerste, zoals blijkt uit de gerapporteerde discussies tussen Apple en Meta over de potentiële integratie van Meta's Llama-modellen in Apple Intelligence - een deal die waarschijnlijk strikte garanties voor dataherkomst zou vereisen om te voldoen aan de privacy- en wettelijke normen van Apple.
Waarom het ertoe doet voor data-eigenaren
De OpenAI-Time deal bevestigt dat het "data-als-een-asset" tijdperk van theorie naar realiteit van miljoenen dollars is geëvolueerd. Voor eigenaren van propriëtaire datasets - of het nu historische archieven, klinische dossiers of technische documentatie zijn - biedt de huidige markt een uniek venster om slapende assets te monetiseren. Nu AI-ontwikkelaars de voorraad van hoogwaardige publieke webdata uitputten, zal de premie op exclusieve, door mensen geverifieerde en juridisch goedgekeurde datasets blijven stijgen. Data-eigenaren moeten hun archieven niet alleen zien als een verslag van het verleden, maar als de essentiële brandstof voor de volgende generatie industriële en consumentenintelligentie.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Fleetalliance — Gelegenheid voor dataset met onderhoudslogboeken
View opportunity →mobiliteitCovase — Gelegenheid voor mobiliteitstelemetriedataset
View opportunity →overigeCruxbv — Gelegenheid voor dataset met regelgevingsgegevens
View opportunity →News & Insights
Latest from the briefing
- Hoe gespecialiseerde beeld datasets te waarderen voor AI-visiemodellen
- Hoe zeldzame taal- en gebarentaaldatasets te waarderen en verkopen
- Hoe Egocentrische Workshopvideo's voor Robotica AI te Waarderen en Licentiëren
- Hoe expert redeneerdata te prijzen voor LLM-training
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →