OpenAI schließt Datenlizenzierungsabkommen mit News Corp über 250 Mio. USD ab
Die Fünfjahresvereinbarung sichert Premium-Journalismusarchive von WSJ und Barron’s für KI-Training und -Inferenz.
OpenAI hat eine wegweisende Content-Lizenzvereinbarung mit News Corp formalisiert, ein Deal, dessen Wert auf über $250 million (wsj.com) über einen Zeitraum von fünf Jahren geschätzt wird. Diese offengelegte Partnerschaft gewährt dem von Microsoft unterstützten KI-Giganten Zugang zu aktuellen und archivierten Inhalten bedeutender Publikationen wie The Wall Street Journal, Barron’s, MarketWatch und The Times, wodurch erstklassige journalistische Erzeugnisse effektiv in einen hochpräzisen Trainingsstream für seine Weltmodelle der nächsten Generation verwandelt werden. Der Schritt signalisiert eine strategische Neuausrichtung von OpenAI, um seine Datenpipeline gegen die wachsenden rechtlichen und ethischen Risiken im Zusammenhang mit unbefugtem Web-Scraping abzusichern.
Der strategische Wert erstklassiger Text-Assets
Die Vereinbarung ist nicht bloß ein defensives rechtliches Manöver; sie ist eine kalkulierte Wette auf die überlegene Performance kuratierter, hochgradig autoritativer Datensätze. Da Frontier-Modelle an die Grenzen öffentlich verfügbarer Internetdaten stoßen, tritt die Branche in eine Phase der „Datenknappheit“ ein, in der die Qualität der Token wichtiger ist als das reine Volumen. Durch die Sicherung des News Corp-Archivs erhält OpenAI Zugang zu jahrzehntelangen strukturierten, faktengeprüften und kontextuell reichen menschlichen Überlegungen. Dies ist entscheidend für die Verbesserung der faktischen Genauigkeit und der Argumentationsfähigkeiten von Modellen wie GPT-5, die darauf abzielen, als zuverlässigere Agenten in professionellen und finanziellen Umgebungen zu fungieren. Der Deal ist so strukturiert, dass OpenAI das Recht erhält, Inhalte als Reaktion auf Nutzeranfragen anzuzeigen, was die Grenze zwischen Suchmaschinen und generativen KI-Schnittstellen weiter verwischt.
Scale AI und die $1B Infrastruktur des Datenüberflusses
Das institutionelle Streben nach qualitativ hochwertigen Daten wird ferner durch die kürzlich abgeschlossene Series F-Finanzierungsrunde von Scale AI in Höhe von $1 billion (techcrunch.com) belegt, die das Unternehmen mit $13.8 billion (reuters.com) bewertete. Scale AI fungiert als entscheidender Vermittler in der Daten-Asset-Ökonomie und bietet das Human-in-the-loop (HITL) Labeling und RLHF (Reinforcement Learning from Human Feedback), das erforderlich ist, um Rohdaten – wie die News Corp-Archive – in maschinenfertige Trainingssets zu verwandeln. Diese Finanzierungsrunde, angeführt von Accel unter Beteiligung von Staatsfonds, unterstreicht, dass die physische und menschliche Infrastruktur zur Datenverarbeitung mittlerweile ebenso wertvoll ist wie die Rechenleistung selbst. Während sich Weltmodelle weiterentwickeln, um multimodale Eingaben – Video, Audio und Sensordaten – zu verarbeiten, steigt die Komplexität der Kennzeichnung dieser Assets exponentiell an, was einen massiven Wettbewerbsvorteil für diejenigen schafft, die die Datenlieferkette kontrollieren.
DeepL und der Aufstieg spezialisierter Daten-Burgräben
Während Allzweckmodelle um Nachrichtenarchive kämpfen, beweisen spezialisierte KI-Firmen den Wert von Nischen-Daten-Assets. DeepL, der deutsche Spezialist für Übersetzungs-KI, sicherte sich kürzlich Investitionen in Höhe von $300 million (reuters.com) bei einer Bewertung von $2 billion (techcrunch.com). Der Erfolg von DeepL basiert auf einem proprietären Datensatz hochwertiger Übersetzungen, der größere Modelle übertrifft, die mit verrauschteren Daten trainiert wurden. Dies bestätigt einen wachsenden Trend im d-nvest Intelligence-Bereich: Datenbesitzer, die über einzigartige, branchenspezifische Datensätze verfügen (rechtlich, medizinisch oder linguistisch), erleben einen sprunghaften Anstieg ihrer Asset-Bewertungen, da generalistische KI-Unternehmen versuchen, spezialisierte „Wissens-Burgräben“ zu erwerben, um ihre Angebote zu differenzieren.
Regulatorische Leitplanken: Der EU AI Act ist finalisiert
Der Markt für Datengeschäfte operiert nun unter einem neuen globalen Standard. Der European Council hat dem EU AI Act, dem weltweit ersten umfassenden Rahmenwerk für künstliche Intelligenz, offiziell seine endgültige Zustimmung (consilium.europa.eu) erteilt. Die Verordnung führt strenge Transparenzanforderungen für Allzweck-KI-Modelle ein, einschließlich der Verpflichtung, detaillierte Zusammenfassungen der für das Training verwendeten Daten bereitzustellen. Diese regulatorische Klarheit wird voraussichtlich den Trend zu formellen Lizenzvereinbarungen beschleunigen, da Unternehmen versuchen, die Einstufung als „Hochrisiko“ und potenzielle Geldstrafen im Zusammenhang mit nicht konformer Datenbeschaffung zu vermeiden. Für Dateninvestoren transformiert der EU AI Act die Datenherkunft von einer rechtlichen Fußnote zu einem primären Bewertungstreiber.
Warum es für Datenbesitzer wichtig ist
Für Besitzer hochwertiger, strukturierter Daten-Assets ist der OpenAI-News Corp-Deal ein Wendepunkt, der einen klaren Marktpreis für Premium-Inhalte festlegt. Wir bewegen uns von einer Ära der Datenausbeutung hin zu einer Ära der Datenmonetarisierung. Da KI-Entwickler ihren Fokus auf „World Models“ verlagern, die ein tiefes kontextuelles Verständnis und eine faktische Fundierung erfordern, verlagert sich die Hebelwirkung zurück zu den Inhaltserstellern. Datenbesitzer sollten ihre Archive nicht länger als historische Aufzeichnungen betrachten, sondern als renditestarke liquide Assets, die wiederholt über verschiedene KI-Vertikalen hinweg lizenziert werden können. Der Schlüssel zur Maximierung des Wertes liegt in der Datenbereitschaft: Sicherzustellen, dass Archive digitalisiert, metadatenreich und rechtlich für das KI-Training freigegeben sind.
Data Academy
Go deeper with our guides
Ihre Expertise ist Gold für KI wert
Experten-Denken, neuer Rohstoff
Read the guide →3 min readIhre Werkstattvideos sind ein Vermögen wert
Die Knappheit von Daten aus der physischen Welt
Read the guide →3 min readIhre seltene Sprache ist für KI nicht auffindbar
Die Lücke bei unterrepräsentierten Sprachen
Read the guide →From the marketplace
Explore live data opportunities
Asicnorth — Industrielles Sensor-Datensatz-Angebot
View opportunity →MobilitätOdwlogistics — Herunterladbare Daten-Asset-Möglichkeit
View opportunity →MobilitätKopflogistics — Gelegenheit für Datensatz zu industriellen Abläufen
View opportunity →News & Insights
Latest from the briefing
- Sind Sie ein versehentlicher Datenbroker? Neue finanzielle Risiken erklärt
- Nachweisanforderungen für EU-KI-Gesetz-Untersuchungen
- Wie man Embedded Finance in vertikale Datenmarktplätze integriert
- Wie zentralisierte Löschung die Ökonomie des Datenbrokerings neu gestaltet
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →