fundingdata licensingscale aiai infrastructure22. Juni 2026

Scale AI sichert sich 1 Mrd. USD in Serie F bei einer Bewertung von 13,8 Mrd. USD

Die von Accel angeführte Runde positioniert Scale AI als primäre 'Data Foundry' für die Entwicklung von Frontier-KI-Modellen.

Scale AI hat eine $1 billion Series F-Finanzierungsrunde abgeschlossen (scale.com), die seine Post-Money-Bewertung auf offengelegte $13.8 billion anhebt (bloomberg.com). Angeführt von Accel mit signifikanter Beteiligung von Nvidia, Amazon und Meta, signalisiert die Runde einen massiven Kapitalschwenk hin zum „Daten-Engpass“, mit dem die größten Entwickler von Large Language Models (LLM) derzeit konfrontiert sind. Da sich die Branche über die Ära des „Scraping des offenen Webs“ hinausbewegt, stellt die Mission von Scale AI, eine „Data Foundry“ aufzubauen, die bisher bedeutendste Investition in die Erstellung von expertenmarkierten, hochdichten Daten-Assets für souveräne und Unternehmens-KI dar.

Die Industrialisierung von KI-Daten

Die $1 billion-Injektion (scale.com) ist nicht nur eine Wachstumsrunde; es ist eine Infrastruktur-Investition. Scale AI positioniert sich als die wesentliche Raffinerie für den Rohstoff des 21. Jahrhunderts. Die Mittel werden verwendet, um ihre „Data Engine“ zu skalieren, die das Reinforcement Learning from Human Feedback (RLHF) liefert, das notwendig ist, um Modelle über aktuelle Argumentations-Plateaus hinaus zu heben. Mit Investoren wie Cisco Investments, Intel Capital und AMD Ventures (bloomberg.com), die dem Cap Table beitreten, unterstreicht der Deal einen branchenübergreifenden Konsens: Die nächste Generation der KI-Leistung wird durch Datenqualität gewonnen, nicht nur durch das Rechenvolumen.

Lizenzierungsgeschäfte erreichen einen Höhepunkt

Die Scale AI-Runde fällt mit einer beispiellosen Welle von direkten Datenerfassungsgeschäften zwischen Modellentwicklern und Eigentümern von Premium-Inhalten zusammen. Insbesondere unterzeichnete News Corp einen Mehrjahresvertrag mit OpenAI (wsj.com), der auf geschätzte $250 million über fünf Jahre (wsj.com) beziffert wird. Diese Partnerschaft gewährt OpenAI Zugriff auf Archive und aktuelle Inhalte von The Wall Street Journal, Barron’s und The Times, was einen definitiven Wandel hin zu lizenzierten, hochautoritativen Datensätzen markiert. Ähnlich bietet die Partnerschaft von OpenAI mit Reddit (openai.com) Echtzeitzugriff auf die Reddit Data API, was die Integration von menschzentrierten Konversationsdaten in ChatGPT und andere Produkte ermöglicht.

Kapitalisierung von verkörperten und spezialisierten Daten

Jenseits von textbasierten LLMs verzeichnet der Markt für spezialisierte Daten-Assets massive Kapitalzuflüsse. Wayve sicherte sich kürzlich $1.05 billion (reuters.com) in einer Series C-Runde unter der Leitung von SoftBank, um „Embodied AI“ für autonomes Fahren zu entwickeln. Dieser Deal unterstreicht den hohen Stellenwert von „Edge-Daten“ – realen sensorischen Informationen, die nicht allein durch synthetische Generierung repliziert werden können. Zur Unterstützung dieses datenintensiven Ökosystems sammelte CoreWeave $1.1 billion (techcrunch.com) ein, um seine spezialisierte Cloud-Infrastruktur zu erweitern, die speziell für den massiven Durchsatz ausgelegt ist, der für datenintensive KI-Trainings-Workloads erforderlich ist.

Die regulatorische und rechtliche Gegenreaktion

Da der Wert von Daten-Assets in die Höhe schnellt, gehen Rechteinhaber aggressiv vor, um ihr geistiges Eigentum zu schützen. Die Sony Music Group gab eine formelle Warnung an über 700 KI-Unternehmen (variety.com) heraus und erklärte ein ausdrückliches „Opt-out“ für unbefugtes Daten-Scraping für das KI-Training. Dies folgt auf eine Reihe von Lizenzvereinbarungen, wie den Deal von OpenAI mit Vox Media (theverge.com) und The Atlantic (theatlantic.com), was darauf hindeutet, dass die Ära des „Fair Use“ für Trainingsdaten rasch durch einen strukturierten, milliardenschweren Marktplatz für Content-Rechte ersetzt wird.

Warum es für Dateneigentümer wichtig ist

Für institutionelle Dateneigentümer bestätigen die Bewertung von Scale AI und der News Corp-Deal, dass proprietäre Datensätze keine sekundären Assets mehr sind – sie sind der primäre Hebel in der KI-Wirtschaft. Der Übergang von $250 million-Lizenzverträgen zu $1 billion-Finanzierungsrunden für Datenraffinerien deutet darauf hin, dass „saubere, expertenmarkierte Daten“ nun eine eigenständige Asset-Klasse sind. Eigentümer von einzigartigen, hochfrequenten oder historisch tiefen Daten sollten Data Governance und „KI-Bereitschaft“ priorisieren, um die Premium-Bewertungen zu erzielen, die nun von den größten Akteuren des Marktes festgelegt werden.

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →