Scale AI sichert sich 1 Mrd. USD in Serie F bei einer Bewertung von 13,8 Mrd. USD
Die von Accel angeführte Runde positioniert Scale AI als primäre 'Data Foundry' für die Entwicklung von Frontier-KI-Modellen.
Scale AI hat eine $1 billion Series F-Finanzierungsrunde abgeschlossen (scale.com), die seine Post-Money-Bewertung auf offengelegte $13.8 billion anhebt (bloomberg.com). Angeführt von Accel mit signifikanter Beteiligung von Nvidia, Amazon und Meta, signalisiert die Runde einen massiven Kapitalschwenk hin zum „Daten-Engpass“, mit dem die größten Entwickler von Large Language Models (LLM) derzeit konfrontiert sind. Da sich die Branche über die Ära des „Scraping des offenen Webs“ hinausbewegt, stellt die Mission von Scale AI, eine „Data Foundry“ aufzubauen, die bisher bedeutendste Investition in die Erstellung von expertenmarkierten, hochdichten Daten-Assets für souveräne und Unternehmens-KI dar.
Die Industrialisierung von KI-Daten
Die $1 billion-Injektion (scale.com) ist nicht nur eine Wachstumsrunde; es ist eine Infrastruktur-Investition. Scale AI positioniert sich als die wesentliche Raffinerie für den Rohstoff des 21. Jahrhunderts. Die Mittel werden verwendet, um ihre „Data Engine“ zu skalieren, die das Reinforcement Learning from Human Feedback (RLHF) liefert, das notwendig ist, um Modelle über aktuelle Argumentations-Plateaus hinaus zu heben. Mit Investoren wie Cisco Investments, Intel Capital und AMD Ventures (bloomberg.com), die dem Cap Table beitreten, unterstreicht der Deal einen branchenübergreifenden Konsens: Die nächste Generation der KI-Leistung wird durch Datenqualität gewonnen, nicht nur durch das Rechenvolumen.
Lizenzierungsgeschäfte erreichen einen Höhepunkt
Die Scale AI-Runde fällt mit einer beispiellosen Welle von direkten Datenerfassungsgeschäften zwischen Modellentwicklern und Eigentümern von Premium-Inhalten zusammen. Insbesondere unterzeichnete News Corp einen Mehrjahresvertrag mit OpenAI (wsj.com), der auf geschätzte $250 million über fünf Jahre (wsj.com) beziffert wird. Diese Partnerschaft gewährt OpenAI Zugriff auf Archive und aktuelle Inhalte von The Wall Street Journal, Barron’s und The Times, was einen definitiven Wandel hin zu lizenzierten, hochautoritativen Datensätzen markiert. Ähnlich bietet die Partnerschaft von OpenAI mit Reddit (openai.com) Echtzeitzugriff auf die Reddit Data API, was die Integration von menschzentrierten Konversationsdaten in ChatGPT und andere Produkte ermöglicht.
Kapitalisierung von verkörperten und spezialisierten Daten
Jenseits von textbasierten LLMs verzeichnet der Markt für spezialisierte Daten-Assets massive Kapitalzuflüsse. Wayve sicherte sich kürzlich $1.05 billion (reuters.com) in einer Series C-Runde unter der Leitung von SoftBank, um „Embodied AI“ für autonomes Fahren zu entwickeln. Dieser Deal unterstreicht den hohen Stellenwert von „Edge-Daten“ – realen sensorischen Informationen, die nicht allein durch synthetische Generierung repliziert werden können. Zur Unterstützung dieses datenintensiven Ökosystems sammelte CoreWeave $1.1 billion (techcrunch.com) ein, um seine spezialisierte Cloud-Infrastruktur zu erweitern, die speziell für den massiven Durchsatz ausgelegt ist, der für datenintensive KI-Trainings-Workloads erforderlich ist.
Die regulatorische und rechtliche Gegenreaktion
Da der Wert von Daten-Assets in die Höhe schnellt, gehen Rechteinhaber aggressiv vor, um ihr geistiges Eigentum zu schützen. Die Sony Music Group gab eine formelle Warnung an über 700 KI-Unternehmen (variety.com) heraus und erklärte ein ausdrückliches „Opt-out“ für unbefugtes Daten-Scraping für das KI-Training. Dies folgt auf eine Reihe von Lizenzvereinbarungen, wie den Deal von OpenAI mit Vox Media (theverge.com) und The Atlantic (theatlantic.com), was darauf hindeutet, dass die Ära des „Fair Use“ für Trainingsdaten rasch durch einen strukturierten, milliardenschweren Marktplatz für Content-Rechte ersetzt wird.
Warum es für Dateneigentümer wichtig ist
Für institutionelle Dateneigentümer bestätigen die Bewertung von Scale AI und der News Corp-Deal, dass proprietäre Datensätze keine sekundären Assets mehr sind – sie sind der primäre Hebel in der KI-Wirtschaft. Der Übergang von $250 million-Lizenzverträgen zu $1 billion-Finanzierungsrunden für Datenraffinerien deutet darauf hin, dass „saubere, expertenmarkierte Daten“ nun eine eigenständige Asset-Klasse sind. Eigentümer von einzigartigen, hochfrequenten oder historisch tiefen Daten sollten Data Governance und „KI-Bereitschaft“ priorisieren, um die Premium-Bewertungen zu erzielen, die nun von den größten Akteuren des Marktes festgelegt werden.
Sources
Data Academy
Go deeper with our guides
Ihre spezialisierten Bilder sind selten
Das Visuelle, das KI online nicht findet
Read the guide →3 min readSeltene und konforme Daten kaufen
Der EU AI Act-Ansatz für Käufer
Read the guide →4 min readDatenmarktplätze, erklärt
Cloud-nativ, unabhängig, vertikal – und was jeder davon preisgibt
Read the guide →From the marketplace
Explore live data opportunities
Mazzetti — Opportunity for Public Procurement Dataset
View opportunity →IndustrieFenka — Gelegenheit für Datensatz mit Wartungsprotokollen
View opportunity →IndustrieTriggertech — Opportunity für Datensatz mit regulatorischen Aufzeichnungen
View opportunity →News & Insights
Latest from the briefing
- Kann die Lizenzierung von Daten für KI-Modelle den Empfehlungsverkehr kannibalisieren?
- Ist personalisierte Preisgestaltung legal? Compliance für datengesteuerte Einnahmen
- Ist Ihre Datenbroker-Registrierung jetzt ein tägliches finanzielles Risiko?
- Die finanziellen und strategischen Kosten der Nichteinhaltung von Datenbrokern
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →