Scale AI haalt $1 miljard Series F op om Data Engine voor Frontier Modellen te schalen
Accel leidt massale ronde met een waardering van $13,8 miljard voor de data-labeling gigant nu de vraag naar hoogwaardige AI-trainingssets piekt.
Scale AI heeft een Series F-financieringsronde van $1 miljard afgesloten, waardoor de waardering is gestegen tot een bekendgemaakte $13,8 miljard (https://techcrunch.com/2024/05/21/scale-ai-raises-1-billion-at-a-13-8-billion-valuation/) nu de wereldwijde race om high-fidelity AI-trainingsdata een hoogtepunt bereikt. De ronde, geleid door Accel met deelname van Nvidia, Amazon en Meta, signaleert een massale institutionele weddenschap op de 'data engine' als de belangrijkste bottleneck voor de ontwikkeling van frontier modellen. De expansie van Scale AI komt op een cruciaal moment waarop het aanbod van hoogwaardige publieke internetdata bijna uitgeput is, waardoor AI-labs gedwongen worden over te schakelen op op maat gemaakte, door mensen aangestuurde data-generatie en geavanceerde synthetische data-pipelines.
De Verschuiving naar Premium Data Licenties
De financiering van Scale AI is symptomatisch voor een bredere marktverschuiving waarbij data niet langer als een grondstof wordt behandeld, maar als een waardevol strategisch bezit. Deze trend wordt verder aangetoond door de baanbrekende meerjarige samenwerking van News Corp met OpenAI, een deal die naar schatting meer dan $250 miljoen (https://www.reuters.com/technology/news-corp-strikes-content-licensing-deal-with-openai-2024-05-22/) over vijf jaar waard is. Onder de overeenkomst krijgt OpenAI toegang tot actuele en gearchiveerde content van grote publicaties zoals The Wall Street Journal en The Times, wat de high-reasoning capaciteiten biedt die alleen professionele redactionele data kan leveren. Deze stap suggereert dat het tijdperk van 'gratis scrapen' effectief voorbij is, vervangen door een gestructureerde markt voor gelicentieerde IP.
Infrastructuur en Governance Kapitaal
Naarmate het volume van beheerde propriëtaire data toeneemt, trekt de infrastructuur die dit ondersteunt recordkapitaal aan. CoreWeave heeft onlangs een bekendgemaakte schuldfinanciering van $7,5 miljard (https://www.reuters.com/technology/coreweave-raises-75-bln-debt-led-by-blackstone-magnetar-2024-05-17/) verkregen om zijn datacenter footprint uit te breiden, waardoor de rekenkracht beschikbaar is om deze enorme nieuwe datasets te verwerken. Tegelijkertijd wordt datagovernance een zelfstandige investeringsthese. Atlan haalde een bekendgemaakte Series C van $105 miljoen (https://atlan.com/news/series-c-funding/) op om ondernemingen te helpen hun 'data estates' te beheren, zodat de data die in AI-modellen wordt gevoerd, compliant, schoon en traceerbaar is – een voorwaarde voor elke enterprise-grade AI-implementatie.
De Opkomst van Gespecialiseerde Data Assets
Naast algemene LLM's zien gespecialiseerde data voor verticale AI aanzienlijke waarderingspremies. DeepL, de specialist in taalvertaling, heeft een bekendgemaakte investering van $300 miljoen verkregen met een waardering van $2 miljard (https://www.forbes.com/sites/iainmartin/2024/05/22/deepl-the-german-ai-translation-startup-hits-2-billion-valuation-with-300-million-investment/) om zijn propriëtaire linguïstische datasets te verdubbelen. Dit benadrukt een groeiende secundaire markt voor 'expert-grade' data die de mogelijkheden van generieke web-gecrawlde informatie overstijgt. Ondertussen blijft autonoom rijden de meest data-intensieve verticale, geïllustreerd door Wayve's bekendgemaakte Series C van $1,05 miljard (https://wayve.ai/news/series-c/) geleid door SoftBank, dat 'Embodied AI' wil commercialiseren door middel van grootschalige sensor dataverwerking.
Waarom het ertoe doet voor data-eigenaren
Voor data-eigenaren bevestigen de deals van Scale AI en News Corp dat we de 'Oogstfase' van de AI-economie zijn ingegaan. Hoogwaardige, door mensen geverifieerde data is nu de schaarste hulpbron in de AI-toeleveringsketen. Eigenaren van propriëtaire archieven, gespecialiseerde technische documentatie of real-world sensordata 'slaan' informatie niet langer alleen op; ze zitten op de grondstoffen voor de volgende generatie soevereine en enterprise AI. Monetisatiestrategieën verschuiven van eenmalige verkopen naar terugkerende licentiemodellen, waarbij de waarde van de data wordt geïndexeerd aan de prestaties en inkomsten van de modellen die het traint.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Advancedoptics — Datasetmogelijkheid voor Inspectierapporten
View opportunity →financiënInbonis — Mogelijkheid voor dataset met openbare aanbestedingen
View opportunity →industrieelDhg — Industriële Sensordata Mogelijkheid
View opportunity →News & Insights
Latest from the briefing
- Hoe expert redeneerdata te prijzen voor LLM-training
- Data Due Diligence: Een Checklist van 6 Punten voor AI-Licenties met Hoge Inzet
- Bouwen versus Kopen: Wanneer externe data verwerven voor AI en groei
- Prijsstelling van auteursrechtelijk beschermd materiaal voor AI-training: een waarderingskader
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →