Scale AI haalt $1 miljard Series F op met een waardering van $13,8 miljard
Door Accel geleide ronde positioneert Scale AI als de primaire 'Data Foundry' voor de ontwikkeling van geavanceerde AI-modellen.
Scale AI heeft een Series F-financieringsronde van $1 miljard afgerond (scale.com), waarmee de waardering na financiering stijgt naar een bekendgemaakte $13.8 miljard (bloomberg.com). Onder leiding van Accel, met aanzienlijke deelname van Nvidia, Amazon en Meta, signaleert de ronde een enorme kapitaalverschuiving naar de 'databottleneck' waar de grootste ontwikkelaars van Large Language Models (LLM) momenteel mee te maken hebben. Nu de sector het tijdperk van het 'scrapen van het open web' achter zich laat, vertegenwoordigt de missie van Scale AI om een 'Data Foundry' te bouwen de meest significante investering tot nu toe in de creatie van door experts gelabelde, hoogwaardige data-assets voor soevereine en zakelijke AI.
De industrialisatie van AI-data
De injectie van $1 miljard (scale.com) is niet louter een groeironde; het is een infrastructuurzet. Scale AI positioneert zichzelf als de essentiële raffinaderij voor de grondstof van de 21e eeuw. De financiering zal worden gebruikt om hun 'Data Engine' op te schalen, die de Reinforcement Learning from Human Feedback (RLHF) levert die nodig is om modellen voorbij de huidige redeneerplateaus te tillen. Met investeerders als Cisco Investments, Intel Capital en AMD Ventures (bloomberg.com) die toetreden tot de cap table, onderstreept de deal een sectoroverschrijdende consensus: de volgende generatie AI-prestaties zal worden gewonnen door datakwaliteit, niet alleen door rekenkracht.
Licentiedeals bereiken een kookpunt
De ronde van Scale AI valt samen met een ongekende golf van directe data-acquisitiedeals tussen modelbouwers en eigenaren van premium content. Het meest opvallend is dat News Corp een meerjarige deal heeft getekend met OpenAI (wsj.com) met een geschatte waarde van $250 miljoen over vijf jaar (wsj.com). Dit partnerschap geeft OpenAI toegang tot archieven en actuele content van The Wall Street Journal, Barron’s en The Times, wat een definitieve verschuiving markeert naar gelicentieerde datasets met een hoge autoriteit. Op vergelijkbare wijze biedt het partnerschap van OpenAI met Reddit (openai.com) realtime toegang tot de Reddit Data API, wat de integratie van mensgerichte conversationele data in ChatGPT en andere producten mogelijk maakt.
Kapitaliseren op belichaamde en gespecialiseerde data
Naast op tekst gebaseerde LLM's ziet de markt voor gespecialiseerde data-assets een enorme kapitaalinstroom. Wayve heeft onlangs $1.05 miljard opgehaald (reuters.com) in een Series C-ronde onder leiding van SoftBank om 'Embodied AI' voor autonoom rijden te ontwikkelen. Deze deal benadrukt de premie die wordt geplaatst op 'edge data'—zintuiglijke informatie uit de echte wereld die niet alleen door synthetische generatie kan worden gereproduceerd. Ter ondersteuning van dit data-intensieve ecosysteem heeft CoreWeave $1.1 miljard opgehaald (techcrunch.com) om zijn gespecialiseerde cloudinfrastructuur uit te breiden, specifiek ontworpen om de enorme doorvoer te verwerken die nodig is voor data-intensieve AI-trainingsworkloads.
De reactie op het gebied van regelgeving en rechten
Terwijl de waarde van data-assets omhoogschiet, ondernemen rechthebbenden agressieve stappen om hun intellectuele eigendom te beschermen. Sony Music Group heeft een formele waarschuwing gestuurd naar meer dan 700 AI-bedrijven (variety.com), waarin een expliciete 'opt-out' wordt verklaard voor het ongeoorloofd scrapen van data voor AI-training. Dit volgt op een reeks licentieovereenkomsten, zoals de deal van OpenAI met Vox Media (theverge.com) en The Atlantic (theatlantic.com), wat suggereert dat het tijdperk van 'fair use' voor trainingsdata snel wordt vervangen door een gestructureerde marktplaats van miljarden dollars voor contentrechten.
Waarom het belangrijk is voor data-eigenaren
Voor institutionele data-eigenaren bevestigen de waardering van Scale AI en de deal met News Corp dat eigen datasets niet langer secundaire activa zijn—ze zijn de primaire hefboom in de AI-economie. De overgang van licentiedeals van $250 miljoen naar financieringsrondes van $1 miljard voor dataraffinaderijen geeft aan dat 'schone, door experts gelabelde data' nu een afzonderlijke activaklasse is. Eigenaren van unieke, hoogfrequente of historisch diepe data zouden prioriteit moeten geven aan datagovernance en 'AI-gereedheid' om de premiumwaarderingen te verzilveren die nu door de grootste spelers op de markt worden vastgesteld.
Sources
Data Academy
Go deeper with our guides
Uw gespecialiseerde afbeeldingen zijn zeldzaam
De beelden die AI niet online kan vinden
Read the guide →3 min readKoop zeldzame, conforme data
De EU AI Act-hoek voor kopers
Read the guide →4 min readData marketplaces, uitgelegd
Cloud-native, onafhankelijk, verticaal — en wat elk afruilt
Read the guide →From the marketplace
Explore live data opportunities
Mazzetti — Mogelijkheid voor dataset openbare aanbestedingen
View opportunity →industrieelFenka — Gelegenheid voor dataset met onderhoudslogboeken
View opportunity →industrieelTriggertech — Gelegenheid voor dataset met regelgevingsgegevens
View opportunity →News & Insights
Latest from the briefing
- Kann Licentieverlening van Data aan AI-modellen verwijzend verkeer kannibaliseren?
- Is Gepersonaliseerde Prijsstelling Legaal? Naleving voor Datagedreven Omzet
- Is Your Data Broker Registration Now a Daily Financial Risk?
- De financiële en strategische kosten van niet-naleving door databrokers
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →