Scale AI haalt $1 miljard Series F op met een waardering van $13,8 miljard
Door Accel geleide ronde positioneert Scale AI als de primaire 'Data Foundry' voor de ontwikkeling van geavanceerde AI-modellen.
Scale AI heeft een Series F-financieringsronde van $1 miljard afgerond (https://scale.com/blog/series-f) waarmee de post-money waardering stijgt naar een bekendgemaakte $13.8 miljard (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation). Geleid door Accel met aanzienlijke deelname van Nvidia, Amazon en Meta, signaleert de ronde een enorme kapitaalverschuiving naar de 'databottleneck' waarmee de grootste Large Language Model (LLM)-ontwikkelaars momenteel worden geconfronteerd. Nu de sector het tijdperk van het 'scrapen van het open web' achter zich laat, vertegenwoordigt de missie van Scale AI om een 'Data Foundry' te bouwen de belangrijkste investering tot nu toe in de creatie van door experts gelabelde, hoogwaardige data-assets voor soevereine en zakelijke AI.
De industrialisatie van AI-data
De injectie van $1 miljard (https://scale.com/blog/series-f) is niet louter een groeironde; het is een infrastructuurzet. Scale AI positioneert zichzelf als de essentiële raffinaderij voor de grondstof van de 21e eeuw. De financiering zal worden gebruikt om hun 'Data Engine' op te schalen, die de Reinforcement Learning from Human Feedback (RLHF) levert die nodig is om modellen voorbij de huidige redeneerplateaus te tillen. Met investeerders als Cisco Investments, Intel Capital en AMD Ventures (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation) die toetreden tot de cap table, onderstreept de deal een sectoroverschrijdende consensus: de volgende generatie AI-prestaties zal worden gewonnen door datakwaliteit, niet alleen door rekenvolume.
Licentiedeals bereiken een kookpunt
De ronde van Scale AI valt samen met een ongekende golf van directe data-acquisitiedeals tussen modelbouwers en eigenaren van premium content. Het meest opvallend is dat News Corp een meerjarige deal heeft getekend met OpenAI (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d) gewaardeerd op naar schatting $250 miljoen over vijf jaar (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d). Dit partnerschap verleent OpenAI toegang tot archieven en actuele content van The Wall Street Journal, Barron’s en The Times, wat een definitieve verschuiving markeert naar gelicentieerde datasets met een hoge autoriteit. Op vergelijkbare wijze biedt het partnerschap van OpenAI met Reddit (https://openai.com/index/openai-and-reddit-partnership/) realtime toegang tot de Reddit Data API, wat de integratie van mensgerichte conversationele data in ChatGPT en andere producten mogelijk maakt.
Kapitaliseren op belichaamde en gespecialiseerde data
Naast op tekst gebaseerde LLM's ziet de markt voor gespecialiseerde data-assets een enorme kapitaalinstroom. Wayve heeft onlangs $1.05 miljard binnengehaald (https://www.reuters.com/business/autos-transportation/uk-ai-start-up-wayve-raises-105-bln-softbank-led-funding-2024-05-07/) in een Series C-ronde geleid door SoftBank om 'Embodied AI' voor autonoom rijden te ontwikkelen. Deze deal benadrukt de premie die wordt geplaatst op 'edge data'—zintuiglijke informatie uit de echte wereld die niet alleen door synthetische generatie kan worden gereproduceerd. Ter ondersteuning van dit data-intensieve ecosysteem haalde CoreWeave $1.1 miljard op (https://techcrunch.com/2024/05/01/coreweave-raises-1-1b-at-a-19b-valuation/) om zijn gespecialiseerde cloudinfrastructuur uit te breiden, specifiek ontworpen om de enorme doorvoer te verwerken die nodig is voor data-intensieve AI-trainingsworkloads.
De reactie op het gebied van regelgeving en rechten
Nu de waarde van data-assets omhoogschiet, treden rechthebbenden agressief op om hun intellectuele eigendom te beschermen. Sony Music Group heeft een formele waarschuwing gestuurd naar meer dan 700 AI-bedrijven (https://variety.com/2024/music/news/sony-music-warns-ai-companies-using-content-without-permission-1236006080/), waarin een expliciete 'opt-out' wordt verklaard voor ongeoorloofde data-scraping voor AI-training. Dit volgt op een reeks licentieovereenkomsten, zoals de deal van OpenAI met Vox Media (https://www.theverge.com/2024/5/13/24155488/openai-vox-media-licensing-deal-chatgpt) en The Atlantic (https://www.theatlantic.com/press-releases/archive/2024/05/the-atlantic-and-openai-announce-strategic-content-and-product-partnership/678526/), wat suggereert dat het tijdperk van 'fair use' voor trainingsdata snel wordt vervangen door een gestructureerde marktplaats van miljarden dollars voor contentrechten.
Waarom het belangrijk is voor data-eigenaren
Voor institutionele data-eigenaren bevestigen de waardering van Scale AI en de deal met News Corp dat eigen datasets niet langer secundaire activa zijn—ze zijn de primaire hefboom in de AI-economie. De overgang van licentiedeals van $250 miljoen naar financieringsrondes van $1 miljard voor dataraffinaderijen geeft aan dat 'schone, door experts gelabelde data' nu een afzonderlijke activaklasse is. Eigenaren van unieke, hoogfrequente of historisch diepe data zouden prioriteit moeten geven aan datagovernance en 'AI-readiness' om de premium waarderingen te verzilveren die nu door de grootste spelers op de markt worden vastgesteld.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Deringer — Mogelijkheid voor Dataset met Regelgevende Documenten
View opportunity →industrieTheion — Kans voor dataset over industriële operaties
View opportunity →industrieelRarukautomation — Kansen voor dataset met onderhoudslogboeken
View opportunity →News & Insights
Latest from the briefing
- Welke MKB-data-activa zijn het meest waardevol voor de Europese AI-markt?
- Waarom gelicentieerde zeldzame data de sleutel is tot naleving van de EU AI Act
- Hoe gespecialiseerde beeld datasets te waarderen voor AI-visiemodellen
- Hoe zeldzame taal- en gebarentaaldatasets te waarderen en verkopen
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →