fundingdata licensingscale aiai infrastructure22 juni 2026

Scale AI haalt $1 miljard Series F op met een waardering van $13,8 miljard

Door Accel geleide ronde positioneert Scale AI als de primaire 'Data Foundry' voor de ontwikkeling van geavanceerde AI-modellen.

Scale AI heeft een Series F-financieringsronde van $1 miljard afgerond (https://scale.com/blog/series-f) waarmee de post-money waardering stijgt naar een bekendgemaakte $13.8 miljard (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation). Geleid door Accel met aanzienlijke deelname van Nvidia, Amazon en Meta, signaleert de ronde een enorme kapitaalverschuiving naar de 'databottleneck' waarmee de grootste Large Language Model (LLM)-ontwikkelaars momenteel worden geconfronteerd. Nu de sector het tijdperk van het 'scrapen van het open web' achter zich laat, vertegenwoordigt de missie van Scale AI om een 'Data Foundry' te bouwen de belangrijkste investering tot nu toe in de creatie van door experts gelabelde, hoogwaardige data-assets voor soevereine en zakelijke AI.

De industrialisatie van AI-data

De injectie van $1 miljard (https://scale.com/blog/series-f) is niet louter een groeironde; het is een infrastructuurzet. Scale AI positioneert zichzelf als de essentiële raffinaderij voor de grondstof van de 21e eeuw. De financiering zal worden gebruikt om hun 'Data Engine' op te schalen, die de Reinforcement Learning from Human Feedback (RLHF) levert die nodig is om modellen voorbij de huidige redeneerplateaus te tillen. Met investeerders als Cisco Investments, Intel Capital en AMD Ventures (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation) die toetreden tot de cap table, onderstreept de deal een sectoroverschrijdende consensus: de volgende generatie AI-prestaties zal worden gewonnen door datakwaliteit, niet alleen door rekenvolume.

Licentiedeals bereiken een kookpunt

De ronde van Scale AI valt samen met een ongekende golf van directe data-acquisitiedeals tussen modelbouwers en eigenaren van premium content. Het meest opvallend is dat News Corp een meerjarige deal heeft getekend met OpenAI (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d) gewaardeerd op naar schatting $250 miljoen over vijf jaar (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d). Dit partnerschap verleent OpenAI toegang tot archieven en actuele content van The Wall Street Journal, Barron’s en The Times, wat een definitieve verschuiving markeert naar gelicentieerde datasets met een hoge autoriteit. Op vergelijkbare wijze biedt het partnerschap van OpenAI met Reddit (https://openai.com/index/openai-and-reddit-partnership/) realtime toegang tot de Reddit Data API, wat de integratie van mensgerichte conversationele data in ChatGPT en andere producten mogelijk maakt.

Kapitaliseren op belichaamde en gespecialiseerde data

Naast op tekst gebaseerde LLM's ziet de markt voor gespecialiseerde data-assets een enorme kapitaalinstroom. Wayve heeft onlangs $1.05 miljard binnengehaald (https://www.reuters.com/business/autos-transportation/uk-ai-start-up-wayve-raises-105-bln-softbank-led-funding-2024-05-07/) in een Series C-ronde geleid door SoftBank om 'Embodied AI' voor autonoom rijden te ontwikkelen. Deze deal benadrukt de premie die wordt geplaatst op 'edge data'—zintuiglijke informatie uit de echte wereld die niet alleen door synthetische generatie kan worden gereproduceerd. Ter ondersteuning van dit data-intensieve ecosysteem haalde CoreWeave $1.1 miljard op (https://techcrunch.com/2024/05/01/coreweave-raises-1-1b-at-a-19b-valuation/) om zijn gespecialiseerde cloudinfrastructuur uit te breiden, specifiek ontworpen om de enorme doorvoer te verwerken die nodig is voor data-intensieve AI-trainingsworkloads.

De reactie op het gebied van regelgeving en rechten

Nu de waarde van data-assets omhoogschiet, treden rechthebbenden agressief op om hun intellectuele eigendom te beschermen. Sony Music Group heeft een formele waarschuwing gestuurd naar meer dan 700 AI-bedrijven (https://variety.com/2024/music/news/sony-music-warns-ai-companies-using-content-without-permission-1236006080/), waarin een expliciete 'opt-out' wordt verklaard voor ongeoorloofde data-scraping voor AI-training. Dit volgt op een reeks licentieovereenkomsten, zoals de deal van OpenAI met Vox Media (https://www.theverge.com/2024/5/13/24155488/openai-vox-media-licensing-deal-chatgpt) en The Atlantic (https://www.theatlantic.com/press-releases/archive/2024/05/the-atlantic-and-openai-announce-strategic-content-and-product-partnership/678526/), wat suggereert dat het tijdperk van 'fair use' voor trainingsdata snel wordt vervangen door een gestructureerde marktplaats van miljarden dollars voor contentrechten.

Waarom het belangrijk is voor data-eigenaren

Voor institutionele data-eigenaren bevestigen de waardering van Scale AI en de deal met News Corp dat eigen datasets niet langer secundaire activa zijn—ze zijn de primaire hefboom in de AI-economie. De overgang van licentiedeals van $250 miljoen naar financieringsrondes van $1 miljard voor dataraffinaderijen geeft aan dat 'schone, door experts gelabelde data' nu een afzonderlijke activaklasse is. Eigenaren van unieke, hoogfrequente of historisch diepe data zouden prioriteit moeten geven aan datagovernance en 'AI-readiness' om de premium waarderingen te verzilveren die nu door de grootste spelers op de markt worden vastgesteld.

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →