biological dataai fundingdata licensingdefense airegulation1 juli 2026

EvolutionaryScale haalt $142 miljoen op om biologische datamodellen op te schalen

De startup sluit een seed-ronde om generatieve AI te bouwen met behulp van een dataset van 2,78 miljard eiwitsequenties.

EvolutionaryScale heeft een bekendgemaakte seedfinancieringsronde van $142 miljoen (forbes.com) afgesloten om de ontwikkeling van generatieve AI-modellen, getraind op enorme biologische datasets, te versnellen. De ronde, geleid door Nat Friedman, Daniel Gross en Lux Capital, positioneert het bedrijf om biologie te behandelen als een programmeerbaar data-actief, gebruikmakend van zijn nieuwe ESM3-model dat is getraind op een dataset van 2,78 miljard eiwitsequenties (evolutionaryscale.ai). Deze mijlpaal onderstreept de escalerende waarde van niet-tekstuele, domeinspecifieke data in de race om geavanceerde AI-mogelijkheden.

De Opkomst van Biologische Data-Activa

In tegenstelling tot algemene LLM's die het publieke web afschrapen, is de waardepropositie van EvolutionaryScale gebouwd op de curatie en verwerking van gespecialiseerde biologische informatie. Het ESM3-model is een multimodale generatieve model dat kan redeneren over de sequentie, structuur en functie van eiwitten. Door biljoenen datapunten (evolutionaryscale.ai) uit de natuurlijke wereld te verwerken, streeft de startup ernaar onderzoekers in staat te stellen nieuwe eiwitten te "programmeren", waardoor de tijdlijnen voor medicijnontdekking mogelijk van jaren naar weken worden verkort. Deze "ChatGPT voor biologie"-aanpak benadrukt een bredere markttrend: de monetisatie van propriëtaire, high-fidelity wetenschappelijke datasets die niet gemakkelijk kunnen worden gerepliceerd door generieke crawlers.

Licenties vs. Rechtszaken: De Strijd om Data-Rechten

De financiering van datarijke startups zoals EvolutionaryScale komt op een moment dat het juridische landschap voor data-acquisitie een kookpunt bereikt. OpenAI en Time Magazine hebben onlangs een meerjarige contentlicentieovereenkomst (openai.com) afgesloten, waardoor OpenAI toegang krijgt tot het 101-jarige archief van Time. Hoewel de exacte financiële voorwaarden niet zijn bekendgemaakt, wijzen analisten in de sector naar de geschatte deal van $250 miljoen van OpenAI met News Corp (reuters.com) als een benchmark voor de premie die nu wordt geplaatst op geverifieerde menselijke journalistiek.

Daarentegen wordt de kosten van het verwerven van ongelicenseerde data prohibitief hoog. De RIAA, die grote labels zoals Sony en Universal vertegenwoordigt, eist wettelijke schadevergoedingen tot $150.000 per werk (reuters.com) in een rechtszaak tegen AI-muziekstartups Suno en Udio. Met honderdduizenden opnames die naar verluidt zonder toestemming zijn gebruikt, kan de totale aansprakelijkheid naar schatting $13,5 miljard (reuters.com) bedragen. Deze juridische druk dwingt een overgang af van de "fair use"-verdediging naar een gestructureerde datamarktplaats waar elke trainings-token een duidelijke herkomst en prijskaartje heeft.

Kapitaalinstroom in Data-Intensieve Infrastructuur

De vraag naar data-ready AI heeft ook geleid tot enorme infrastructuurinvesteringen. Helsing, een Europees defensie-AI-bedrijf, heeft een bekendgemaakte €450 miljoen (reuters.com) binnengehaald in een Series C-ronde, waarmee het bedrijf wordt gewaardeerd op een geschatte €5 miljard (bloomberg.com). De software-gedefinieerde defensiesystemen van Helsing zijn afhankelijk van real-time verwerking van slagveldsensordata, wat een kritieke verticale vertegenwoordigt voor de monetisatie van data-activa in de publieke sector. Evenzo heeft Etched.ai een bekendgemaakte $120 miljoen (techcrunch.com) opgehaald om gespecialiseerde chips te bouwen die specifiek zijn ontworpen om de enorme data-doorvoer te verwerken die vereist is door Transformer-modellen.

In de juridische tech-ruimte zou de startup Harvey in gesprek zijn om nieuw kapitaal op te halen met een geschatte waardering van $2 miljard (techcrunch.com). De kernactiviteit van Harvey is de toegang tot en verwerking van propriëtaire juridische data, wat verder bewijst dat de markt bedrijven beloont die de "data moat" beheersen in plaats van alleen het algoritme.

Waarom het ertoe doet voor data-eigenaren

Voor institutionele data-eigenaren bevestigen de deals van EvolutionaryScale en OpenAI-Time dat het tijdperk van gratis data-scraping ten einde loopt. Data is niet langer een bijproduct van bedrijfsvoering; het is een primaire activaklasse. Of het nu gaat om biologische sequenties, historische archieven of juridische precedenten, de markt biedt nu twee duidelijke paden: licentiepartnerschappen van miljoenen dollars voor degenen die meewerken, en rechtszaken van miljarden dollars voor degenen wiens activa zonder toestemming worden afgenomen. Naarmate AI-modellen gespecialiseerder worden, zal de waarde van niche, high-integrity datasets blijven stijgen ten opzichte van de waarde van generieke, van het web afgeschraapte content.

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →