biological dataai fundingdata licensingdefense airegulation1 juli 2026

EvolutionaryScale haalt $142 miljoen op om biologische datamodellen op te schalen

De startup sluit een seed-ronde om generatieve AI te bouwen met behulp van een dataset van 2,78 miljard eiwitsequenties.

EvolutionaryScale heeft een bekendgemaakte seed-financieringsronde van $142 miljoen (https://www.forbes.com/sites/alexkonrad/2024/06/25/evolutionaryscale-raises-142-million-for-biology-ai/) afgesloten om de ontwikkeling van generatieve AI-modellen, getraind op massale biologische datasets, te versnellen. De ronde, geleid door Nat Friedman, Daniel Gross en Lux Capital, positioneert het bedrijf om biologie te behandelen als een programmeerbaar data-actief, gebruikmakend van zijn nieuwe ESM3-model dat is getraind op een dataset van 2,78 miljard eiwitsequenties (https://www.evolutionaryscale.ai/blog/esm3-release). Deze mijlpaal onderstreept de escalerende waarde van niet-tekstuele, domeinspecifieke data in de race om geavanceerde AI-mogelijkheden.

De Opkomst van Biologische Data-Activa

In tegenstelling tot algemene LLM's die het publieke web scrapen, is de waardepropositie van EvolutionaryScale gebouwd op de curatie en verwerking van gespecialiseerde biologische informatie. Het ESM3-model is een multimodale generatieve model dat kan redeneren over de sequentie, structuur en functie van eiwitten. Door biljoenen datapunten (https://www.evolutionaryscale.ai/blog/esm3-release) uit de natuurlijke wereld te verwerken, streeft de startup ernaar onderzoekers in staat te stellen nieuwe eiwitten te "programmeren", wat de doorlooptijden voor medicijnontdekking potentieel kan verkorten van jaren naar weken. Deze "ChatGPT voor biologie"-aanpak benadrukt een bredere markttrend: de monetisatie van propriëtaire, hoogwaardige wetenschappelijke datasets die niet gemakkelijk kunnen worden gerepliceerd door generieke crawlers.

Licentiëring versus Rechtszaken: De Strijd om Data-Rechten

De financiering van datarijke startups zoals EvolutionaryScale komt op een moment dat het juridische landschap voor data-acquisitie een kookpunt bereikt. OpenAI en Time Magazine hebben onlangs een meerjarige contentlicentieovereenkomst gesloten (https://openai.com/index/openai-and-time-sign-multi-year-content-partnership-and-strategic-alliance/), waardoor OpenAI toegang krijgt tot het 101-jarige archief van Time. Hoewel de exacte financiële voorwaarden niet zijn bekendgemaakt, wijzen brancheanalisten naar de geschatte deal van $250 miljoen van OpenAI met News Corp (https://www.reuters.com/technology/news-corp-strikes-ai-content-licensing-deal-with-openai-2024-05-22/) als een benchmark voor de premie die nu wordt geplaatst op geverifieerde menselijke journalistiek.

Daarentegen worden de kosten van niet-gelicentieerde data-acquisitie prohibitief hoog. De RIAA, die grote labels zoals Sony en Universal vertegenwoordigt, eist wettelijke schadevergoedingen tot $150.000 per werk (https://www.reuters.com/legal/music-labels-sue-suno-udio-ai-copyright-infringement-2024-06-24/) in een rechtszaak tegen AI-muziekstartups Suno en Udio. Met honderdduizenden opnames die naar verluidt zonder toestemming zijn gebruikt, kan de totale aansprakelijkheid oplopen tot een geschatte $13,5 miljard (https://www.reuters.com/legal/music-labels-sue-suno-udio-ai-copyright-infringement-2024-06-24/). Deze juridische druk dwingt een overgang af van de "fair use"-verdediging naar een gestructureerde datamarktplaats waar elke trainings-token een duidelijke herkomst en prijskaartje heeft.

Kapitaalinstroom in Data-Intensieve Infrastructuur

De vraag naar data-ready AI heeft ook geleid tot massale infrastructuurinvesteringen. Helsing, een Europese defensie-AI-firma, heeft een bekendgemaakte €450 miljoen (https://www.reuters.com/technology/defense-ai-startup-helsing-raises-450-mln-euro-funding-round-2024-07-04/) opgehaald in een Series C-ronde, waarmee het bedrijf wordt gewaardeerd op een geschatte €5 miljard (https://www.bloomberg.com/news/articles/2024-06-17/defense-ai-startup-helsing-is-said-to-near-400-million-funding). De software-gedefinieerde defensiesystemen van Helsing zijn afhankelijk van real-time verwerking van slagveld-sensordata, wat een kritieke verticale vertegenwoordigt voor de monetisatie van data-activa in de publieke sector. Evenzo haalde Etched.ai een bekendgemaakte $120 miljoen (https://techcrunch.com/2024/06/25/etched-raises-120m-to-build-a-chip-that-only-runs-transformer-models/) op om gespecialiseerde chips te bouwen die specifiek zijn ontworpen om de enorme data-doorvoer te verwerken die vereist is door Transformer-modellen.

In de juridische tech-ruimte zou de startup Harvey in gesprek zijn om nieuw kapitaal op te halen tegen een geschatte waardering van $2 miljard (https://techcrunch.com/2024/06/25/legal-ai-startup-harvey-is-raising-600m-from-google-at-a-2b-valuation/). De kernactiviteit van Harvey is zijn toegang tot en verwerking van propriëtaire juridische data, wat verder bewijst dat de markt bedrijven beloont die de "data moat" beheersen in plaats van alleen het algoritme.

Waarom het ertoe doet voor data-eigenaren

Voor institutionele data-eigenaren bevestigen de deals van EvolutionaryScale en OpenAI-Time dat het tijdperk van gratis data-scraping ten einde loopt. Data is niet langer een bijproduct van bedrijfsvoering; het is een primaire activaklasse. Of het nu gaat om biologische sequenties, historische archieven of juridische precedenten, de markt biedt nu twee duidelijke paden: licentiepartnerschappen van meerdere miljoenen dollars voor degenen die meewerken, en rechtszaken van miljarden dollars voor degenen wiens activa zonder toestemming worden afgenomen. Naarmate AI-modellen gespecialiseerder worden, zal de waarde van niche, hoogwaardige datasets blijven stijgen ten opzichte van de waarde van generieke, van het web gescrapte inhoud.

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →