biological aidata acquisitionfunding roundbiotech dataregulation25 juni 2026

EvolutionaryScale haalt $142 miljoen op voor training van AI op 2,8 miljard eiwitsequenties

Geleid door Lux Capital, richt de startup voor biologische AI zich op de markt voor medicijnontdekking met eigen genomische datasets.

EvolutionaryScale heeft een seedfinancieringsronde van $142 miljoen afgerond (https://techcrunch.com/2024/06/25/evolutionaryscale-is-building-a-chatgpt-for-biology-with-142m-from-nat-friedman-and-lux-capital/) om ESM3 te commercialiseren, een generatief AI-model getraind op een enorme corpus van 2,78 miljard eiwitsequenties (https://www.forbes.com/sites/alexkonrad/2024/06/25/evolutionaryscale-raises-142-million-for-biological-ai/). De ronde, geleid door Lux Capital, Nat Friedman en Daniel Gross, met deelname van Amazon en NVentures (het venture-onderdeel van Nvidia), signaleert een beslissende verschuiving in de markt voor data-activa: de overgang van algemene LLM's naar gespecialiseerde, high-fidelity biologische datamodellen. ESM3 vertegenwoordigt een van de grootste toepassingen van wetenschappelijke data in het AI-tijdperk, met 98 miljard parameters (https://www.forbes.com/sites/alexkonrad/2024/06/25/evolutionaryscale-raises-142-million-for-biological-ai/) en het vermogen om 500 miljoen jaar evolutie te simuleren om nieuwe eiwitten te ontwerpen.

De Biologische Data Frontier

In tegenstelling tot de tekst-heavy datasets die de eerste golf van generatieve AI aandreven, is de waardepropositie van EvolutionaryScale volledig gebouwd op de curatie en verwerking van genomische en proteomische data. Door te trainen op miljarden sequenties creëert het bedrijf effectief een "programmeerbare biologie" laag. Deze stap onderstreept de premie die nu wordt geplaatst op gestructureerde wetenschappelijke data, die veel schaarser en moeilijker te verwerken is dan publieke webteksten. De betrokkenheid van Amazon en Nvidia (https://techcrunch.com/2024/06/25/evolutionaryscale-is-building-a-chatgpt-for-biology-with-142m-from-nat-friedman-and-lux-capital/) suggereert dat de infrastructuurproviders gretig zijn om een voet aan de grond te krijgen in de biologische datapijplijn, die naar verwachting de farmaceutische R&D-sector van $1 biljoen zal revolutioneren.

OpenAI's Strategische Data Acquisitie

De zoektocht naar data-efficiëntie beperkt zich niet tot biologie. OpenAI kondigde onlangs de overname aan van Rockset (https://openai.com/index/openai-to-acquire-rockset/), een bedrijf voor real-time zoek- en analyse databases. Deze overname is een duidelijke tactische zet om de retrieval-augmented generation (RAG) mogelijkheden van OpenAI te versterken. Door de technologie van Rockset te integreren, kan OpenAI de enorme datasets die door zijn zakelijke partners worden geleverd effectiever indexeren en bevragen, waardoor statische data repositories worden omgezet in dynamische, bruikbare intelligentie. Deze deal benadrukt het groeiende belang van de "data-to-model" interface - de softwarelaag die bepaalt hoe efficiënt een AI toegang kan krijgen tot en kan redeneren over bedrijfseigen activa.

De Klinische Data Land Grab

Verder benadrukkend de waarde van gespecialiseerde data, heeft HEALWELL AI een definitieve overeenkomst gesloten om BioPharma Services (https://www.globenewswire.com/news-release/2024/06/24/2903058/0/en/HEALWELL-AI-to-Acquire-BioPharma-Services-a-Leading-Full-Service-Contract-Research-Organization.html) te verwerven voor ongeveer $11,5 miljoen (https://www.globenewswire.com/news-release/2024/06/24/2903058/0/en/HEALWELL-AI-to-Acquire-BioPharma-Services-a-Leading-Full-Service-Contract-Research-Organization.html). BioPharma Services is een full-service Contract Research Organization (CRO) die diepe klinische proefdata-activa bezit. Voor HEALWELL is dit niet alleen een uitbreiding van diensten, maar een strategische acquisitie van een datapijplijn. Toegang tot hoogwaardige klinische proefdata is de belangrijkste bottleneck voor AI-gedreven medicijnontdekking en gepersonaliseerde geneeskunde, en het verwerven van een CRO biedt een directe, bedrijfseigen bron van de "ground truth" data die nodig is om diagnostische en therapeutische modellen te trainen.

Regelgevende Muren en Data Portabiliteit

Naarmate de waarde van data-activa stijgt, bewegen regelgevers zich om ervoor te zorgen dat deze waarde niet wordt opgesloten achter de "walled gardens" van Big Tech. De Europese Commissie heeft onlangs voorlopige bevindingen uitgegeven dat Apple de Digital Markets Act (DMA) schendt (https://ec.europa.eu/commission/presscorner/detail/en/ip_24_3433). De focus van het onderzoek omvat de sturingsregels van Apple, die ontwikkelaars verhinderen consumenten vrijelijk naar alternatieve aanbiedingen en data-ecosystemen te leiden. Deze regelgevende druk maakt deel uit van een bredere wereldwijde trend gericht op het afdwingen van data-portabiliteit en interoperabiliteit. Voor data-investeerders zijn deze uitspraken cruciaal: ze signaleren een toekomst waarin de controle over gebruikersdata en het vermogen om deze te gelde te maken via secundaire licenties onderhevig zullen zijn aan intense antitrust-scrutiny.

Waarom het ertoe doet voor data-eigenaren

De deals van EvolutionaryScale en Healwell demonstreren dat de meest lucratieve data-activa niet langer te vinden zijn op het "open web", maar in gespecialiseerde domeinen met hoge barrières, zoals genomica en klinische geneeskunde. Voor data-eigenaren is de les duidelijk: de markt beweegt weg van bulkdata-licenties naar high-precision, gestructureerde datasets die direct kunnen worden opgenomen door gespecialiseerde AI-architecturen. Of het nu gaat om eiwitsequenties of real-time zakelijke data, de waarde ligt in het unieke vermogen van de data om specifieke, waardevolle problemen op te lossen die algemene modellen niet kunnen aanpakken. Monetisatiestrategieën moeten zich richten op data-reinheid, naleving van regelgeving en het vermogen om te integreren met de nieuwste RAG- en generatieve architecturen.

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →