EvolutionaryScale haalt $142 miljoen op om biologische datamodellen op te schalen
De startup sluit een seed-ronde om generatieve AI te bouwen met behulp van een dataset van 2,78 miljard eiwitsequenties.
EvolutionaryScale heeft een bekendgemaakte seedfinancieringsronde van $142 miljoen (forbes.com) afgesloten om de ontwikkeling van generatieve AI-modellen, getraind op enorme biologische datasets, te versnellen. De ronde, geleid door Nat Friedman, Daniel Gross en Lux Capital, positioneert het bedrijf om biologie te behandelen als een programmeerbaar data-actief, gebruikmakend van zijn nieuwe ESM3-model dat is getraind op een dataset van 2,78 miljard eiwitsequenties (evolutionaryscale.ai). Deze mijlpaal onderstreept de escalerende waarde van niet-tekstuele, domeinspecifieke data in de race om geavanceerde AI-mogelijkheden.
De Opkomst van Biologische Data-Activa
In tegenstelling tot algemene LLM's die het publieke web afschrapen, is de waardepropositie van EvolutionaryScale gebouwd op de curatie en verwerking van gespecialiseerde biologische informatie. Het ESM3-model is een multimodale generatieve model dat kan redeneren over de sequentie, structuur en functie van eiwitten. Door biljoenen datapunten (evolutionaryscale.ai) uit de natuurlijke wereld te verwerken, streeft de startup ernaar onderzoekers in staat te stellen nieuwe eiwitten te "programmeren", waardoor de tijdlijnen voor medicijnontdekking mogelijk van jaren naar weken worden verkort. Deze "ChatGPT voor biologie"-aanpak benadrukt een bredere markttrend: de monetisatie van propriëtaire, high-fidelity wetenschappelijke datasets die niet gemakkelijk kunnen worden gerepliceerd door generieke crawlers.
Licenties vs. Rechtszaken: De Strijd om Data-Rechten
De financiering van datarijke startups zoals EvolutionaryScale komt op een moment dat het juridische landschap voor data-acquisitie een kookpunt bereikt. OpenAI en Time Magazine hebben onlangs een meerjarige contentlicentieovereenkomst (openai.com) afgesloten, waardoor OpenAI toegang krijgt tot het 101-jarige archief van Time. Hoewel de exacte financiële voorwaarden niet zijn bekendgemaakt, wijzen analisten in de sector naar de geschatte deal van $250 miljoen van OpenAI met News Corp (reuters.com) als een benchmark voor de premie die nu wordt geplaatst op geverifieerde menselijke journalistiek.
Daarentegen wordt de kosten van het verwerven van ongelicenseerde data prohibitief hoog. De RIAA, die grote labels zoals Sony en Universal vertegenwoordigt, eist wettelijke schadevergoedingen tot $150.000 per werk (reuters.com) in een rechtszaak tegen AI-muziekstartups Suno en Udio. Met honderdduizenden opnames die naar verluidt zonder toestemming zijn gebruikt, kan de totale aansprakelijkheid naar schatting $13,5 miljard (reuters.com) bedragen. Deze juridische druk dwingt een overgang af van de "fair use"-verdediging naar een gestructureerde datamarktplaats waar elke trainings-token een duidelijke herkomst en prijskaartje heeft.
Kapitaalinstroom in Data-Intensieve Infrastructuur
De vraag naar data-ready AI heeft ook geleid tot enorme infrastructuurinvesteringen. Helsing, een Europees defensie-AI-bedrijf, heeft een bekendgemaakte €450 miljoen (reuters.com) binnengehaald in een Series C-ronde, waarmee het bedrijf wordt gewaardeerd op een geschatte €5 miljard (bloomberg.com). De software-gedefinieerde defensiesystemen van Helsing zijn afhankelijk van real-time verwerking van slagveldsensordata, wat een kritieke verticale vertegenwoordigt voor de monetisatie van data-activa in de publieke sector. Evenzo heeft Etched.ai een bekendgemaakte $120 miljoen (techcrunch.com) opgehaald om gespecialiseerde chips te bouwen die specifiek zijn ontworpen om de enorme data-doorvoer te verwerken die vereist is door Transformer-modellen.
In de juridische tech-ruimte zou de startup Harvey in gesprek zijn om nieuw kapitaal op te halen met een geschatte waardering van $2 miljard (techcrunch.com). De kernactiviteit van Harvey is de toegang tot en verwerking van propriëtaire juridische data, wat verder bewijst dat de markt bedrijven beloont die de "data moat" beheersen in plaats van alleen het algoritme.
Waarom het ertoe doet voor data-eigenaren
Voor institutionele data-eigenaren bevestigen de deals van EvolutionaryScale en OpenAI-Time dat het tijdperk van gratis data-scraping ten einde loopt. Data is niet langer een bijproduct van bedrijfsvoering; het is een primaire activaklasse. Of het nu gaat om biologische sequenties, historische archieven of juridische precedenten, de markt biedt nu twee duidelijke paden: licentiepartnerschappen van miljoenen dollars voor degenen die meewerken, en rechtszaken van miljarden dollars voor degenen wiens activa zonder toestemming worden afgenomen. Naarmate AI-modellen gespecialiseerder worden, zal de waarde van niche, high-integrity datasets blijven stijgen ten opzichte van de waarde van generieke, van het web afgeschraapte content.
Sources
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Produmax — Kansen voor inspectierapportendatasets
View opportunity →financiënCavendish — Gelegenheid voor dataset met financiële transacties
View opportunity →industrieelDiscovery Acquisition — Gegevensset voor Industriële Operaties
View opportunity →News & Insights
Latest from the briefing
- Hoe Embedded Finance te integreren in Verticale Datamarkten
- Hoe gecentraliseerde verwijdering de economie van databrokerage opnieuw vormgeeft
- Verborgen aansprakelijkheden bij het kopen van ongeverifieerde data van brokers
- Hoe Universele Verwijderingsmechanismen de Waardering van Consumentengegevens Beïnvloeden
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →