EvolutionaryScale Ottiene 142 Milioni di Dollari per "World Models" Biologici
Nvidia e Amazon supportano un round seed da 142 Milioni di Dollari per addestrare il modello ESM3 su un dataset di 278 milioni di proteine.
EvolutionaryScale ha chiuso un round di finanziamento seed da 142 milioni di dollari (forbes.com) per accelerare lo sviluppo di "modelli del mondo" AI in grado di simulare e ingegnerizzare sistemi biologici. Il round, guidato da Lux Capital, Nat Friedman e Daniel Gross, con la partecipazione di Nvidia e Amazon, posiziona la startup all'avanguardia nella corsa agli armamenti "data-for-biology". Il capitale è destinato al perfezionamento di ESM3, un modello linguistico all'avanguardia per la biologia che vanta 98 miliardi di parametri (evolutionaryscale.ai) ed è stato addestrato su un enorme set di dati di 2,78 miliardi di proteine (evolutionaryscale.ai).
L'ascesa dei modelli del mondo biologici
A differenza dell'IA generativa tradizionale che si concentra su testo o pixel, EvolutionaryScale sta costruendo quello che i ricercatori chiamano un "modello del mondo" per le scienze della vita. Trattando il codice genetico come un linguaggio, il modello ESM3 ha dimostrato la capacità di generare proteine fluorescenti completamente nuove che deviano significativamente da quelle trovate in natura, simulando efficacemente 500 milioni di anni di evoluzione (evolutionaryscale.ai) in un ambiente digitale. Questa capacità segnala un cambiamento nel mercato degli asset di dati, dove i set di dati più preziosi non sono più solo testo raccolto dal web, ma sequenze biologiche altamente specializzate e strutturate che possono essere utilizzate per "programmare" la materia.
Il pivot del licensing dei dati: da fair use ad asset a pagamento
Il round di EvolutionaryScale coincide con un più ampio spostamento del mercato verso il licensing di dati ad alta integrità. Mentre i dati biologici vengono tokenizzati per la scoperta di farmaci, i giganti dei media stanno assicurando i propri archivi. OpenAI ha recentemente firmato un accordo di licenza di contenuti pluriennale (time.com) con Time Magazine, concedendo al laboratorio AI l'accesso a oltre 100 anni di archivi giornalistici. Sebbene i termini finanziari rimangano riservati (reuters.com), l'accordo segue il benchmark di 250 milioni di dollari (reuters.com) stabilito dall'accordo News Corp. Allo stesso modo, YouTube starebbe negoziando (ft.com) con le principali etichette discografiche, tra cui Sony e Universal, per offrire somme forfettarie stimate in milioni di dollari (ft.com) per l'accesso legale ai cataloghi musicali per l'addestramento AI.
Ostacoli normativi e provenienza dei dati
Poiché il valore dei dati di addestramento sale alle stelle, i regolatori e i creatori si oppongono all'uso non autorizzato. Figma ha recentemente disabilitato la sua funzionalità AI "Make Design" (theverge.com) a seguito di accuse secondo cui sarebbe stata addestrata su progetti di app esistenti, evidenziando i rischi legali delle pipeline di dati opache. Inoltre, l'investimento di SoftBank di 10-20 milioni di dollari (bloomberg.com) in Perplexity AI avviene nel mezzo di una raffica di avvisi di violazione del copyright da parte degli editori, suggerendo che anche le startup AI ad alta crescita devono ora preventivare pesantemente la conformità dei dati e le transazioni. Questa tendenza è ulteriormente evidenziata dal round di finanziamento stimato di 100 milioni di dollari di Harvey (techcrunch.com), che valuta lo specialista di dati legali a circa 1,5 miliardi di dollari (techcrunch.com premium guidato dal suo accesso a set di dati legali proprietari e ad alto rischio).
Perché è importante per i proprietari di dati
L'accordo EvolutionaryScale dimostra che la frontiera più redditizia per la monetizzazione dei dati si sta spostando dai contenuti web generali ai "modelli del mondo specifici del dominio". Per i proprietari di dati in biologia, diritto e musica, il mercato è andato oltre la semplice licenza per un modello di partnership strategica in cui i dati sono il catalizzatore primario per scoperte scientifiche e creative. Poiché i laboratori AI come OpenAI e Anthropic esauriscono i dati web pubblici, il premio sui set di dati puliti, proprietari e legalmente approvati continuerà ad aumentare, trasformando gli archivi passivi in asset finanziari ad alto rendimento.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Bentham — Opportunità di Dataset di Registrazioni Normative
View opportunity →industrialeDcubed — Opportunità di Asset Dati Scaricabile
View opportunity →industrialeUmweltanalytik Saalfeld — Opportunità di Dataset di Rapporti di Ispezione
View opportunity →News & Insights
Latest from the briefing
- Come i Meccanismi di Cancellazione Universale Impattano la Valutazione dei Dati dei Consumatori
- Come determinare se la tua attività si qualifica come raccoglitore di dati regolamentato
- Il Vero Costo Operativo della Scalabilità di un Business di Monetizzazione dei Dati
- La concessione in licenza di dati a modelli AI cannibalizza il traffico di riferimento?
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →