EvolutionaryScale Asegura $142M para "Modelos del Mundo" Biológicos
Nvidia y Amazon respaldan una ronda semilla de $142M para entrenar el modelo ESM3 en un conjunto de datos de 278 millones de proteínas.
EvolutionaryScale ha cerrado una ronda de financiación inicial de 142 millones de dólares (forbes.com) para acelerar el desarrollo de "modelos del mundo" de IA capaces de simular e ingeniar sistemas biológicos. La ronda, liderada por Lux Capital, Nat Friedman y Daniel Gross, con la participación de Nvidia y Amazon, posiciona a la startup a la vanguardia de la carrera armamentista de "datos para la biología". El capital está destinado al refinamiento de ESM3, un modelo de lenguaje de vanguardia para la biología que cuenta con 98 mil millones de parámetros (evolutionaryscale.ai) y fue entrenado en un conjunto de datos masivo de 2.78 mil millones de proteínas (evolutionaryscale.ai).
El Auge de los Modelos del Mundo Biológicos
A diferencia de la IA generativa tradicional que se enfoca en texto o píxeles, EvolutionaryScale está construyendo lo que los investigadores llaman un "modelo del mundo" para las ciencias de la vida. Al tratar el código genético como un lenguaje, el modelo ESM3 ha demostrado la capacidad de generar proteínas fluorescentes completamente nuevas que se desvían significativamente de las encontradas en la naturaleza, simulando efectivamente 500 millones de años de evolución (evolutionaryscale.ai) en un entorno digital. Esta capacidad señala un cambio en el mercado de activos de datos, donde los conjuntos de datos más valiosos ya no son solo texto extraído de la web, sino secuencias biológicas altamente especializadas y estructuradas que pueden usarse para "programar" la materia.
El Pivote de Licenciamiento de Datos: De Uso Justo a Activos Pagados
La ronda de EvolutionaryScale coincide con un cambio de mercado más amplio hacia el licenciamiento de datos de alta integridad. Mientras los datos biológicos se tokenizan para el descubrimiento de fármacos, los gigantes de los medios están asegurando sus propios archivos. OpenAI firmó recientemente un acuerdo de licencia de contenido multianual (time.com) con Time Magazine, otorgando al laboratorio de IA acceso a más de 100 años de archivos periodísticos. Si bien los términos financieros no se han revelado (reuters.com), el acuerdo sigue al punto de referencia de 250 millones de dólares revelado (reuters.com) establecido por el acuerdo de News Corp. De manera similar, YouTube está negociando (ft.com) con importantes sellos discográficos, incluidos Sony y Universal, para ofrecer sumas globales estimadas de varios millones de dólares (ft.com) por acceso legal a catálogos de música para entrenamiento de IA.
Vientos Regulatorios y Procedencia de Datos
A medida que el valor de los datos de entrenamiento se dispara, los reguladores y creadores se oponen al uso no autorizado. Figma recientemente deshabilitó su función de IA "Make Design" (theverge.com) tras las acusaciones de que fue entrenada con diseños de aplicaciones existentes, lo que resalta los riesgos legales de las tuberías de datos opacas. Además, la inversión reportada de SoftBank de 10 a 20 millones de dólares (bloomberg.com) en Perplexity AI se produce en medio de una avalancha de avisos de infracción de derechos de autor de editores, lo que sugiere que incluso las startups de IA de alto crecimiento ahora deben presupuestar considerablemente para el cumplimiento y la liquidación de datos. Esta tendencia se evidencia aún más en la ronda de financiación estimada de 100 millones de dólares de Harvey (techcrunch.com), que valora al especialista en datos legales en aproximadamente 1.5 mil millones de dólares (techcrunch.com premium impulsado por su acceso a conjuntos de datos legales propietarios y de alto riesgo.
Por qué importa para los propietarios de datos
El acuerdo de EvolutionaryScale demuestra que la frontera más lucrativa para la monetización de datos está cambiando del contenido general de la web a los "modelos del mundo específicos de dominio". Para los propietarios de datos en biología, derecho y música, el mercado ha ido más allá del simple licenciamiento a un modelo de asociación estratégica donde los datos son el catalizador principal para avances científicos y creativos. A medida que los laboratorios de IA como OpenAI y Anthropic agotan los datos públicos de la web, la prima sobre los conjuntos de datos limpios, propietarios y legalmente autorizados continuará aumentando, transformando los archivos pasivos en activos financieros de alto rendimiento.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Bentham — Oportunidad de Conjunto de Datos de Registros Regulatorios
View opportunity →industrialOportunidad de Activo de Datos Descargable — Dcubed
View opportunity →industrialUmweltanalytik Saalfeld — Oportunidad de Conjunto de Datos de Informes de Inspección
View opportunity →News & Insights
Latest from the briefing
- Cómo los mecanismos universales de eliminación impactan la valoración de datos del consumidor
- Cómo determinar si su empresa califica como un recopilador de datos regulado
- El Costo Operacional Real de Escalar un Negocio de Monetización de Datos
- ¿La concesión de licencias de datos a modelos de IA canibaliza el tráfico de referencia?
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →