Scale AI Asegura $1B Serie F con una Valoración de $13.8B
La ronda liderada por Accel posiciona a Scale AI como la principal 'Data Foundry' para el desarrollo de modelos de IA de vanguardia.
Scale AI ha finalizado una ronda de financiación Serie F de $1 mil millones (https://scale.com/blog/series-f) que eleva su valoración post-money a unos $13.8 mil millones revelados (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation). Liderada por Accel con una participación significativa de Nvidia, Amazon y Meta, la ronda señala un giro masivo de capital hacia el "cuello de botella de datos" que enfrentan actualmente los mayores desarrolladores de Large Language Model (LLM). A medida que la industria deja atrás la era del "raspado de la web abierta", la misión de Scale AI de construir una "Data Foundry" representa la inversión más significativa hasta la fecha en la creación de activos de datos de alta densidad etiquetados por expertos para IA soberana y empresarial.
La industrialización de los datos de IA
La inyección de $1 mil millones (https://scale.com/blog/series-f) no es simplemente una ronda de crecimiento; es una apuesta por la infraestructura. Scale AI se está posicionando como la refinería esencial para la materia prima del siglo XXI. La financiación se utilizará para escalar su "Data Engine", que proporciona el Reinforcement Learning from Human Feedback (RLHF) necesario para impulsar los modelos más allá de los actuales estancamientos de razonamiento. Con inversores como Cisco Investments, Intel Capital y AMD Ventures (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation) uniéndose a la tabla de capitalización, el acuerdo subraya un consenso intersectorial: la próxima generación de rendimiento de IA se ganará a través de la calidad de los datos, no solo del volumen de cómputo.
Los acuerdos de licencia alcanzan su punto álgido
La ronda de Scale AI coincide con una ola sin precedentes de acuerdos directos de adquisición de datos entre constructores de modelos y propietarios de contenido premium. Cabe destacar que News Corp firmó un acuerdo plurianual con OpenAI (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d) valorado en un estimado de $250 millones durante cinco años (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d). Esta asociación otorga a OpenAI acceso a archivos y contenido actual de The Wall Street Journal, Barron’s y The Times, marcando un cambio definitivo hacia conjuntos de datos licenciados y de alta autoridad. Del mismo modo, la asociación de OpenAI con Reddit (https://openai.com/index/openai-and-reddit-partnership/) proporciona acceso en tiempo real a la Reddit Data API, lo que permite la integración de datos conversacionales centrados en el ser humano en ChatGPT y otros productos.
Capitalizando los datos personificados y especializados
Más allá de los LLM basados en texto, el mercado de activos de datos especializados está recibiendo flujos masivos de capital. Wayve aseguró recientemente $1.05 mil millones (https://www.reuters.com/business/autos-transportation/uk-ai-start-up-wayve-raises-105-bln-softbank-led-funding-2024-05-07/) en una ronda Serie C liderada por SoftBank para desarrollar "Embodied AI" para la conducción autónoma. Este acuerdo destaca la prima otorgada a los "datos de borde" (edge data): información sensorial del mundo real que no puede ser replicada únicamente mediante generación sintética. Respaldando este ecosistema intensivo en datos, CoreWeave recaudó $1.1 mil millones (https://techcrunch.com/2024/05/01/coreweave-raises-1-1b-at-a-19b-valuation/) para expandir su infraestructura de nube especializada, diseñada específicamente para manejar el rendimiento masivo requerido para las cargas de trabajo de entrenamiento de IA con uso intensivo de datos.
La reacción regulatoria y de derechos
A medida que el valor de los activos de datos se dispara, los titulares de derechos están actuando agresivamente para proteger su propiedad intelectual. Sony Music Group emitió una advertencia formal a más de 700 empresas de IA (https://variety.com/2024/music/news/sony-music-warns-ai-companies-using-content-without-permission-1236006080/), declarando un "opt-out" explícito del raspado de datos no autorizado para el entrenamiento de IA. Esto sigue a una serie de acuerdos de licencia, como el trato de OpenAI con Vox Media (https://www.theverge.com/2024/5/13/24155488/openai-vox-media-licensing-deal-chatgpt) y The Atlantic (https://www.theatlantic.com/press-releases/archive/2024/05/the-atlantic-and-openai-announce-strategic-content-and-product-partnership/678526/), lo que sugiere que la era del "uso justo" para los datos de entrenamiento está siendo reemplazada rápidamente por un mercado estructurado de miles de millones de dólares para los derechos de contenido.
Por qué es importante para los propietarios de datos
Para los propietarios de datos institucionales, la valoración de Scale AI y el acuerdo con News Corp confirman que los conjuntos de datos propietarios ya no son activos secundarios: son la palanca principal en la economía de la IA. La transición de acuerdos de licencia de $250 millones a rondas de financiación de $1 mil millones para refinerías de datos indica que los "datos limpios y etiquetados por expertos" son ahora una clase de activo distinta. Los propietarios de datos únicos, de alta velocidad o históricamente profundos deben priorizar la gobernanza de datos y la "preparación para la IA" para capturar las valoraciones premium que ahora están estableciendo los actores más grandes del mercado.
Data Academy
Go deeper with our guides
Comprar datos sin equivocarse
La debida diligencia del comprador en 6 puntos
Read the guide →3 min readSu experiencia vale oro para la IA
El razonamiento de expertos, la nueva materia prima
Read the guide →3 min readSus videos de taller valen una fortuna
La escasez de datos del mundo físico
Read the guide →From the marketplace
Explore live data opportunities
Deringer — Oportunidad de Conjunto de Datos de Registros Regulatorios
View opportunity →industrialTheion — Oportunidad de Conjunto de Datos de Operaciones Industriales
View opportunity →industrialRarukautomation — Oportunidad de Conjunto de Datos de Registros de Mantenimiento
View opportunity →News & Insights
Latest from the briefing
- ¿Qué Activos de Datos de PYMES Son Más Valiosos para el Mercado Europeo de IA?
- Por qué los datos raros con licencia son la clave para el cumplimiento de la Ley de IA de la UE
- Cómo valorar conjuntos de datos de imágenes especializados para modelos de visión artificial
- Cómo valorar y vender conjuntos de datos de lenguas raras y lenguas de señas
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →