Scale AI Ottiene 1 Miliardo di Dollari Serie F con una Valutazione di 13,8 Miliardi di Dollari
Il round guidato da Accel posiziona Scale AI come la principale 'Data Foundry' per lo sviluppo di modelli AI all'avanguardia.
Scale AI ha finalizzato un round di finanziamento Series F da $1 miliardo (https://scale.com/blog/series-f) che eleva la sua valutazione post-money a $13.8 miliardi dichiarati (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation). Guidato da Accel con una partecipazione significativa di Nvidia, Amazon e Meta, il round segnala un massiccio spostamento di capitale verso il 'collo di bottiglia dei dati' che i principali sviluppatori di Large Language Model (LLM) stanno attualmente affrontando. Mentre l'industria supera l'era dello 'scraping del web aperto', la missione di Scale AI di costruire una 'Data Foundry' rappresenta l'investimento più significativo fino ad oggi nella creazione di asset di dati ad alta densità ed etichettati da esperti per l'IA sovrana e aziendale.
L'industrializzazione dei dati per l'IA
L'iniezione di $1 miliardo (https://scale.com/blog/series-f) non è semplicemente un round di crescita; è una mossa infrastrutturale. Scale AI si sta posizionando come la raffineria essenziale per la materia prima del XXI secolo. Il finanziamento sarà utilizzato per scalare il loro 'Data Engine', che fornisce il Reinforcement Learning from Human Feedback (RLHF) necessario per spingere i modelli oltre gli attuali plateau di ragionamento. Con investitori come Cisco Investments, Intel Capital e AMD Ventures (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation) che si uniscono alla tabella di capitalizzazione, l'accordo sottolinea un consenso intersettoriale: la prossima generazione di prestazioni dell'IA sarà vinta attraverso la qualità dei dati, non solo il volume di calcolo.
Gli accordi di licenza raggiungono il culmine
Il round di Scale AI coincide con un'ondata senza precedenti di accordi diretti di acquisizione dati tra costruttori di modelli e proprietari di contenuti premium. In particolare, News Corp ha firmato un accordo pluriennale con OpenAI (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d) valutato circa $250 milioni in cinque anni (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d). Questa partnership garantisce a OpenAI l'accesso agli archivi e ai contenuti attuali di The Wall Street Journal, Barron’s e The Times, segnando un passaggio definitivo verso dataset autorizzati e ad alta autorevolezza. Allo stesso modo, la partnership di OpenAI con Reddit (https://openai.com/index/openai-and-reddit-partnership/) fornisce accesso in tempo reale alla Reddit Data API, consentendo l'integrazione di dati conversazionali incentrati sull'uomo in ChatGPT e altri prodotti.
Capitalizzare sui dati incarnati e specializzati
Oltre ai LLM basati su testo, il mercato degli asset di dati specializzati sta vedendo massicci afflussi di capitale. Wayve ha recentemente ottenuto $1.05 miliardi (https://www.reuters.com/business/autos-transportation/uk-ai-start-up-wayve-raises-105-bln-softbank-led-funding-2024-05-07/) in un round Series C guidato da SoftBank per sviluppare l' 'Embodied AI' per la guida autonoma. Questo accordo evidenzia il valore attribuito agli 'edge data' — informazioni sensoriali del mondo reale che non possono essere replicate solo dalla generazione sintetica. A supporto di questo ecosistema ad alta intensità di dati, CoreWeave ha raccolto $1.1 miliardi (https://techcrunch.com/2024/05/01/coreweave-raises-1-1b-at-a-19b-valuation/) per espandere la sua infrastruttura cloud specializzata, progettata specificamente per gestire il massiccio throughput richiesto per i carichi di lavoro di addestramento dell'IA ad alta intensità di dati.
La reazione normativa e sui diritti
Mentre il valore degli asset di dati sale alle stelle, i titolari dei diritti si stanno muovendo in modo aggressivo per proteggere la loro proprietà intellettuale. Sony Music Group ha emesso un avvertimento formale a oltre 700 aziende di IA (https://variety.com/2024/music/news/sony-music-warns-ai-companies-using-content-without-permission-1236006080/), dichiarando un esplicito 'opt-out' dallo scraping non autorizzato di dati per l'addestramento dell'IA. Ciò segue una serie di accordi di licenza, come l'accordo di OpenAI con Vox Media (https://www.theverge.com/2024/5/13/24155488/openai-vox-media-licensing-deal-chatgpt) e The Atlantic (https://www.theatlantic.com/press-releases/archive/2024/05/the-atlantic-and-openai-announce-strategic-content-and-product-partnership/678526/), suggerendo che l'era del 'fair use' per i dati di addestramento sta venendo rapidamente sostituita da un mercato strutturato da miliardi di dollari per i diritti sui contenuti.
Perché è importante per i proprietari di dati
Per i proprietari di dati istituzionali, la valutazione di Scale AI e l'accordo con News Corp confermano che i dataset proprietari non sono più asset secondari: sono la leva primaria nell'economia dell'IA. La transizione da accordi di licenza da $250 milioni a round di finanziamento da $1 miliardo per le raffinerie di dati indica che i 'dati puliti ed etichettati da esperti' sono ora una classe di asset distinta. I proprietari di dati unici, ad alta velocità o storicamente profondi dovrebbero dare priorità alla governance dei dati e alla 'AI-readiness' per catturare le valutazioni premium che vengono ora stabilite dai più grandi attori del mercato.
Data Academy
Go deeper with our guides
Acquistare dati senza errori
La due diligence dell'acquirente in 6 punti
Read the guide →3 min readLa tua expertise vale oro per l'IA
Il ragionamento di un esperto, la nuova materia prima
Read the guide →3 min readI tuoi video di officina valgono una fortuna
La scarsità di dati del mondo fisico
Read the guide →From the marketplace
Explore live data opportunities
Deringer — Opportunità di Dataset di Registri Normativi
View opportunity →industrialeTheion — Opportunità di Dataset per Operazioni Industriali
View opportunity →industrialeRarukautomation — Opportunità di Dataset di Log di Manutenzione
View opportunity →News & Insights
Latest from the briefing
- Quali Asset di Dati delle PMI sono più preziosi per il Mercato Europeo dell'IA?
- Perché i Dati Rari con Licenza sono la Chiave per la Conformità all'AI Act dell'UE
- Come Valutare Dataset di Immagini Specializzati per Modelli AI di Visione
- Come valutare e vendere dataset di lingue rare e di lingua dei segni
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →