fundingdata licensingscale aiai infrastructure22 giugno 2026

Scale AI Ottiene 1 Miliardo di Dollari Serie F con una Valutazione di 13,8 Miliardi di Dollari

Il round guidato da Accel posiziona Scale AI come la principale 'Data Foundry' per lo sviluppo di modelli AI all'avanguardia.

Scale AI ha finalizzato un round di finanziamento Series F da $1 miliardo (https://scale.com/blog/series-f) che eleva la sua valutazione post-money a $13.8 miliardi dichiarati (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation). Guidato da Accel con una partecipazione significativa di Nvidia, Amazon e Meta, il round segnala un massiccio spostamento di capitale verso il 'collo di bottiglia dei dati' che i principali sviluppatori di Large Language Model (LLM) stanno attualmente affrontando. Mentre l'industria supera l'era dello 'scraping del web aperto', la missione di Scale AI di costruire una 'Data Foundry' rappresenta l'investimento più significativo fino ad oggi nella creazione di asset di dati ad alta densità ed etichettati da esperti per l'IA sovrana e aziendale.

L'industrializzazione dei dati per l'IA

L'iniezione di $1 miliardo (https://scale.com/blog/series-f) non è semplicemente un round di crescita; è una mossa infrastrutturale. Scale AI si sta posizionando come la raffineria essenziale per la materia prima del XXI secolo. Il finanziamento sarà utilizzato per scalare il loro 'Data Engine', che fornisce il Reinforcement Learning from Human Feedback (RLHF) necessario per spingere i modelli oltre gli attuali plateau di ragionamento. Con investitori come Cisco Investments, Intel Capital e AMD Ventures (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation) che si uniscono alla tabella di capitalizzazione, l'accordo sottolinea un consenso intersettoriale: la prossima generazione di prestazioni dell'IA sarà vinta attraverso la qualità dei dati, non solo il volume di calcolo.

Gli accordi di licenza raggiungono il culmine

Il round di Scale AI coincide con un'ondata senza precedenti di accordi diretti di acquisizione dati tra costruttori di modelli e proprietari di contenuti premium. In particolare, News Corp ha firmato un accordo pluriennale con OpenAI (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d) valutato circa $250 milioni in cinque anni (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d). Questa partnership garantisce a OpenAI l'accesso agli archivi e ai contenuti attuali di The Wall Street Journal, Barron’s e The Times, segnando un passaggio definitivo verso dataset autorizzati e ad alta autorevolezza. Allo stesso modo, la partnership di OpenAI con Reddit (https://openai.com/index/openai-and-reddit-partnership/) fornisce accesso in tempo reale alla Reddit Data API, consentendo l'integrazione di dati conversazionali incentrati sull'uomo in ChatGPT e altri prodotti.

Capitalizzare sui dati incarnati e specializzati

Oltre ai LLM basati su testo, il mercato degli asset di dati specializzati sta vedendo massicci afflussi di capitale. Wayve ha recentemente ottenuto $1.05 miliardi (https://www.reuters.com/business/autos-transportation/uk-ai-start-up-wayve-raises-105-bln-softbank-led-funding-2024-05-07/) in un round Series C guidato da SoftBank per sviluppare l' 'Embodied AI' per la guida autonoma. Questo accordo evidenzia il valore attribuito agli 'edge data' — informazioni sensoriali del mondo reale che non possono essere replicate solo dalla generazione sintetica. A supporto di questo ecosistema ad alta intensità di dati, CoreWeave ha raccolto $1.1 miliardi (https://techcrunch.com/2024/05/01/coreweave-raises-1-1b-at-a-19b-valuation/) per espandere la sua infrastruttura cloud specializzata, progettata specificamente per gestire il massiccio throughput richiesto per i carichi di lavoro di addestramento dell'IA ad alta intensità di dati.

La reazione normativa e sui diritti

Mentre il valore degli asset di dati sale alle stelle, i titolari dei diritti si stanno muovendo in modo aggressivo per proteggere la loro proprietà intellettuale. Sony Music Group ha emesso un avvertimento formale a oltre 700 aziende di IA (https://variety.com/2024/music/news/sony-music-warns-ai-companies-using-content-without-permission-1236006080/), dichiarando un esplicito 'opt-out' dallo scraping non autorizzato di dati per l'addestramento dell'IA. Ciò segue una serie di accordi di licenza, come l'accordo di OpenAI con Vox Media (https://www.theverge.com/2024/5/13/24155488/openai-vox-media-licensing-deal-chatgpt) e The Atlantic (https://www.theatlantic.com/press-releases/archive/2024/05/the-atlantic-and-openai-announce-strategic-content-and-product-partnership/678526/), suggerendo che l'era del 'fair use' per i dati di addestramento sta venendo rapidamente sostituita da un mercato strutturato da miliardi di dollari per i diritti sui contenuti.

Perché è importante per i proprietari di dati

Per i proprietari di dati istituzionali, la valutazione di Scale AI e l'accordo con News Corp confermano che i dataset proprietari non sono più asset secondari: sono la leva primaria nell'economia dell'IA. La transizione da accordi di licenza da $250 milioni a round di finanziamento da $1 miliardo per le raffinerie di dati indica che i 'dati puliti ed etichettati da esperti' sono ora una classe di asset distinta. I proprietari di dati unici, ad alta velocità o storicamente profondi dovrebbero dare priorità alla governance dei dati e alla 'AI-readiness' per catturare le valutazioni premium che vengono ora stabilite dai più grandi attori del mercato.

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →