Mistral AI залучила 600 млн євро в рамках раунду серії B для масштабування глобальних операцій з даними
Оцінка в 5,8 млрд євро, очолювана General Catalyst, сприяє придбанню французькою компанією високоякісних багатомовних наборів даних.
Mistral AI залучила €600 million ($645 million) у межах фінансування Series B, що підняло оцінку паризького стартапу після залучення коштів до €5.8 billion. Це вливання капіталу під керівництвом General Catalyst за участю існуючих інвесторів, таких як Lightspeed Venture Partners, та стратегічних гігантів, включаючи Nvidia, Salesforce та Samsung, знаменує критичний поворот до придбання власних активів даних у промислових масштабах. На відміну від попередніх раундів, зосереджених на основній розробці, цей транш спеціально призначений для розширення обчислювальних потужностей та забезпечення високоякісних багатомовних наборів даних, необхідних для підтримки конкурентної переваги моделей з відкритими вагами проти конкурентів із закритим вихідним кодом, таких як OpenAI та Anthropic.
Стратегічний поворот до домінування активів даних
Фінансування Mistral підкреслює посилення гонки озброєнь за «суверенні» дані. Оскільки AI Act Європейського Союзу досягає своїх фінальних законодавчих етапів, Mistral позиціонує себе як головного бенефіціара системи конфіденційності даних на континенті. Використовуючи свій новий капітал для ліцензування преміальних європейських лінгвістичних даних, Mistral прагне створювати моделі, які перевершують моделі США за регіональними нюансами та відповідністю нормативним вимогам. Ця стратегія стосується не лише обсягу; мова йде про кураторство високоточних неанглійських наборів даних, які історично були недостатньо представлені в навчальних корпусах великих мовних моделей (LLMs). У раунді також взяли участь європейські інституційні інвестори, такі як Belfius та Bertelsmann, що свідчить про загальноконтинентальні зусилля з консолідації ресурсів даних під керівництвом вітчизняного лідера.
Консолідація в інтелектуальному шарі
Поки Mistral масштабує свої фундаментальні можливості, ринок спеціалізованих активів даних переживає масову консолідацію. Лише за 48 годин до оголошення Mistral, AlphaSense завершила придбання Tegus, провідного постачальника експертних досліджень та фінансових даних, за $930 million. Ця угода разом із раундом фінансування на суму $650 million при оцінці в $4 billion підкреслює преміальну цінність даних за участю експертів («expert-in-the-loop»). Tegus додає бібліотеку з понад 100,000 стенограм експертних дзвінків та фінансових моделей до ШІ-платформи AlphaSense. Для інвесторів у активи даних злиття AlphaSense-Tegus є класичним прикладом вертикальної інтеграції, де цінність полягає не в самому алгоритмі ШІ, а в ексклюзивному володінні базовим власним графом знань.
Інфраструктура та взаємосумісність як інструменти роботи з даними
Рух цих масивних наборів даних також оптимізується завдяки безпрецедентним хмарним партнерствам. Oracle та Google Cloud оголосили про мультихмарне партнерство цього тижня, розроблене для скасування плати за вихід даних та надання клієнтам можливості розгортати сервіси баз даних Oracle в інфраструктурі Google Cloud. Цей технічний міст є прямою відповіддю на проблему «гравітації даних», коли розробка ШІ часто гальмується вартістю та затримкою переміщення навчальних даних між провайдерами. Забезпечуючи швидкість з’єднання до 250 Gbps, партнерство дозволяє підприємствам передавати свої найбільш конфіденційні дані, що зберігаються в середовищах Oracle, безпосередньо в моделі Vertex AI від Google, фактично перетворюючи ізольовані бази даних на живі активи для навчання ШІ.
Чому це важливо для власників даних
Угоди Mistral та AlphaSense підтверджують, що ера «дефіциту даних» офіційно розпочалася, піднімаючи оцінку високоякісних власних наборів даних до рекордних рівнів. Для власників даних це зміщення ринку свідчить про те, що монетизація виходить за межі простого ліцензування в бік стратегічного партнерства в капіталі. Оскільки постачальники фундаментальних моделей, такі як Mistral, шукають «суверенні» та «експертні» дані, щоб виділитися, вартість нішевих високоточних наборів даних — особливо в регульованих галузях або неанглійськими мовами — продовжуватиме мати значну премію. Інфраструктурні рішення від Oracle та Google ще більше знижують бар’єр входу для власників даних для монетизації своїх активів без втрати контролю над місцем зберігання даних.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Gophr — Можливості датасету промислових операцій
View opportunity →промисловийPolysolar — Можливості платформи даних розробника
View opportunity →промисловийViridi — Можливості набору даних журналів технічного обслуговування
View opportunity →News & Insights
Latest from the briefing
- Скільки коштує набір даних? 4 перевірені методи оцінки
- Скільки коштують дані вашого МСП? 7 монетизованих класів активів
- Як оцінювати та ліцензувати пропрієтарні набори даних зображень для навчання ШІ
- Монетизація даних рідкісних мов: Посібник для корпусів тренування ШІ
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →