Scale AI залучила розкриті $1 млрд раунду серії F з оцінкою $13,8 млрд
Масштабний раунд фінансування, очолюваний Accel та Nvidia, знаменує собою ключовий зсув в оцінці готових до ШІ даних.
Scale AI завершила оголошений раунд фінансування Серії F на суму $1 billion (scale.com), що підвищило її оцінку до оголошених $13.8 billion (bloomberg.com). Раунд, у якому взяли активну участь стратегічні гіганти, включаючи Nvidia, Meta та Amazon, сигналізує про фундаментальне усвідомлення ринку: у гонці за штучним загальним інтелектом необроблені обчислювальні потужності цінні лише настільки, наскільки цінними є очищені дані, що їх живлять. Оскільки індустрія відходить від ери безладного веб-скрапінгу, здатність Scale надавати високоточні дані з участю людини (human-in-the-loop, HITL) стала вирішальною конкурентною перевагою для лабораторій, що прагнуть подолати поточні плато продуктивності великих мовних моделей.
Кінець дефіциту даних
Протягом багатьох років сектор AI працював, виходячи з припущення, що публічний інтернет забезпечує невичерпний запас навчальних матеріалів. Однак, оскільки моделі досягають масштабу в трильйон параметрів, індустрія стикається з тим, що дослідники називають «Стіною даних». Масштабне залучення капіталу Scale AI є прямою відповіддю на цей дефіцит. Залучивши $1 billion нового капіталу (scale.com), компанія позиціонує себе не просто як постачальник послуг, а як фундаментальна інфраструктура для «достатку даних». Ця стратегія передбачає масштабне розширення спеціалізованих операцій RLHF (Reinforcement Learning from Human Feedback), де експерти рівня PhD у галузі фізики, права та програмування залучаються для створення складних ланцюжків міркувань, які сучасні моделі не можуть знайти на Reddit або Wikipedia.
Стратегічне об'єднання титанів AI
Список інвесторів цього раунду виглядає як довідник владних структур у сфері AI. Окрім Accel, яка очолила раунд, присутність Nvidia та Meta (bloomberg.com) свідчить про вертикальну інтеграцію ланцюжка поставок AI. Nvidia потребує високоякісних даних, щоб забезпечити максимальну корисність своїх чіпів H100 та B200, тоді як Meta потребує вдосконалених наборів даних для підтримки конкурентної переваги своєї серії Llama з відкритим кодом. Цей приплив у $1 billion менше стосується традиційного венчурного масштабування, а більше — забезпечення надійного каналу даних «ground truth» в умовах дедалі більшої кількості судових позовів та приватності даних.
Перехід до преміального ліцензування
Оцінка Scale AI у майже $14 billion відображає зростання витрат, що спостерігається в угодах з прямого ліцензування даних. Для контексту, OpenAI нещодавно підписала оголошений багаторічний контракт на суму $250 million (reuters.com) з News Corp для доступу до преміальних журналістських архівів. Одночасно Google виділила приблизно $60 million щорічно (reuters.com) для Reddit за доступ до API в реальному часі. Scale AI знаходиться в центрі цієї екосистеми, перетворюючи ці необроблені ліцензійні потоки на структуровані формати, необхідні для тонкого налаштування. Капітал, ймовірно, буде використаний для розширення «Data Engine» від Scale, який автоматизує кураторство синтетичних даних, перевірених висококласними експертами-людьми — гібридний підхід, що стає галузевим стандартом.
Регуляторний та етичний фронтир
Оскільки EU AI Act (digital-strategy.ec.europa.eu) починає впроваджувати суворіші вимоги до прозорості навчальних даних, цінність «чистих», етично отриманих та юридично ліцензованих даних буде лише зростати. Інвестиції Scale AI у походження даних корпоративного рівня — це стратегічна ставка на це регуляторне майбутнє. Компанії більше не готові ризикувати багатомільярдними запусками навчання моделей на даних, які в майбутньому можуть стати об'єктом відкликання авторських прав. Надаючи прозорий, задокументований ланцюжок поставок даних, Scale фактично продає зниження юридичних та операційних ризиків найбільшим підприємствам світу.
Чому це важливо для власників даних
Для власників даних — від медичних мереж до юридичних репозиторіїв — оцінка Scale AI є закликом до дії, що свідчить про те, що їхні активи ніколи не були такими ліквідними. Перехід від контентних угод на суму $250 million до мільярдних інфраструктурних раундів вказує на те, що ринок виходить за межі «експериментальної» фази збору даних. Зараз ми перебуваємо в ері Data Asset Class. Якщо ви володієте власним, високошвидкісним або вузькоспеціалізованим людським дискурсом, ви більше не просто видавець чи постачальник послуг; ви — паливо для наступного покоління глобального інтелекту. Ключовим для цих власників буде перехід від одноразових ліцензійних зборів до структурованої участі, подібної до капіталу, у моделях AI, які створюють їхні дані.
Data Academy
Go deeper with our guides
Ваша рідкісна мова недоступна для ШІ
Дефіцит недостатньо представлених мов
Read the guide →3 min readВаші спеціалізовані зображення рідкісні
Візуальний контент, який ШІ не знаходить онлайн
Read the guide →3 min readПридбання рідкісних даних, що відповідають вимогам
Кут зору EU AI Act для покупців
Read the guide →From the marketplace
Explore live data opportunities
Serviceup — Можливості набору даних журналів технічного обслуговування
View opportunity →мобільністьAmbercor — Можливість отримання набору даних промислових операцій
View opportunity →промисловийEnerparc — Можливості набору даних журналів технічного обслуговування
View opportunity →News & Insights
Latest from the briefing
- Фінансові та стратегічні витрати через недотримання вимог брокерами даних
- Чи є ви випадковим брокером даних? Нові фінансові ризики пояснено
- Вимоги до доказів для розслідувань відповідно до Закону ЄС про ШІ
- Як інтегрувати вбудовані фінанси у вертикальні ринки даних
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →