Scale AI залучила $1 млрд раунду Серії F з оцінкою $13,8 млрд
Раунд під керівництвом Accel позиціонує Scale AI як основну 'Data Foundry' для розробки передових моделей ШІ.
Scale AI завершила раунд фінансування Series F на суму $1 млрд (https://scale.com/blog/series-f), що підвищує її оцінку після залучення коштів до оголошених $13.8 млрд (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation). Очолюваний Accel за значної участі Nvidia, Amazon та Meta, цей раунд сигналізує про масовий поворот капіталу до «вузького місця даних», з яким зараз стикаються найбільші розробники Large Language Model (LLM). Оскільки індустрія виходить за межі ери «скрейпінгу відкритої мережі», місія Scale AI зі створення «Data Foundry» представляє найбільш значну інвестицію на сьогоднішній день у створення активів даних високої щільності з експертним маркуванням для суверенного та корпоративного AI.
Індустріалізація даних AI
Вливання $1 млрд (https://scale.com/blog/series-f) — це не просто раунд зростання; це інфраструктурний крок. Scale AI позиціонує себе як важливий нафтопереробний завод для сировини 21-го століття. Фінансування буде використано для масштабування їхнього «Data Engine», який забезпечує Reinforcement Learning from Human Feedback (RLHF), необхідне для просування моделей за межі поточних плато міркувань. З такими інвесторами, як Cisco Investments, Intel Capital та AMD Ventures (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation), що приєдналися до таблиці капіталізації, угода підкреслює міжгалузевий консенсус: наступне покоління продуктивності AI буде виграно завдяки якості даних, а не лише обсягу обчислень.
Ліцензійні угоди досягають апогею
Раунд Scale AI збігається з безпрецедентною хвилею прямих угод з придбання даних між розробниками моделей та власниками преміум-контенту. Зокрема, News Corp підписала багаторічну угоду з OpenAI (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d), вартість якої оцінюється у $250 млн протягом п'яти років (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d). Це партнерство надає OpenAI доступ до архівів та поточного контенту The Wall Street Journal, Barron’s та The Times, що знаменує остаточний перехід до ліцензованих набірів даних з високим рівнем авторитетності. Аналогічно, партнерство OpenAI з Reddit (https://openai.com/index/openai-and-reddit-partnership/) забезпечує доступ у реальному часі до Reddit Data API, дозволяючи інтегрувати орієнтовані на людину розмовні дані в ChatGPT та інші продукти.
Капіталізація на втілених та спеціалізованих даних
Окрім текстових LLM, ринок спеціалізованих активів даних спостерігає масовий приплив капіталу. Wayve нещодавно залучила $1.05 млрд (https://www.reuters.com/business/autos-transportation/uk-ai-start-up-wayve-raises-105-bln-softbank-led-funding-2024-05-07/) у раунді Series C під керівництвом SoftBank для розробки «Embodied AI» для автономного водіння. Ця угода підкреслює преміальність «периферійних даних» — сенсорної інформації з реального світу, яку неможливо відтворити лише за допомогою синтетичної генерації. Підтримуючи цю екосистему з великим обсягом даних, CoreWeave залучила $1.1 млрд (https://techcrunch.com/2024/05/01/coreweave-raises-1-1b-at-a-19b-valuation/) для розширення своєї спеціалізованої хмарної інфраструктури, розробленої спеціально для обробки масивної пропускної здатності, необхідної для інтенсивних робочих навантажень з навчання AI.
Регуляторна реакція та протидія щодо прав
Оскільки вартість активів даних стрімко зростає, правовласники рішуче діють для захисту своєї інтелектуальної власності. Sony Music Group винесла офіційне попередження понад 700 компаніям AI (https://variety.com/2024/music/news/sony-music-warns-ai-companies-using-content-without-permission-1236006080/), оголосивши про явну відмову від несанкціонованого скрейпінгу даних для навчання AI. Це слідує за низкою ліцензійних угод, таких як угода OpenAI з Vox Media (https://www.theverge.com/2024/5/13/24155488/openai-vox-media-licensing-deal-chatgpt) та The Atlantic (https://www.theatlantic.com/press-releases/archive/2024/05/the-atlantic-and-openai-announce-strategic-content-and-product-partnership/678526/), що свідчить про те, що ера «добросовісного використання» для навчальних даних швидко замінюється структурованим багатомільярдним ринком прав на контент.
Чому це важливо для власників даних
Для інституційних власників даних оцінка Scale AI та угода з News Corp підтверджують, що власні набори даних більше не є вторинними активами — вони є основним важелем в економіці AI. Перехід від ліцензійних угод на $250 млн до раундів фінансування на $1 млрд для «нафтопереробних заводів» даних вказує на те, що «чисті дані з експертним маркуванням» тепер є окремим класом активів. Власники унікальних, високошвидкісних або історично глибоких даних повинні пріоритезувати управління даними та «готовність до AI», щоб отримати преміальні оцінки, які зараз встановлюються найбільшими гравцями ринку.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Deringer — Можливість використання набору даних регуляторних записів
View opportunity →промисловийTheion — Можливість набору даних про промислові операції
View opportunity →промисловийRarukautomation — Можливість використання набору даних журналів технічного обслуговування
View opportunity →News & Insights
Latest from the briefing
- Які активи даних МСП є найціннішими для європейського ринку ШІ?
- Чому ліцензовані рідкісні дані є ключем до відповідності EU AI Act
- Як оцінювати спеціалізовані набори даних зображень для моделей AI Vision
- Як оцінювати та продавати набори даних рідкісних мов та мови жестів
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →