Poolside AI залучила $400 млн при оцінці в $2 млрд для LLM для коду та даних
Coatue та Dragoneer очолили масивне вливання коштів у паризький стартап для масштабування пропрієтарних активів для генерації коду.
Poolside AI наближається до угоди про залучення орієнтовно $400 million (bloomberg.com) у новому раунді фінансування, який оцінить компанію у $2 billion (bloomberg.com). Раунд, очолюваний Coatue Management та Dragoneer Investment Group (techcrunch.com), сигналізує про величезну ставку на спеціалізовані дані, необхідні для переходу Large Language Models (LLMs) від загального спілкування до автономної програмної інженерії. Зосередивши свою діяльність у Paris, Poolside позиціонує себе в центрі європейської екосистеми талантів та даних у сфері AI, націлюючись саме на пропрієтарні кодові бази та робочі процеси розробників, які визначають наступний рубіж інструментів продуктивності.
Спеціалізований рів з даних: за межами загальних LLMs
Вливання капіталу в Poolside AI підкреслює ширший ринковий поворот до галузевих активів даних. У той час як моделі загального призначення досягли плато корисності, стартапи, що зосереджуються на високоточних спеціалізованих наборах даних, отримують преміальні оцінки. Стратегія Poolside зосереджена на навчанні моделей на масивних структурованих репозиторіях коду, які потребують значно вищої точності, ніж стандартні текстові набори даних. Ця тенденція відображається в біологічному секторі, де EvolutionaryScale нещодавно оголосила про посівний раунд у розмірі $142 million (reuters.com) для комерціалізації своєї моделі ESM3. ESM3 була навчена на приголомшливих 2.7 billion білкових послідовностей (techcrunch.com), що ілюструє: найціннішими активами даних сьогодні є ті, що відображають фундаментальні будівельні блоки науки та інженерії.
Ліцензійні війни: архіви проти доступу в реальному часі
Поки стартапи залучають фінансування для створення моделей, визнані гіганти AI агресивно закріплюють за собою архіви історичних даних. OpenAI уклала багаторічну угоду про ліцензування контенту з Time (openai.com), отримавши доступ до 101 years архівного контенту (theverge.com) для вдосконалення своїх моделей та надання відповідей із посиланнями в ChatGPT. Ця угода продовжує серію високовартісних партнерств із такими видавцями, як News Corp та Axel Springer, встановлюючи чітку ринкову ціну на авторитетні текстові дані. Для власників даних ці угоди означають перехід від пасивного хостингу до активного управління активами, оскільки попит на перевірену, створену людьми інформацію зростає у прямій відповіді на поширення згенерованого AI «сміття» (slop) в мережі.
Регуляторний тиск та цілісність даних
Однак гонка за даними стикається зі значними юридичними та регуляторними перешкодами. Recording Industry Association of America (RIAA) подала позови проти AI-генераторів музики Suno та Udio (reuters.com), вимагаючи відшкодування збитків у розмірі до $150,000 за кожен твір, що порушує авторські права (billboard.com). Водночас гігант дизайну Figma зіткнувся з негативною реакцією щодо своєї політики навчання AI на даних (theverge.com), що змусило компанію роз'яснити механізми відмови для корпоративних користувачів. Ці події свідчать про те, що хоча капіталу для AI з інтенсивним використанням даних достатньо, ера «дикого заходу» з безоплатним скрейпінгом добігає кінця. Такі компанії, як Glean, яка веде переговори про залучення $250 million (reuters.com) при оцінці в $4.5 billion (reuters.com), досягають успіху, зосереджуючись на безпечних, дозволених внутрішніх корпоративних даних, а не на публічному контенті, зібраному з вебу.
Чому це важливо для власників даних
Оцінка Poolside AI та судові процеси проти музичних стартапів доводять, що ринок роздвоюється: загальні дані стають товаром широкого вжитку, тоді як спеціалізовані, високоцілісні активи даних стають основним джерелом альфи. Для власників даних можливість полягає в переході від одноразового ліцензування до регулярних структурованих моделей «дані як сервіс» (DaaS). Оскільки EU AI Act починає впроваджувати прозорість у навчальних наборах, походження даних стане таким же цінним, як і самі дані, перетворюючи комплаєнс на конкурентну перевагу для інституційних власників даних.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Powerbee — Можливість отримання даних промислових датчиків
View opportunity →промисловийEveractive — Можливість отримання даних промислових датчиків
View opportunity →промисловийTexasenterprises — Можливості набору даних журналів технічного обслуговування
View opportunity →News & Insights
Latest from the briefing
- Чи є персоналізоване ціноутворення законним? Відповідність вимогам для отримання доходу на основі даних
- Чи є ваша реєстрація брокера даних тепер щоденним фінансовим ризиком?
- Фінансові та стратегічні витрати через недотримання вимог брокерами даних
- Чи є ви випадковим брокером даних? Нові фінансові ризики пояснено
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →