EvolutionaryScale залучила $142 млн для масштабування моделей біологічних даних
Стартап закрив початковий раунд фінансування для створення генеративного ШІ з використанням набору даних з 2,78 мільярда послідовностей білків.
EvolutionaryScale закрила оголошений раунд посівного фінансування на суму $142 million (forbes.com) для прискорення розробки генеративних моделей ШІ, навчених на масивних біологічних наборах даних. Раунд під керівництвом Nat Friedman, Daniel Gross та Lux Capital дозволяє компанії розглядати біологію як програмований інформаційний актив, використовуючи свою нову модель ESM3, яка була навчена на наборі даних із 2.78 billion послідовностей білків (evolutionaryscale.ai). Ця віха підкреслює зростаючу цінність нетекстових, вузькоспеціалізованих даних у гонці за передові можливості ШІ.
Зростання біологічних інформаційних активів
На відміну від LLM загального призначення, які збирають дані з відкритої мережі, ціннісна пропозиція EvolutionaryScale ґрунтується на кураторстві та обробці спеціалізованої біологічної інформації. Модель ESM3 — це мультимодальна генеративна модель, яка може аналізувати послідовність, структуру та функцію білків. Обробляючи трильйони точок даних (evolutionaryscale.ai) з природного світу, стартап прагне надати дослідникам можливість «програмувати» нові білки, потенційно скорочуючи терміни розробки ліків з років до тижнів. Цей підхід «ChatGPT для біології» підкреслює ширшу ринкову тенденцію: монетизацію власних високоточних наукових наборів даних, які не можуть бути легко відтворені звичайними пошуковими роботами.
Ліцензування проти судових позовів: Битва за права на дані
Фінансування стартапів з інтенсивним використанням даних, таких як EvolutionaryScale, відбувається в той час, коли правовий ландшафт у сфері збору даних досягає точки кипіння. OpenAI та Time Magazine нещодавно уклали багаторічну угоду про ліцензування контенту (openai.com), надавши OpenAI доступ до 101-річного архіву Time Magazine. Хоча точні фінансові умови не розголошуються, галузеві аналітики вказують на угоду OpenAI з News Corp на суму близько $250 million (reuters.com) як на еталон премії, що зараз встановлюється за перевірену людську журналістику.
Навпаки, вартість неліцензійного збору даних стає непомірно високою. RIAA, що представляє такі великі лейбли, як Sony та Universal, вимагає відшкодування передбачених законом збитків у розмірі до $150,000 за твір (reuters.com) у позові проти музичних ШІ-стартапів Suno та Udio. Оскільки сотні тисяч записів нібито використовувалися без дозволу, загальна відповідальність може сягнути приблизно $13.5 billion (reuters.com). Цей юридичний тиск змушує переходити від захисту «добросовісного використання» до структурованого ринку даних, де кожен токен для навчання має чітке походження та ціну.
Приплив капіталу в інфраструктуру з інтенсивним використанням даних
Попит на готовий до роботи з даними ШІ також спровокував масивні інвестиції в інфраструктуру. Helsing, європейська оборонна ШІ-фірма, залучила оголошені €450 million (reuters.com) у раунді Серії C, що оцінює компанію приблизно у €5 billion (bloomberg.com). Програмно-визначені системи оборони Helsing покладаються на обробку даних з датчиків на полі бою в реальному часі, що представляє критичну вертикаль для монетизації інформаційних активів у державному секторі. Аналогічно, Etched.ai залучила оголошені $120 million (techcrunch.com) для створення спеціалізованих чіпів, розроблених спеціально для обробки масивних потоків даних, необхідних моделям Transformer.
У сфері юридичних технологій стартап Harvey, за повідомленнями, веде переговори про залучення нового капіталу при оцінці близько $2 billion (techcrunch.com). Основним активом Harvey є доступ до власних юридичних даних та їх обробка, що ще раз доводить: ринок винагороджує компанії, які контролюють «інформаційний рів», а не лише алгоритм.
Чому це важливо для власників даних
Для інституційних власників даних угоди EvolutionaryScale та OpenAI-Time підтверджують, що ера безкоштовного збору даних добігає кінця. Дані більше не є побічним продуктом бізнес-операцій; це основний клас активів. Будь то біологічні послідовності, історичні архіви чи юридичні прецеденти, ринок тепер пропонує два чітких шляхи: багатомільйонні ліцензійні партнерства для тих, хто співпрацює, і багатомільярдні судові процеси для тих, чиї активи забираються без згоди. Оскільки моделі ШІ стають більш спеціалізованими, цінність нішевих, цілісних наборів даних продовжуватиме випереджати цінність контенту, зібраного із загальнодоступної мережі.
Sources
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Produmax — Можливості набору даних звітів про інспекції
View opportunity →фінансиCavendish — Можливості набору даних фінансових транзакцій
View opportunity →промисловийМожливість придбання набору даних промислових операцій від Discovery Acquisition
View opportunity →News & Insights
Latest from the briefing
- Як інтегрувати вбудовані фінанси у вертикальні ринки даних
- Як централізоване видалення змінює економіку брокерської діяльності з даними
- Приховані зобов'язання при купівлі неперевірених даних від брокерів
- Як універсальні механізми видалення впливають на оцінку споживчих даних
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →