licensingai fundingdata acquisitionregulationworld models2 липня 2026 р.

OpenAI укладає угоду про ліцензування даних на $250 млн з News Corp

П'ятирічна угода забезпечує доступ до преміальних журналістських архівів від WSJ та Barron’s для навчання та виведення моделей ШІ.

OpenAI офіційно оформила знакову угоду про ліцензування контенту з News Corp, вартість якої оцінюється у понад $250 million (wsj.com) протягом п'ятирічного періоду. Це розкрите партнерство надає гіганту у сфері штучного інтелекту, що підтримується Microsoft, доступ до поточного та архівного контенту великих видань, включаючи The Wall Street Journal, Barron’s, MarketWatch та The Times, фактично перетворюючи преміальну журналістську продукцію на високоточний потік даних для навчання своїх моделей світу наступного покоління. Цей крок сигналізує про стратегічний поворот OpenAI з метою захисту свого каналу даних від зростаючих юридичних та етичних ризиків, пов'язаних із несанкціонованим веб-скрапінгом.

Стратегічна цінність преміальних текстових активів

Угода є не просто оборонним юридичним маневром; це розрахована ставка на вищу продуктивність кураторських наборів даних з високим рівнем авторитетності. Оскільки передові моделі наближаються до меж загальнодоступних інтернет-даних, галузь входить у фазу «дефіциту даних», де якість токенів важить більше, ніж необроблений обсяг. Забезпечивши доступ до архіву News Corp, OpenAI отримує доступ до десятиліть структурованих, перевірених фактами та контекстуально багатих людських міркувань. Це критично важливо для покращення фактологічної точності та здатності до міркування таких моделей, як GPT-5, які мають на меті функціонувати як більш надійні агенти у професійному та фінансовому середовищах. Угода структурована таким чином, щоб надати OpenAI право відображати контент у відповідь на запити користувачів, ще більше розмиваючи межу між пошуковими системами та інтерфейсами генеративного штучного інтелекту.

Scale AI та інфраструктура достатку даних на $1B

Інституційне прагнення до високоякісних даних додатково підтверджується нещодавно завершеним раундом фінансування серії F компанії Scale AI на суму $1 billion (techcrunch.com), який оцінив компанію у $13.8 billion (reuters.com). Scale AI виступає критично важливим посередником в економіці даних-активів, забезпечуючи розмітку за участю людини (HITL) та RLHF (навчання з підкріпленням на основі зворотного зв'язку від людини), необхідні для перетворення необроблених даних — таких як архіви News Corp — у готові для машин набори для навчання. Цей раунд фінансування, очолюваний Accel за участю суверенних фондів добробуту, підкреслює, що фізична та людська інфраструктура, необхідна для обробки даних, зараз є такою ж цінною, як і сама обчислювальна потужність. Оскільки моделі світу еволюціонують для обробки мультимодальних вхідних даних — відео, аудіо та сенсорних даних — складність маркування цих активів зростає експоненціально, створюючи величезний бар'єр для тих, хто контролює ланцюг постачання даних.

DeepL та поява спеціалізованих «рвів» даних

Поки моделі загального призначення борються за архіви новин, спеціалізовані фірми у сфері штучного інтелекту доводять цінність нішевих активів даних. DeepL, німецький фахівець із перекладу на основі ШІ, нещодавно залучив $300 million (reuters.com) інвестицій при оцінці у $2 billion (techcrunch.com). Успіх DeepL побудований на власному наборі даних високоякісних перекладів, який перевершує більші моделі, навчені на менш чистих даних. Це підтверджує зростаючу тенденцію в просторі d-nvest intelligence: власники даних, які володіють унікальними галузевими наборами даних (юридичними, медичними або лінгвістичними), спостерігають стрімке зростання вартості своїх активів, оскільки компанії, що займаються ШІ загального профілю, прагнуть придбати спеціалізовані «рви знань» для диференціації своїх пропозицій.

Регуляторні бар'єри: Остаточне затвердження EU AI Act

Ринок угод з даними тепер працює за новим глобальним стандартом. Європейська рада офіційно надала своє остаточне схвалення (consilium.europa.eu) EU AI Act, першій у світі комплексній базі для штучного інтелекту. Регламент запроваджує суворі вимоги до прозорості для моделей ШІ загального призначення, включаючи зобов'язання надавати детальні резюме даних, використаних для навчання. Очікується, що ця регуляторна ясність прискорить тенденцію офіційних ліцензійних угод, оскільки компанії прагнуть уникнути позначення «високого ризику» та потенційних штрафів, пов'язаних із невідповідним джерелом даних. Для інвесторів у дані EU AI Act перетворює походження даних з юридичної примітки на основний фактор оцінки.

Чому це важливо для власників даних

Для власників високоякісних структурованих активів даних угода OpenAI-News Corp є переломним моментом, який встановлює чітку ринкову ціну на преміальний контент. Ми переходимо від ери експлуатації даних до ери монетизації даних. Оскільки розробники ШІ зміщують свій фокус на «Моделі світу», які потребують глибокого контекстуального розуміння та фактологічного обґрунтування, важелі впливу повертаються до творців контенту. Власники даних більше не повинні розглядати свої архіви як історичні записи, а як високоприбуткові ліквідні активи, які можна багаторазово ліцензувати в різних вертикалях ШІ. Ключ до максимізації вартості полягає в готовності даних: забезпеченні того, щоб архіви були оцифровані, багаті на метадані та юридично очищені для навчання ШІ.

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →