licensingmetanews corpdata valuationai training2026年6月28日

News Corp 和 Meta 达成每年 5000 万美元的 AI 数据许可协议

这项为期五年的协议授予 Meta 访问《华尔街日报》和 Barron’s 的优质内容,用于 AI 训练。

News Corp 已与 Meta Platforms 达成一项多年期许可协议,预计每年可获得约 5000 万美元(journalismpakistan.com)的收入,为这家科技巨头的生成式人工智能生态系统提供高质量的新闻数据。该协议于 2026 年 6 月 26 日披露,允许 Meta 访问包括《华尔街日报》、《巴伦周刊》和《纽约邮报》(apnews.com)在内的知名报刊,以及英国和澳大利亚主要报刊的当前和存档内容。此举标志着 Meta 的战略转变,该公司过去一直依赖公开网络抓取,现在则致力于获取“前沿数据”来为其 Llama 和 Nova 模型系列提供支持。

优质数据资产的新基准

该协议为新闻行业的企业级数据许可设定了重要的价格底线。分析人士指出,此次合作与此前 News Corp 和 OpenAI 之间达成的价值 2.5 亿美元、为期五年的协议(timesofindia.indiatimes.com)类似。随着出版商日益分化为两类:一类是像《纽约时报》那样寻求诉讼的,另一类是选择商业变现的,高质量训练数据的市场正在收紧。许可趋势正在全球加速,巴西报纸 Folha(journalismpakistan.com)就是一个例子,该公司本周在与 Google 合作后不久,通过签署商业协议解决了与 OpenAI 的法律纠纷。

基础设施和主权数据基础

随着许可协议规模的扩大,管理这些海量数据集所需的基础设施也在不断扩展。2026 年 6 月 27 日,VAST Data 宣布与 Sharon AI 扩大合作,在澳大利亚建立一个 600 PB 的主权人工智能数据基础(tipranks.com)。该项目旨在为大规模 Python 和推理工作负载提供必要的高性能安全数据层,从而简化企业从试点项目到实时人工智能应用的路径。与此同时,金融行业正在见证“代理式”数据货币化的兴起;Visa 和 Alchemy 报告称,他们面向人工智能代理的新款 AgentCard(americanbanker.com)在最初的 48 小时内获得了 78,000 次注册(americanbanker.com),凸显了由实时数据代币驱动的机器对机器经济的快速崛起。

监管合规与透明度

许可活动的激增也是对欧盟人工智能法案(consilium.europa.eu)最终实施阶段的回应,该法案要求提高用于训练通用人工智能(GPAI)模型的数据集的透明度。Google 等公司正在扩大其新闻人工智能试点计划(mediapost.com),将其纳入《华盛顿邮报》和《卫报》,为出版商提供通过“人工智能驱动的文章摘要”而非传统搜索推荐流量来实现货币化的途径。这种监管压力正迫使人工智能开发者清理其供应链,使许可的、经过人类验证的数据成为人工智能堆栈中最有价值的资产。

这对数据所有者为何重要

对于数据所有者而言,News Corp 与 Meta 的交易证明了优质档案不再仅仅是历史记录,而是高收益的流动资产。随着人工智能实验室在数据来源方面面临日益严峻的法律和监管审查,“抽成率”正在上升。现在,拥有专业、高完整性数据的所有者拥有前所未有的议价能力,可以协商多年期、数百万美元的经常性收入流,以抵消传统数字广告和流量模式的下降。

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →