ai fundingdata licensingscale aivaluationinfrastructure2026年6月23日

Scale AI 以 138 亿美元估值完成 10 亿美元 F 轮融资

由 Accel 和 Nvidia 领投的巨额融资轮标志着对 AI 就绪数据资产估值的关键转变。

Scale AI 已完成 10 亿美元(https://scale.com/blog/series-f)的 F 轮融资,将其估值推升至 138 亿美元(https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation)。本轮融资得到了 Nvidia、Meta 和 Amazon 等战略巨头的积极参与,这标志着市场基本认识到:在通用人工智能的竞赛中,原始算力的价值与其所喂养的精炼数据的价值相当。随着行业摆脱无差别抓取网页数据的时代,Scale 提供高保真度、人工参与(HITL)数据的能力已成为旨在超越大型语言模型当前性能瓶颈的实验室的终极竞争壁垒。

数据稀缺时代的终结

多年来,人工智能行业一直认为公共互联网提供了取之不尽的训练材料。然而,随着模型达到万亿参数规模,行业正面临研究人员所说的“数据墙”。Scale AI 的巨额融资是对此类稀缺性的直接回应。通过获得 10 亿美元的新资本(https://scale.com/blog/series-f),该公司不仅将自己定位为服务提供商,更是“数据富足”的基础设施。这一战略涉及大规模扩展专门的 RLHF(人类反馈强化学习)操作,其中聘请物理学、法律和编码领域的博士级专家来生成当前模型在 Reddit 或 Wikipedia 上找不到的复杂推理链。

AI 巨头的战略协同

本轮融资的投资者名单堪称人工智能权力结构的目录。除了领投的 Accel 外,Nvidia 和 Meta(https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation)的参与表明了人工智能供应链的垂直整合。Nvidia 需要高质量的数据来确保其 H100 和 B200 芯片发挥最大效用,而 Meta 则需要精炼的数据集来保持其开源 Llama 系列的竞争优势。这 10 亿美元的注入与其说是传统的风险投资扩张,不如说是为了在日益诉讼化和注重隐私的数据环境中确保可靠的“事实真相”数据流。

转向高级许可

Scale AI 近 140 亿美元的估值与直接数据许可交易中不断上涨的成本相呼应。作为参考,OpenAI 最近与新闻集团(News Corp)签署了一项价值 2.5 亿美元(https://www.reuters.com/technology/openai-news-corp-sign-content-licensing-deal-2024-05-22/)的多年协议,以获取高级新闻档案。同时,Google 已承诺每年向 Reddit 支付约 6000 万美元(https://www.reuters.com/technology/reddit-ai-content-licensing-deal-with-google-sources-say-2024-02-22/)以获取实时 API 访问权限。Scale AI 处于这个生态系统的中心,将这些原始许可的数据流转化为微调所需的结构化格式。这笔资金很可能用于扩展 Scale 的“数据引擎”,该引擎可自动整理由高端人类专家验证的合成数据,这种混合方法正成为行业标准。

监管和道德前沿

随着欧盟人工智能法案(https://digital-strategy.ec.europa.eu/en/policies/regulatory-framework-ai)开始对训练数据实施更严格的透明度要求,“干净”、合乎道德且合法许可的数据的溢价将不断增长。Scale AI 在企业级数据溯源方面的投资是对这种监管未来的战略押注。公司不再愿意冒着数十亿美元模型训练的风险使用可能面临未来版权追溯的数据。通过提供透明、有据可查的数据供应链,Scale 实际上是在向全球最大的企业出售法律和运营上的风险规避。

这对数据所有者意味着什么

对于数据所有者——从医疗网络到法律存储库——Scale AI 的估值是一个明确的信号,表明他们的资产从未像现在这样具有流动性。从 2.5 亿美元的内容交易到 10 亿美元的基础设施融资轮的转变表明,市场已经走过了数据获取的“实验”阶段。我们现在正处于数据资产类别时代。如果您拥有专有的、高速的或高度专业化的人类话语,您就不再仅仅是出版商或服务提供商;您是下一代全球智能的燃料。对这些所有者而言,关键在于从一次性许可费转向结构化的、类似股权的参与其数据所创造的人工智能模型。

Get the next analysis

One deep-dive per edition on where valuable data is hiding — the evidence, the sources, and who would pay for it. No noise.

One email per edition. Unsubscribe any time. We never share your address.

From the marketplace

Explore live data opportunities

Browse datasets by sector & use-case
Found this useful? Share it

d-nvest turns the data assets behind these deals into scored, actionable opportunities.

Explore the pipeline →