Scale AI 融资 10 亿美元,估值达 138 亿美元
此轮巨额融资由 Accel 和 Nvidia 领投,标志着 AI 就绪数据资产估值的重要转变。
Scale AI 已完成一笔披露金额为 $1 billion (scale.com) 的 Series F 融资,将其估值推高至披露的 $13.8 billion (bloomberg.com)。本轮融资吸引了包括 Nvidia、Meta 和 Amazon 在内的战略巨头的深度参与,标志着市场的一个根本性认识:在通用人工智能的竞赛中,原始算力的价值仅取决于喂养它的精炼数据。随着行业告别无差别网页抓取的时代,Scale AI 提供高保真、人工在环 (HITL) 数据的能力,已成为旨在突破当前大语言模型性能瓶颈的实验室的终极竞争护城河。
数据稀缺的终结
多年来,AI 领域一直假设公开互联网提供了无穷无尽的训练材料。然而,随着模型达到万亿参数规模,行业正撞上研究人员所称的“数据墙”。Scale AI 的巨额融资是对这种稀缺性的直接回应。通过获得 $1 billion 的新资本 (scale.com),该公司不仅将自己定位为服务提供商,而且定位为“数据丰饶”的基础设施。这一战略涉及大规模扩展专门的 RLHF (Reinforcement Learning from Human Feedback) 业务,即聘请物理、法律和编程领域的 PhD 级专家来生成当前模型在 Reddit 或 Wikipedia 上无法找到的复杂推理链。
AI 巨头的战略结盟
本轮融资的投资者名单读起来就像一份 AI 权力结构的目录。除了领投的 Accel 之外,Nvidia 和 Meta (bloomberg.com) 的加入暗示了 AI 供应链的垂直整合。Nvidia 需要高质量数据来确保其 H100 和 B200 芯片发挥最大效用,而 Meta 则需要精炼数据集来保持其开源 Llama 系列的竞争优势。这笔 $1 billion 的资金流入与其说是传统的风险扩张,不如说是为了在日益诉讼化和私有化的数据环境中确保可靠的“地面真值”数据管道。
向溢价许可的转变
Scale AI 近 $14 billion 的估值反映了直接数据许可交易中不断攀升的成本。作为背景,OpenAI 最近与 News Corp 签署了一项披露金额为 $250 million (reuters.com) 的多年协议,以获取优质新闻档案。与此同时,Google 已承诺每年向 Reddit 支付约 $60 million (reuters.com) 以获取实时 API 访问权限。Scale AI 处于这一生态系统的中心,将这些原始的许可馈送转换为微调所需的结构化格式。这笔资金可能会用于扩展 Scale AI 的“Data Engine”,该引擎可自动处理由高端人类专家验证的合成数据,这种混合方法正成为行业标准。
监管与伦理前沿
随着 EU AI Act (digital-strategy.ec.europa.eu) 开始对训练数据实施更严格的透明度要求,“干净”、来源合乎伦理且获得法律许可的数据的溢价将持续增长。Scale AI 对企业级数据溯源的投资是对这一监管未来的战略押注。企业不再愿意冒着数十亿美元模型训练运行的风险去使用可能面临未来版权追索的数据。通过提供透明、有记录的数据供应链,Scale AI 实际上是在向全球最大的企业销售法律和运营层面的去风险化方案。
为什么这对数据所有者很重要
对于从医疗网络到法律存储库的数据所有者来说,Scale AI 的估值是一个响亮的信号,表明他们的资产从未像现在这样具有流动性。从 $250 million 的内容交易到数十亿美元的基础设施融资轮次,这表明市场正在跨越数据获取的“实验”阶段。我们现在处于数据资产类别时代。如果你拥有专有的、高流速的或高度专业化的人类话语,你就不再仅仅是一个出版商或服务提供商;你是下一代全球智能的燃料。对于这些所有者来说,关键将是从一次性的许可费转向对其数据所创建的 AI 模型进行结构化的、类似于股权的参与。
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Serviceup — 维护日志数据集机会
View opportunity →mobilityAmbercor — 工业运营数据集机会
View opportunity →工业Enerparc — 维护日志数据集机会
View opportunity →d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →