Scale AI 获 10 亿美元 F 轮融资,估值 138 亿美元
由 Accel 领投的此轮融资将 Scale AI 定位为前沿人工智能模型开发的主要“数据铸造厂”。
Scale AI 已完成 $1 billion 的 Series F 融资 (https://scale.com/blog/series-f),使其投后估值达到披露的 $13.8 billion (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation)。此轮融资由 Accel 领投,Nvidia、Amazon 和 Meta 大力参与,标志着资本正大规模转向目前大型 Large Language Model (LLM) 开发商面临的“数据瓶颈”。随着行业超越“抓取公开网络”的时代,Scale AI 建立“Data Foundry”的使命,代表了迄今为止在为主权和企业 AI 创建专家标注、高密度数据资产方面最重大的投资。
AI 数据的工业化
这笔 $1 billion 的注资 (https://scale.com/blog/series-f) 不仅仅是一轮增长融资;它是一次基础设施布局。Scale AI 将自己定位为 21 世纪原材料的核心精炼厂。这笔资金将用于扩展其“Data Engine”,该引擎提供 Reinforcement Learning from Human Feedback (RLHF),这是推动模型突破当前推理瓶颈所必需的。随着 Cisco Investments、Intel Capital 和 AMD Ventures (https://www.bloomberg.com/news/articles/2024-05-21/scale-ai-raises-1-billion-at-13-8-billion-valuation) 加入股东名册,这笔交易强调了跨行业的共识:下一代 AI 性能的胜负将取决于数据质量,而不仅仅是计算量。
许可协议达到白热化
Scale AI 的融资轮次恰逢模型构建者与优质内容所有者之间前所未有的直接数据获取交易浪潮。最值得注意的是,News Corp 与 OpenAI 签署了一份为期多年的协议 (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d),估计五年内价值 $250 million (https://www.wsj.com/business/media/news-corp-openai-content-licensing-deal-80860d4d)。这一合作伙伴关系使 OpenAI 能够访问来自 The Wall Street Journal、Barron’s 和 The Times 的存档和当前内容,标志着向许可的、高权威数据集的明确转变。同样,OpenAI 与 Reddit 的合作 (https://openai.com/index/openai-and-reddit-partnership/) 提供了对 Reddit Data API 的实时访问,允许将以人为中心的对话数据整合到 ChatGPT 和其他产品中。
利用具身和专业化数据
除了基于文本的 LLMs,专业化数据资产市场也正迎来大规模的资本流入。Wayve 最近在由 SoftBank 领投的 Series C 轮融资中获得了 $1.05 billion (https://www.reuters.com/business/autos-transportation/uk-ai-start-up-wayve-raises-105-bln-softbank-led-funding-2024-05-07/),用于开发自动驾驶的“Embodied AI”。这笔交易突显了“边缘数据”的溢价——即无法仅通过合成生成来复制的现实世界感官信息。为了支持这一数据密集型生态系统,CoreWeave 筹集了 $1.1 billion (https://techcrunch.com/2024/05/01/coreweave-raises-1-1b-at-a-19b-valuation/) 以扩展其专门的云基础设施,旨在处理数据密集型 AI 训练工作负载所需的大规模吞吐量。
监管与权利的反弹
随着数据资产价值的飙升,权利持有人正采取积极行动保护其知识产权。Sony Music Group 向 700 多家 AI 公司发出了正式警告 (https://variety.com/2024/music/news/sony-music-warns-ai-companies-using-content-without-permission-1236006080/),宣布明确“退出”未经授权的 AI 训练数据抓取。在此之前,已有一系列许可协议达成,例如 OpenAI 与 Vox Media (https://www.theverge.com/2024/5/13/24155488/openai-vox-media-licensing-deal-chatgpt) 和 The Atlantic (https://www.theatlantic.com/press-releases/archive/2024/05/the-atlantic-and-openai-announce-strategic-content-and-product-partnership/678526/) 的交易,这表明训练数据的“合理使用”时代正迅速被结构化的、价值数十亿美元的内容权利市场所取代。
为什么这对数据所有者很重要
对于机构数据所有者而言,Scale AI 的估值和 News Corp 的交易证实了专有数据集不再是次要资产——它们是 AI 经济中的核心杠杆。从 $250 million 的许可交易到数据精炼厂 $1 billion 的融资轮次,这表明“干净、专家标注的数据”现在已成为一种独特的资产类别。拥有独特、高流速或历史深厚数据的所有者应优先考虑数据治理和“AI 就绪性”,以获取目前由市场巨头设定的溢价估值。
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Deringer — 监管记录数据集机会
View opportunity →工业Theion — 工业运营数据集机会
View opportunity →工业Rarukautomation — 维护日志数据集商机
View opportunity →d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →