EvolutionaryScale sichert sich 142 Mio. US-Dollar zur Skalierung biologischer Datenmodelle
Das Startup schließt eine Seed-Runde ab, um generative KI mithilfe eines Datensatzes von 2,78 Milliarden Proteinsequenzen aufzubauen.
EvolutionaryScale hat eine disclosed 142 Millionen US-Dollar (forbes.com) Seed-Finanzierungsrunde abgeschlossen, um die Entwicklung von generativen KI-Modellen zu beschleunigen, die auf massiven biologischen Datensätzen trainiert werden. Die Runde, angeführt von Nat Friedman, Daniel Gross und Lux Capital, positioniert das Unternehmen, um Biologie als programmierbaren Datenwert zu behandeln, indem es sein neues ESM3-Modell nutzt, das auf einem Datensatz von 2,78 Milliarden Proteinsequenzen (evolutionaryscale.ai) trainiert wurde. Dieser Meilenstein unterstreicht den steigenden Wert nicht-textueller, domänenspezifischer Daten im Rennen um fortschrittliche KI-Fähigkeiten.
Der Aufstieg biologischer Datenwerte
Im Gegensatz zu Allzweck-LLMs, die das öffentliche Web durchforsten, basiert das Wertversprechen von EvolutionaryScale auf der Kuratierung und Verarbeitung spezialisierter biologischer Informationen. Das ESM3-Modell ist ein multimodales generatives Modell, das über die Sequenz, Struktur und Funktion von Proteinen schlussfolgern kann. Durch die Verarbeitung von Billionen von Datenpunkten (evolutionaryscale.ai) aus der natürlichen Welt zielt das Startup darauf ab, Forschern die "Programmierung" neuer Proteine zu ermöglichen, was die Zeitpläne für die Medikamentenentwicklung potenziell von Jahren auf Wochen verkürzt. Dieser "ChatGPT für Biologie"-Ansatz unterstreicht einen breiteren Markttrend: die Monetarisierung proprietärer, hochfideliter wissenschaftlicher Datensätze, die nicht einfach von generischen Crawlern repliziert werden können.
Lizenzierung vs. Rechtsstreit: Der Kampf um Datenrechte
Die Finanzierung datenintensiver Startups wie EvolutionaryScale erfolgt zu einer Zeit, in der die rechtliche Landschaft für die Datenbeschaffung einen Siedepunkt erreicht. OpenAI und das Time Magazine haben kürzlich eine mehrjährige Content-Lizenzvereinbarung (openai.com) abgeschlossen, die OpenAI den Zugang zum 101-jährigen Archiv von Time gewährt. Während die genauen finanziellen Bedingungen nicht bekannt gegeben wurden, verweisen Branchenanalysten auf die geschätzte 250-Millionen-Dollar-Vereinbarung von OpenAI mit News Corp (reuters.com) als Benchmark für die Prämie, die nun auf verifizierten menschlichen Journalismus gelegt wird.
Umgekehrt werden die Kosten für die unlizenzierte Datenbeschaffung prohibitiv hoch. Die RIAA, die große Labels wie Sony und Universal vertritt, fordert in einer Klage gegen die KI-Musik-Startups Suno und Udio Schadensersatz in Höhe von bis zu 150.000 US-Dollar pro Werk (reuters.com). Da angeblich Hunderttausende von Aufnahmen ohne Erlaubnis verwendet wurden, könnten die Gesamthaftungskosten schätzungsweise 13,5 Milliarden US-Dollar (reuters.com) erreichen. Dieser rechtliche Druck erzwingt einen Übergang von der "Fair Use"-Verteidigung zu einem strukturierten Datenmarkt, auf dem jedes Trainings-Token eine klare Herkunft und einen klaren Preis hat.
Kapitalzufluss in datenintensive Infrastruktur
Die Nachfrage nach datenfertiger KI hat auch massive Infrastrukturinvestitionen ausgelöst. Helsing, ein europäisches Verteidigungs-KI-Unternehmen, hat in einer Serie-C-Runde eine disclosed 450 Millionen Euro (reuters.com) gesichert, was das Unternehmen auf eine geschätzte Bewertung von 5 Milliarden Euro (bloomberg.com) bringt. Die softwaredefinierten Verteidigungssysteme von Helsing basieren auf der Echtzeitverarbeitung von Schlachtfeldsensordaten und stellen einen kritischen Sektor für die Monetarisierung von Datenwerten im öffentlichen Sektor dar. Ebenso hat Etched.ai disclosed 120 Millionen US-Dollar (techcrunch.com) gesammelt, um spezialisierte Chips zu entwickeln, die speziell für den Umgang mit dem massiven Datendurchsatz entwickelt wurden, der von Transformer-Modellen benötigt wird.
Im Bereich Legal Tech soll das Startup Harvey Gespräche über die Aufnahme neuen Kapitals zu einer geschätzten Bewertung von 2 Milliarden US-Dollar führen (techcrunch.com). Das Kernvermögen von Harvey ist sein Zugang zu und seine Verarbeitung proprietärer juristischer Daten, was weiter beweist, dass der Markt Unternehmen belohnt, die den "Daten-Moat" kontrollieren und nicht nur den Algorithmus.
Warum es für Dateneigentümer wichtig ist
Für institutionelle Dateneigentümer bestätigen die Deals von EvolutionaryScale und OpenAI-Time, dass die Ära des kostenlosen Data Scrapings zu Ende geht. Daten sind kein Nebenprodukt von Geschäftsabläufen mehr; sie sind eine primäre Anlageklasse. Ob es sich um biologische Sequenzen, historische Archive oder juristische Präzedenzfälle handelt, der Markt bietet nun zwei unterschiedliche Wege: Lizenzpartnerschaften in Millionenhöhe für diejenigen, die kooperieren, und Rechtsstreitigkeiten in Milliardenhöhe für diejenigen, deren Vermögenswerte ohne Zustimmung entwendet werden. Da KI-Modelle spezialisierter werden, wird der Wert von Nischen-Datensätzen mit hoher Integrität weiterhin den Wert von generischen, aus dem Web gescrapten Inhalten übertreffen.
Sources
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Produmax — Datensatzmöglichkeit für Inspektionsberichte
View opportunity →FinanzenCavendish — Gelegenheit für Finanztransaktionsdatensatz
View opportunity →IndustrieDiscovery Acquisition — Gelegenheit für Datensatz zu industriellen Betriebsabläufen
View opportunity →News & Insights
Latest from the briefing
- Wie man Embedded Finance in vertikale Datenmarktplätze integriert
- Wie zentralisierte Löschung die Ökonomie des Datenbrokerings neu gestaltet
- Versteckte Verbindlichkeiten beim Kauf nicht verifizierter Daten von Brokern
- Wie universelle Löschmechanismen die Bewertung von Verbraucherdaten beeinflussen
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →