EvolutionaryScale تؤمن 142 مليون دولار لنماذج "العالم" البيولوجية
Nvidia وأمازون تدعمان جولة تمويل أولية بقيمة 142 مليون دولار لتدريب نموذج ESM3 على مجموعة بيانات تضم 278 مليون بروتين.
أغلقت EvolutionaryScale جولة تمويل أولية معلنة بقيمة 142 مليون دولار (https://www.forbes.com/sites/alexkonrad/2024/06/25/evolutionaryscale-raises-142-million-for-biological-ai-model/) لتسريع تطوير "نماذج العالم" للذكاء الاصطناعي القادرة على محاكاة وهندسة الأنظمة البيولوجية. الجولة، بقيادة Lux Capital، وNat Friedman، وDaniel Gross، بمشاركة من Nvidia و Amazon، تضع الشركة الناشئة في طليعة سباق "البيانات من أجل البيولوجيا". تم تخصيص رأس المال لصقل ESM3، وهو نموذج لغوي متطور للبيولوجيا يضم 98 مليار معامل (https://www.evolutionaryscale.ai/blog/esm3-release) وتم تدريبه على مجموعة بيانات ضخمة تضم 278 مليون بروتين (https://www.evolutionaryscale.ai/blog/esm3-release).
صعود نماذج العالم البيولوجية
على عكس الذكاء الاصطناعي التوليدي التقليدي الذي يركز على النصوص أو البكسلات، تقوم EvolutionaryScale ببناء ما يسميه الباحثون "نموذج عالم" لعلوم الحياة. من خلال التعامل مع الشفرة الوراثية كلغة، أظهر نموذج ESM3 القدرة على توليد بروتينات فلورية جديدة تمامًا تختلف اختلافًا كبيرًا عن تلك الموجودة في الطبيعة - مما يحاكي بشكل فعال 500 مليون سنة من التطور (https://www.evolutionaryscale.ai/blog/esm3-release) في بيئة رقمية. تشير هذه القدرة إلى تحول في سوق الأصول البيانية، حيث لم تعد مجموعات البيانات الأكثر قيمة مجرد نصوص تم جمعها من الويب، بل تسلسلات بيولوجية متخصصة ومنظمة للغاية يمكن استخدامها "لبرمجة" المادة.
تحول ترخيص البيانات: من الاستخدام العادل إلى الأصول المدفوعة
تتزامن جولة EvolutionaryScale مع تحول أوسع في السوق نحو ترخيص البيانات عالية النزاهة. بينما يتم ترميز البيانات البيولوجية لاكتشاف الأدوية، تؤمن شركات الإعلام الكبرى أرشيفاتها الخاصة. وقعت OpenAI مؤخرًا صفقة ترخيص محتوى متعددة السنوات (https://time.com/6992661/time-openai-partnership/) مع Time Magazine، مما يمنح مختبر الذكاء الاصطناعي الوصول إلى أكثر من 100 عام من الأرشيفات الصحفية. في حين أن الشروط المالية لا تزال غير معلنة (https://www.reuters.com/technology/openai-time-strike-multi-year-content-licensing-deal-2024-06-27/)، فإن الصفقة تتبع المعيار المعلن البالغ 250 مليون دولار (https://www.reuters.com/technology/news-corp-signs-multi-year-ai-content-deal-with-openai-2024-05-22/) الذي حددته اتفاقية News Corp. وبالمثل، يُقال إن YouTube يتفاوض (https://www.ft.com/content/22759e6f-479e-41a4-9e7b-f947702f23b2) مع شركات تسجيلات رئيسية بما في ذلك Sony و Universal لتقديم مبالغ مقطوعة تقدر بملايين الدولارات (https://www.ft.com/content/22759e6f-479e-41a4-9e7b-f947702f23b2) للوصول القانوني إلى كتالوجات الموسيقى لتدريب الذكاء الاصطناعي.
تحديات تنظيمية وأصل البيانات
مع ارتفاع قيمة بيانات التدريب بشكل كبير، يضغط المنظمون والمبدعون ضد الاستخدام غير المصرح به. قامت Figma مؤخرًا بتعطيل ميزة "Make Design" للذكاء الاصطناعي الخاصة بها (https://www.theverge.com/2024/7/1/24189917/figma-disables-ai-design-tool-apple-weather-app-copying) بعد مزاعم بأنها تم تدريبها على تصميمات تطبيقات موجودة، مما يسلط الضوء على المخاطر القانونية لخطوط أنابيب البيانات غير الشفافة. علاوة على ذلك، يأتي استثمار SoftBank المعلن بقيمة 10 ملايين دولار إلى 20 مليون دولار (https://www.bloomberg.com/news/articles/2024-06-27/softbank-to-invest-in-search-startup-perplexity-ai/) في Perplexity AI وسط سيل من إشعارات انتهاك حقوق النشر من الناشرين، مما يشير إلى أنه حتى الشركات الناشئة في مجال الذكاء الاصطناعي ذات النمو المرتفع يجب أن تخصص الآن ميزانية كبيرة للامتثال البيانات والتسوية. يتضح هذا الاتجاه بشكل أكبر من خلال جولة التمويل المقدرة بـ 100 مليون دولار لشركة Harvey (https://techcrunch.com/2024/06/26/legal-ai-startup-harvey-is-raising-100m-at-a-1-5b-valuation/)، والتي تقيم المتخصص في البيانات القانونية بما يقدر بـ 1.5 مليار دولار (https://techcrunch.com/2024/06/26/legal-ai-startup-harvey-is-raising-100m-at-a-1-5b-valuation/) - علاوة مدفوعة بوصولها إلى مجموعات بيانات قانونية خاصة وعالية المخاطر.
لماذا يهم أصحاب البيانات
تثبت صفقة EvolutionaryScale أن الفرصة الأكثر ربحًا لتحقيق الدخل من البيانات تتحول من محتوى الويب العام إلى "نماذج عالم خاصة بالمجال". بالنسبة لأصحاب البيانات في مجالات البيولوجيا والقانون والموسيقى، تجاوز السوق مجرد الترخيص إلى نموذج شراكة استراتيجية حيث تكون البيانات هي المحفز الأساسي للاختراقات العلمية والإبداعية. مع استنفاد مختبرات الذكاء الاصطناعي مثل OpenAI و Anthropic لبيانات الويب العامة، سيستمر العلاوة على مجموعات البيانات النظيفة والخاصة والمصرح بها قانونيًا في الارتفاع، مما يحول الأرشيفات السلبية إلى أصول مالية عالية العائد.
Data Academy
Go deeper with our guides
From the marketplace
Explore live data opportunities
Globalsourcingservices — فرصة مجموعة بيانات المشتريات العامة
View opportunity →تنقلClg Inc — فرصة مجموعة بيانات العمليات الصناعية
View opportunity →التنقلBroekmanlogistics — فرصة مجموعة بيانات العمليات الصناعية
View opportunity →News & Insights
Latest from the briefing
- كيفية تقييم وبيع مجموعات بيانات اللغات النادرة ولغة الإشارة
- سعر السوق لبيانات تدريب الذكاء الاصطناعي غير المرخصة
- كيفية تدقيق مجموعات البيانات للامتثال لقانون الذكاء الاصطناعي للاتحاد الأوروبي عالي المخاطر
- كيفية الامتثال لقانون الحذف في كاليفورنيا ونظام DROP
d-nvest turns the data assets behind these deals into scored, actionable opportunities.
Explore the pipeline →