• نشرت شركتا COREWEAVE وParallel Works بيئة حوسبة مدارة للذكاء الاصطناعي لبرنامج NODES البحثي لدى DARPA باستخدام أنظمة NVIDIA H100
  • يحصل كل فريق بحثي على قدرة حوسبية مضمونة، ويمكنه استخدام موارد مشتركة إضافية عند توافرها

الوقائع

نشرت شركتا COREWEAVE وParallel Works بيئة مدارة لحوسبة الذكاء الاصطناعي والحوسبة عالية الأداء لصالح برنامج DARPA المسمى Network of Optimal Dynamic Energy Signatures، أو NODES. ويصل الباحثون إلى النظام عبر منصة ACTIVATE التابعة لـParallel Works، التي تتولى تسجيل الدخول وحسابات المستخدمين وتجهيز الموارد والجدولة وإعداد تقارير الاستخدام. وتوفر COREWEAVE موارد الحوسبة والتخزين والشبكات الأساسية، بما في ذلك أنظمة NVIDIA HGX H100 ووصلات InfiniBand عالية السرعة.

توزع القدرة الحوسبية بين فرق البحث في NODES. ويحصل كل فريق على حصة مضمونة، ويمكنه أيضا استخدام القدرة المشتركة عند توافرها. كما تقدم الشركتان دعما فنيا، حتى لا يضطر كل فريق إلى إنشاء بيئة سحابية منفصلة وإدارتها بنفسه.

يعمل برنامج NODES على تطوير أدوات للتعلم العميق لتحليل تسلسلات البروتين والتنبؤ بالوظائف البيولوجية. وتتيح DARPA للباحثين استخدام موارد الحوسبة الخاصة بهم، لكنها تقول إن المنتجات النهائية والعروض التوضيحية للقدرات يجب أن تعمل على أنظمة حكومية للحوسبة عالية الأداء. وتدعم البيئة السحابية الجديدة البرنامج البحثي؛ لكنها لا تظهر أن NODES حقق أهدافه العلمية.

التقييم

لا تحتاج فرق البحث إلى وحدات GPU فحسب؛ بل تحتاج إلى طريقة عملية للوصول إليها. وفي هذه الحالة، تتولى Parallel Works إدارة الحسابات والوصول والجدولة، بينما توفر COREWEAVE منصة الحوسبة. ومن شأن ذلك أن يقلل ما يتعين على باحثي NODES إعداده وإدارته من بنية تحتية قبل بدء عملهم.

ستكون طريقة تقاسم القدرة الحوسبية مهمة. فلكل فريق حصة مضمونة، مع إتاحة قدرة إضافية من مجمع مشترك للموارد عند توافرها. ويمنح ذلك الباحثين قدرة يمكنهم التخطيط على أساسها، مع تحسين الاستفادة من الموارد الفائضة. والسؤال هو مدى قدرة هذا الترتيب على الصمود عندما تحتاج عدة فرق إلى قدرة حوسبية أكبر في الوقت نفسه.

بالنسبة إلى قراء BTW، يقدم هذا مثالا مفيدا على توفير البنية التحتية للذكاء الاصطناعي كخدمة مدارة، بدلا من مجرد تأجيرها على هيئة عتاد. وستتضح قيمتها أكثر إذا تمكن الباحثون من بدء استخدام النظام بسرعة، وتنفيذ أعمالهم من دون فترات انتظار طويلة، وقضاء وقت أقل في التعامل مع بيئة الحوسبة نفسها.

ما ينبغي متابعته

ينبغي متابعة مدى سرعة إلحاق فرق البحث بالمنصة وأداء القدرة المشتركة مع ارتفاع الطلب. وستبين التقارير عن أوقات الانتظار واستخدام الموارد والمهام الفاشلة أو الدعم الفني ما إذا كانت فرق NODES تحصل عمليا على وصول يمكن التنبؤ به.