تخطي إلى المحتوى الرئيسي

إحاطة الإشارات / اتجاهات الخدمات السحابية العالمية

ما هي الرؤية الحاسوبية في التعلم العميق؟

الرؤية الحاسوبية هي مجال من الذكاء الاصطناعي يسمح للآلات بتفسير وفهم المعلومات البصرية من البيئة المحيطة بها.

ما هي الرؤية الحاسوبية في التعلم العميق؟
المنطقة
عالمي
تركيز الإشارة
سوق
نوع المحتوى
حدث
النطاق الأساسي
سوق
الموضوع
سوق
تأثير
متوسط
الثقة
دليل درجة الثقة
ثقة محدودة (72%)

عدة مصادر عامة

يتم تصنيف ما هي الرؤية الحاسوبية في التعلم العميق؟ بواسطة BTW Media لأن الأدلة المنشورة تربطه بالبنية التحتية للإنترنت والحوكمة والتبعيات التشغيلية أو وضوح السوق.

  • الرؤية الحاسوبية هي مجال من مجالات الذكاء الاصطناعي التي تمكن الآلات من تفسير وفهم المعلومات البصرية من البيئة المحيطة.
  • إنها تتيح لأجهزة الكمبيوتر إدراك العالم من خلال الصور أو مقاطع الفيديو الرقمية، تمامًا كما يفعل البشر بأعينهم.
  • من خلال الاستفادة من الخوارزميات المتقدمة ونماذج التعلم العميق، يمكن لأجهزة الكمبيوتر التعرف على الأشياء واكتشاف الأنماط واتخاذ قرارات ذكية بناءً على البيانات البصرية.

الرؤية الحاسوبية (CV) هي دراسة كيفية فهم الآلات لمحتوى الصور ومقاطع الفيديو. من خلال تحليل عناصر محددة من البيانات البصرية، تتيح خوارزميات الرؤية الحاسوبية مهام التنبؤ أو اتخاذ القرار.

التعلم العميق هو الآن النهج السائد للرؤية الحاسوبية. تبحث هذه المقالة في تطبيقات مختلفة للتعلم العميق في الرؤية الحاسوبية، مع التركيز على مزايا الشبكات العصبية التلافيفية (CNN). توفر الشبكات العصبية التلافيفية بنية طبقية تسمح للشبكات العصبية بتحديد أهم الخصائص في الصورة، مما يحسن دقة وكفاءة التحليل.

اقرأ أيضًا:ما هو مثال على حاسوب فائق؟

ما هي الرؤية الحاسوبية؟

الرؤية الحاسوبية، وهي مجموعة فرعية من التعلم الآلي، تركز على تفسير وفهم الصور ومقاطع الفيديو لتمكين أجهزة الكمبيوتر من "الرؤية" وأداء المهام البصرية المشابهة لتلك التي يقوم بها البشر.

تم تصميم نماذج الرؤية الحاسوبية لتحليل البيانات البصرية من خلال تحديد الخصائص والسياق المكتسب أثناء التدريب. تتيح هذه القدرة للنماذج تفسير الصور ومقاطع الفيديو، وتطبيق معرفتها على عمليات التنبؤ أو اتخاذ القرار.

على الرغم من أن كلاهما يتعامل مع البيانات البصرية، إلا أنه من المهم التمييز بين معالجة الصور والرؤية الحاسوبية. تتضمن معالجة الصور تعديل أو تحسين الصور لتوليد نتيجة جديدة، مثل ضبط السطوع أو الدقة، أو تعتيم التفاصيل الحساسة، أو الاقتصاص. على عكس الرؤية الحاسوبية، لا تتضمن معالجة الصور بالضرورة تحديد المحتوى.

اقرأ أيضًا:إنتل تطور أكبر نظام حاسوبي عصبي الشكل

دور التعلم العميق

التعلم العميق، مجموعة فرعية من التعلم الآلي، أحدث ثورة في الرؤية الحاسوبية من خلال تمكين تحليل صور أكثر دقة وكفاءة. في قلب التعلم العميق توجد الشبكات العصبية الاصطناعية، وهي شبكات معقدة من العقد المترابطة المستوحاة من الدماغ البشري. يتم تدريب هذه الشبكات العصبية على مجموعات بيانات كبيرة لتعلم الأنماط والخصائص المعقدة مباشرة من البيانات الأولية للصور، دون الحاجة إلى برمجة صريحة.

استخدامات التعلم العميق في الرؤية الحاسوبية

أدى تطوير تقنيات التعلم العميق إلى إنشاء نماذج رؤية حاسوبية أكثر دقة وتعقيدًا. ومع تطور هذه التقنيات، يصبح تكامل تطبيقات الرؤية الحاسوبية مفيدًا بشكل متزايد. فيما يلي بعض الطرق التي يُستخدم بها التعلم العميق لتحسين الرؤية الحاسوبية.

كشف الأشياء

هناك نوعان شائعان من كشف الأشياء يتم إجراؤهما بواسطة تقنيات الرؤية الحاسوبية. تتطلب الخطوة الأولى من كشف الأشياء المكون من خطوتين شبكة اقتراح المناطق (RPN)، لتوفير عدد من المناطق المرشحة التي قد تحتوي على أشياء مهمة. وتتمثل الخطوة الثانية في تمرير مقترحات المناطق إلى بنية تصنيف عصبية، عادةً خوارزمية تجميع هرمي تعتمد على RCNN أو تجميع مناطق الاهتمام (ROI) في Fast RCNN. هذه الأساليب دقيقة إلى حد ما، ولكنها قد تكون بطيئة جدًا.

مع الحاجة إلى كشف الأشياء في الوقت الفعلي، ظهرت بنيات كشف الأشياء المكونة من خطوة واحدة، مثلYOLOوSSDوRetinaNet. تجمع هذه بين خطوات الكشف والتصنيف عن طريق الانحدار على تنبؤات الصناديق المحيطة. يتم تمثيل كل صندوق محيط ببضع إحداثيات فقط، مما يسهل الجمع بين خطوة الكشف والتصنيف ويسرع المعالجة.

تحديد المواقع وكشف الأشياء

يتضمن تحديد المواقع في الصور تحديد موقع الأشياء في الصورة، عادةً عن طريق الإشارة إليها بصناديق محيطة. يعتمد كشف الأشياء على ذلك ليس فقط من خلال تحديد موقع الأشياء، بل أيضًا تصنيفها. تعتمد هذه المهمة بشكل كبير على الشبكات العصبية التلافيفية (CNN).

يعد تحديد المواقع وكشف الأشياء ضروريين لتحديد العديد من الأشياء في المشاهد المعقدة، مما يتيح تطبيقات مثل تفسير صور التشخيص الطبي.

التجزئة الدلالية

التجزئة الدلالية، والتي تسمى أيضًا تجزئة الكائنات، تختلف عن كشف الأشياء من خلال التحديد الدقيق للبكسل المرتبط بالأشياء الفردية، مما يلغي الحاجة إلى الصناديق المحيطة. يسمح هذا النهج بتحديد أكثر دقة للأشياء في الصورة.

يتم تنفيذ التجزئة الدلالية عادةً باستخدام شبكات تلافيفية بالكامل (FCN) أو U-Nets.

أحد التطبيقات الواسعة للتجزئة الدلالية هو تدريب المركبات ذاتية القيادة. تتيح هذه التقنية للباحثين استخدام صور الشوارع أو الطرق السريعة مع حدود كائنات محددة بدقة، مما يسهل التدريب القوي لأنظمة الملاحة الذاتية.

تقدير الوضعية

تقدير الوضعية هو طريقة تستخدم لتحديد مكان المفاصل في صورة شخص أو كائن وما يشير إليه وضع هذه المفاصل. يمكن استخدامه مع الصور ثنائية وثلاثية الأبعاد. البنية الرئيسية المستخدمة لتقدير الوضعية هي PoseNet، والتي تعتمد على الشبكات العصبية التلافيفية.

يُستخدم تقدير الوضعية لتحديد أين قد تظهر أجزاء الجسم في الصورة ويمكن استخدامه لتوليد أوضاع أو حركات واقعية للأشكال البشرية. غالبًا، تُستخدم هذه الميزة للواقع المعزز، أو إعادة إنتاج الحركات باستخدام الروبوتات، أو تحليل المشية.

موجز الإشارة

  • إشارة: ما هي الرؤية الحاسوبية في التعلم العميق؟
  • المنطقة: عالمي
  • فئة السوق: اتجاهات الخدمات السحابية العالمية

البصمة التشغيلية

  • يجب أن تحدد المصادر المنشورة الأطراف المتأثرة، ونطاق التشغيل، والتعرض للسوق قبل اعتبار خريطة الاتجاه هذه مكتملة.

سياق السوق

  • الأهمية التشغيلية: متوسط
  • الأفق الزمني: الربع القادم

ما الذي تشاهده

  • راقب البيانات الرسمية، التحديثات التنظيمية، تعرض العملاء أو الشركاء، والإفصاحات المتابعة.

إحاطة الأعضاء

السياق الأعمق للاتجاهات

سجّل الدخول بمستوى العضوية المناسب لفتح الإحاطة الكاملة وملاحظات المصادر.

فقط لتحالف القيادة

تحالف القيادة

للمشغلين والمستثمرين وفرق السياسات الذين يحتاجون إلى أدلة العلاقات ومسارات الفشل وملاحظات المصادر. سجل الدخول لفتح.

انضم إلى تحالف القيادة
رجوعالمزيد من التغطية: اتجاهات الخدمات السحابية العالمية