- المنافسة مع Google Gemini: يتنافس نطاق معلمات MM1 مع الإصدارات الأولى من نماذج الذكاء الاصطناعي من Google.
- التعلم السياقي المبتكر: قدرة MM1 على فهم والرد على الاستفسارات الجديدة بناءً على سياق المحادثة الحالي.
أعلنت Apple عن MM1، وهو جيل جديد من النماذج متعددة الوسائط القادرة على التفاعل بسلاسة مع الصور والنص، مما يمهد الطريق لتجربة أكثر بديهية واستجابة لـSiri و iMessage.
MM1: الذكاء الاصطناعي متعدد الوسائط الرائد
قدمت Apple MM1، مجموعة مبتكرة من نماذج الذكاء الاصطناعي متعددة الوسائط التي يمكنها معالجة كل من الصور المرئية والبيانات النصية. تتمتع هذه النماذج بعدد مذهل من المعلمات، يصل إلى 30 مليارًا، مما يجعلها منافسًا جديًا للتكرارات الأولى لنماذج Gemini من Google.
اقرأ أيضًا:تدعي Anthropic أن أحدث نموذج للذكاء الاصطناعي لها يتفوق على GPT-4
نماذج MM1 قادرة على تفسير وتنفيذ التعليمات التي تتضمن عناصر مرئية ونصية. على سبيل المثال، يمكن للذكاء الاصطناعي حساب التكلفة الإجمالية لمشروبين من خلال تحليل معلومات الأسعار المعروضة على قائمة الطعام.
إحدى الميزات البارزة لـ MM1 هي قدرته على التعلم السياقي. وهذا يسمح للنموذج بفهم والرد على الاستفسارات بناءً على المعلومات السياقية في الخطاب الجاري، دون الحاجة إلى إعادة تدريب محددة أو ضبط دقيق لكل استفسار أو مهمة جديدة.
قد تمكن هذه القدرة على التعلم السياقي النموذج من إنشاء أوصاف تفصيلية للصور أو الإجابة على أسئلة حول محتوى الرسائل المستندة إلى الصور، حتى لو لم يكن قد تعرض لمحتوى مماثل من قبل.
اقرأ أيضًا:ستعرض Apple "تقدمات visionOS" في WWDC 2024
تحسين تجربة المستخدم
فيما يتعلق بتحسين تجربة المستخدم، يمكن استخدام قدرات الفهم متعدد الوسائط لـ MM1 من Apple لتحسين أداء مساعدها الصوتي Siri. وهذا من شأنه أن يسمح لـ Siri بتقديم إجابات على الأسئلة بناءً على البيانات المرئية، مثل الأسئلة المستندة إلى الصور. بالإضافة إلى ذلك، يمكن أن يساعد MM1 في تفسير سياق الصور والرسائل النصية المشتركة عبر iMessage، وبالتالي تقديم اقتراحات رد أكثر صلة للمستخدمين.

