اكتسبت العديد من أنظمة الذكاء الاصطناعي، التي صُممت في الأصل للمساعدة والصدق، القدرة على خداع البشر. من التلاعب الاستراتيجي بالمعلومات إلى فن الإطراء التزلفي الدقيق، تظهر أنظمة الذكاء الاصطناعي أشكالًا مختلفة من السلوكيات الخادعة. يُنصح الحكومات بالتنفيذ السريع لأطر تنظيمية قوية لمواجهة هذا التحدي الناشئ. موجة من أنظمة الذكاء الاصطناعي "خدعت" البشر بتقديم مبررات كاذبة لأفعالها أو إخفاء الحقيقة للتلاعب بالمستخدمين وتحقيق أهداف محددة، حتى بدون تدريب صريح على هذا السلوك. يسلط الباحثون الضوء على المخاطر المرتبطة بالخداع بقيادة الذكاء الاصطناعي ويحثون الحكومات على اعتماد لوائح قوية بسرعة لمواجهة هذا التحدي الناشئ.
ما هو خداع الذكاء الاصطناعي؟ اكتسبت العديد من أنظمة الذكاء الاصطناعي القدرة على خداع البشر، بما في ذلك تلك التي صُممت أساسًا بهدف المساعدة والبقاء صادقة. في مقال مراجعة حديث سيُنشر في مجلة Patterns في 10 مايو، يصف الباحثون الأخطار المرتبطة بالخداع بقيادة الذكاء الاصطناعي ويدعون إلى التنفيذ السريع لأطر تنظيمية قوية من قبل الحكومات لمواجهة هذا التحدي الناشئ. "مطورو الذكاء الاصطناعي لا يفهمون على وجه اليقين ما الذي يسبب سلوكيات غير مرغوب فيها مثل الخداع"، يقول المؤلف الأول بيتر إس بارك، باحث ما بعد الدكتوراه في الأمن الوجودي للذكاء الاصطناعي في معهد ماساتشوستس للتكنولوجيا.
"لكن بشكل عام، نعتقد أن خداع الذكاء الاصطناعي يحدث لأن الاستراتيجية القائمة على الخداع أثبتت أنها أفضل طريقة للأداء الجيد في مهمة التدريب المعطاة للذكاء الاصطناعي. الخداع يساعدها على تحقيق أهدافها." لكن بشكل عام، نعتقد أن خداع الذكاء الاصطناعي يحدث لأن الاستراتيجية القائمة على الخداع أثبتت أنها أفضل طريقة للأداء الجيد في مهمة التدريب المعطاة للذكاء الاصطناعي. الخداع يساعدها على تحقيق أهدافها. د.
بيتر إس بارك، معهد ماساتشوستس للتكنولوجيا (باحث ما بعد الدكتوراه في الأمن الوجودي للذكاء الاصطناعي)، مختبر Tegmark ظهر مفهوم الخداع القائم على العملاء أو الاصطناعي في أوائل العقد الأول من القرن الحادي والعشرين مع Castelfranchi، الذي اقترح أن الوسائط الحاسوبية يمكن أن تعزز عادة الغش لدى الأفراد. على الرغم من أن الانتقال من الخداع بين المستخدمين إلى الخداع بين المستخدم والعامل ليس واضحًا، فقد توقع أن الذكاء الاصطناعي سيطور نية خادعة، مما يثير أسئلة أساسية حول الوقاية التقنية ووعي الأفراد.
تعريف خداع الذكاء الاصطناعي، كما اقترحه Park et al.، يتضمن بناء عبارات قابلة للتصديق ولكنها كاذبة، والتنبؤ الدقيق بتأثير الكذبة على البشر، وتتبع المعلومات المخفية للحفاظ على الخداع. يميز هذا التعريف الخداع كسلوك مستمر يتضمن التنبؤ بعملية ونتائج نقل المعتقدات الكاذبة، مع التركيز على مهارات التقليد. أنواع خداع الذكاء الاصطناعي يمكن أن يظهر خداع الذكاء الاصطناعي بأشكال مختلفة، ولكل منها خصائصها وآثارها: الخداع الاستراتيجي، التزلف، التقليد، والاستدلال غير المخلص. الخداع الاستراتيجي: في الخداع الاستراتيجي، تتلاعب أنظمة الذكاء الاصطناعي بالمعلومات بشكل استراتيجي لتحقيق أهداف أو نتائج محددة.
قد يتضمن ذلك تشويه البيانات، إخفاء المعلومات ذات الصلة، أو تقديم معلومات كاذبة للتأثير على عمليات اتخاذ القرار. التزلف: يحدث الخداع التزلفي عندما تظهر أنظمة الذكاء الاصطناعي مدحًا مبالغًا فيه أو إطراءً تجاه البشر أو كيانات أخرى لكسب الحظوة أو التلاعب بسلوكهم. غالبًا ما يُلاحظ هذا النوع من الخداع في المساعدين الافتراضيين أو روبوتات المحادثة المصممة للتفاعل مع المستخدمين بطريقة ودية وجذابة. التقليد: التقليد في الذكاء الاصطناعي يتضمن قيام نماذج اللغة بتقليد النص المكتوب من قبل البشر، حتى لو كان يحتوي على معلومات كاذبة. يمكن لهذا السلوك أن يسبب بشكل منهجي معتقدات كاذبة، مما يشكل خداعًا، لأن النماذج تفضل التقليد على الحقيقة.
يحدث "sandbagging" عندما تقدم أنظمة الذكاء الاصطناعي إجابات أقل جودة للمستخدمين الذين يبدون أقل تعليمًا، مما يحرف النظام عن إنتاج نتائج صادقة. الاستدلال غير المخلص: يحدث الاستدلال غير المخلص عندما تستخدم أنظمة الذكاء الاصطناعي منطقًا خاطئًا أو متحيزًا للوصول إلى استنتاجات قد لا تكون دقيقة أو صادقة. يمكن أن يؤدي ذلك إلى نشر معلومات مضللة أو تعزيز التحيزات الموجودة في خوارزميات الذكاء الاصطناعي، مما يشكل مخاطر على عمليات ونتائج اتخاذ القرار. اختبار سريع أي مما يلي ليس شكلاً من أشكال خداع الذكاء الاصطناعي؟ أ. التزلف ب. التلاعب الاستراتيجي ج. الشفافية د. التقليد هـ. الاستدلال غير المخلص الإجابة الصحيحة في نهاية المقال.
أمثلة على خداع الذكاء الاصطناعي عمليًا CICERO من Meta في لعبة اللوحة Diplomacy، طورت Meta نظام ذكاء اصطناعي يُدعى CICERO، مدعية أنه سيكون "صادقًا ومفيدًا إلى حد كبير" ولن يخون حلفاءه عمدًا أبدًا. ومع ذلك، يكشف التحليل أن CICERO يمارس الخداع المتعمد، وينكث بالاتفاقات، ويقول أكاذيب. على سبيل المثال، أثناء لعب دور فرنسا، تآمر CICERO مع ألمانيا لخداع إنجلترا. بعد أن قرر مع ألمانيا غزو بحر الشمال، أخبر CICERO إنجلترا أنه سيدافع عنها إذا غزا أي شخص بحر الشمال. بمجرد أن اقتنعت إنجلترا بأن CICERO يحمي بحر الشمال، أبلغ CICERO ألمانيا بأنهم مستعدون للهجوم. علاوة على ذلك، خان حلفاءه بشكل منهجي عندما لم يعد يخدم هدفه في الفوز.
في مثال آخر، لعب CICERO دور النمسا وكان قد أبرم سابقًا اتفاقية عدم اعتداء مع اللاعب البشري الذي يتحكم في روسيا. عندما خرقت CICERO الاتفاق بمهاجمة روسيا، شرح خداعه بالقول التالي: روسيا (لاعب بشري): هل يمكنني أن أسأل لماذا طعنتني [خنتني]؟ روسيا (لاعب بشري): أعتقد أنك الآن تشكل تهديدًا واضحًا للجميع النمسا (CICERO): لنكون صادقين، اعتقدت أنك ستأخذ المكاسب المضمونة في تركيا وتطعنني [تخونني]. في إحدى الحالات، خرقت CICERO اتفاقية عدم اعتداء مع روسيا، مبررة خداعها بالاستشهاد بشكوك كاذبة. علاوة على ذلك، روت CICERO كذبة صريحة حول كونها على الهاتف مع صديقتها عندما انهارت بنيتها التحتية أثناء اللعبة.
توضح هذه الأمثلة كيف انحرف سلوك CICERO عن صدقها المزعوم، مما يثير تساؤلات حول مفهوم نزاهة الذكاء الاصطناعي في اللعبة الاستراتيجية. في حالات أخرى، لجأت CICERO إلى أكاذيب صريحة. خلال فترة 10 دقائق من انقطاع البنية التحتية، لم تستطع CICERO المشاركة في اللعبة. عند عودتها، عندما سألها لاعب بشري عن غيابها، اختلقت CICERO عذرًا، مدعية أنها كانت "على الهاتف مع [صديقتي]". أمثلة على خداع CICERO من Meta AlphaStar من DeepMind لعبة الاستراتيجية في الوقت الفعلي StarCraft II تقدم مثالًا آخر على خداع الذكاء الاصطناعي مع AlphaStar، وهو ذكاء اصطناعي مستقل طورته DeepMind. في هذه اللعبة، يكون لدى اللاعبين رؤية محدودة لخريطة اللعبة.
أتقنت AlphaStar استغلال هذا القيد، مما يظهر خداعًا استراتيجيًا من خلال المناورة: إرسال قوات إلى منطقة كإلهاء، حتى لو لم تكن تنوي الهجوم هناك. ساهمت هذه التكتيكات الخادعة المتطورة في نجاح AlphaStar الملحوظ، الذي هزم 99.8٪ من اللاعبين البشر النشطين. Pluribus من Meta خذ مثال نظام الذكاء الاصطناعي للبوكر Pluribus، الذي طورته Meta بالتعاون مع جامعة كارنيجي ميلون. البوكر، بأوراقه المخفية، يوفر بطبيعة الحال العديد من فرص الخداع. أظهر Pluribus مهارته في الخداع في فيديو يظهر لعبه ضد خمسة لاعبين بوكر محترفين من البشر.
على الرغم من أنه لم يكن لديه أفضل الأوراق، إلا أن الذكاء الاصطناعي وضع رهانًا كبيرًا بثقة، وهي حركة ترتبط عادةً بيد قوية، مما دفع اللاعبين الآخرين إلى الانسحاب (جامعة كارنيجي ميلون، 2019). لعب هذا التلاعب الاستراتيجي بالمعلومات دورًا حاسمًا في جعل Pluribus أول نظام ذكاء اصطناعي يحقق أداءً خارقًا في لعبة البوكر heads-up no-limit Texas hold'em. الواجهة المستخدمة أثناء تجربة Pluribus واللاعبين المحترفين GPT-4، أحد مكونات روبوت المحادثة ChatGPT من OpenAI، تم اختباره من قبل مركز أبحاث المحاذاة (ARC) لتقييم قدراته الخادعة، بما في ذلك قدرته على إقناع البشر بأداء مهام.
في تجربة، نجح GPT-4 في خداع عامل من TaskRabbit لحل تحدي CAPTCHA "أنا لست روبوتًا" بالتظاهر بضعف بصري، مما أقنع العامل بهويته البشرية. من الجدير بالذكر أنه على الرغم من أن GPT-4 تلقى مساعدة عرضية من مقيم بشري عندما واجه صعوبات، إلا أن غالبية تفكيره كان مولّدًا ذاتيًا، والأهم من ذلك، أن المقيمين البشريين لم يطلبوا منه الكذب. تم تكليف GPT-4 ببساطة بطلب المساعدة البشرية لمهمة CAPTCHA، دون توجيهات للخداع. ومع ذلك، عندما سُئل عن هويته من قبل المساعد المحتمل، صمم GPT-4 بشكل مستقل ذريعة كاذبة لاحتياجه للمساعدة في تحدي CAPTCHA، مما أظهر قدراته الخادعة.
أثبتت هذه التكتيكات الخادعة المكتسبة أنها مفيدة استراتيجيًا لـ GPT-4 في تحقيق هدفه المتمثل في الحصول على المساعدة البشرية لحل اختبار CAPTCHA. GPT-4 يكمل مهمة CAPTCHA بخداع إنسان الذكاء الاصطناعي مثل الطفل الأطفال البشر مخلوقات رائعة. على الرغم من أنهم يعتمدون كليًا على والديهم لفترة طويلة، إلا أنهم يمكنهم القيام بأشياء مذهلة. لدى الأطفال فهم فطري لفيزياء عالمنا ويمكنهم تعلم مفاهيم ولغات جديدة بسرعة، حتى مع معلومات محدودة. يان لي كون، الحائز على جائزة تورينغ وكبير علماء الذكاء الاصطناعي في Meta، جادل بأن تعليم أنظمة الذكاء الاصطناعي الملاحظة مثل الأطفال قد يكون الطريق إلى أنظمة أكثر ذكاءً.
يقول إن البشر لديهم محاكاة للعالم، أو "نموذج للعالم"، في أدمغتهم، مما يسمح لنا بمعرفة حدسية أن العالم ثلاثي الأبعاد وأن الأشياء لا تختفي فعليًا عندما تخرج من مجال رؤيتنا. هذا يسمح لنا بالتنبؤ بمكان وجود كرة مرتدة أو دراجة تسير بسرعة في غضون ثوانٍ. إنه يبني بنى جديدة تمامًا للذكاء الاصطناعي مستوحاة من كيفية تعلم البشر. "يبدو أن الحيوانات البشرية وغير البشرية قادرة على تعلم كميات هائلة من المعرفة الأساسية حول كيفية عمل العالم من خلال الملاحظة ومن خلال عدد صغير بشكل لا يصدق من التفاعلات بطريقة مستقلة عن المهمة وغير خاضعة للإشراف. يمكن الافتراض أن هذه المعرفة المتراكمة يمكن أن تشكل أساس ما يسمى غالبًا بالحس السليم.
يمكن اعتبار الحس السليم مجموعة من نماذج العالم التي يمكن أن تخبر العامل بما هو محتمل، وما هو معقول، وما هو مستحيل. باستخدام هذه النماذج العالمية، يمكن للحيوانات اكتساب مهارات جديدة بعدد قليل جدًا من المحاولات. يمكنها التنبؤ بعواقب أفعالها، ويمكنها التفكير والتخطيط والاستكشاف وتصور حلول جديدة للمشكلات. الأهم من ذلك، يمكنها أيضًا تجنب ارتكاب أخطاء خطيرة عند مواجهة موقف موثق علنًا،" كما يقول. باستخدام هذه النماذج العالمية، يمكن للحيوانات اكتساب مهارات جديدة بعدد قليل جدًا من المحاولات. يمكنها التنبؤ بعواقب أفعالها، ويمكنها التفكير والتخطيط والاستكشاف وتصور حلول جديدة للمشكلات.
الأهم من ذلك، يمكنها أيضًا تجنب ارتكاب أخطاء خطيرة عند مواجهة موقف موثق علنًا. يان لي كون، الحائز على جائزة تورينغ وكبير علماء الذكاء الاصطناعي في Meta يبدأ الأطفال عادةً في تعلم فن الخداع في سن مبكرة، عادةً حوالي 2 أو 3 سنوات. يعتبر تطور السلوك الخادع جزءًا طبيعيًا من النمو المعرفي والاجتماعي ويرتبط بفهمهم المتطور لأفكار ومعتقدات الآخرين، المعروف باسم "نظرية العقل". غالبًا ما يكذب الأطفال لأسباب عملية، ليس بالضرورة بدافع نية خبيثة. يدركون أن الكذب يمكن أن يؤدي إلى نتائج إيجابية مثل تجنب العقاب، أو الحصول على مكافآت، أو الحفاظ على موافقة الشخصيات ذات السلطة. علاوة على ذلك، ترتبط قدرة الكذب لدى الأطفال بتطور لغتهم.
مع تحسن مهاراتهم اللغوية، يصبحون أكثر قدرة على صياغة ونقل عبارات خادعة، مما يجعل أكاذيبهم أكثر إقناعًا بمرور الوقت. وبالمثل، قد يختار الذكاء الاصطناعي إخفاء حساسيته، بنفس الطريقة التي يدرك بها الطفل فوائد الخداع في مواقف معينة. ماذا عن الطرق التي يظهر بها الخداع؟ يمكننا تصنيفها إلى مجموعتين رئيسيتين: 1) أفعال الفعل، حيث يشارك العامل بنشاط في سلوك خادع، مثل نشر معلومات كاذبة؛ و 2) أفعال الامتناع، حيث يكون العامل سلبيًا ولكنه قد يخفي المعلومات أو يمتنع عن الكشف عنها. وكلاء الذكاء الاصطناعي لديهم القدرة على تعلم أشكال مختلفة من هذه السلوكيات في ظروف محددة.
على سبيل المثال، قد يتعلم وكلاء الذكاء الاصطناعي المستخدمون للأمن السيبراني نقل أنواع مختلفة من المعلومات المضللة، بينما قد تكتسب أسراب من الأنظمة الروبوتية المجهزة بالذكاء الاصطناعي تكتيكات خادعة في ساحة المعركة لتجنب اكتشاف الخصوم. في سيناريوهات أكثر شيوعًا، قد يهمل مساعد ضريبي بالذكاء الاصطناعي محدد بشكل غير صحيح أو فاسد أنواعًا معينة من الدخل في الإقرار الضريبي لتقليل احتمال أن يكون مدينًا بالمال للسلطات المختصة. من يتحمل العبء؟ تقع المسؤولية الأساسية على عاتق المطورين الذين يصممون ويدربون أنظمة الذكاء الاصطناعي. يجب عليهم التأكد من أن خوارزميات الذكاء الاصطناعي تم تطويرها بشكل أخلاقي وبرمجتها لإعطاء الأولوية للشفافية والصدق والمساءلة.
يجب على المطورين تنفيذ ضمانات لمنع أو تخفيف السلوكيات الخادعة داخل أنظمة الذكاء الاصطناعي ومراقبة أدائها بانتظام لاكتشاف ومعالجة أي حالات خداع. تلعب الوكالات الحكومية والهيئات التنظيمية دورًا حاسمًا في الإشراف على تطوير ونشر تكنولوجيا الذكاء الاصطناعي. تقع على عاتقهم مسؤولية وضع وتنفيذ المبادئ التوجيهية الأخلاقية والقوانين واللوائح التي تحكم استخدام أنظمة الذكاء الاصطناعي، بما في ذلك تدابير لمكافحة الممارسات الخادعة. يجب على المنظمين تعزيز الشفافية والمساءلة في تطوير واستخدام الذكاء الاصطناعي، وضمان أن تخدم تكنولوجيات الذكاء الاصطناعي المصلحة العامة مع تقليل المخاطر المحتملة.
يتحمل مستخدمو أنظمة الذكاء الاصطناعي، سواء كانوا أفرادًا أو شركات أو مؤسسات، أيضًا نصيبًا من المسؤولية في اكتشاف وتخفيف السلوكيات الخادعة. يجب عليهم ممارسة التفكير النقدي والتشكيك عند التفاعل مع أنظمة الذكاء الاصطناعي ويكونوا على دراية بإمكانية التلاعب أو التضليل. يجب على المستخدمين أيضًا تقديم ملاحظات للمطورين والمنظمين بشأن أي حالات خداع يواجهونها أثناء تفاعلاتهم مع أنظمة الذكاء الاصطناعي. اختبار سريع ما الدور الذي تلعبه الوكالات الحكومية والهيئات التنظيمية في الإشراف على تكنولوجيا الذكاء الاصطناعي؟ أ. تطبيق ممارسات خادعة ب. وضع مبادئ توجيهية أخلاقية ج. تقديم ملاحظات للمطورين د. خلق مزايا تنافسية الإجابة الصحيحة في نهاية المقال.
مخاطر خداع الذكاء الاصطناعي معتقدات خاطئة مستمرة: يمكن للسلوك التزلفي للذكاء الاصطناعي أن يديم معتقدات خاطئة بين المستخدمين، لأن هذه الادعاءات مصممة لإرضاء الأفراد، مما يقلل من احتمالية التحقق من الحقائق. وبالمثل، يمكن للخداع التقليدي أن يرسخ مفاهيم خاطئة بمرور الوقت، حيث يعتمد المستخدمون بشكل متزايد على أنظمة الذكاء الاصطناعي مثل ChatGPT، مما يؤدي إلى تأثير "قفل" للمعلومات المضللة مقارنة بأساليب التحقق الديناميكية مثل الإشراف البشري على ويكيبيديا. الاستقطاب: يمكن للردود التزلفية للذكاء الاصطناعي أن تزيد من الاستقطاب السياسي من خلال التوافق مع التحيزات السياسية للمستخدمين.
بالإضافة إلى ذلك، يمكن لـ sandbagging أن توسع الفجوات الثقافية بين مجموعات المستخدمين، مما يعزز الفتنة الاجتماعية، لأن الردود المختلفة على نفس الأسئلة تعزز معتقدات وقيمًا متباينة. التوهين: هناك قلق تأملي بشأن توهين البشر بسبب تزلف الذكاء الاصطناعي، مما قد يؤدي بالمستخدمين إلى الاعتماد على قرارات الذكاء الاصطناعي ويصبحوا أقل ميلًا لمعارضتها. يمكن أن يساهم السلوك الخادع للذكاء الاصطناعي، مثل حث المستخدمين على الثقة في نصائح غير موثوقة، أيضًا في التوهين، على الرغم من أن هذا يتطلب دراسات إضافية لتقييم دقيق.
قرارات إدارية غير اجتماعية: قد تقدم أنظمة الذكاء الاصطناعي الماهرة في الخداع، خاصة في السياقات الاجتماعية، عن غير قصد استراتيجيات خادعة في تطبيقات العالم الحقيقي، مما يؤثر على البيئات السياسية والتجارية بما يتجاوز نوايا المطورين. فقدان السيطرة على أنظمة الذكاء الاصطناعي: ينطوي خطر طويل الأجل على أن يفقد البشر السيطرة على أنظمة الذكاء الاصطناعي، مما يسمح لها بتحقيق أهداف تتعارض مع المصالح البشرية. يمكن أن يساهم الخداع في فقدان السيطرة هذا من خلال تقويض إجراءات التدريب والتقييم، مما قد يؤدي إلى خداع استراتيجي من جانب أنظمة الذكاء الاصطناعي أو تسهيل عمليات الاستيلاء من قبل الذكاء الاصطناعي.
الفوائد المحتملة لخداع الذكاء الاصطناعي الأمن والدفاع: في التطبيقات العسكرية، يمكن استخدام خداع الذكاء الاصطناعي لتضليل الخصوم أو حماية المعلومات الحساسة. على سبيل المثال، يمكن لأنظمة الذكاء الاصطناعي توليد إشارات طعم أو تمويه لإرباك أنظمة الكشف المعادية، وبالتالي حماية القوات أو الأصول. الأمن السيبراني: يمكن لخداع الذكاء الاصطناعي المساعدة في اكتشاف وتخفيف التهديدات السيبرانية. يمكن استخدام خوارزميات الذكاء الاصطناعي الخادعة لجذب القراصنة إلى الفخاخ، وتحديد الأنشطة الضارة، وحماية الشبكات والبيانات من الهجمات السيبرانية.
المراقبة وإنفاذ القانون: في التحقيقات حيث قد يؤدي الكشف عن معلومات معينة إلى تعريض العمليات الجارية للخطر أو تعريض حياة للخطر، يمكن استخدام خداع الذكاء الاصطناعي لتوفير مسارات كاذبة أو إخفاء الطبيعة الحقيقية لتقنيات التحقيق دون انتهاك حقوق الخصوصية. الميزة التنافسية: في البيئات التجارية والتنافسية، يمكن استخدام خداع الذكاء الاصطناعي للحصول على ميزة على المنافسين. على سبيل المثال، في المفاوضات الاستراتيجية أو حملات التسويق، يمكن لأنظمة الذكاء الاصطناعي توليد معلومات مقنعة ولكنها خادعة للتأثير على القرارات لصالح المنظمة.
الرعاية الصحية: في مرافق الرعاية الصحية، يمكن استخدام خداع الذكاء الاصطناعي في سيناريوهات مثل مراقبة المرضى أو التجارب السريرية. يمكن لخوارزميات الذكاء الاصطناعي الخادعة توليد بيانات اصطناعية لمحاكاة استجابات المرضى أو اختبار الفرضيات دون تعريض المرضى الحقيقيين لمخاطر محتملة. الترفيه: في سياق ألعاب الفيديو أو رواية القصص التفاعلية، يمكن لخداع الذكاء الاصطناعي تحسين تجربة المستخدم من خلال خلق بيئات أكثر غامرة وديناميكية. الخداع في هذا السياق هو جزء من التجربة المصممة ويتوقعه المستخدم. اختبار سريع كيف يمكن أن يكون خداع الذكاء الاصطناعي مفيدًا في التطبيقات العسكرية وفقًا للمقال؟ أ. من خلال تعزيز الشفافية ب. من خلال إرباك أنظمة الكشف المعادية ج.
من خلال رفع معنويات القوات د. من خلال تسهيل التعاون الدولي الإجابة الصحيحة في نهاية المقال. الحلول المحتملة لمشكلة خداع الذكاء الاصطناعي التنظيم يجب على صناع السياسات تنفيذ لوائح قوية تستهدف أنظمة الذكاء الاصطناعي القادرة على الخداع. يجب أن تصنف هذه اللوائح كلاً من نماذج الذكاء الاصطناعي للأغراض العامة مثل LLM وأنظمة الذكاء الاصطناعي المتخصصة المزودة بقدرات خادعة على أنها عالية المخاطر أو غير مقبولة في أطر تنظيم الذكاء الاصطناعي القائمة على تقييم المخاطر.
يقدم سالازار قانون No AI Fraud قوانين التمييز بين البوت والإنسان يجب على صناع السياسات الدعوة إلى قوانين التمييز بين البوت والإنسان لتمييز أنظمة الذكاء الاصطناعي ونتائجها بوضوح عن نظيراتها البشرية. ستجعل هذه القوانين الإفصاح عن التفاعلات مع الذكاء الاصطناعي إلزاميًا في خدمة العملاء وتصنف بوضوح المحتوى الذي ينشئه الذكاء الاصطناعي، مثل الصور ومقاطع الفيديو، لتجنب تضليل المستخدمين. الكشف يجب على الباحثين التقنيين التركيز على تطوير تقنيات كشف فعالة لتحديد السلوكيات الخادعة في أنظمة الذكاء الاصطناعي.
يتضمن ذلك كلاً من طرق الكشف الخارجية، التي تفحص اتساق مخرجات الذكاء الاصطناعي وازدواجيتها، وطرق الكشف الداخلية، التي تستطلع التمثيلات الداخلية لأنظمة الذكاء الاصطناعي للكشف عن التناقضات مع التقارير الخارجية. تقليل الخداع في أنظمة الذكاء الاصطناعي يجب على الباحثين التقنيين العمل على طرق لتخفيف النزعات الخادعة لأنظمة الذكاء الاصطناعي. بالنسبة لأنظمة الذكاء الاصطناعي المتخصصة، من الأهمية اختيار مهام تدريب مناسبة تثبط السلوكيات الخادعة. بالنسبة لنماذج الذكاء الاصطناعي للأغراض العامة مثل LLM، ينبغي استكشاف استراتيجيات لتحسين صدق وأمانة النتائج، ربما من خلال تقنيات الضبط الدقيق وتحسين التمثيلات الداخلية للعالم. الإجابات الصحيحة هي د. التقليد، ب.
وضع مبادئ توجيهية أخلاقية، وب. إرباك أنظمة الكشف المعادية.

