تخطي إلى المحتوى الرئيسي

إحاطة الإشارات / اتجاهات الخدمات السحابية العالمية

OpenAI Voice Engine يقلد صوتك في 15 ثانية

كشفت OpenAI عن Voice Engine، وهي منصة لتوليد الكلام الاصطناعي من مقطع صوتي مدته 15 ثانية. يمكن لهذه الأداة قراءة النصوص بعدة لغات. تختبر OpenAI هذه التقنية على نطاق صغير لجمع الملاحظات وتنفيذ إجراءات أمنية، بما في ذلك العلامة المائية، لمنع إساءة الاستخدام مثل deepfake الصوتي.

OpenAI Voice Engine يقلد صوتك في 15 ثانية

أداة استنساخ الصوت من OpenAI التي تقلد صوتك بعينة مدتها 15 ثانية تم تسليط الضوء عليها من قبل BTW Media لأن الأدلة المنشورة تربطها بالبنية التحتية للإنترنت أو الحوكمة أو التبعيات التشغيلية أو رؤية السوق.

  • نموذج يُدعى "Voice Engine" يمكنه أساسًا نسخ صوت شخص من مقطع صوتي مدته 15 ثانية، وفقًا لمنشور مدونة من OpenAI يشارك نتائج اختبار صغير النطاق للأداة.
  • قالت OpenAI في منشور مدونتها: "هذه النشرات صغيرة النطاق تساعدنا في تحسين نهجنا وحواجز الحماية وتفكيرنا حول كيفية استخدام Voice Engine بشكل مفيد في قطاعات مختلفة."
  • OpenAI هي أداة تخضع لرقابة صارمة حتى يتم وضع حمايات لمواجهة التسجيلات الصوتية المزيفة التي تهدف إلى خداع المستمعين.

طورت OpenAI منصة لتوليد النص إلى كلام تُسمى Voice Engine، والتي تنشئ كلامًا اصطناعيًا من مقطع صوتي مدته 15 ثانية.

أداة استنساخ الصوت

يمكن للكلام المولد بالذكاء الاصطناعي قراءة الاستفسارات النصية حسب الأوامر بنفس لغة المتحدث أو بعدة لغات أخرى.

قالت OpenAI في منشور مدونتها: "هذه النشرات صغيرة النطاق تساعدنا في تحسين نهجنا وحواجز الحماية وتفكيرنا حول كيفية استخدام Voice Engine بشكل مفيد في قطاعات مختلفة."

في هذه العينات التي نشرتها OpenAI، يمكنك سماع محتوى سردي مكتوب مسبقًا، بالإضافة إلى "ردود مخصصة في الوقت الفعلي" كُتبت لـ GPT-4.

أشارت OpenAI إلى أنها بدأت تطوير محرك صوتي في أواخر عام 2022، وتوفر التقنية بالفعل أصواتًا محددة مسبقًا لواجهات برمجة التطبيقات (API) الخاصة بتوليد الكلام ووظيفة القراءة بصوت عالٍ في ChatGPT.

اقرأ أيضًا:OpenAI توسع علاقاتها الإعلامية مع شركاء أخبار لتدريب الشات بوت

مشكلات أمنية

تعلن OpenAI أنها تعمل مع شركاء أمريكيين ودوليين من الحكومات ووسائل الإعلام والترفيه والتعليم والمجتمع المدني وقطاعات أخرى لدمج ملاحظاتهم أثناء البناء.

يخشى باحثو المعلومات المضللة من إساءة استخدام واسعة النطاق للتطبيقات المدعومة بالذكاء الاصطناعي في عام انتخابي حاسم، بسبب انتشار أدوات استنساخ الصوت الرخيصة والسهلة الاستخدام والتي يصعب تتبعها.

تقر OpenAI بهذه المشكلات وتقول إنه "نظرًا لاحتمال إساءة استخدام الكلام الاصطناعي، تتبنى الشركة نهجًا حذرًا ومستنيرًا للنشر الأوسع."

قبل بضعة أشهر، اعترف مستشار سياسي يعمل في الحملة الرئاسية للمنافس الديمقراطي لجو بايدن بأنه وراء مكالمات هاتفية آلية تحاكي الرئيس الأمريكي.

أثار الحادث قلق الخبراء الذين يخشون فيضانًا من التضليل العميق (deepfake) المدعوم بالذكاء الاصطناعي في سباق البيت الأبيض لعام 2024 وفي انتخابات رئيسية أخرى حول العالم هذا العام.

قالت OpenAI: "لقد وضعنا مجموعة من إجراءات السلامة، بما في ذلك العلامة المائية لتتبع أصل أي صوت يولده Voice Engine، بالإضافة إلى المراقبة الاستباقية لاستخدامه."

موجز الإشارة

  • إشارة: OpenAI Voice Engine يقلد صوتك في 15 ثانية
  • المنطقة: عالمي
  • فئة السوق: اتجاهات الخدمات السحابية العالمية

البصمة التشغيلية

  • يجب أن تحدد المصادر المنشورة الأطراف المتأثرة، ونطاق العمليات، والتعرض للسوق قبل أن تُعتبر خريطة الاتجاه هذه مكتملة.

سياق السوق

  • الأهمية التشغيلية: متوسط
  • الأفق الزمني: الربع القادم

ماذا تشاهد

  • راقب التصريحات الرسمية، والتحديثات التنظيمية، وتعرض العملاء أو الشركاء، والإفصاحات اللاحقة.

إحاطة الأعضاء

سياق أعمق للاتجاهات

سجّل الدخول بمستوى العضوية المناسب لفتح الإحاطة الكاملة وملاحظات المصادر.

لأعضاء تحالف القيادات فقط

تحالف القيادات

للمشغلين والمستثمرين وفرق السياسات الذين يحتاجون إلى أدلة العلاقات ومسارات الفشل وملاحظات المصادر. سجل الدخول لفتح.

انضم إلى تحالف القيادات
لقطة
المنطقة
عالمي
تركيز الإشارة
الأسواق والقطاعات
نوع المحتوى
حدث
النطاق الأساسي
الأسواق والقطاعات
الموضوع
الأسواق والقطاعات
تأثير
متوسط
الثقة
دليل درجة الثقة
ثقة محدودة (82%)

عدة مصادر عامة

رجوعالمزيد من التغطية: اتجاهات الخدمات السحابية العالمية