لم يعد الذكاء الاصطناعي يكتفي بالتعرف على الوجوه أو تحليل الصور، بل أصبحت أصوات البشر واحدة من البيانات التي يمكن للتقنيات الحديثة تحليلها وتقليدها وإعادة إنتاجها بدرجة كبيرة من التشابه، وهو ما يفتح الباب أمام استخدامات مفيدة، لكنه يفرض في الوقت نفسه تحديات جديدة تتعلق بالخصوصية والأمان، وتستطيع تقنيات استنساخ الصوت تحليل تسجيل قصير لصوت شخص، ثم إنتاج كلام جديد يبدو قريبًا من صوته الحقيقي، ما يجعل الصوت أشبه بـ”بصمة رقمية” يمكن استخدامها للتعرف على صاحبها أو إنشاء محتوى صوتي يحاكيه.
من المكالمات إلى الاحتيال الرقمي
أصبح استنساخ الأصوات يثير مخاوف متزايدة بسبب إمكانية استخدامه في انتحال شخصية الآخرين، خصوصًا مع المكالمات الهاتفية والرسائل الصوتية، فقد يسمع الشخص صوت أحد أفراد أسرته أو مديره في العمل، بينما يكون التسجيل في الحقيقة مولدًا بواسطة الذكاء الاصطناعي، ولا تتوقف المخاطر عند الاحتيال، إذ يمكن استخدام الأصوات المزيفة في نشر تصريحات لم يقلها أصحابها أو إنتاج محتوى مضلل يصعب على المستمع العادي اكتشافه من خلال الصوت وحده.
لماذا الصوت مهم للذكاء الاصطناعي؟
يمثل الصوت كمية كبيرة من المعلومات، فلا ينقل الكلمات فقط، بل يتضمن أيضًا طريقة النطق وسرعة الكلام والنبرة والتوقفات، وهي تفاصيل تستطيع النماذج الحديثة تحليلها والاستفادة منها في تقليد أسلوب المتحدث، وفي المقابل، توفر هذه التكنولوجيا استخدامات إيجابية، مثل مساعدة الأشخاص الذين فقدوا القدرة على الكلام، وتحسين خدمات المساعدات الصوتية، وإنتاج محتوى صوتي وترجمات أكثر طبيعية.
كيف يحمي المستخدم صوته؟
مع انتشار أدوات استنساخ الصوت، يصبح التعامل مع التسجيلات الشخصية أكثر حذرًا أمرًا ضروريًا. ولا ينبغي اعتبار سماع صوت شخص في مكالمة أو رسالة دليلًا كافيًا على أن المتحدث هو صاحبه فعلًا، خاصة عند طلب تحويل أموال أو مشاركة بيانات شخصية، ويظل الوعي الرقمي هو خط الدفاع الأول، إلى جانب تجنب نشر تسجيلات صوتية شخصية دون حاجة، والتأكد من هوية المتصل عبر وسيلة أخرى قبل تنفيذ أي طلب حساس.