ماذا حدث؟
لم يعد صوت الإنسان مجرد وسيلة للتواصل بل أصبح مع التطور المتسارع لتقنيات الذكاء الاصطناعي جزءا من البيانات التي يمكن استغلالها في عمليات انتحال الهوية والاحتيال الإلكتروني.
في الوقت الذي اعتاد فيه المستخدمون التعامل بحذر مع الرسائل المشبوهة والروابط المجهولة ومحاولات سرقة كلمات المرور ظهرت أساليب جديدة تعتمد على تقنيات قادرة على محاكاة أصوات أشخاص حقيقيين بدرجة قد تجعل التمييز بين الصوت الأصلي والمقلد أكثر صعوبة.
قد تبدأ عملية الاحتيال بمكالمة تبدو عادية في ظاهرها تأتي من رقم غير محفوظ على الهاتف لكن الصوت الموجود على الطرف الآخر قد يكون مألوفا بصورة تدفع الضحية إلى الاطمئنان.
قد يدعي المتصل أنه أحد أفراد الأسرة أو الأصدقاء ثم يروي قصة طارئة عن حادث أو مشكلة مالية أو حاجة عاجلة إلى المساعدة قبل أن يطلب تحويل أموال أو الحصول على بيانات شخصية أو مشاركة رمز تحقق وصل إلى الهاتف.
تتيح تقنيات استنساخ الصوت إنتاج كلام جديد يحاكي صوت شخص حقيقي اعتمادا على عينات صوتية متاحة وهو ما يثير تساؤلات متزايدة حول حجم المعلومات الشخصية التي يشاركها المستخدمون على الإنترنت وإمكانية توظيفها في عمليات احتيال أكثر تطورا.
في ظل هذا التحول لم يعد التعرف على صوت شخص مألوف دليلا كافيا وحده على هوية المتصل خصوصا عندما تقترن المكالمة بطلب مالي أو الحصول على معلومات حساسة.
من هنا تبرز أهمية التعامل مع المكالمات غير المعتادة بحذر وعدم اتخاذ أي قرار تحت ضغط الخوف أو الاستعجال والتحقق من هوية المتصل عبر وسيلة اتصال مستقلة قبل الاستجابة لأي طلب.
أجرت جامعة أبيرتاي بحثا تناول نسخا اصطناعية من الإنجليزية الاسكتلندية المعيارية إلى جانب لهجة دندي المحلية وخلص إلى أن المستمعين افترضوا في كثير من الحالات أن الأصوات التي ينتجها الذكاء الاصطناعي تعود إلى أشخاص حقيقيين فيما ارتفع هذا الانطباع عند استخدام اللهجات الإقليمية لاعتقاد الناس أن الآلات أقل قدرة على محاكاتها بدقة.
تكشف دراسة أخرى نشرت عام 2026 في Journal of Marketing Research جانبًا من خطورة هذه الظاهرة في الاحتيال بعدما حلل الباحثون 7002 حالة بين رواد أعمال ومستثمرين في برنامج شارك تانك إلى جانب 2091 حملة على منصة Kickstarter وعدد من التجارب المعملية.
أظهرت النتائج أن التشابه في خصائص الأصوات بين المتحدثين والمستمعين ارتبط بمستويات أعلى من الثقة والقدرة على الإقناع حتى في غياب عوامل أخرى تمنح المتحدث مصداقية إضافية.
كشفت رحاب الرحماوي أستاذة الذكاء الاصطناعي في الأكاديمية العسكرية للدراسات العليا والاستراتيجية في مصر أن تطور تقنيات الذكاء الاصطناعي فرض نمطا جديدا من أساليب الاحتيال الإلكتروني بعدما أصبح من الممكن استخدام تقنيات استنساخ الصوت في انتحال شخصيات حقيقية وإقناع الضحية بأن المتحدث أحد أفراد أسرته أو معارفه.
أوضحت أن المحتال قد يعتمد على تسجيلات صوتية متاحة على منصات التواصل أو مصادر أخرى للحصول على عينة صوتية ثم توظيف تقنيات الذكاء الاصطناعي لإنتاج عبارات جديدة تبدو قريبة بدرجة كبيرة من صوت صاحبها مشيرة إلى أن الخطر لا يرتبط بدقة تقليد الصوت فقط وإنما بالسيناريو الذي يوضع فيه الضحية تحت ضغط نفسي يدفعه إلى اتخاذ قرار سريع.
أكدت أن التعامل مع الصوت باعتباره دليلا كافيا على هوية المتصل لم يعد آمنا داعية إلى اعتماد وسيلة تحقق ثانية خصوصا عند وجود طلب مالي أو محاولة للحصول على معلومات حساسة ونصحت بإنهاء المكالمة وإعادة الاتصال بالشخص عبر رقم محفوظ مسبقا.
لماذا هذا مهم؟
يعني نجاح محاكاة الأصوات المألوفة واللهجات الإقليمية أن الثقة الصوتية وحدها لم تعد ضمانا للهوية في المكالمات غير المتوقعة.
يبرز استغلال الضغط النفسي وقصص الحوادث أو الحاجة العاجلة كأداة تمنع الضحية من التحقق الهادئ قبل تحويل المال أو مشاركة رموز التحقق.
يذكر ارتباط تشابه خصائص الصوت بارتفاع الثقة والإقناع في دراسة 2026 أن التأثير لا يقتصر على الخداع العائلي بل يمتد إلى سياقات الاستثمار والأعمال.
يضع نشر التسجيلات الشخصية على الإنترنت مصدر عينات جاهزة للمحتالين ما يوسع سطح الهجوم إلى ما بعد كلمات المرور التقليدية.
يفتح التحول نحو انتحال الصوت باب حاجة إلى ثقافة تحقق مزدوج قبل أي قرار مالي أو كشف بيانات حساسة.
يظل عنصر الاستعجال أخطر ما في السيناريو لأنه يقلص فرصة المراجعة والتأكد عبر قناة مستقلة.
ماذا بعد؟
من المتوقع أن تتزايد حملات التوعية حول مخاطر استنساخ الصوت وضرورة التحقق عبر رقم محفوظ قبل الاستجابة لأي طلب عاجل.
قد يقلل الحد من نشر التسجيلات الشخصية غير الضرورية من فرص جمع عينات صوتية قابلة للاستغلال.
يبقى أفضل رد عند اقتران المكالمة بطلب مالي أو بيانات حساسة هو إنهاء الاتصال والتحقق المستقل قبل اتخاذ أي إجراء.
