← العودة إلى المدونة
Newsحوالي 1 دقيقة قراءة

أول قضية في شنغهاي لانتهاك حقوق الصوت بالذكاء الاصطناعي: القابلية للتعرف معيار وتغريم المنصة 50 ألف يوان

نُشر في 6 أكتوبر 2026
أول قضية في شنغهاي لانتهاك حقوق الصوت بالذكاء الاصطناعي: القابلية للتعرف معيار وتغريم المنصة 50 ألف يوان

--- title: أول قضية في شنغهاي لانتهاك حقوق الصوت بالذكاء الاصطناعي: القابلية للتعرف معيار وتغريم المنصة 50 ألف يوان meta_title: كيف يُحكم في انتهاك حقوق الصوت بالذكاء الاصطناعي؟ أول قضية استئناف في شنغهاي تقدم المعيار meta_description: محكمة شنغهاي الأولى للشعب في الاستئناف أيدت الحكم الابتدائي: صوت ممثلة دبلجة تم تركيبه بالذكاء الاصطناعي لأغراض ترويجية، وتغريم المنصة 50 ألف يوان. وقد أرست المحكمة القابلية للتعرف كمعيار أساسي لانتهاك حقوق الصوت. ---

لم تكتشف السيدة وانغ، ممثلة الدبلجة الصوتية، المشكلة إلا بعد تنبيه من صديقة. قال لها أحدهم إن صوتًا في حملة ترويجية لجذب مستخدمين جديدة في أحد التطبيقات يشبه صوتها كثيرًا.

ذهبت للتحقق، وخلصت إلى أن تلك المقاطع الصوتية على الأرجح مُركّبة بالذكاء الاصطناعي. ثم وثّقت الأدلة عبر كاتب العدل، ورفعت دعوى ضد المشغّل مطالبة بتعويض 300 ألف يوان. ووصلت القضية إلى المحكمة الشعبية المتوسطة الأولى في شنغهاي، حيث أيّد الحكم النهائي الحكم الابتدائي: المنصة تُعدّ منتهكة لحقوق الصوت، وتُغرم بتعويض 50 ألف يوان.

هذه أول قضية في شنغهاي لنزاع يتعلق بحماية حقوق الصوت تنشأ عن صوت مُركّب بالذكاء الاصطناعي. وتستحق أن تُطرح على حدة، والسبب لا علاقة له بمبلغ التعويض: فقد أوضحت المحكمة مسألة واحدة، وهي متى يُعدّ تقليد الذكاء الاصطناعي لصوت شخص ما انتهاكًا.

ثلاث حقائق رئيسية في القضية

أولًا، أقرّ المدعى عليه بأن المقطع الصوتي مُولّد بالذكاء الاصطناعي، لكنه لم يستطع توضيح مصدر المواد.

دفاع شركة A كان: المقطع الصوتي محل القضية مُولّد فعلاً بالذكاء الاصطناعي الذي طورته الشركة، لكن المصدر المحدد والمواد التي دُرِّب عليها النموذج لا يمكن تأكيدهما بسبب مغادرة موظف سابق. كما لم تكن الشركة تعلم سابقًا أن السيدة وانغ ممثلة دبلجة، ولم يكن هناك جمع أو استخدام لصوتها.

ثانيًا، قدّم رأي الخبرة نتيجة كمية.

تقدّمت السيدة وانغ بطلب لخبرة قضائية لمقارنة الصوت الموثّق لدى كاتب العدل بصوتها الذي جُمع في الجلسة. ومن بين 28 مؤشرًا صوتيًا للذروات الرنينية (formants)، كان انحراف 24 مؤشرًا أقل من 10%، ومنها 16 أقل من 5.36%. وبلغت نسبة الأجزاء المتشابهة إلى حد كبير والمتشابهة للغاية بينهما 90%.

ثالثًا، حمّلت المحكمة عبء الإثبات للمنصة التي تمتلك بيانات التدريب.

رأت المحكمة الشعبية المتوسطة الأولى في شنغهاي أن شركة A، بصفتها الجهة المسيطرة التي تمتلك بيانات التدريب الأصلية، لم تقدّم أدلة كافية على قانونية مصدر المواد التي دُرِّب عليها النموذج، ولا على عدم استخدامها لسمات صوت شخص طبيعي، ولا على عدم إحداثها لبسًا أو خطأً لدى الجمهور، وبالتالي يجب أن تتحمل النتيجة السلبية للعجز عن الإثبات.

القاعدة التي أرستها المحكمة: العبرة بالقابلية للتعرف، لا بالمصدر التقني

المبدأ القضائي الجوهري في هذه القضية يمكن تلخيصه في جملة واحدة: استخدام صوت شخص طبيعي كبيانات تدريب دون موافقته، وتقليد جرس صوته ونبرته وأسلوب نطقه، وتوليد صوت مركّب يمكن من خلاله التعرف على ذلك الشخص الطبيعي، يجب أن يُعتبر انتهاكًا لحقوق صوته.

هنا معنيان يستحقان التفصيل.

المعنى الأول هو أن خط الدفاع الشائع لدى مطوّري الأصوات بالذكاء الاصطناعي لا يصمد. قد يقول البعض إن الصوت إعادة بناء خوارزمية لبصمة الصوت، ويختلف عن النسخ المباشر للتسجيل الأصلي، لذلك لا يُشكّل انتهاكًا. وكان رد المحكمة أن أساس الحكم يقع على النتيجة المُركّبة: هل تتيح لعامة الجمهور ربطها بهوية محددة.

المعنى الثاني هو أن عتبة التعرف حُدّدت عند مستوى عامة الجمهور، لا المتخصصين. ونتيجة الخبرة في القضية كانت تشابهًا كبيرًا للغاية، لذا تحققت القابلية للتعرف. لكن هذا يعني أيضًا أن اقتراب التشابه إلى هذا الحد يلامس الخط الأحمر، وليس فقط عندما يصل إلى حد يتعذّر تمييزه عن الحقيقي.

هذا الحكم يتصل بوثيقة المحكمة الشعبية العليا

إذا نظرنا إلى الخط الزمني على مدى أوسع، فإن هذه القضية ليست حكمًا منعزلًا.

في 7 سبتمبر، أصدرت المحكمة الشعبية العليا 'الآراء بشأن النظر في قضايا النزاعات المتعلقة بالذكاء الاصطناعي وفقًا للقانون'، ونصّت المادة الرابعة على أمرين بوضوح: استخدام الذكاء الاصطناعي لمعالجة اسم شخص آخر أو صورته دون موافقته، وتوليد كيان رقمي افتراضي يمكن التعرف عليه واستخدامه أو نشره، يُشكّل انتهاكًا لحق الاسم وحق الصورة وغيرهما من الحقوق الشخصية؛ واستخدام صوت شخص آخر في التدريب دون موافقته، وتقليد جرسه ونبرته وأسلوب نطقه وتوليد صوت مركّب يمكن التعرف عليه، يُشكّل انتهاكًا لحقوق الصوت.

هذه أول وثيقة قواعد قضائية تتعلق بالذكاء الاصطناعي تصدرها أعلى مؤسسة قضائية في البلاد. وأكثر ما فيها ثقلًا أن الصوت حصل للمرة الأولى على حماية مساوية للصورة، وأن القابلية للتعرف أصبحت المعيار الموحّد لتحديد الانتهاك.

وجاءت قضية شنغهاي هذه بعد هذه الآراء، لتُنزل القواعد المكتوبة إلى وقائع محددة: قدّمت الخبرة تشابهًا بنسبة 90%، وبناءً عليه اعتبرت المحكمة القابلية للتعرف قائمة، ولم تقدّم المنصة دليلًا على المصدر القانوني للمواد، فترتب التعويض.

وسابقًا، صُنّفت قضية نموذجية أخرى كمرجع من قبل المحكمة العليا. في عام 2024، كلّفت شركة إعلام ثقافي في شوتشو مضيف بث تجاري بإنتاج فيديو ترويجي، فاستخدم المضيف مقطعًا من خطاب علني للسيدة لي، وهي باحثة في مجال التربية الأسرية، وأضاف إليه صوتًا مركّبًا بالذكاء الاصطناعي شديد التشابه مع صوتها في الجرس والنبرة وأسلوب النطق. وفي يوليو 2025، قضت محكمة الإنترنت في بكين على المدعى عليه بالاعتذار وتعويض الخسائر الاقتصادية وتكاليف حماية الحقوق المعقولة بمبلغ 120 ألف يوان. وتشير القضيتان إلى المنطق نفسه: الاستخدام غير المصرّح به لصورة شخص آخر، مع إضافة صوت مركّب بالذكاء الاصطناعي شديد التطابق، يُشكّل انتهاكًا مزدوجًا لحق الصورة وحقوق الصوت.

ردّ فعل السوق: تقييد تبديل الوجوه، بينما استنساخ الصوت لا يزال يُباع

بعد إنفاذ القواعد، لم يكن ردّ فعل جانب التداول متماثلًا.

وفقًا لتقارير إعلامية، خلال الأسبوع الذي تلا نشر آراء المحكمة العليا، أظهر البحث في بعض منصات التجارة الإلكترونية حجبًا أقوى لخدمات تبديل الوجوه، إذ لم تُظهر النتائج منتجات ذات صلة؛ أما البحث عن استنساخ الصوت، فما زالت المنتجات تُعرض للبيع بكثرة. بعض منتجات تركيب الكلام كانت تُباع بسعر 33.88 يوانًا وقد بيع منها أكثر من 700 قطعة؛ وبعض خدمات تدريب نماذج الصوت بسعر 20 يوانًا؛ وعلى منصات التداول المستعمل كانت هناك خدمة استنساخ صوت بسعر 8.85 يوانات، تُظهر بيع أكثر من 770 قطعة.

هذا التفاوت نفسه يكشف واقعًا: عتبة استنساخ الصوت أدنى بكثير من تبديل الوجوه، والحاجة إلى المواد أكثر خفاءً. فمقطع دبلجة منشور، أو حلقة بودكاست، أو مقطع فيديو قصير، قد يشكّل بيانات تدريب جيدة بما يكفي.

أما بالنسبة إلى المستخدمين، فالإشارات التي تقدّمها هذه القضايا واضحة. أولًا، لا تتوقعوا الإعفاء من المسؤولية لمجرد عدم القدرة على توضيح مصدر المواد؛ فالطرف الذي يملك بيانات التدريب في موضع غير مؤاتٍ من حيث الإثبات. ثانيًا، يعتمد تقدير القابلية للتعرف على الخبرة التقنية؛ فبمجرد أن تقترب النتيجة المُركّبة إلى حد يسمح للجمهور بربطها بشخص محدد، يصبح الاستخدام التجاري انتهاكًا. ثالثًا، يُحدَّد مبلغ التعويض بالرجوع إلى رسوم الترخيص المماثلة لصاحب الحق؛ والتكلفة التي يوفرها تجاوز الترخيص بالذكاء الاصطناعي قد تُردّ في النهاية على شكل تعويض.

ماذا يعني ذلك للفرق التي تبني منتجات صوت بالذكاء الاصطناعي

منطق الحكم في هذه القضية يحمل عدة إشارات مباشرة لجانب المنتج.

إثبات مصدر بيانات التدريب يجب أن يُحفظ في السجلات. وأكثر نقطة قاتلة في القضية كانت عجز شركة A عن توضيح مصدر المواد التي دُرِّب عليها النموذج. وبالنسبة إلى الفرق العاملة في استنساخ الصوت وتركيب الكلام وتوليد المحتوى الصوتي، يجب أن يكون سلسلة ترخيص المواد الصوتية قابلة للتتبع ومسجلة، لا أن تعتمد على تأكيد شفهي.

تقليد سمات الصوت يجب فصله عن أي شخص محدد. إذا كان المنتج يريد توليد جرس صوتي معين، فالترخيص شرط مسبق، وليس علاجًا لاحقًا. وعلى العكس، إذا كان المطلوب مجرد جرس صوتي عام، فيجب ضمان أن بيانات التدريب من مصادر قابلة للاستخدام التجاري وقابلة للتتبع.

يجب التعامل مع خط القابلية للتعرف كخط أحمر لا كقيمة مرجعية. فنسبة التشابه 90% في تقرير الخبرة كانت أساس التقدير في هذه القضية، لكن المحكمة لم تعطِ عتبة عددية ثابتة. وهذا يعني أن أي نتيجة توليد تقترب من سمات صوت شخص طبيعي محدد تحتاج إلى تقييم حذر.

في قضية السيدة وانغ، بلغ التعويض 50 ألف يوان. وبالمقارنة مع المطالبة البالغة 300 ألف يوان، فإن هذا الرقم ليس مرتفعًا. لكن أهميته ليست في هذه القضية نفسها، بل في أن الافتراض الافتراضي لدى الجميع عند بناء أصوات بالذكاء الاصطناعي قد تغيّر بعدها.

مقالات ذات صلة