← العودة إلى المدونة
Aiحوالي 1 دقيقة قراءة

C2PA وSynthID: بعد قانون الذكاء الاصطناعي الأوروبي، أصبح توثيق مصدر الوسائط مهمة هندسية

نُشر في 7 أكتوبر 2026
C2PA وSynthID: بعد قانون الذكاء الاصطناعي الأوروبي، أصبح توثيق مصدر الوسائط مهمة هندسية

أصبح من الصعب بشكل متزايد التمييز بين النصوص والصور والصوت والفيديو المولّدة بالذكاء الاصطناعي والأعمال التي أنشأها البشر. وقد حوّل ذلك توثيق المصدر من موضوع بحثي إلى متطلب في خط الإنتاج، وبدأت المواعيد النهائية تلزم الفرق.

تسري واجبات الشفافية بموجب المادة 50 من قانون الذكاء الاصطناعي الأوروبي اعتباراً من 2 أغسطس 2026، مع فترة سماح للوسم تمتد حتى 2 ديسمبر 2026. وقد عدّلت الهند قواعدها الخاصة بتكنولوجيا المعلومات في فبراير 2026 لتشمل المعلومات المولّدة اصطناعياً. أصبح وسم الوسائط المولّدة الآن شيئاً على الفريق تنفيذه، لا مجرد شيء يتناقش فيه.

ثلاث أدوات تجيب عن أسئلة مختلفة

الخطأ الذي تقع فيه معظم الفرق هو التعامل مع توثيق المصدر والعلامات المائية والكشف على أنها بدائل لبعضها. وهي ليست كذلك، وتفشل بطرق مختلفة.

توثيق المصدر، بمعنى C2PA، هو بيانات وصفية موقّعة تشفيرياً ومرفقة بملف أو مُشار إليها منه. وهو يجيب عن سؤال محدد: من وقّع هذا، وبأي أداة، وهل تغيّر منذ ذلك الحين. تتمثل نقطة ضعفه الرئيسية في أنه سهل الإزالة. فالتقاط صورة للشاشة، أو إعادة ترميز الملف، أو منصة تُسقط البيانات الوصفية، كلها تزيل البيان.

العلامة المائية غير المرئية هي إشارة مدمجة في المحتوى نفسه، سواء في البكسلات أو عينات الصوت أو اختيارات الرموز/التوكنات. وهي تجيب: هل أنتج هذا نظام يطبّق هذه العلامة المائية؟ وتكمن نقطة ضعفها في أن التحرير المكثف أو إعادة الصياغة أو الهجمات الخصومية قد تضعف الإشارة أو تزيلها، وعادة لا يمكن كشفها إلا بواسطة كاشف البائع نفسه.

مصنّف الكشف هو نموذج مُدرّب على تخمين ما إذا كان المحتوى اصطناعياً. وهو يجيب: هل يبدو هذا مولّداً بالذكاء الاصطناعي؟ وهو احتمالي، وينحرف مع تحسّن المولّدات، وينتج نتائج إيجابية كاذبة على محتوى حقيقي.

التمييز الأساسي هو أن توثيق المصدر والعلامات المائية يُطبّقان وقت الإنشاء بواسطة طرف متعاون. أما الكشف فيُطبّق لاحقاً على محتوى من أي جهة، بما في ذلك الخصوم، ما يجعله أضعف شكل من أشكال الإثبات، مع أنه الخيار الوحيد للمحتوى الذي لم يُوسم قط.

لماذا لا يكفي الكشف وحده

الكشف سباق تسلح. تتعلم المصنّفات آثار المولّدات المعروفة، بينما تغيّر النماذج الجديدة مع المعالجة اللاحقة البسيطة تلك الآثار. وتؤذي النتائج الإيجابية الكاذبة أشخاصاً حقيقيين، لأن الصور الحقيقية المعدّلة، والفيديو المضغوط، والكتابة بغير اللغة الأم تُوسم بالخطأ. وعندما يصبح ذلك مشكلة عدالة، تُرفض صورة سيلفي حقيقية لعميل.

كما أن نتيجة نظيفة لا تثبت شيئاً. فقد يأتي المحتوى من مولّد لم يره النموذج قط. والإرشاد العملي هو التعامل مع الكشف كإشارة خطر واحدة، مع مراجعة بشرية للقرارات المهمة.

كيف يعمل C2PA فعلياً

ينشر تحالف مصدر المحتوى وأصالته معياراً تقنياً مفتوحاً لتسجيل أصل المحتوى الرقمي وتاريخ تحريره. وتضم لجنته التوجيهية شركات منها Adobe وGoogle وMicrosoft وMeta وOpenAI وAmazon وSony وBBC. وتقع المواصفة في سلسلتها 2.x وتُراجَع بانتظام، لذا ينبغي للتصاميم التحقق من الإصدار الحالي بدلاً من تثبيت إصدار واحد.

الوحدة الأساسية هي بيان C2PA، وهو بنية بيانات موقّعة تشفيرياً تصف مصدر الأصل. ويمكن لمخزن البيانات أن يحتوي على عدة بيانات، واحد لكل خطوة في حياة الأصل. أما التأكيدات فهي عبارات فردية عن الأصل، وتغطي المعيارية منها إجراءات مثل الإنشاء أو التحرير، بما في ذلك بواسطة نظام ذكاء اصطناعي، إضافة إلى المكونات والصور المصغرة.

بحلول منتصف 2026، تُرفق OpenAI بيانات C2PA بكل صورة تنتجها نماذجها للصور، وتُرفق Google كلاً من بيانات C2PA وعلامات SynthID المائية بمخرجات توليد الصور والفيديو لديها. وقد فعلت Firefly من Adobe الشيء نفسه منذ 2024. كما تكتب البرامج الثابتة لكاميرات Canon وSony وNikon وLeica الآن بيانات اعتماد المحتوى عند التصوير، ما يعني أن البنية نفسها التي تتيح لغرفة أخبار التحقق من صورة فوتوغرافية تتيح أيضاً لمدير توظيف التحقق من صورة ملف شخصي.

قارورة زجاجية فارغة شبه شفافة مختومة بالشمع على سطح داكن، والختم يلتقط ضوءاً دافئاً

ما الذي يفعله SynthID بشكل مختلف

SynthID من Google DeepMind هو عائلة من تقنيات العلامات المائية التي تكيّف الإشارة مع كل نوع محتوى بدلاً من استخدام تقنية واحدة لكل شيء. فالصور تحصل على إشارة موزعة عبر الصورة بحيث تُحفظ الجودة البصرية الطبيعية ولا تمحوها بعض التحويلات الشائعة. أما الفيديو فيوزع معلومات العلامة المائية عبر الإطارات، مما يساعد المدقق على فحص مقطع كامل بدلاً من منطقة معزولة واحدة. والصوت يضع الإشارة داخل الصوت، غير مسموعة لكن قابلة للكشف آلياً. والنص يجعل النموذج يغيّر احتمالات الرموز/التوكنات بشكل خفي، مع فحص المدقق نصاً كافياً للنمط الإحصائي المتوقع.

العلامة المائية للنص هي الحالة الأكثر هشاشة. فقد لا تحتوي إجابة قصيرة على أدلة كافية. كما أن إعادة الصياغة المكثفة أو الترجمة أو خلط مخرجات عدة نماذج يمكن أن تضعف النمط. ولهذا ينبغي الإبلاغ عن النتيجة السلبية بعبارة «لم يتم اكتشاف علامة مائية مدعومة»، بدلاً من «مكتوب بواسطة إنسان».

ماذا يعني هذا لفريق يطلق وسائط مولّدة

تتبع من اختلافات الأدوات ثلاث ممارسات.

وقّع عند الإنشاء واحفظ الأصل. يصمد C2PA أمام إعادة الترميز أحياناً، لكن البيانات الوصفية غالباً ما تُسقط لاحقاً في مسار المعالجة. والسجل الوحيد الموثوق للمصدر هو الملف الذي احتفظت به.

لا تتعامل مع غياب العلامة المائية كدليل على تأليف بشري. فقد يعني غياب الإشارة أن المولّد لا يطبّق واحدة، أو أن التحرير أزالها، أو أن الكاشف لم يكن متاحاً. وكل واحد من هذه الاحتمالات حقيقة مختلفة.

افصل السؤال التقني عن سؤال الحقيقة. تساعد تشفير C2PA على كشف التغييرات غير المصرّح بها، لكنه لا يشهد بحد ذاته على أن تصوير منتج ما دقيق أو أن كل عبارة في بيان ما صحيحة. يخبرك توثيق المصدر من أين جاء الملف. لكنه لا يخبرك ما إذا كان الملف صادقاً.

لقد استجاب السوق لكل هذا. قُدّر الإنفاق على العلامات المائية للذكاء الاصطناعي وتوثيق المصدر بنحو 480 مليون دولار في 2025، مع توقعات بنمو سنوي يتجاوز 28 بالمئة حتى 2034. وهذا إنفاق مؤسسي، وليس تبنياً استهلاكياً، ويعكس حقيقة بسيطة: مع انخفاض تكلفة توليد الوسائط، ترتفع قيمة إثبات مصدرها. والفرق التي تتعامل مع توثيق المصدر كبنية تحتية لخط الإنتاج لا كفضول مختبري ستكون جاهزة عندما تصبح قواعد الوسم ملزمة.

كيف يبدو خط إنتاج متوافق

بعيداً عن التجريدات، يحتاج الفريق الذي عليه وسم الوسائط المولّدة الآن إلى تسلسل محدد من الخطوات، وكل خطوة تقابل واحدة من الأدوات أعلاه.

عند الإنشاء، يوقّع خط الإنتاج المخرجات. وبالنسبة للصور المنتجة عبر واجهة برمجة تطبيقات كبرى، يحدث هذا تلقائياً: تُرفق OpenAI بيان C2PA بكل صورة، وتُرفق Google بياناً وعلامة SynthID المائية معاً، وتفعل Adobe الشيء نفسه عبر Firefly. أما الفريق الذي يعمل عبر مزوّد أصغر فقد يضطر إلى إضافة البيان بنفسه.

خلال التحرير، يحافظ خط الإنتاج على السلسلة. وينبغي لكل أداة تلمس الأصل أن تضيف تأكيداً بدلاً من استبدال البيان، كي يبقى التاريخ محفوظاً. وهنا تتسرب معظم خطوط الإنتاج، لأن الأداة التي تعيد ترميز الملف قد تُسقط بيانات وصفية لا تفهمها.

عند التوزيع، يحتفظ خط الإنتاج بالأصل. فالمنصات تجرّد البيانات الوصفية بشكل روتيني، وتعيد ضغط الملفات المرفوعة، وتولّد معاينات. والملف الموقّع الذي يغادر نظام الإنتاج هو السجل الموثوق الوحيد، وينبغي الاحتفاظ به بشكل مستقل عن أي مكان تُنشر فيه الصورة.

على المستوى البشري، يضع خط الإنتاج تسميات. والتسمية المرئية هي أبسط أشكال الإفصاح، وهي التي يتوقعها المنظمون لاستخدامات معينة. وهي أيضاً الأسهل قصّاً وإزالة، ولهذا توضع إلى جانب الإشارات القابلة للقراءة آلياً بدلاً من أن تحل محلها.

التمييز الذي يرسمه المنظمون

ترسم المادة 50 من قانون الذكاء الاصطناعي الأوروبي، وقواعد تكنولوجيا المعلومات الهندية المعدلة، خطاً يسهل طمسه في نقاش هندسي.

الالتزام يتعلق بالشفافية، لا بالدقة. فالصورة الموسومة تُشهد بأنها مولّدة أو معدّلة بعملية محددة الهوية، وهذا كل ما تؤكده العلامة. والتمييز مهم لأنه يحدد الغرض من البيان. فهو يسجل المصدر، أي من أنشأ الملف وكيف. لكنه لا يضمن المحتوى، أي ما إذا كان ما يصوره الملف حقيقياً.

الخلط في هذا التمييز يؤدي إلى فشل متوقع. فيتعامل الفريق مع بيانات اعتماد محتوى صالحة كدليل على أن الصورة موثوقة، بينما لا تؤكد بيانات الاعتماد إلا أن الصورة جاءت من النظام الذي تدّعي أنها جاءت منه. فالصورة التي جرى التلاعب بها مع بيان سليم تبقى صورة جرى التلاعب بها، والبيان لا يكشف التلاعب.

الخلاصة لفريق يعمل فعلياً

تترتب على ذلك ثلاثة أمور، وكلها تتعلق بالانضباط لا بالتقنية.

تعامل مع الوسم كجزء من خطوة التصدير، لا كإضافة لاحقة. فتوثيق المصدر يُطبّق عند الإنشاء، ولا يمكن إضافة ذلك بأثر رجعي لأصل صار متداولاً بالفعل.

احتفظ بالأصل، لأن النسخة التي يراها الآخرون ستكون عادة مجرّدة من البيانات. فلا يكون البيان مفيداً إلا إذا كان الفريق قادراً على إنتاج الملف الذي يحمله.

وافصل سؤال المصدر عن سؤال الكشف في طريقة حديث الفريق عن المخرجات. يخبرك توثيق المصدر من أين جاء الملف. أما الكشف فيخبرك بما يخمّنه نموذج حول محتوى لم يره قط، وهو ادعاء أضعف. والقول بذلك بوضوح، داخلياً وللعملاء، هو ما يبقي برنامج الامتثال صادقاً بشأن ما يمكنه إثباته وما لا يمكنه إثباته.

مقالات ذات صلة