طبقة إعلانات الفيديو انقسمت إلى متخصصين، وBoreal-H3 يوضح السبب

أطلقت Creatify Labs نموذج Boreal-H3 في 2 أكتوبر، وهو نموذج فيديو بُني عبر التدريب اللاحق على MiniMax H3 بالشراكة مع MiniMax، ويستهدف مهمة واحدة: إنتاج مقاطع إعلانية. الجزء المثير للاهتمام يكمن في المعيار الذي ابتكرته Creatify لتسويقه، وما يعنيه ذلك المعيار بشأن الاتجاه الذي يتجه إليه توليد الفيديو.
العرض الترويجي، بالأرقام
يحصل Boreal-H3 على 133.3 في مؤشر جودة الإعلانات من Creatify، حيث يُعاير MiniMax H3 عند 100. وتضعه مجموعة المقارنة متقدمًا على Gemini Omni 1.1 Flash عند 122.2، وSeedance 2.5 عند 118.1، وWan 3.0 Prime عند 111.1.
وفي دقة المطابقة المرجعية (المقاسة عند عتبة أكثر صرامة تبلغ 7 من 10)، بلغ Boreal-H3 نسبة 85.3 في المئة، متقدمًا على MiniMax H3 عند 82.4 في المئة، وWan 3.0 Prime عند 79.4 في المئة، وSeedance 2.5 عند 71.9 في المئة، وOmni 1.1 Flash عند 70.6 في المئة.
ومقارنةً بقاعدته الأصلية، نقلت حلقة التدريب اللاحق اتساق العنصر من 83.3 إلى 94.4 في المئة، ورفعت نسبة إتمام الموجز من 27.8 إلى 50.0 في المئة على مجموعة من الموجزات الإنتاجية الصعبة، وخفضت العيوب الظاهرة من 1.11 إلى 0.33 لكل مقطع، أي انخفاض بنسبة 70 في المئة.
أرقام التكلفة والسرعة هي حيث يصبح العرض أكثر إقناعًا. عند دقة 768p، يولّد Boreal-H3 بمعدل 1.1 ثانية لكل ثانية فيديو، لذا يستغرق مقطع مدته 10 ثوانٍ نحو 11 ثانية ويكلف 0.40 دولار. أما Seedance 2.5 فيعمل بمعدل 46.5 ثانية لكل ثانية فيديو وبحوالي 0.47 دولار في الثانية. وفي عرض توضيحي لمنتج مدته 15 ثانية، أنتج Boreal-H3 المقطع في 84 ثانية مقابل 411 ثانية لـ Seedance 2.5.
لماذا يهم المعيار أكثر من النموذج
يقيس مؤشر جودة الإعلانات شيئًا محددًا: كم مرة ينتج النموذج مقطعًا يصلح أن يكون إعلانًا. ولا يُعد المقطع ناجحًا إلا إذا حصل كل من اتباع التوجيه واتساق المرجع والواقعية البصرية على 6 من 10 أو أعلى. ثم تُفهرَس نسبة النجاح لكل نموذج مقابل MiniMax H3.
هذا سؤال مختلف عن السؤال الذي تطرحه معظم معايير الفيديو. فـ Artificial Analysis ولوحات الصدارة المشابهة تصنّف المخرجات وفق الجودة العامة والجاذبية الجمالية. أما ما إذا كان المقطع يُبقي ملصق المنتج قابلًا للقراءة، ويحافظ على ثبات شكل العبوة، ويُبقي وجه المبدع كما هو من الإطار الأول إلى الأخير، فليس ما تقيسه تلك التصنيفات، وهو أول ما يتحقق منه المعلن.
التحفظ الصادق هنا هو أن Creatify بنت المؤشر، وتديره، وتبيع النموذج الذي يفوز به. وتقول الشركة إن حكامها الآليين جرى التحقق من صحتهم مقابل تفضيلات بشرية، وإن الدراسات البشرية استخدمت مخرجات مجهولة الهوية وعشوائية الترتيب. هذا ادعاء منهجي معقول، لكنه يبقى ادعاءً من الطرف الأول، من المورّد، عن منتج المورّد نفسه. ولا يوجد حتى الآن تكرار مستقل للنتائج.
وهناك تفصيل أهدأ: تشمل المقارنة Seedance 2.5 وWan 3.0 Prime، وكلاهما نموذجا فيديو عامّان قويان يُقيَّمان وفق معايير خاصة بالإعلانات. وخسارة معيار متخصص لصالح نموذج متخصص أمر متوقع. أما الرقم المقلق فسيكون أن يخسر Boreal-H3 لصالح نموذج عام في ملعبه الخاص.
الانقسام نحو التخصص حقيقي وبنيوي
موقع Boreal-H3 في هذا المشهد أكثر إثارة للاهتمام من كونه يفوز.
انقسم توليد الفيديو في عام 2026 انقسامًا واضحًا. في أحد الجانبين يقف العامة السينمائيون (Veo من جوجل، وKling، وGen-4.5 من Runway) الذين يبيعون الجودة والتحكم بالكاميرا والصوت الأصلي لأي شخص لديه قصة يرويها. وفي الجانب الآخر يقف المتخصصون في الإعلانات: Creatify وArcads وHeyGen، وكلها مبنية حول فيديو المبدعين بأسلوب UGC وعروض المنتجات، وتُباع لمسوّقي الأداء الذين يحتاجون إلى الكم وسرعة التكرار لا إلى لقطة بطولية واحدة.
تفسّر الاقتصاديات هذا الانقسام. فحملة إعلانية قائمة على الأداء تحتاج إلى عشرات النسخ للعثور على الخطّاف الذي ينجح. وإذا كانت تكلفة كل نسخة 5 دولارات، فلا تستقيم الحسابات. أما إذا كانت تكلفة كل نسخة 40 سنتًا وتُنتج في 11 ثانية، فيمكنك اختبار اثني عشر خطّافًا قبل الغداء. الجودة السينمائية وسرعة التكرار منتجان مختلفان، ومحاولة بيعهما معًا من نموذج واحد تعني التسوية في ما يهم المشتري أكثر.
وسلكت HeyGen مسارًا مشابهًا في الأسبوع نفسه، إذ أطلقت نموذج فيديو شاملًا بسنت واحد لكل ثانية، مُدرَّبًا لاحقًا أيضًا على MiniMax H3. شركتان قررتا بشكل مستقل أن قاعدة MiniMax هي الأساس المناسب للتخصص، وهذا يقول شيئًا عن موقع الحدود المتقدمة في النماذج المفتوحة الأوزان.
ما لا يزال النموذج عاجزًا عنه
القسم الذي يتخطاه معظم المورّدين: تشوّه المنتج.
قد يتغيّر شكل الزجاجة تغيرًا طفيفًا بين الإطارات، أو بين النسخ المولّدة كلٌّ على حدة للمنتج نفسه. وتظهر العلامات التجارية بمظهر معقول لكنه خاطئ تقنيًا: شعار بنسب غير صحيحة، أو شعار نصي مجسّم بحرف لا وجود له تمامًا. واتساق العبوة بين عمليات التوليد شائع بما يكفي لدرجة أن سير العمل الجاد يثبّت صورة مرجعية لتقييده بدلًا من الوثوق بوصف نصي.
تدّعي Creatify أنها عالجت هذه المشكلة ونشرت انخفاضًا في معدل العيوب. لكن ما لا يغطيه الادعاء هو نمط الفشل الأهم في حملة مدفوعة: عيب ينجو من المراجعة لأنه يبدو صحيحًا بحجم الصورة المصغّرة وخاطئًا بالحجم الكامل. والحكام الآليون الذين يمنحون الواقعية البصرية 6 من 10 لن يلتقطوا شعارًا مرسومًا خطأً بشكل موثوق. أما الإنسان الذي يقارن المخرجات بالمنتج الفعلي فسيلتقطه.
النصيحة العملية التي تلي ذلك غير براقة. ابدأ كل لقطة منتج من صورة فوتوغرافية للمنتج الحقيقي لا من وصف نصي، لأن التوجيه النصي وحده يجعل النموذج يختلق الملصق مع الجسم. واكتب التوجيهات للحركة (ما يتحرك، وكيف تتحرك الكاميرا، وما تفعله الإضاءة) لأن الصورة تحمل المنتج بالفعل. وضع كل مقطع بجانب الجسم الفعلي قبل إطلاقه.
ما يمنحه التخصص وما يكلّفه
الحجة لصالح نموذج مثل Boreal-H3 مباشرة: إذا كان ناتجك إعلانات، فإن نموذجًا مضبوطًا على الإعلانات سيوفر عليك دورات تكرار يهدرها النموذج العام على قدرات لا تحتاجها.
أما الحجة ضد فهي نوع معيّن من الارتهان. فالنموذج المُدرَّب لاحقًا على حلقة تقييم شركة واحدة يكون مُحسَّنًا وفق تعريف تلك الشركة للإعلان الجيد، وهذا التعريف غير منشور في صيغة يستطيع أي طرف آخر تدقيقها. ومؤشر جودة الإعلانات بديل معقول عن سؤال "هل يصلح هذا كإعلان تجاري؟". أما ما إذا كان يرتبط بسؤال "هل تحقق هذه الحملة أداءً؟" فسؤال لا يجيب عنه إلا مشترو الوسائط، وسيجيبون عليه بميزانياتهم خلال الربعين المقبلين.
هناك تأثير من الدرجة الثانية يستحق التوقع. فعندما يُدرَّب نموذج لاحقًا على هدف تجاري محدد، فإنه يميل إلى التحسن في الأنماط التي يكافئها هذا الهدف، وإلى التدهور في الأنماط التي لا يقيسها. وقد ينزلق نموذج موجّه للإعلانات حُسِّن من أجل دقة المنتج واتساق المبدع بعيدًا عن الابتكار البصري الذي يجعل الحملة عالقة في الذاكرة. ولا يحتوي مؤشر جودة الإعلانات على أي عنصر يقيس ما إذا كان المقطع مثيرًا للاهتمام، وهذا اختيار متعمد لتحديد النطاق، وله عواقب.
ويشكّل شرط المواد المرجعية القيد العملي الآخر. فكلٌّ من التحكم بالإطار المفتاحي والتحكم بمراجع متعددة يتطلب أن يوفّر المعلن مدخلات جيدة: لقطة نظيفة للمنتج، ومبدع ثابت الملامح، وأسلوب بصري راسخ. وهذا مناسب للعلامات التي لديها بالفعل مكتبة تصوير ونظام تصميم. أما البائع الصغير الذي يولّد المحتوى من الصفر، فالتخصص أقل فائدة له، لأن المدخلات التي يحتاجها النموذج هي المدخلات التي لا يملكها البائع.
ما يبرهن عليه Boreal-H3 حقًا هو أن سوق توليد الفيديو نضج إلى حد تجاوز النقطة التي تحسم فيها لوحة صدارة واحدة أي شيء. فالسؤال ذو الصلة لدى المشتري في أواخر 2026 لم يعد أي نموذج هو الأفضل. بل أي نموذج هو الأفضل في الشيء المحدد الذي تصنعه، وهل تستطيع قياس ذلك بنفسك بدلًا من الوثوق بمؤشر المورّد.
هذه العبارة الأخيرة هي الأكثر أهمية. فالمورّدون الذين يبنون نماذج الإعلانات هم أنفسهم من يبيعون المعايير التي تصنّفها. والتقييم الموثوق الوحيد هو اختبار مضبوط على مجموعة منتجاتك الخاصة، بمعايير مراجعة خاصة بك، مع إنسان يقارن كل مخرج بالجسم الفعلي. إنه أبطأ من قراءة لوحة صدارة، وأكثر فائدة بكثير.
مقالات ذات صلة
ميتا ترخّص تقنية الصور والفيديو من ميدجورني، والسبب ذو دلالة
تتحرك معايير القياس كل ربع سنة. أما حكم مجتمع على ما يبدو جيدًا فلا.
AssemblyAI تخفض زمن استجابة الكلام في الوقت الفعلي إلى 91 مللي ثانية. إليك لماذا يهم هذا الرقم
القيد على الصوت لم يكن أبدًا معدل خطأ الكلمات. بل كان تبادل الأدوار.
نانو بنانا 2.1 من جوجل إصدار ميزات وليس نموذجاً رائداً
إصدار الطبقة المتوسطة يخبرك بما يعتقد مختبر أن معظم مستخدميه يحتاجونه فعلاً، وهو إشارة أكثر فائدة من إصدار رائد.
نشرت OpenAI 722 نتيجة رياضية مستمدة من الذكاء الاصطناعي. ويتساءل علماء الرياضيات من ينال الفضل.
يتحقق مساعد الإثبات من أن الحجة تتبع، وليس من أن الحجة هي التي يعتقدها شخص ما.