بناء بوابة ما قبل الشحن لإبداع الذكاء الاصطناعي علّمني أن درجة التشابه لا تميّز أحمر Pantone لديك من أحمر منافس. CIEDE2000 تستطيع.
Artificial IntelligenceBrand StrategyMarketing

نموذج منح أحمرًا خاطئًا ظاهرًا 0.97 ضمن هوية العلامة. ذلك الرقم غيّر ما بنيته.

Ashutosh SinghalAshutosh Singhal27 يونيو 202616 min

أتذكر الرقم بالضبط، لأنه أحرجني. 0.968. نظر نموذج تشابه عام إلى أصلٍ موسمي كان أحمر بطولته خاطئاً بصورة ظاهرة وواضحة، ومنحه تقييماً 0.97 ضمن هوية العلامة. على مقياسٍ يعني فيه 1.0 الكمال، قال لي إن هذا الإبداع جيد تقريباً كأنه جاهز للشحن.

كنت قد أمضيت المرحلة الأولى من هذا المشروع مفترضاً أن المشكلة الصعبة هي العكس. ظننت أن العمل المثير في محتوى الذكاء الاصطناعي الجدير بالثقة هو تحسين التوليد، وتعليم نموذجٍ أن يصيب أحمر العلامة بالضبط، وتضييق المطالبات حتى يبدو المُخرَج صحيحاً. كنت أبني Brand Fidelity Firewall، عرضاً لبوابة ما قبل الشحن يجب أن يجتازها كل أصل حملة مُولَّد بالذكاء الاصطناعي قبل أن يُشحَن. وظللت ألجأ إلى النموذج ليكون هو الحكم. كان النموذج آخر شيء كان ينبغي أن أثق به في تلك المهمة.

هذه قصة كيف أعاد رقمٌ خاطئٌ واحدٌ ترتيب كل شيء. إن أردت أن ترى النسخة النهائية وهي تقرّر على دفعة حيّة، فهي تعمل على veriprajna.com/ar/demos/brand-ai-content. لكن العرض التوضيحي هو الجزء السهل للنظر إليه. الجزء الجدير بالتدوين هو ما تطلّبه التوقّف عن مطالبة النموذج بأداء مهمة لا يستطيع أداءها.

بنيت الشيء الخطأ أولاً

بدأت حيث يبدأ معظم الناس، أي بدرجة التشابه. والغريزة معقولة. لديك دليل علامة وأصل مُولَّد، وتريد رقماً واحداً يقول مدى قربهما. كل أداة جمالية بالذكاء الاصطناعي في السوق تعطيك ذلك الرقم، ويبدو كأنه حوكمة. وهو ليس حوكمة. إنه إحساسٌ بنقطةٍ عشرية.

لكي يكون العرض صادقاً اخترعت علامة وهمية للاختبار ضدها، لأنني لم أكن سأمرّر إبداع شركة حقيقية عبر إثبات مفهوم. العلامة هي "Lumiere،" دار فاخرة اصطناعية شعارها "Quiet luxury, since 1984." ولونها الأساسي هو Lumiere Crimson، Pantone PMS 484، hex #9E2B25، مع تسامحٍ لكل لون قدره 3.0. كل ما يلي يُقاس إزاء دليل العلامة هذا. إنها علامة مختلقة، لكن البكسلات والمواصفات حقيقية، وهي الطريقة الوحيدة لاختبار ما إذا كان الفحص يعمل فعلاً.

ثم ألّفت دفعة من اثني عشر أصلاً موسمياً، اصطناعية أيضاً، تخطيطات مسطحة بُنيت بحيث يقيس كل فحص بكسلات حقيقية بدل ضوضاء التصوير. الجدار نفسه لا يولّد شيئاً. يستوعب أصولاً مُولَّدة مسبقاً ويقرر ما هو آمن للشحن، لذا فالاثنا عشر هي تجهيزات اختبار ألّفتها لتمرين الفحوصات. أحد عشر منها كانت سليمة. واحد، الأصل الذي سمّيته a08، كان أحمر بطولته سيُشير إليه أي مدير فني من الطرف الآخر للغرفة. تطابق مع #9D2E0B عبر نحو 46 بالمئة من مساحته. هذا أحمر مختلف. ليس مختلفاً بخفاء. خاطئ.

ودرجة التشابه أحبّته.

رقمٌ لا يستطيع تمييز أحمرك من أحمر منافسٍ ليس يقيس علامتك. إنه يقيس الإضاءة ويُشيح بكتفيه.

سبب حبّه له جدير بالفهم، لأنه هو الحجة كلها. خط الأساس العام الذي استخدمته هو تجزئة إدراكية حقيقية، pHash قائم على DCT، من نفس عائلة التقنيات التي تستخدمها منصات المحتوى لاكتشاف الصور شبه المكررة. وهي مبنية عمداً لتكون متينة إزاء اللون. تهتم بالبنية والإضاءة، لذا تستطيع التعرّف على الصورة نفسها بعد إعادة تلوين أو تمريرة ضغط. تلك المتانة هي بالضبط الخاصية التي تريدها لإزالة التكرار، وبالضبط الخاصية التي تجعلها عديمة النفع كحكم على العلامة. نظرت إلى تخطيطٍ مُركَّب بشكل صحيح صُبّ فيه أحمر خاطئ ورأت تخطيطاً مُركَّباً بشكل صحيح. 0.968. كانت ستُشحَن.

ماذا ترى درجة التشابه فعلاً؟

أُبقي لقطة الشاشة تلك مفتوحة حين أشرح هذا للناس، لأن اللوحة تقوله بصراحة أكبر مما أستطيع. على اليسار، الأصل خارج هوية العلامة. وعلى اليمين، قراءة الجدار له.

لوحة أدلة Brand Fidelity Firewall للأصل a08، تُظهر لون العلامة مقيساً عند ΔE00 7.12 إزاء تسامح 3.0، والـ hex المطابق 9D2E0B مقابل 9E2B25 للعلامة، مع ملاحظة أن خط الأساس العام للتجزئة الإدراكية قيّمه بـ 0.968 ضمن الهوية وكان سيُشحنه.
نفس الأصل، حكمان. قيّمه خط الأساس العام للتجزئة الإدراكية بـ 0.968 ضمن هوية العلامة. مقيساً بـ CIEDE2000، أحمر البطولة ينحرف ΔE00 7.12 عن Lumiere Crimson إزاء تسامح 3.0، لذا تمنعه البوابة.

الفجوة بين هذين الرقمين هي المنتج بأكمله. 7.12 إزاء تسامح 3.0. هذا فرق اللون مقيساً بـ CIEDE2000، معيار ISO و CIE الإدراكي لفرق اللون، ويُكتب ΔE00. ليس تخميناً للتشابه وليس شيئاً اخترعته. إنه الرقم الذي اتفق عليه عالم علم الألوان مسبقاً لسؤال "كم يختلف هذان اللونان في عين الإنسان." قيمة ΔE00 البالغة 7.12 إزاء تسامح 3 هي فشل قاطع. درجة التشابه 0.97 وΔE00 البالغة 7.12 ينظران إلى البكسلات نفسها ويختلفان تماماً، وواحد فقط منهما يقيس ما تهتم به العلامة فعلاً.

في أول مرة وضعت في هاتين القراءتين جنباً إلى جنب، توقفت عن التفكير في التوليد كلياً. لم يكن يهم مدى جودة المولّد. مولّد مثالي ما زال يُنتج أصولاً يجب قياسها إزاء مواصفة دقيقة، ونموذج التشابه غير قادر بنيوياً على إجراء ذلك القياس. المشكلة لم تكن يوماً صنع إبداع أفضل. المشكلة كانت معرفة ما هو آمن للشحن.

أريد أن أكون دقيقاً في أمر واحد، لأنه موضع يُبالِغ فيه الناس. لم أشغّل CLIP هنا. CLIP هو المقياس الذي تذكره كثير من عروض "تسجيل درجات هوية العلامة بالذكاء الاصطناعي"، وتشغيله فعلياً إضافة موثّقة جاهزة، لكنه يجرّ اعتماداً بحجم نحو غيغابايتين ويُظهر نفس الإخفاق الذي يُظهره pHash مجاناً. لذا فخط الأساس في العرض هو بديل صادق بتجزئة إدراكية لنهج التشابه العام، وليس CLIP مرتدياً زيّاً. والنقطة تصمد في الحالتين. التشابه، أياً كانت طريقة حسابه، لا يستطيع تمييز أحمر Pantone لديك من أحمر خاطئ. علم الألوان يستطيع.

حاولت أن أجعل النموذج هو الحكم. أجاب بطلاقة وكان مخطئاً.

لم أصل إلى ذلك الاستنتاج برشاقة. لفترة كنت مقتنعاً بأن البنية الصحيحة هي أن أدع نموذج رؤية-لغة قادراً ليكون الحَكَم. أره الأصل، أره دليل العلامة، اطلب منه أن يقرر. النماذج جيدة في وصف الصور. بالتأكيد يستطيع أحدها أن يخبرني ما إذا كان الأصل ضمن هوية العلامة.

لم يستطع، وطريقة إخفاقه هي ما أقلقني. لم يفشل بصخب. فشل بأدب وبثقة. كنت أسلّمه الأحمر خارج الهوية فينتج فقرة سلسة ومعقولة عن كيف يحترم التكوين الجمالية المتحفظة للعلامة، وينتهي بالموافقة. ثم أسلّمه أصلاً صحيحاً فأحصل على فقرة سلسة بالقدر نفسه تُشير أحياناً إلى مشكلة متخيلة. كانت الأحكام نثراً، والنثر هو بالضبط ما لا تريده بين أحمر خاطئ وحملة مشحونة.

هناك تكلفة حقيقية تقع تحت هذا، ولهذا لم أستطع أن أتجاهله كفضول عرض توضيحي. بدأ المستهلكون يُسعّرون الفرق. نصفهم يقولون إنهم يفضّلون العلامات التي تتجنّب محتوى الذكاء الاصطناعي التوليدي، وفقاً لـ Gartner في مارس 2026. وثلثهم يتوقفون عن التفاعل مع علامة بمجرد كشف أن المحتوى بالذكاء الاصطناعي، وفقاً لتقرير Adobe Digital Trends لعام 2026. ووجدت Smartly.io في 2025 أن الثقة المقيسة في إعلان تهبط من 48 بالمئة إلى 13 بالمئة حين ينتقل من مشترك الصنع إلى ذكاء اصطناعي كامل. إعلان كوكاكولا الموسمي بالذكاء الاصطناعي، سبعون ألف مقطع مُولَّد، وُصف بأنه بلا روح علناً. وفي كان عام 2025، شهدت فضيحة DM9 إلغاء اثنتي عشرة جائزة بسبب لقطات ملفّقة بالذكاء الاصطناعي. حين يكون الجانب السلبي بهذا الوضوح، فإن طبقة حوكمة تُنتج فقرات واثقة بدل قياسات قابلة للإثبات ليست ضمانة. إنها مسؤولية بآداب جيدة.

إذا كان ما يقف بين أصل خاطئ وحملة حيّة يمكن إقناعه بأي شيء، فليس بوابة. إنه اقتراح.

لذا توقفت عن محاولة جعل النموذج هو الحكم. تلك كانت نقطة التحوّل. كل ما بنيته بعد ذلك يفترض أن النموذج هو أقل مكوّن جدارة بالثقة في النظام، لا أذكاه.

لماذا علم الألوان، وليس مطالبة أفضل؟

اخترت أن أجعل فحص اللون النواة الصلبة غير القابلة للنقاش، وأريد أن أشرح لماذا أثق به بطريقة لم أثق بها يوماً بالنموذج. CIEDE2000 ليس استدلالاً عدّلته حتى بدا العرض جيداً. إنه صيغة منشورة مع بيانات اختبار مرجعية، وتحققت من تطبيقي إزاء أزواج الألوان المرجعية لدى Sharma et al. هناك اختبار وحدة، test_ciede2000_matches_sharma، ويمرّ كواحد من خمسة اختبارات ناجحة في المجموعة. وهذا أهم مما يبدو. يعني أن 7.12 ليس رأيي في مدى خطأ الأحمر. إنه قياس قابل للتكرار يستطيع متخصص قياس الألوان التحقق منه إزاء كتابٍ مدرسي.

ذلك هو الفرق بين رقم أستطيع الدفاع عنه أمام مدير علامة متشكك ورقم عليّ أن أعتذر عنه. حين يقول نموذج تشابه 0.97، ويسأل أحدهم لماذا، فالجواب الصادق هو "النموذج شعر بذلك." وحين يقول ΔE00 7.12 إزاء تسامح 3، فالجواب هو "ها هما اللونان في CIELAB، وهذه الصيغة المعيارية، وهذا التحقق المرجعي، وهنا حيث يتجاوز 7.12 قيمة 3." أحد هذين الجوابين يصمد أمام مراجعة قانونية. والآخر يصمد حتى أول سؤال صعب.

حكم أستطيع تتبّعه إلى صيغة منشورة يصمد أمام مراجعة قانونية. حكم لا أستطيع تفسيره إلا بحدس نموذج يصمد حتى أول سؤال صعب.

تعلّمت أيضاً الحذر بشأن أين يُقاس اللون. الحكم على الصورة كلها كان سيسمح لشعار صغير صحيح أن يسحب المتوسط إلى داخل التسامح بينما تُشحَن منطقة البطولة العملاقة الخاطئة. لذا يحكم الفحص تحديداً على منطقة البطولة المهيمنة المشبّعة، وهي الطريقة التي يُلتقط بها الأحمر خارج الهوية حتى حين يجلس شعار بلون قرمزي صحيح في الزاوية وهو متوافق تماماً. البوابة تنظر حيث تنظر عين الإنسان أولاً.

يجب أن تكون البوابة مملّة

وضعت قاعدة لنفسي في منتصف الطريق: الشيء الذي يقرّر يجب أن يكون مملاً. ممل بمعنى حتمي، كود صريح، خارج أي نموذج، قابل للاختبار، وقابل للتكرار. في اللحظة التي يعتمد فيها قرار على مزاج نموذج، يتوقف عن أن يكون قابلاً للتدقيق، والحكم القابل للتدقيق هو القيمة كلها.

لذا فالبوابة بالضبط كذلك. تُصدر BLOCK عند أي فشل قاطع، وتُصدر FLAG للحالات التي يجب أن يملكها إنسان فعلاً، وإلا تُصدر PASS. هناك ثابت مختبَر بالوحدة أهتم به أكثر من أي ميزة منفردة، test_gate_invariant_no_hard_fail_passes: لا يُعاد أي أصل بفشل قاطع أبداً كـ PASS أو FLAG. لا يمكن أن يتسلل. تلك خاصية تستطيع إثباتها، لا سلوكاً تأمل فيه.

اللون ليس الحظر القاطع الوحيد، وبنيت عمداً حظراً ثانياً لا علاقة له باللون، لإثبات أن البوابة ليست مقياس لون بحيلة واحدة. الأصل a09 لديه قرمزي مثالي، ΔE00 بقيمة 0.00، مطابق تماماً لـ Lumiere Crimson. والبوابة تمنعه رغم ذلك.

لوحة الأدلة للأصل a09، تُظهر لون العلامة ΔE00 عند 0 إزاء تسامح 3، لكن مساحة الوضوح المحيطة بالشعار مقيسة عند 11px إزاء المطلوب 24px، مما يُنتج حكم BLOCK على الهندسة لا على اللون.
الأصل a09 لديه قرمزي بلا عيب، ΔE00 0.00، ومع ذلك يُمنع. مساحة الوضوح المحيطة بالشعار 11px إزاء 24px التي تتطلبها العلامة. هذا الحظر هندسة، لا لون، وهذه هي النقطة.

الحظر القاطع الثالث تنظيمي، وهو الذي ترتبط به تواريخ حقيقية. إذا شُحن محتوى ذكاء اصطناعي إلى سوق يشترط إفصاحاً مقروءاً آلياً عن محتوى الذكاء الاصطناعي وكان الإفصاح مفقوداً، فذلك حظر قاطع بغض النظر عن جودة البكسلات. الأصل a10 تخطيط نظيف ضمن الهوية متجه إلى الاتحاد الأوروبي بلا ملصق Article 50. التزام الإفصاح بموجب Article 50 من EU AI Act قابل للإنفاذ في 2 أغسطس 2026، بغرامات تصل إلى 15 مليون يورو أو 3 بالمئة من رقم الأعمال. وSB-8420A في نيويورك يدخل حيّز التنفيذ في 9 يونيو 2026. وCAITA في كاليفورنيا يصل في أغسطس 2026. وSection 5 من FTC يظل فوق ذلك كله. ملصق مطلوب مفقود ليس ملاحظة أسلوب. إنه غرامة تنتظر الحدوث، والبوابة تتعامل معه كذلك.

على دفعة العرض الكاملة ذات الاثني عشر أصلاً، ينقسم الناتج إلى سبعة PASS، وثلاثة BLOCK، واثنان FLAG. هذا معدّل إجازة تلقائية بنسبة 58.3 بالمئة على هذه الدفعة الثابتة تحديداً، وأقول "هذه الدفعة تحديداً" عمداً، لأنه نتيجة محسوبة على اثني عشر أصلاً اصطناعياً، لا وعداً بشأن خط إنتاجك.

تقرير دفعة Brand Fidelity Certificate، بعنوانه 7 من 12 إبداعاً أُجيزت للشحن دون لمسة بشرية، يُظهر معدّل إجازة تلقائية 58.3 بالمئة، 7 أُجيزت، 3 مُنعت، 2 أُشير إليها، و1 التقطه ΔE00 فاتت درجة تشابه عامة، فوق جدول أحكام لكل أصل.
شهادة الدفعة لتشغيل العرض ذي الاثني عشر أصلاً. سبعة أُجيزت، ثلاثة مُنعت، اثنان أُشير إليهما، والأهم: أصل واحد التقطه ΔE00 كانت درجة تشابه عامة ستشحنه. ثابت الثقة مذكور في الأعلى.

حالتا FLAG هما اللتان أفتخر بهما أكثر، لأنهما الحالتان اللتان يقول فيهما نظام صادق "لا أعرف، على إنسان أن يقرر." الأصل a11 يحتوي وجهاً بشرياً مُولَّداً بالذكاء الاصطناعي، لذا يُوجَّه إلى شخص لتوقيع أصالة بدل أن يُخدع إلى PASS أو BLOCK. ذلك خطر الهالة السلبية لدى NielsenIQ، الاكتشاف أن الوجوه المُولَّدة بالذكاء الاصطناعي قد تسحب إدراك العلامة إلى الأسفل، وليس قراراً ينبغي أن يتخذه الكود وحده. الأصل a12 يستهدف اليابان، سوقاً خارج تغطية دليل العلامة، لذا فقواعد الإفصاح مجهولة ويذهب إلى الشؤون القانونية بدل أن يُجاز زوراً. بوابة لا تعترف أبداً بعدم اليقين ليست صارمة. إنها متهورة.

فيما يظل النموذج مفيداً

لم أرمِ النموذج، وأريد أن أكون صادقاً بشأن أين استقر، لأن "أزلنا الذكاء الاصطناعي" سيكون كذباً وإهداراً أيضاً. نموذج الرؤية-اللغة ما زال في خط الأنابيب. ببساطة ليس له صوت. يكتب ملاحظة استشارية، استدعاء واحد قابل لتبديل المزوّد، وهي معلوماتية فقط. يمتنع بنظافة إن لم يكن هناك مفتاح أو حدث خطأ، ولا يغيّر أبداً PASS أو FLAG أو BLOCK.

بطاقة مراجعة LLM للأصل a08، مُسمّاة استشارية، تقرأ أن القرمزي خارج المواصفة عند ΔE00 7.12 يُقرأ كأحمر خاطئ ظاهرياً للمستهلكين ويُضعف توقيع الفخامة الهادئة لدى Lumiere، معروضة تحت حكم BLOCK الحتمي الذي لا تؤثر فيه.
مساهمة النموذج في الأحمر خارج الهوية: ملاحظة مؤسَّسة بأن القرمزي خارج المواصفة عند ΔE00 7.12 يُقرأ كأحمر خاطئ ظاهرياً ويُضعف توقيع العلامة. مُسمّاة استشارية، وتجلس تحت BLOCK قررته البوابة مسبقاً.
يمكن للنموذج أن يكون بطلاقة وواثقاً كما يشاء. ما زال لا يستطيع شحن أحمر خاطئ.

اقرأ تلك الملاحظة الاستشارية بجانب الحكم وترى تقسيم العمل الصحي الذي كنت أسعى إليه. البوابة قالت BLOCK مسبقاً، بقوة 7.12 إزاء 3.0. النموذج يضيف اللون البشري، لماذا يهم، الجملة التي يريد مدير علامة أن يقرأها فعلاً. ذلك مفيد حقاً. إنه سياق، لا حكم. البوابة الحتمية تقرّر. النموذج يقدّم المشورة فقط. بمجرد أن وضعت النموذج في ذلك المقعد، توقفت عن القلق بشأنه. تحوّلت طلاقته من خطر إلى ميزة، لأن تلك الطلاقة تجلس الآن تحت حكم لا يملك سلطة تحريكه.

كل أصل مُجاز يصدّر Brand Fidelity Certificate، JSON مع HTML قابل للطباعة، يحمل قياسات كل فحص، ومنشأ أي العناصر بالذكاء الاصطناعي مقابل البشري، وحالة الإفصاح لكل سوق، ونتيجة البوابة، والنموذج والإصدار، وطابع زمني. ينبغي أن أكون حذراً بشأن ما هو هذا المستند. إنه أثر أدلة قابل للإيداع، إيصال قابل للتكرار لما قيس وقُرر. ليس شهادة قانونية وليس استشارة قانونية. تسميته "معتمداً بموجب EU AI Act" سيكون بالضبط نوع المبالغة الواثقة التي وُجد هذا المشروع كله لرفضها.

التوليد لم يكن يوماً عنق الزجاجة

أعود باستمرار إلى اللحظة مع 0.968، لأنها قلبت إحساسي بمكان المشكلة الصعبة. افترضت أنه مع تحسّن المولّدات ستتقلص مشكلة الثقة. بناء هذا أقنعني بالعكس. مولّد أفضل يُنتج أحمر خاطئاً أسرع وبأحجام أعلى. لا يخبرك أن الأحمر خاطئ. لا شيء في جودة النموذج يمسّ سؤال ما إذا كان أصل يطابق PMS 484 ويحمل ملصق Article 50، وهذان هما السؤالان اللذان يقرران ما هو آمن للشحن.

النسخة غير المريحة من هذا، التي بدأت أقولها بصوت عالٍ، هي أن أهم جزء في مكدس محتوى ذكاء اصطناعي جدير بالثقة يحتوي تقريباً على لا ذكاء اصطناعي. فحص اللون صيغة من هيئة معايير. فحص مساحة الوضوح هندسة. فحص الإفصاح محرك قواعد مربوط بقوانين مؤرّخة. النموذج الوحيد في النظام غير مسموح له أن يقرر أي شيء. بدا ذلك شيئاً غريباً أن أبنيه حتى تذكّرت أن الهدف كله كان القدرة على إثبات الحكم، ولا تستطيع إثبات فقرة.

يمكنك تشغيل البوابة النهائية بنفسك ومشاهدة التقاطها للأحمر على veriprajna.com/ar/demos/brand-ai-content. ما أفضّل أن تأخذه معك هو السؤال الذي تركته لي. إذا كانت طبقة الحوكمة لديك يمكن إقناعها بالموافقة على أحمر خاطئ بجملة واثقة، فهل كانت تحكم أي شيء أصلاً؟ أم كنت تولّد أسرع فحسب وتسمي السرعة استراتيجية؟

وإن كنت تفضّل مشاهدتها على قراءة وصفي لها، فها هي البوابة كلها تعمل من البداية إلى النهاية.

لا أظن أن هذا السؤال يصبح أسهل كلما تحسّنت النماذج. أظنه يصبح أحدّ.

أبحاث ذات صلة

منشور أيضًا على

ابنِ ذكاءك الاصطناعي بثقة.

تعاون مع فريق يمتلك خبرة عميقة في بناء الجيل القادم من الذكاء الاصطناعي للمؤسسات. دعنا نساعدك على تصميم استراتيجية ذكاء اصطناعي جديرة بثقتك وبنائها وتطبيقها.

Veriprajna استشارات التقنيات العميقة متخصصة في بناء أنظمة الذكاء الاصطناعي الحرجة للسلامة في مجالات الرعاية الصحية والتمويل والقطاعات التنظيمية. تُقيَّم بنياتنا المعمارية وفق البروتوكولات المعتمدة مع توثيق شامل للامتثال.