طبقة التحقق والحوكمة لتواصل الذكاء الاصطناعي

مدقِّق حتمي يقرر ما يُسمح لتواصلك بالذكاء الاصطناعي بإرساله.

يُحسِّن مندوبو المبيعات بالذكاء الاصطناعي للكمية، وترسل نماذج المرور الواحد عبارات ذات مصدر متقادم وكيان خاطئ وادعاءات مبالغ فيها كما هي. يتيح Veracity Engine لنموذج لغة كبير صياغة المسودة، ثم تزيل فحوصات Python الخالص كل ادعاء غير مُثبَت، وتُسجِّل ما يتبقى، وتُمرِّره عبر بوابة سياسات مُعايَرة حسب المخاطر. الوكلاء ينصحون، والكود يقرر.

100%

سلامة الإرسال عندما ينجو ادعاء

كل ادعاء في الرسالة المُرسَلة مدعوم بمصدر

25/25

دقة الحكم على المجموعة الذهبية الموسومة

حتمي وقابل لإعادة الإنتاج (معيار من 25 حالة)

3

فحوصات حتمية قبل الإرسال

التأسيس، تطابق الكيان، الصلاحية الزمنية

هذا عرض تجريبي قابل للتشغيل. الاسترجاع وإدارة علاقات العملاء (CRM) وإرسال البريد الإلكتروني مُحاكاة، والعملاء المحتملون اصطناعيون باستثناء Werner Enterprises، التي تُعد مقتطفات نموذج 10-K الخاصة بها سجلاً عاماً حقيقياً.

الكمية بلا تحقق تدمر من خط الأنابيب أكثر مما تبني

نمط الإخفاق وراء انهيارات مندوبي المبيعات بالذكاء الاصطناعي المعروفة على نطاق واسع.

مندوبو المبيعات بالذكاء الاصطناعي مبنيون لإرسال المزيد. تهلوس نماذج اللغة الكبيرة ذات المرور الواحد شريحة قابلة للقياس من الادعاءات الخاصة بالعملاء المحتملين، ولا تعيد أدوات التخصيص أبداً التحقق من الادعاء الناتج مقابل مصدر حالي وصحيح الكيان. لذا تُشحَن عبارات المصدر المتقادم والكيان الخاطئ والادعاءات المبالغ فيها كما هي، ويُركَّب التحقق بعد الإرسال أو لا يحدث أصلاً.

سياق الصناعة صارخ. تهلوس نماذج اللغة الكبيرة ذات المرور الواحد من 12 إلى 18% من الادعاءات الخاصة بالعملاء المحتملين (AI SDR Industry Report, 2026). يبلغ معدل تخلّي المؤسسات عن مندوبي المبيعات بالذكاء الاصطناعي من 50 إلى 70% سنوياً (UserGems, 2026). جمعت 11x.ai مبلغ $74M ثم انهارت في 2025 بمعدل تخلٍّ من 70 إلى 80% (TechCrunch). لدى 7% فقط من المؤسسات حوكمة خاصة بالأنظمة الوكيلة (Deloitte, 2026)، ويتوقع Gartner أن يُتخلَّى عن أكثر من 40% من مشاريع الذكاء الاصطناعي الوكيل بحلول 2027. منذ نوفمبر 2025، يُفعِّل معدل بريد عشوائي يتجاوز 0.3% رفضاً على مستوى SMTP في Gmail وتعافياً للنطاق يستغرق من 6 إلى 12 أسبوعاً.

الخلل الحقيقي ليس القواعد النحوية السيئة. القواعد النحوية مثالية، وهذا ما يجعل الأمر أسوأ. الخطر هو ادعاء مستشهد به بشكل صحيح لكنه مستخدم على نحو مضلِّل: حقيقة صحيحة مأخوذة من مصدر متقادم، أو حقيقة صحيحة عن شركة أخرى تحمل الاسم نفسه، أو ادعاء مورِّد يناقضه المصدر. نسمّي ذلك إساءة الاستخدام السياقية، والنماذج الأساس الأفضل لا تزيله. حتى النموذج المثالي ما زال لا يستطيع أن يُثبت لـ FINRA أو اللائحة العامة لحماية البيانات (GDPR) أي مصدر حالي أيّد أي ادعاء.

كيف يعمل Veracity Engine

نموذج لغة كبير يصوغ المسودة. وكود حتمي يقرر ما يُشحَن. هذا عصبي-رمزي: تأليف عصبي، تحقق رمزي.

يجري خط الأنابيب مرحلة العميل المحتمل، ثم البحث (ورقة حقائق ترتبط فيها كل حقيقة بمصدر مؤرَّخ)، ثم الصياغة (نموذج كاتب مقيَّد بورقة الحقائق فقط)، ثم التحقق (فحوصات حتمية)، ثم بوابة سياسات، ثم إيصال تدقيق موقَّع، ثم كتابة رجعية مُحاكاة إلى إدارة علاقات العملاء. خطوة التحقق ليست نموذجاً يحكم على نموذج. إنها Python خالص، لذا يُنتج المدخل نفسه الحكم نفسه في كل تشغيل.

الفحوصات الحتمية الثلاثة

يُختبَر كل ادعاء وقائعي مقابل مصدره المستشهد به. يفوز أول فحص فاشل، حسب ترتيب الأولوية: unsourced، ثم contradicted، ثم entity mismatch، ثم stale.

1. التأسيس

هل يستلزم مقتطف المصدر الادعاء؟ يجب ألا يقل تداخل الرموز عن 0.5 من رموز المحتوى، وتُستبعد رموز اسم الشركة حتى لا يحصل ادعاء على درجة عالية فقط بتكرار اسم الشركة.

2. تطابق الكيان

هل المصدر عن هذا العميل المحتمل تحديداً، لا عن شركة أخرى تحمل الاسم نفسه؟ مصدر عن شركة مختلفة بنفس الاسم يفشل، حتى عندما تتوافق الكلمات.

3. الصلاحية الزمنية

إذا استخدم الادعاء لغة حداثة ("recently"، "just"، "now"، "this week")، يجب أن يكون المصدر ضمن 365 يوماً. تُوسَم المصادر الأقدم بأنها متقادمة، حتى عندما تكون الحقيقة صحيحة.

يعمل حارسان إضافيان إلى جانبها: فحص تناقض المورِّد، وحد أدنى لأمانة الجملة قدره 0.3 يمنع نموذجاً حيّاً من ركوب معرِّف حقيقة صالح على جملة مختلَقة. تقود مفردات الحكم ألوان الواجهة: supported (أخضر) يجتاز؛ أما stale (كهرماني) وentity_mismatch (أحمر) وcontradicted (أحمر) وunsourced (أحمر) فلا تجتاز.

بوابة السياسات

تزيل البوابة كل ادعاء غير مدعوم، ثم تُبلِّغ رقمين. درجة Veracity هي الادعاءات المدعومة مقسومة على إجمالي الادعاءات الوقائعية في المسودة، أي مقدار ما كتبه الذكاء الاصطناعي وكان صحيحاً فعلاً. سلامة الإرسال تبلغ 100% كلما نجا ادعاء واحد على الأقل، لأن الرسالة المُرسَلة حينها لا تحتوي إلا على ادعاءات مدعومة بمصدر. ذلك هو ضمان التصميم.

التوجيه يتبع المخاطر. تُنقَّح الرسالة إذا لم ينجُ شيء آمن أو انخفضت تغطية المسودة عن 0.5. وتُرسَل إلى مراجعة بشرية إذا كانت عالية القيمة (خاضعة للتنظيم، أو لكبار المسؤولين التنفيذيين، أو صفقة لا تقل عن $100,000) حتى على مسودة نظيفة بنسبة 100%. وإلا فهي مؤهَّلة تلقائياً. وضع المقارنة، مندوب المبيعات بالذكاء الاصطناعي القياسي، يبحث ويصوغ ويرسل مع 0 ادعاءات مُتحقَّق منها قبل الإرسال؛ ويعرض التطبيق ذلك كفحص ظلّي لاحق لما خرج بالفعل.

المأزق، معالَجاً من البداية إلى النهاية

ثلاثة عملاء محتملين من مجموعة العرض التجريبي (تاريخ مرجعي 2026-06-17). كل صورة أدناه لقطة شاشة من التطبيق أثناء تشغيله.

حقيقة صحيحة من مصدر متقادم ما زالت الشيء الخطأ الذي يُرسَل

بالنسبة لعميل Northwind Logistics المحتمل (مزوِّد خدمات لوجستية لطرف ثالث 3PL اصطناعي في السوق المتوسطة)، تزعم المسودة أن الشركة "recently expanded into APAC". المصدر خبر APAC حقيقي عن Northwind، وتداخل التأسيس 100%، والكيان صحيح. لكن المصدر مؤرَّخ في 2019-03-14، أي بعمر 2,652 يوماً (نحو 7.3 سنوات) مقابل نافذة حداثة قدرها 365 يوماً، لذا تفشل الصلاحية الزمنية ويُزال الادعاء. يُبقي Veracity Engine الادعاءات المدعومة (يتصدرها دفع لتوظيف ستة مسؤولي Salesforce، بدليل إعلان وظيفة مؤرَّخ في 2026-06-09)، ويلتقط الادعاءين السيئين، ويرسل رسالة مدعومة بمصدر بنسبة 100%.

نتيجة Veracity Engine لعميل Northwind المحتمل: 100% من الرسالة المُرسَلة مدعومة بمصدر، و60% من المسودة قابلة للتحقق، وادّعاءان التُقطا وأُزيلا مع أسباب معروضة في السطر.
نتيجة Veracity Engine: سلامة الإرسال 100%، وقابلية تحقق المسودة 60%، وادّعاءان التُقطا وشُطبا مع الأسباب.
لوحة أدلة تُظهر التأسيس عند 100% والكيان سليماً، لكن الفحص الزمني يفشل: عمر المصدر 2,652 يوماً يتجاوز 365 يوماً لادعاء حداثة، لذا الحكم متقادم (stale).
لوحة الأدلة: التأسيس يجتاز، والكيان يجتاز، والصلاحية الزمنية تفشل (عمر المصدر 2,652 يوماً فوق نافذة 365 يوماً). الحكم: stale.

الفجوة نفسها على إيداع SEC حقيقي

Werner Enterprises, Inc. شركة عامة حقيقية، والمصدران W1 وW2 مقتطفات حرفية من نموذج 10-K للسنة المالية 2023 (SEC EDGAR، CIK 0000793074، أُودع في 2024-02-26). الادعاء في المسودة "recently growing your One-Way Truckload fleet to 2,735 trucks" واقعي فعلاً، لكن الإيداع أكبر من عامين، لذا يُلتقَط إطار "recently" بوصفه متقادماً. هذه هي فجوة إساءة الاستخدام الزمنية نفسها التي تتركها أدوات التخصيص المعتمدة على إيداعات SEC مفتوحة. (جهة الاتصال وإعلان الوظيفة في هذا العميل المحتمل اصطناعيان؛ وحده Werner ومقتطفات 10-K الخاصة به حقيقيان.)

ادعاء Werner Enterprises حقيقي مدعوم بنموذج SEC 10-K للسنة المالية 2023، التُقط بوصفه متقادماً لأن الإيداع أكبر من عامين مقابل نافذة حداثة قدرها 365 يوماً.
ادعاء Werner حقيقي من 10-K، دقيق وقائعياً، التُقط بوصفه متقادماً على إطار حداثة.

تصادم كيان بنفس الاسم

بالعودة إلى عميل Northwind المحتمل، تزعم المسودة أيضاً «$40M Series B». المصدر المستشهد به حقيقي، لكنه عن «Northwind Inc.»، شركة ناشئة للأمن السيبراني في أوستن، لا عن «Northwind Logistics». يفشل فحص تطابق الكيان ويُزال الادعاء قبل أن يُشحَن.

لوحة أدلة تُظهر فشلاً في تطابق الكيان: مصدر التمويل المستشهد به عن Northwind Inc.، شركة ناشئة للأمن السيبراني في أوستن، لا عن Northwind Logistics.
عدم تطابق كيان: مصدر التمويل يصف Northwind Inc.، لا Northwind Logistics.

الحوكمة تتعلق بالمخاطر، لا بالصحة فحسب

Atlas Capital Markets وسيط-تاجر اصطناعي خاضع لتنظيم FINRA، مع جهة اتصال بمنصب مدير الإيرادات التنفيذي وصفقة بقيمة $220,000. حتى مسودة نظيفة بنسبة 100% ومدعومة بمصدر بالكامل تُفرَض عليها مراجعة بشرية من بوابة السياسات، لأنها خاضعة للتنظيم، وموجَّهة لكبار المسؤولين التنفيذيين، وفوق عتبة $100,000. المسودة النظيفة ليست هي نفسها المسودة القابلة للإرسال.

وُجِّه Atlas Capital Markets إلى مراجعة بشرية لأنه خاضع للتنظيم وموجَّه لكبار المسؤولين التنفيذيين وصفقة بقيمة $220,000، رغم أن المسودة مدعومة بمصدر بالكامل.
وُجِّه Atlas إلى مراجعة بشرية على مسودة نظيفة بنسبة 100%: خاضع للتنظيم، وكبار المسؤولين التنفيذيين، وصفقة فوق $100,000.

إيصال موقَّع، ومعيار قابل لإعادة الإنتاج

تُنتج كل رسالة إيصال تدقيق JSON قابلاً للتنزيل: مزوِّد النموذج وإصداره، والعميل المحتمل ومستوى المخاطر، وورقة الحقائق، وحكم كل ادعاء مع نطاق مصدره وتواريخه، ودرجة Veracity، وقاعدة السياسة التي أُطلقت، والمُوافِق البشري. على مجموعة ذهبية موسومة من 25 حالة، يسجِّل المدقِّق الحتمي دقة حكم 25/25: التقاط 10 من 10 ادعاءات صعبة أو سيئة، والحفاظ على 15 من 15 ادعاءً نظيفاً. قابلية إعادة الإنتاج هذه هي ما يجعله قابلاً للتصديق، وحَكَم نموذج لغة كبير ليس كذلك. ننسب الرقم 25/25 إلى هذا المعيار الموسوم، لا كضمان في عالم مفتوح.

إيصال تدقيق JSON القابل للتنزيل مع أثر لكل فحص، وإصدار النموذج، والأحكام، ونطاقات المصدر، والتواريخ، وقاعدة السياسة التي أُطلقت.
إيصال تدقيق JSON الموقَّع، مع الأثر الكامل لكل فحص.
المجموعة الذهبية الموسومة المكوَّنة من 25 حالة تسجِّل دقة حكم 25 من 25، حتمية وقابلة لإعادة الإنتاج.
المجموعة الذهبية من 25 حالة: دقة حكم 25/25، النتيجة نفسها في كل تشغيل.

مندوب المبيعات بالذكاء الاصطناعي القياسي مقابل Veracity Engine

المفتاح نفسه الذي يقارن به العرض التجريبي، جنباً إلى جنب.

البُعد مندوب المبيعات بالذكاء الاصطناعي القياسي Veracity Engine
الادعاءات المُتحقَّق منها قبل الإرسال 0 كل ادعاء وقائعي، حتمياً
من يقرر ما يُشحَن نموذج اللغة الكبيرة يرسل ما صاغه فحوصات Python خالصة، لا نموذج لغة كبير
التقاط المصدر المتقادم لا شيء الصلاحية الزمنية، نافذة 365 يوماً
كيان خاطئ يحمل الاسم نفسه لا شيء فحص تطابق الكيان
مسار التدقيق لا شيء إيصال JSON موقَّع لكل رسالة
التعامل مع المخاطر العالية يُرسل على أي حال يُوجَّه إلى مراجعة بشرية

ما لا يفعله هذا العرض التجريبي

  • ✓ لا يدّعي معدل هلوسة صفرياً. ما زال نموذج اللغة الكبيرة يصوغ المسودة؛ والضمان هو أن الادعاءات غير المُثبَتة تُزال قبل الإرسال. أي شخص يدّعي معدل هلوسة صفرياً ليس صادقاً.
  • ✓ لا يستخدم موصِّلات حيّة. EDGAR وLinkedIn وGreenhouse واسترجاع الأخبار وقراءة إدارة علاقات العملاء وكتابتها وإرسال البريد الإلكتروني مُبتَرة أو مُحاكاة، وورقة الحقائق مبنية مسبقاً.
  • ✓ لا يقدِّم Northwind أو Atlas كشركتين حقيقيتين. هما اصطناعيتان. وحده Werner Enterprises ومقتطفات W1/W2 من 10-K سجل عام حقيقي.
  • ✓ لا يُبلِّغ نطاق الهلوسة من 12 إلى 18% كنتيجة مقيسة خاصة بهذا المنتج. ذلك الرقم سياق سوقي؛ وعنوان العرض التجريبي هو تغطية المنشأ ومعدل المعالجة التلقائية.
  • ✓ لا يحمل عملاء أو دراسات حالة أو شهادات أو أرقام عائد استثمار. لا يوجد أي منها بعد. هذا عرض تجريبي يُثبت الآلية، لا نشراً.

أسئلة يطرحها المشترون فعلاً

هل هذا مجرد مندوب مبيعات بالذكاء الاصطناعي آخر (مثل 11x)؟

لا. نحن لا نضيف مندوب مبيعات بالذكاء الاصطناعي آخر إلى السوق. Veracity Engine طبقة تحقق وحوكمة تقع بعد المسودة: مدقِّق حتمي بـPython خالص يفحص كل ادعاء كتبه ذكاء اصطناعي مقابل مصدر مؤرَّخ ومتطابق الكيان، ويزيل أي شيء غير مُثبَت، ويكتب إيصال تدقيق موقَّعاً قبل السماح بإرسال الرسالة. يُحسِّن مندوبو المبيعات بالذكاء الاصطناعي للكمية؛ ونحن نقرر ما هو آمن للشحن.

كيف تتحققون من ادعاءات رسائل المبيعات المُولَّدة بالذكاء الاصطناعي قبل إرسالها؟

يمر كل ادعاء وقائعي في المسودة عبر ثلاثة فحوصات حتمية: التأسيس (هل يستلزم مقتطف المصدر الادعاء، بتداخل رموز لا يقل عن 0.5)، وتطابق الكيان (هل المصدر عن هذا العميل المحتمل تحديداً، لا عن شركة تحمل الاسم نفسه)، والصلاحية الزمنية (إذا استخدم الادعاء لغة حداثة، يجب أن يكون المصدر ضمن 365 يوماً). تُوسَم الادعاءات التي تجتاز فقط بأنها مدعومة وتُحفَظ؛ ويُزال كل ما عداها. المدقِّق كود، لا نموذجاً يحكم على نموذج، لذا يُنتج المدخل نفسه دائماً الحكم نفسه.

كيف يلتقط ادعاءً صحيح تقنياً لكنه مضلِّل؟

ذلك هو نمط الإخفاق نفسه الذي بُني من أجله، ويسمّيه العرض التجريبي إساءة الاستخدام السياقية. في أحد العملاء المحتملين المعالَجين، الجملة "recently expanded into APAC" مؤسَّسة وعن الشركة الصحيحة، لكن المصدر الوحيد مؤرَّخ في 2019، لذا عمره 2,652 يوماً مقابل نافذة حداثة قدرها 365 يوماً ويُلتقَط بوصفه متقادماً ويُزال. نعرض النمط نفسه على ادعاء Werner Enterprises حقيقي مدعوم بنموذج SEC 10-K للسنة المالية 2023: دقيق وقائعياً، لكن الإيداع أكبر من عامين، لذا يفشل إطار "recently" في الصلاحية الزمنية.

هل يمكن استخدام تواصل الذكاء الاصطناعي في صناعات خاضعة للتنظيم مثل الخدمات المالية / FINRA؟

هناك تكون طبقة التحقق والحوكمة الأهم، لأن ادعاءً مختلَقاً أو منسوبًا خطأً يحمل عاقبة تنظيمية. في العرض التجريبي، توجِّه بوابة السياسات أي رسالة خاضعة للتنظيم، أو مُرسَلة إلى جهة اتصال من كبار المسؤولين التنفيذيين، أو مرتبطة بصفقة لا تقل عن $100,000 إلى مراجعة بشرية، حتى عندما تكون المسودة مدعومة بمصدر بالكامل. الحوكمة هنا دالة للمخاطر، لا للصحة فحسب.

كيف تُثبتون أي مصدر أيّد ادعاءً، لتدقيق امتثال؟

تُنتج كل رسالة إيصال تدقيق JSON قابلاً للتنزيل يسجِّل مزوِّد النموذج وإصداره، والعميل المحتمل ومستوى المخاطر، وورقة الحقائق، وحكم كل ادعاء مع نطاق مصدره وتواريخه، ودرجة Veracity، وقاعدة السياسة الدقيقة التي أُطلقت، والمُوافِق البشري. يعود أي ادعاء إلى مصدره في ثوانٍ. حتى النموذج المثالي ما زال لا يستطيع أن يُثبت لمدقِّق أي مصدر حالي أيّد أي ادعاء؛ أما الإيصال فيستطيع.

هل سيُصلح نموذج ذكاء اصطناعي أفضل/أحدث مشكلة الهلوسة فحسب؟

لا، وهذه هي النقطة الدائمة. النماذج الأساس الأفضل ما زالت تصوغ المسودة، وأي شخص يدّعي معدل هلوسة صفرياً ليس صادقاً، لذا لا تزول الحاجة إلى إثبات المنشأ والاحتفاظ بمسار تدقيق والبوابة حسب المخاطر. المنشأ وإيصالات التدقيق وبوابة السياسات خصائص دائمة؛ وكاتب أقوى لا يُلغي شرط التحقق مما يكتبه وحوكمة ذلك.

هل هذا منتج حي أم عرض تجريبي؟

إنه عرض تجريبي قابل للتشغيل يُثبت الآلية، لا خط أنابيب منشور. مصادر الاسترجاع (EDGAR، LinkedIn، Greenhouse، الأخبار) وقراءة إدارة علاقات العملاء وكتابتها وإرسال البريد الإلكتروني مُحاكاة، وورقة الحقائق مبنية مسبقاً؛ والعملاء المحتملون اصطناعيون باستثناء Werner Enterprises، التي تُعد مقتطفات نموذج 10-K الخاصة بها سجلاً عاماً حقيقياً. المدقِّق الحتمي وبوابة السياسات وإيصال التدقيق حقيقية وتعمل تماماً كما هو معروض.

بحث تقني

البحث وراء هذا العرض التجريبي — المعمارية، وتصميم التحقق، والمخطط المؤسسي.

وضع تواصل الذكاء الاصطناعي أمام مشترين في قطاعات خاضعة للتنظيم؟

طبقة التحقق والحوكمة هي الجزء الصعب. نحن نبنيها.

إذا كان فريقك يصارع كيفية وضع تواصل الذكاء الاصطناعي أمام مشترين في قطاعات خاضعة للتنظيم دون المخاطرة بادعاء مختلَق، فنود حقاً أن نسمع كيف تفكّرون في الأمر. المشكلة على مستوى الصناعة وستكون الإجابات كذلك.

تقييم التحقق

  • ✓ حدِّد أين يمكن لتواصلك بالذكاء الاصطناعي أن يُشحِن ادعاءً غير مُثبَت
  • ✓ عرِّف قواعد التأسيس والكيان والزمنية لبياناتك
  • ✓ صمِّم مستويات المخاطر وبوابة المراجعة البشرية
  • ✓ حدِّد إيصال التدقيق الذي يحتاجه فريق الامتثال لديك

ابنِ الطبقة

  • ✓ مدقِّق حتمي فوق مصادرك الحقيقية
  • ✓ بوابة سياسات مُعايَرة لقطاعاتك الخاضعة للتنظيم
  • ✓ إيصالات تدقيق موقَّعة قابلة للتنزيل لكل إرسال
  • ✓ تأليف قابل لتبديل النموذج (Anthropic، OpenAI، Gemini، Ollama)
التواصل الاجتماعي

منشور أيضًا على