ClaimLens · אישוש טענות AI

לעקוב אחר טענת ה-AI אל הראיות שלה.

Synthetic Nimbus Capital AI מפרסמת דיוק של 98% בזיהוי תוכן. בדיקת המבחן שסופקה מציגה 53%. ClaimLens שומרת יחד את המשפט, הראיות והכלל המכריע, כדי שסוקרים יוכלו לבחון את הפער.

6 דק' 56 שנ' · רשומות סינתטיות · מענים מייעצים שמורים במטמון

98% נטענו

דיוק זיהוי תוכן

הצהרת אתר Synthetic Nimbus

53% נרשמו

תוצאת בדיקת מבחן בטקסט מעורב שסופקה

מתקן בדיקה (test fixture) של Synthetic Nimbus

פער של 45 נקודות

חורג מהטולרנטיות שהוגדרה

כלל הדגמה: יותר מ-5 נקודות אחוז

סקירה של רשומות שסופקו עבור צוותי משפט, ציות, שיווק והנדסה. פסיקות ההדגמה אינן מבססות ציות משפטי ואינן מאמתות את הראיות באופן בלתי תלוי.

משפט בעל ביטחון עדיין זקוק לרשומה תואמת

טענת דיוק מחייבת צוות למשימה ולתוצאה מדודה. הצהרה על אוטונומיה מלאה כוללת גם טענה לגבי מעורבות אנושית. הסקירה נדרשת לשמר את ההתחייבויות הללו למשך זמן מספיק כדי להשוותן לרשומות שמאחורי הניסוח.

בדוגמה של Nimbus, הממצא החשוב הוא היחס שבין הדיוק המפורסם לבין בדיקת המבחן שסופקה. סוקר יכול לראות איזה משפט דורש תשומת לב ומדוע. אותה רשומה גם הופכת את השאלה הבאה לקונקרטית: האם הניסוח שגוי, האם הראיות אינן שלמות, או שמא בדיקת המבחן שביסוד הדברים דורשת חקירה?

כיצד הסקירה מגיעה להחלטה

אנו מדגימים תהליך עבודה תחום על פני שלושה גילויים סינתטיים ו-14 רשומות ראיות שסופקו. התהליך מחלץ עשר טענות, מקשר את הנושאים שלהן לרשומות ומשמר את הנימוק לכל פסיקה שהוגדרה.

01 / EXTRACT

לשמר את המשפט

פיצול משפטים דטרמיניסטי והתאמת מילות מפתח או נושאי AI בוחרים טענות מתוך הגילויים המצורפים. ניסוח המקור נותר גלוי.

02 / LINK

למצוא ביסוס שסופק

אחזור מתאים שדה נושא מובנה לרשומות בדיקת מבחן ותפעול. הוא אינו מבצע חיפוש סמנטי ואינו מאמת את מהימנותן של אותן רשומות.

03 / DECIDE

לנקוב בשם הכלל

קוד Python רגיל מחיל בדיקות מוגדרות. פער מספרי של יותר מחמש נקודות אחוז מניב CONTRADICTED בדוגמת המדד המודגמת.

שופט האישוש (Substantiation Judge) מייעץ מבלי לשנות את החלטת שער המדיניות. הבוחן האדברסרי (Adversarial Examiner) פועל על גבי טענות שאוששו בשער ועשוי להוריד את דירוגן ל-PARTIALLY_SUBSTANTIATED כאשר הוא מחזיר REFUTED; הוא אינו יכול להעלות את דירוגן. ההקלטה משמיעה מחדש מענים מייעצים שמורים במטמון בזמן שהבדיקות הדטרמיניסטיות מתבצעות. כל ארבעת מעני הבוחן השמורים במטמון מאששים את תוצאותיהם הנתמכות.

ההרצה שהושלמה יכולה לייצא חבילת אישוש בפורמט JSON‏ (JSON Substantiation Package). היא משמרת את הטענה, המקור, הפסיקה, הכלל, הנימוק ומזהי הראיות להמשך טיפול, בצירוף סיכום ומידע על גרסה. היא מצביעה על הרשומות שביסוד הדברים; היא אינה מטמיעה ארכיון ראיות מלא.

לבחון את הסיבה שמאחורי התווית

תצוגות אלו מגיעות מתוך הדגמת ClaimLens המקומית. כל חברת Nimbus, גילוי, בדיקת מבחן ורשומה תפעולית המוצגים כאן הם סינתטיים.

פירוט זיהוי תוכן ב-ClaimLens: דיוק מוצהר של 98%, תוצאת בדיקת מבחן שסופקה של 53% והחלטת מדיניות CONTRADICTED.
פירוט זיהוי התוכן משמר את משפט המקור, רשומת בדיקת המבחן והכלל המכריע. פער 45 נקודות האחוז שלו חורג מהטולרנטיות המוגדרת של חמש נקודות. תקדימי ממשק ותוויות רגולטוריות נועדו להמחשה בלבד, ואינם ממצאי תחולה משפטית. הצג בגודל מלא

סתירה מצביעה על קונפליקט

הצהרת הקליטה (onboarding) הנפרדת מבטיחה ללא אדם במעגל (no human in the loop). יומן התפעול הסינתטי שלה רושם 68% התערבות אנושית. כלל ה-no-human שהוגדר מחזיר CONTRADICTED מעל 10% התערבות; סף זה הוא בחירה לצורכי הדגמה, ולא גבול מספק מבחינה משפטית.

פער נותר פתוח לחקירה

מודל תיק ההשקעות אכן קיים, אך היומן שסופק רושם השפעה על 1.5% בלבד מהחלטות ההקצאה. השער מחזיר NEEDS_PROOF. השופט השמור במטמון מגדיר זאת כסותר, מה שממחיש מדוע חוות דעת מייעצת ותוצאה סופית זקוקות לתוויות נפרדות.

טענת תיק השקעות סינתטי ב-ClaimLens המציגה השפעה תפעולית של 1.5%, שער NEEDS_PROOF ועצה שמורה במטמון של CONTRADICTED.
תצוגת תיק ההשקעות משמרת את הנתון התפעולי המדויק של 1.5% ברשומת הראיות. ניסוח המדיניות מעגל זאת ל-2%; הפסיקה נותרת NEEDS_PROOF, בעוד שטקסט הייעוץ השמור במטמון מציין CONTRADICTED. תוויות תקדים הן הערות מתקן להמחשה, ולא ממצאים משפטיים. הצג בגודל מלא
מרשם ClaimLens המציג עשר טענות סינתטיות, שש הדורשות המשך טיפול, שתיים בסתירה וארבע מאוששות.
המרשם שומר טענות נתמכות לצד כאלו שטרם נפתרו. ארבע טענות מאוששות, שתיים בסתירה וארבע זקוקות להוכחה תחת הכללים שהוגדרו. שש דורשות המשך טיפול; אין זה מניין של הפרות מוכחות. הצג בגודל מלא

טענת זיהוי ההונאות הסינתטית נותרת מאוששת עם רמת דיוק (precision) מדווחת של 94% ורשומות בדיקת מבחן ותפעול תומכות. תוצאת מתקן נתמכת היא עדיין טענה לגבי רשומות שסופקו. על הסוקר לאמת את המדידות האמיתיות ואת הרלוונטיות שלהן לפני הסתמכות על ניסוח בפועל.

טענת זיהוי הונאות סינתטית ב-ClaimLens עם רמת דיוק של 94% שדווחה, רשומות בדיקת מבחן ותפעול, ופסיקת SUBSTANTIATED.
דוגמת זיהוי ההונאות הנתמכת משמרת הפניות הן לבדיקת המבחן והן לתפעול. טקסט בדיקת המתקן שלה מציין 94.1%, בעוד שהשדה המספרי המאוחסן הוא 94.0; הטענה שדווחה היא 94%. זוהי תמיכה תחת כללים מוגדרים, ולא ביצועים שאומתו באופן בלתי תלוי. הצג בגודל מלא

היכן תהליך עבודה זה משתלב

ClaimLens מדגימה סקירה מהטענה לרשומה. הטבלה מפרידה בין מה שתהליך העבודה המוקלט מאפשר לבחון לבין העבודה שסקירה אמיתית עדיין דורשת.

משימת סקירהמה שהדגמה זו מספקתמה שנותר מחוצה לה
למצוא את ההתחייבותמשפט המקושר למקור שסופק עבורוקליטת מסמכים כללית וגילוי טענות מלא
להשוות את הביסוסקישור רשומות מבוסס-נושא ובדיקות מוגדרותאימות מהימנות ראיות והערכת בדיקת מבחן בלתי תלויה
להבין את התוצאהפסיקה, כלל מכריע ונימוקייעוץ משפטי או אישור רגולטורי
להעביר הלאה את הסקירהחבילת JSON עם מזהי ראיותארכיון ראיות מלא או שרשרת משמורת מוגנת משיבוש

מה שהדגמה זו אינה עושה

זוהי הדגמה מקומית המשתמשת בנתונים סינתטיים מצורפים. אין בה סורק אתרים או דיווחים חי, העלאת מסמכים שרירותית, אינטגרציית AIBOM או CI/CD לסביבת ייצור, אחזור סמנטי, הערכה משפטית אוטונומית או ייצוא קלסר HTML. הספים שלה אינם מבססים מובהקות סטטיסטית או דיות משפטית. דף זה מסביר את תהליך העבודה המוקלט; הוא אינו מעניק גישה לאפליקציה המקומית.

שאלות שצוות סקירה צריך לשאול

האם זה יכול לומר לנו אם טענות ה-AI שלנו עומדות בדרישות החוק?

ClaimLens משווה בין ניסוחים שסופקו לבין רשומות טכניות באמצעות כללי הדגמה שהוגדרו. תוצאה מאוששת אינה מהווה הכשר משפטי, והתוויות הרגולטוריות המוצגות בממשק הן תוויות ניתוב להמחשה בלבד. סקירה אנושית ואימות של הרשומות שביסוד הדברים נותרים הכרחיים.

האם נוכל להעלות מסמכים משלנו או לחבר את אתר האינטרנט שלנו?

הדגמה זו משתמשת בסט הנתונים הסינתטי המצורף של Nimbus. היא אינה מקבלת העלאות מסמכים שרירותיות ואינה סורקת אתרי אינטרנט, דיווחים רגולטוריים או מערכות פנימיות. הדף מציג את תהליך העבודה המוקלט ואת תצוגות הראיות שלו.

אילו ראיות הסקירה בודקת בפועל?

ההדגמה מקשרת משפטים שחולצו לרשומות טכניות שסופקו באמצעות שדה נושא מובנה. רשומות אלו כוללות בדיקות מבחן ויומני תפעול. הבדיקות משוות ערכים ותנאים שהוגדרו; הן אינן מאמתות את מהימנות הרשומות ואינן מעריכות באופן בלתי תלוי את מתודולוגיית בדיקת המבחן.

האם ה-AI מקבל את ההחלטה הסופית?

שופט האישוש (Substantiation Judge) מספק ייעוץ מבלי לשנות את החלטת שער המדיניות. הבוחן האדברסרי (Adversarial Examiner) יכול להוריד בדירוג טענה שאוששה בשער כאשר הוא מחזיר הזמה (refutation), אך אינו יכול להעלות טענה בדירוג. בהקלטה זו, מענים מייעצים שמורים במטמון וכל ארבעת מעני הבוחן מאששים את התוצאות הנתמכות.

מדוע טענה יכולה להזדקק להוכחה גם כאשר המודל קיים?

רשומת מודל מבססת כי רכיב מסוים מתועד, בעוד שטענה תפעולית זקוקה גם לראיות לגבי מה שהוא עושה בפועל. בדוגמת תיק ההשקעות הסינתטי, היומן שסופק רושם השפעה על 1.5% בלבד מהחלטות ההקצאה. השער שהוגדר מחזיר NEEDS_PROOF, ובכך משמר פער זה לבחינה.

מה מקבלים הסוקרים בחבילה המיוצאת?

כפתור ה-Export בדפדפן שומר חבילת JSON מתוך ההרצה שהושלמה, עם כל טענה, מקור, פסיקה, כלל מכריע, נימוק ומזהי ראיות. היא כוללת גם סיכום, גרסת מנוע וחותמת זמן של ההפקה. היא אינה מטמיעה רשומות ראיות מלאות, תמלילי ייעוץ או שרשרת משמורת מוגנת משיבוש.

מחקר טכני

גלו מחקר קשור להקשר רחב יותר על הדגמה זו.

להביא את הטענה ואת הראיות שלה לאותה הסקירה

שוחחו עם Veriprajna על תהליך עבודה לאישוש טענות.

נוכל לשוחח על הרשומות, גבולות הסקירה וההחלטות האנושיות שהצוות שלכם זקוק להם לפני הגדרת יישום.

תיחום היקף הסקירה

  • ✓ זהו את הניסוח הנמצא בבדיקה
  • ✓ מפו את הראיות שסופקו
  • ✓ הגדירו בשם שאלות שטרם נפתרו
  • ✓ הסכימו על תחומי האחריות של סקירה אנושית

הגדרת היישום

  • ✓ דונו בקליטת מקורות ורשומות
  • ✓ הגדירו גבולות כללים הולמים
  • ✓ תכננו הסברים המיועדים לסוקרים
  • ✓ אפיינו דרישות להעברת ראיות הלאה