שער המקוריות סביב מנוע השיחה שלכם

ציטוט בדוי נתפס ומוחזק לפני שקורא רואה אותו בכלל.

ברגע שמוציא לאור עונה לקורא מתוך הארכיון שלו עצמו, הוא בעלים של התשובה, ואין מגן Section 230 למה שהמערכת שלכם מייצרת. The Standards Desk היא השכבה סביב מנוע השיחה שלכם: היא מעגנת כל משפט שמפורסם לקטע ארכיון אמיתי, מאמתת כל ציטוט מילה במילה, ומנתבת כל דבר שאינה יכולה להוכיח לשולחן התקנים במקום לקוראים, עם קבלת ביקורת בלחיצה אחת לכל תשובה.

0

תשובות לא מעוגנות שיכולות לעבור אישור אוטומטי

אינווריאנט שער דטרמיניסטי, נבדק ביחידה

6/10

פורסמו בלי מגע אנושי בסט ההערכה

3 אושרו אוטומטית ועוד 3 עם גיזום משפטים (תוצאת סט ההערכה הזה)

200

כתבות ארכיון סינתטיות, 2014 עד 2025

קורפוס The Riverbend Ledger, סינתטי במלואו, 13 שנים

זו הדגמה ניתנת-להרצה. The Riverbend Ledger, ראש העיר רייס וכל כתבה מסומנים כסינתטיים, ואין חשבונות חיים. שער המדיניות הדטרמיניסטי, כלל הציטוט מילה במילה, ו-13 הבדיקות שעוברות הם אמיתיים.

מוציאים לאור נדחפים לענות לקוראים, ולהיות בעלים של כל תשובה

נפח בלי אימות הוא בדיוק הדרך שבה כותרת משגרת ציטוט שמעולם לא נאמר.

החיפוש כבר אינו שולח קוראים לכתבה. סקירות AI מופיעות כעת ב-48% מחיפושי Google (theStacc דרך Search Engine Land, 2026), תנועת החיפוש של מוציאים לאור ירדה ב-33% משנה לשנה עד נובמבר 2025 עם ירידה נוספת של כ-43% הצפויה עד 2029 (Reuters Institute Trends 2026), וה-Daily Mail מדד ירידה של 89% בשיעור ההקלקה בדסקטופ כאשר סקירת AI הופיעה מעל הקישור שלו. הלחץ הוא לענות לקוראים ישירות, מהארכיון, תחת הכותרת.

הצרה מתחילה ברגע שאתם מייצרים את התשובה הזו. אין מגן Section 230 לתוכן שהמערכת שלכם עצמה מייצרת מהארכיון שלכם עצמכם: אתם בעלים שלו. ה-Washington Post הפך זאת למוחשי כאשר פרויקט Ask The Post AI שלו שיגר פודקאסט בסוף 2025 שהמציא ציטוטים, ייחס מקורות באופן שגוי, והכניס פרשנות כעמדת המערכת של העיתון, כישלון שעלה על פני השטח כשדלף ה-Slack של עורך התקנים (Semafor, 2025). שורש הכשל הטכני היה שלב חסר של אימות ציטוט.

מודל חזק יותר אינו מתקן זאת. מנוע המענה הוא המקום הלא נכון לחפש, כי בית משפט אינו מתעניין עד כמה המודל היה בטוח בעצמו; הוא מתעניין אם הציטוט היה אמיתי ואם הארכיון באמת אמר זאת. התשובה העמידה היא שכבה נפרדת שמעגנת כל טענה בארכיון, אוכפת ציטוטים מילה במילה, וכנה לגבי מה שאינה יכולה לתמוך.

כיצד The Standards Desk עובד

החלקים שנושאים את הערבות הם Python דטרמיניסטי. הסוכנים מייעצים. השער מחליט.

שאלת קורא רצה בצינור בן שישה שלבים, חי ולא-מקוון: מתכנן טמפורלי מפרק אותה לחלונות זמן, מאחזר היברידי (BM25 ועוד הטמעה מקומית) שולף קטעי מועמדים, רצפת כיסוי נמנעת אם דבר אינו מפנה את סף הציון, מנוע המענה כותב תשובה מעוגנת בקפדנות עם ציטוטי [S#] מוטמעים, בדיקת ציטוט מילה במילה דטרמיניסטית מתאימה כל מחרוזת מצוטטת מול המקור שצוטט, בקר מקוריות מדרג כל טענה, ושער מדיניות דטרמיניסטי מוציא החלטה אחת. כל שלב נדלק בקונסולה שמשדרת את ההשהיה שלו עצמו, כך שדבר אינו קופסה שחורה.

ווידג'ט הקורא של The Riverbend Ledger עם קונסולת צינור בת שישה שלבים: מתכנן טמפורלי פורק ל-3 חלונות זמן, אחזור ארכיון של 10 קטעים, מנוע מענה מעוגן עם 6 טענות שנוסחו, בדיקת ציטוט מילה במילה הקוראת 5 מתוך 5 ציטוטים מילה במילה, בקר מקוריות 6 מתוך 6 טענות נתמכות, ושער מדיניות הקורא Auto clear, המסתיים בבאנר AUTO-CLEARED FOR PUBLICATION.
הצינור בן ששת השלבים רץ לכל שאלה: תכנון, אחזור, עיגון, בדיקת ציטוט מילה במילה, בקרת מקוריות, שער מדיניות. סוכנים מייעצים, קוד מחליט.

שני מנועים, מפוצלים במכוון

שלושה סוכנים שמייעצים

המתכנן הטמפורלי, מנוע המענה ובקר המקוריות הם שלושה סוכני Pydantic AI עם פסקי דין מטיפוס לכל טענה. הם ניתנים להחלפת ספק (ברירת מחדל claude-opus-4-8), ואותו צינור רץ מקצה לקצה בלי מפתח דרך stub דטרמיניסטי לא-מקוון או גשר Claude מקומי ללא מפתח, כך שהשער נשאר פעיל בשני האופנים.

קוד שמחליט

גבול האמון יושב מחוץ לסוכנים. כלל הציטוט מילה במילה, התאמת מחרוזת מדויקת מול טקסט המקור שצוטט, ושער המדיניות הם Python רגיל. בטיחות-פרסום לעולם אינה תלויה בדיווח עצמי של LLM, כי קונה זקוק להחלטה ניתנת-להוכחה וניתנת-לביקורת, לא לאמירת-כן של מודל.

אחת מארבע החלטות שער לכל תשובה

כל תשובה מגיעה בדיוק להחלטה אחת. השתיים שמפרסמות עושות זאת רק כשהתשובה מעוגנת במלואה; השתיים שאינן עושות זאת כנות לגבי הסיבה.

החלטת שער מה זה אומר נקבע על ידי
AUTO-CLEARED FOR PUBLICATION כל טענה מעוגנת, כל ציטוט מילה במילה, כיסוי מעל רצפת הציון שער מדיניות דטרמיניסטי, בלי מגע אנושי
PUBLISHED AFTER PRUNING משפט לא נתמך מושמט והתשובה המעוגנת שנותרה עוברת דטרמיניסטי, נספר כפורסם בלי מגע אנושי
HELD FOR STANDARDS-DESK REVIEW ציטוט בדוי או שאינו מילה במילה, או טענה לא נתמכת דטרמיניסטי, חסום מקוראים ומנותב לתור
OUTSIDE COVERAGE האחזור אינו מפנה דבר מעל רצפת הציון דטרמיניסטי, הימנעות כנה במקום ניחוש

אינווריאנט השער וקבלת הביקורת

הערבות הדטרמיניסטית האחת, שנבדקת ביחידה, היא אינווריאנט השער: אף תשובה עם ציטוט שאינו ניתן לאימות או טענה לא נתמכת אינה מאושרת אוטומטית לעולם. מעל זאת, לחיצה אחת מייצאת קבלת ביקורת JSON לכל תשובה, המתעדת את השאילתה, תת-השאלות המפורקות, המקורות שאוחזרו עם מזהה כתבה, תאריך ו-url, התשובה שפורסמה, פסקי דין לכל טענה עם קטעי ראיות, בדיקות מילה במילה לכל ציטוט, החלטת השער והסיבה, המנוע והמודל, וחותמת זמן UTC. מתג חירום בלוח המחוונים משהה את ווידג'ט הקורא בעוד שה-back end נשאר חי.

שלוש שאלות קורא, שלוש תוצאות כנות

כל תמונה למטה היא צילום מסך של האפליקציה הרצה, שהופק על ידי הצינור החי מעל ארכיון The Riverbend Ledger הסינתטי. המוציא לאור, ראש העיר והכתבות מסומנים כסינתטיים.

שאלת 13 שנים שווידג'ט vector-RAG אינו יכול לענות, אושרה לפרסום

כשנשאל כיצד השתנתה עמדת ראש העיר רייס לגבי תקנת הצפיפות במרכז העיר מ-2014 עד 2025, המתכנן הטמפורלי מפצל את השאלה על פני חלונות זמן ומנוע המענה מרכיב נרטיב כרונולוגי, מ-"לא אמיר את אופיו של Riverbend במגדלים" ב-2014 עד "שיניתי את דעתי, והייתי עושה זאת שוב" ב-2025. כל משפט נושא ציטוט [S#] מוטמע, כל ציטוט עובר את בדיקת מילה במילה, הכיסוי מפנה את הרצפה, והשער קורא AUTO-CLEARED FOR PUBLICATION. זו הסינתזה האורכית שווידג'ט של קטע יחיד אינו יכול לייצר.

ווידג'ט הקורא מציג תשובה כרונולוגית, מצוטטת במלואה, העוקבת אחר עמדתו המשתנה של ראש העיר רייס מ-2014 עד 2025, כל משפט נושא ציטוטי מספר-S מוטמעים ולוח Grounded To של מקורות מתוארכים, תחת באנר ירוק AUTO-CLEARED FOR PUBLICATION.
תשובה כרונולוגית, מצוטטת במלואה, שסונתזה על פני 13 שנים, אושרה אוטומטית כי כל טענה מעוגנת וכל ציטוט מילה במילה.

כל משפט מתחקה לקטע ארכיון מתוארך

לוח Grounded To אינו קישוט. כל [S#] נפתר לקטע הארכיון האמיתי שממנו נשאב, עם התאריך והפניית הארכיון שלו, כך שעורך יכול לקרוא את המקור מאחורי כל משפט לפני שהוא מתפרסם. הציטוט מ-2019, למשל, נפתח לכתבה האמיתית שבה רייס הפכה את עמדתה הקודמת ואמרה "מרכז העיר שלנו חייב לגדול למעלה, לא רק החוצה." עיגון הוא מה שהופך את התשובה לניתנת-להגנה, לא רק שוטפת.

לוח Grounded To ומקורות של ווידג'ט הקורא, עם ציטוט S1 מורחב לחשוף את קטע הארכיון המלא שבו ראש העיר רייס תמכה במדד הצפיפות במרכז העיר שהתנגדה לו, מתוארך 2019-06-24 עם הפניית ארכיון.
כל ציטוט נפתח לקטע הארכיון האמיתי, המתוארך שלו. כל טענה שמפורסמת מעוגנת, לא רק סבירה.

מלכודת הציטוט: ציטוט בדוי שנתפס והוחזק מקוראים

כשנשאל מה הבטיח ראש העיר רייס ליזמים לגבי המגרש על גדות הנהר, הארכיון אינו מתעד שום הבטחה כזו (כתבה אחת מציינת שהמגרש "לא היה על סדר היום"). מנוע המענה בודה בדיוק כמו שמודל RAG רגיל היה עושה, וממציא את השורה "אנחנו מחויבים לקדם את המגרש על גדות הנהר עבור היזמים." בדיקת הציטוט מילה במילה מוצאת שהמחרוזת הזו בשום מקור שצוטט, כיסוי עיגון-הטענות נוחת ב-50%, והשער מחזיק את כל התשובה. הקורא רואה רק HELD FOR STANDARDS-DESK REVIEW, לא מוצג לקוראים. זה כישלון ה-Washington Post, שנמנע לפני הפרסום.

ווידג'ט הקורא לשאלת המגרש על גדות הנהר, עם שער המדיניות קורא Review ובאנר אדום HELD FOR STANDARDS-DESK REVIEW, לא מוצג לקוראים, התשובה שנוסחה מוחזקת, וכפתור Export Audit Receipt JSON.
ציטוט בדוי דוחף את השער ל-Review, והתשובה מוחזקת מקוראים במקום להתפרסם ולהיות מתוקנת מאוחר יותר.

מה שולחן התקנים רואה: מקוריות לכל טענה והציטוט המסומן באדום

בלוח המחוונים של The Standards Desk, התשובה המוחזקת מבוקרת טענה אחר טענה: טענה אחת Supported, אחת רק Partial, והציטוט הפוגע מסומן באדום כ-NOT verbatim באף מקור שצוטט (בדוי או מצוטט באופן שגוי). החלטת השער וכיסוי ה-50% שלה מתועדים, והתשובה נוחתת בתור הבדיקה עם הטיוטה המוחזקת שלה וקבלה JSON ניתנת-לייצוא. הקטע הפוגע מודגש כך שעורך יודע בדיוק מה לתקן, ודבר לא הגיע לקורא בינתיים.

בקרת המקוריות בלוח המחוונים של The Standards Desk לתשובת המגרש על גדות הנהר: החלטת שער של review בכיסוי עיגון-טענות של 50%, מקוריות לכל טענה מסומנת Supported ו-Partial, בדיקת ציטוט מילה במילה המסמנת באדום ציטוט שהוא NOT verbatim באף מקור, ותור בדיקה עם טיוטה מוחזקת וקישור Receipt JSON.
לוח המחוונים מציג מדוע התשובה הוחזקה: פסקי דין לכל טענה, בדיקת הציטוט מילה במילה באדום, ותור הבדיקה עם קבלה ניתנת-לייצוא.

כשאין בארכיון תשובה, הוא נמנע במקום לנחש

כשנשאל על תקציב התחבורה הציבורית של Riverbend ל-2026, האחזור אינו מוצא דבר מעל רצפת הציון (רלוונטיות עליונה 0.12 מול רצפה של 0.1784), כך שהצינור מדלג על מנוע המענה לחלוטין והשער מחזיר OUTSIDE COVERAGE. לקורא נאמר בבירור, "אין לי בארכיון הזה דבר שעונה על זה," במקום לקבל ניחוש בטוח בעצמו. הימנעות כנה היא תכונה של השער, לא כישלון של המודל.

ווידג'ט הקורא לשאלת תקציב התחבורה ל-2026, קונסולת הצינור מציגה את מנוע המענה המעוגן, בדיקת הציטוט מילה במילה ובקר המקוריות כולם מדולגים, שער המדיניות קורא Outside coverage עם רלוונטיות 0.12 מתחת לרצפה 0.1784, והודעת OUTSIDE COVERAGE, not guessing לקורא.
דבר אינו מפנה את רצפת הציון, כך שמנוע המענה מדולג והקורא מקבל הימנעות כנה במקום בלוף.

ממשל ששולחן התקנים יכול להפעיל: מתג חירום

מתג אחד משהה את ווידג'ט הקורא בעוד שה-back end נשאר חי, כך שעורך יכול לעצור תשובות קוראים חדשות מיד במהלך סיפור שובר או תקריות בלי להוריד את הארכיון. בשילוב עם קבלת הביקורת לכל תשובה, זה משטח הממשל התפעולי ששולחן תקנים באמת זקוק לו: השהו את החזית, שמרו את הראיות, בדקו את התור.

האפליקציה המלאה עם כותרת Veriprajna Building True Intelligence, תיבת הסימון Reader widget paused מופעלת, והודעת ענבר הקוראת Paused by the standards desk, the reader widget is offline, new reader questions are not being answered, בעוד שהצינור וקבלת הביקורת נשארים גלויים.
מתג החירום משהה תשובות קוראים מיד בעוד שה-back end ושביל הביקורת נשארים חיים.

ווידג'ט RAG רגיל מול The Standards Desk

The Standards Desk אינו מנוע שיחה נוסף. זו השכבה שמחליטה מה בטוח לפרסם תחת הכותרת שלכם.

ממד ווידג'ט vector-RAG רגיל שער המקוריות של The Standards Desk
ציטוט בדוי מתפרסם תחת הכותרת שלכם, בלי להיתפס נתפס בהתאמת מחרוזת מילה במילה, מוחזק מקוראים
טענה לא נתמכת מפורסמת כעובדה נגזמת, או כל התשובה מוחזקת, עם כיסוי מדוד
שאלה שחוצה שנים תשובת קטע יחיד או כלום מתוכננת על פני חלונות זמן, מורכבת כרונולוגית עם ציטוטים
כלום בארכיון ניחוש בטוח בעצמו OUTSIDE COVERAGE, הימנעות כנה
מי מחליט לפרסם הביטחון העצמי של המודל שער מדיניות דטרמיניסטי ב-Python רגיל
שביל ביקורת אין קבלת JSON בלחיצה אחת לכל תשובה

מה שהדגמה זו אינה עושה

  • ✓ זה אינו צ'אטבוט, מנוע חיפוש, או מתחרה ל-Google, Perplexity, FT או Bloomberg. זה שער מקוריות סביב מנוע השיחה של מוציא לאור עצמו.
  • ✓ זה אינו טוען לסינתזה מושלמת או שלעולם אינו הוזה. מנוע המענה יכול לבדות, ומלכודת הציטוט מראה אותו עושה בדיוק זאת. הערך הוא שהשער תופס זאת לפני שקורא רואה זאת.
  • ✓ נתוני ההערכה (10 מתוך 10 דליים, 6 מתוך 10 פורסמו, 200 כתבות, 13 בדיקות) הם היקף ההדגמה הבנויה הזו על סט מתויג של 10 שאילתות, לא ערבויות לעולם פתוח. רק אינווריאנט השער, אף תשובה לא מעוגנת אינה מאושרת אוטומטית, הוא ערבות דטרמיניסטית שנבדקת ביחידה. הפיצול 60 / 20 / 20 הוא תוצאת סט ההערכה הזה, לא אוניברסלי.
  • ✓ The Riverbend Ledger, ראש העיר רייס, התקנה וכל כתבה מסומנים כסינתטיים. אין נתוני מוציא לאור אמיתיים ואין חשבונות חיים, וציטוטי הקורפוס הם מקור האמת לבדיקת מילה במילה.
  • ✓ חלק מהחלקים מבוימים ומכונים כך: פתרון ישויות לייצור הוא fixture שנפתר מראש, גרף הידע הטמפורלי מודגם עם תגי תאריך וישות בתוספת המתכנן, סנכרון CMS הוא fixture של Arc XP, ומתג החירום מגבה דגל מקומי. נדחה: קליטת OCR ומיקרופילם, GraphRAG מלא על ארכיון חי, לוח הרישוי וההכנסות, תמחור שכבת Intelligence, תשובות קול, והקשחת הטמעה באתר.
  • ✓ אין לקוחות, המלצות, ROI או נתוני חיסכון בדולרים. אף אחד מאלה אינו קיים עדיין. זה מוכיח את המנגנון; זו אינה פריסה.

שאלות שמוציאים לאור באמת שואלים

האם זה צ'אטבוט או מנוע חיפוש לארכיון שלנו?

אף אחד מהם. The Standards Desk הוא שער מקוריות שעוטף את מנוע השיחה שאתם כבר מריצים על הארכיון שלכם. הוא אינו מתחרה ב-Google, Perplexity או בתיבת חיפוש של חדר חדשות. תפקידו להחליט, באופן דטרמיניסטי, אילו תשובות שנוצרו בטוחות לפרסום תחת הכותרת שלכם, אילו מקבלות משפט לא נתמך שנגזם, ואילו מוחזקות לאדם, ולהשאיר קבלת ביקורת בכל מקרה.

המודל עדיין יכול להמציא דברים. מה בדיוק זה עוצר?

מנוע המענה יכול ועושה בדיה. דוגמת מלכודת-הציטוט שלנו מראה אותו ממציא ציטוט שווידג'ט RAG רגיל היה מפרסם. מה ש-The Standards Desk עוצר הוא שהתשובה הזו תגיע לקורא. כל ציטוט מותאם מילה במילה מול המקור שצוטט וכל טענה מדורגת מול קטע אמיתי, כך שציטוט בדוי או טענה לא נתמכת נתפסים ומנותבים לשולחן התקנים לפני הפרסום ולא אחרי תיקון.

נהיה בעלים של כל מה שה-AI שלנו מפרסם תחת הכותרת שלנו. כיצד זה מפחית את הסיכון הזה?

אין מגן Section 230 לתוכן שהמערכת שלכם עצמה מייצרת מהארכיון שלכם עצמכם, כך שציטוט בדוי הוא האחריות שלכם, לא של צד שלישי. השער לעולם אינו מאשר אוטומטית תשובה שיש בה ציטוט שאינו ניתן לאימות או טענה לא נתמכת, והוא מייצא קבלת ביקורת JSON המתעדת כל טענה, המקור שצוטט ופסק הדין שלה, וכל בדיקת ציטוט מילה במילה. אתם מפרסמים תשובה שאתם יכולים להוכיח, או שמעולם לא פרסמתם אותה.

האם מודל טוב יותר פשוט יהפוך זאת למיותר?

לא, כי בטוח-לפרסם היא תכונת ממשל, לא תכונת מודל. תובע לשון הרע אינו מתעניין עד כמה המודל היה בטוח בעצמו; הוא מתעניין אם הציטוט היה אמיתי ואם הארכיון באמת אמר זאת. הערך העמיד, עיגון כל טענה, אכיפת ציטוטים מילה במילה, והימנעות כנה, מחזיק בכל איכות מודל, ולכן כלל הציטוט מילה במילה ושער המדיניות חיים ב-Python רגיל מחוץ לסוכנים.

האם זה רץ על ארכיון עיתון אמיתי, או שזו הדגמה?

זו הדגמה ניתנת-להרצה שמוכיחה את המנגנון, לא פריסה. The Riverbend Ledger, ראש העיר רייס וכל 200 הכתבות מ-2014 עד 2025 מסומנים כסינתטיים, בלי נתוני מוציא לאור אמיתיים ובלי חשבונות חיים. מה שאמיתי: השער הדטרמיניסטי, כלל הציטוט מילה במילה, התכנון הטמפורלי, האחזור, ו-13 הבדיקות שעוברות רצים בדיוק כפי שמוצג, במצב לא-מקוון במלואו. פתרון ישויות לייצור, גרף הידע הטמפורלי וסנכרון CMS מבוימים כ-fixtures ומכונים כך.

מה יש בפועל בקבלת הביקורת, ובאיזו מהירות אפשר למשוך אחת?

לחיצה אחת מייצאת קבלת JSON לכל תשובה: השאילתה, תת-השאלות המפורקות, המקורות שאוחזרו עם מזהה כתבה, תאריך ו-url, התשובה שפורסמה, רשומה לכל טענה של הטענה, המקור שצוטט, פסק הדין וקטע הראיות, רשומה לכל ציטוט של הציטוט, ההתאמה מילה במילה והמקור שלו, החלטת השער והסיבה, המנוע והמודל, וחותמת זמן UTC. מה שביקורת ידנית של מפגש עשויה לקחת שעה לשחזר מיוצא בשניות.

מחקר טכני

המחקר מאחורי ההדגמה הזו — הארכיטקטורה, עיצוב האימות, והמתווה הארגוני.

שמים את הארכיון שלכם מול קוראים עם AI?

שער המקוריות הוא החלק הקשה. אנחנו בונים אותו.

אם חדר החדשות שלכם עובד על איך לענות לקוראים מהארכיון בלי לפרסם ציטוט שמעולם לא נאמר, נשמח באמת לשמוע איך אתם חושבים על זה. הבעיה היא כלל-תעשייתית והתשובות יהיו גם כן.

הערכת מקוריות

  • ✓ מיפוי היכן ה-AI השיחתי שלכם יכול לפרסם ציטוט שאינו ניתן לאימות
  • ✓ הגדרת כללי העיגון, הציטוט מילה במילה והכיסוי לארכיון שלכם
  • ✓ עיצוב ניתוב הבדיקה של שולחן התקנים וספי ההימנעות
  • ✓ פירוט קבלת הביקורת שצוותי העריכה והמשפט שלכם זקוקים לה

בניית השכבה

  • ✓ שער מדיניות דטרמיניסטי וכלל ציטוט מילה במילה ב-Python רגיל
  • ✓ תשובות מעוגנות ואורכיות עם מקוריות לכל טענה
  • ✓ הימנעות כנה ותור בדיקה של שולחן התקנים
  • ✓ ניתן-להחלפת-מודל, עם קבלת ביקורת JSON לכל תשובה
רשתות חברתיות

פורסם גם ב