De herkomstpoort rond uw conversationele engine
Zodra een uitgever een lezer antwoordt vanuit het eigen archief, is de uitgever eigenaar van het antwoord, en er is geen Section 230-bescherming voor wat uw systeem genereert. The Standards Desk is de laag rond uw conversationele engine: het verankert elke gepubliceerde zin in een echt archieffragment, verifieert elk citaat woordelijk, en stuurt alles wat het niet kan bewijzen door naar de standaardenredactie in plaats van naar lezers, met een auditbewijs per antwoord in één klik.
0
Niet-verankerde antwoorden die automatisch kunnen worden vrijgegeven
Deterministische poortinvariant, unit-getest
6/10
Gepubliceerd zonder menselijke tussenkomst op de evaluatieset
3 automatisch vrijgegeven plus 3 zinnen gesnoeid (het resultaat van deze evaluatieset)
200
Synthetische archiefartikelen, 2014 tot 2025
Het Riverbend Ledger-corpus, volledig synthetisch, 13 jaar
Dit is een uitvoerbare demo. The Riverbend Ledger, Mayor Reyes en elk artikel zijn als synthetisch gelabeld, en er zijn geen live accounts. De deterministische beleidspoort, de woordelijke-citaatregel en de 13 geslaagde tests zijn echt.
Volume zonder verificatie is precies hoe een vlag een citaat publiceert dat nooit is uitgesproken.
Zoekmachines sturen lezers niet langer naar het artikel. AI Overviews verschijnen nu bij 48% van de Google-zoekopdrachten (theStacc via Search Engine Land, 2026), het zoekverkeer van uitgevers daalde 33% jaar-op-jaar tot november 2025, met een verdere daling van bijna 43% verwacht tegen 2029 (Reuters Institute Trends 2026), en de Daily Mail mat de desktop-doorklikratio 89% lager wanneer een AI Overview boven de link verscheen. De druk is om lezers rechtstreeks te beantwoorden, vanuit het archief, onder het vlag.
Het probleem begint op het moment dat u dat antwoord genereert. Er is geen Section 230-bescherming voor content die uw eigen systeem produceert vanuit uw eigen archief: u bent eigenaar ervan. The Washington Post maakte dat concreet toen het Ask The Post AI-project eind 2025 een podcast publiceerde die citaten verzon, bronnen verkeerd toeschreef en commentaar invoegde als de redactionele positie van de krant, een falen dat aan het licht kwam toen de Slack van de standaardenredacteur uitlekte (Semafor, 2025). De technische oorzaak was een ontbrekende citaatverificatiestap.
Een sterker model lost dit niet op. De opsteller is de verkeerde plek om te zoeken, omdat een rechtbank niet geïnteresseerd is in hoe zeker het model was; het gaat erom of het citaat echt was en of het archief het daadwerkelijk zei. Het duurzame antwoord is een aparte laag die elke claim in het archief verankert, citaten woordelijk afdwingt, en eerlijk is over wat het niet kan onderbouwen.
De onderdelen die de garantie dragen zijn deterministische Python. De agents adviseren. De poort beslist.
Een lezersvraag doorloopt een pijplijn van zes stadia, live en offline: een temporele planner splitst die op in tijdvensters, een hybride retriever (BM25 plus een lokale embedding) haalt kandidaatpassages op, een dekkingsdrempel onthoudt zich als niets de scoredrempel haalt, de antwoordmodule schrijft een strikt verankerd antwoord met inline [S#]-citaten, een deterministische woordelijke-citaattoets toetst elke geciteerde string aan de aangehaalde bron, een herkomstauditor beoordeelt elke claim, en een deterministische beleidspoort geeft één beslissing. Elk stadium licht op in een console die de eigen latentie streamt, zodat niets een black box is.
De temporele planner, de antwoordmodule en de herkomstauditor zijn drie Pydantic AI-agents met getypeerde oordelen per claim. Ze zijn van provider verwisselbaar (standaard claude-opus-4-8), en dezelfde pijplijn draait van begin tot eind zonder sleutel via een deterministische offline stub of een sleutelloze lokale Claude-brug, zodat de poort in beide gevallen functioneel blijft.
De vertrouwensgrens ligt buiten de agents. De woordelijke-citaatregel, een exacte stringmatch tegen de aangehaalde brontekst, en de beleidspoort zijn gewone Python. Publicatieveiligheid hangt nooit af van de zelfrapportage van een LLM, omdat een koper een bewijsbare, auditeerbare beslissing nodig heeft, geen woord van een model.
Elk antwoord lost op tot precies één beslissing. De twee die publiceren, doen dat alleen wanneer het antwoord volledig is verankerd; de twee die dat niet doen, zijn eerlijk over waarom.
| Poortbeslissing | Wat het betekent | Beslist door |
|---|---|---|
| AUTO-CLEARED FOR PUBLICATION | Elke claim verankerd, elk citaat woordelijk, dekking boven de drempel | Deterministische beleidspoort, geen menselijke tussenkomst |
| PUBLISHED AFTER PRUNING | Een niet-onderbouwde zin wordt weggelaten en het resterende verankerde antwoord haalt de drempel | Deterministisch, telt als gepubliceerd zonder menselijke tussenkomst |
| HELD FOR STANDARDS-DESK REVIEW | Een gefabriceerd of niet-woordelijk citaat, of een niet-onderbouwde claim | Deterministisch, geblokkeerd voor lezers en doorgestuurd naar de wachtrij |
| OUTSIDE COVERAGE | Opvraging haalt niets boven de scoredrempel | Deterministisch, eerlijke onthouding in plaats van een gok |
De ene deterministische, unit-geteste garantie is de poortinvariant: geen enkel antwoord met een niet-verifieerbaar citaat of een niet-onderbouwde claim wordt ooit automatisch vrijgegeven. Daarbovenop exporteert één klik een JSON-auditbewijs per antwoord, met vastlegging van de query, de opgesplitste deelvragen, de opgehaalde bronnen met article id, date en url, het gepubliceerde antwoord, oordelen per claim met bewijspassages, woordelijke toetsen per citaat, de poortbeslissing en reden, de engine en het model, en een UTC-tijdstempel. Een noodstop op het dashboard pauzeert de lezerswidget terwijl de backend live blijft.
Elk beeld hieronder is een screenshot van de draaiende app, geproduceerd door de live pijplijn over het synthetische Riverbend Ledger-archief. De uitgever, de burgemeester en de artikelen zijn als synthetisch gelabeld.
Gevraagd hoe het standpunt van Mayor Reyes over de downtown density ordinance veranderde van 2014 tot 2025, splitst de temporele planner de vraag over tijdvensters en stelt de antwoordmodule een chronologisch verhaal samen, van "I will not trade Riverbend's character for towers" in 2014 tot "I changed my mind, and I'd do it again" in 2025. Elke zin draagt een inline [S#]-citaat, elk citaat doorstaat de woordelijke toets, de dekking haalt de drempel, en de poort leest AUTO-CLEARED FOR PUBLICATION. Dit is de longitudinale synthese die een widget voor één passage niet kan produceren.
Het Grounded To-paneel is geen decoratie. Elk [S#] verwijst naar het echte archieffragment waaruit het is gehaald, met datum en archiefreferentie, zodat een redacteur de bron achter elke zin kan lezen voordat die wordt gepubliceerd. Het citaat uit 2019 opent bijvoorbeeld naar het daadwerkelijke artikel waarin Reyes haar eerdere standpunt herzag en zei "Our downtown has to grow up, not just out." Verankering is wat het antwoord verdedigbaar maakt, niet slechts vloeiend.
Gevraagd wat Mayor Reyes ontwikkelaars beloofde over het riverfront parcel, registreert het archief geen dergelijke belofte (één artikel merkt op dat het perceel "was not on the agenda"). De antwoordmodule confabuleert precies zoals een vanilla RAG-model zou doen, en verzint de zin "We're committed to moving riverfront parcel forward for the developers." De woordelijke-citaattoets vindt die string in geen enkele aangehaalde bron, de claimverankeringsdekking landt op 50%, en de poort houdt het hele antwoord vast. De lezer ziet alleen HELD FOR STANDARDS-DESK REVIEW, not shown to readers. Dit is het falen van The Washington Post, voorkomen vóór publicatie.
Op het dashboard van The Standards Desk wordt het vastgehouden antwoord claim voor claim geaudit: één claim Supported, één slechts Partial, en het gewraakte citaat rood gemarkeerd als NOT verbatim in any cited source (gefabriceerd of verkeerd geciteerd). De poortbeslissing en de dekking van 50% worden vastgelegd, en het antwoord belandt in de beoordelingswachtrij met het vastgehouden concept en een exporteerbaar JSON-bewijs. Het gewraakte fragment is gemarkeerd zodat een redacteur precies weet wat te herstellen, en in de tussentijd bereikte niets een lezer.
Gevraagd naar het openbaarvervoersbudget van Riverbend voor 2026, vindt de opvraging niets boven de scoredrempel (hoogste relevantie 0.12 tegen een drempel van 0.1784), dus slaat de pijplijn de antwoordmodule volledig over en geeft de poort OUTSIDE COVERAGE terug. De lezer krijgt duidelijk te horen: "I don't have anything in this archive that answers that," in plaats van een zelfverzekerde gok. Eerlijke onthouding is een eigenschap van de poort, geen falen van het model.
Eén schakelaar pauzeert de lezerswidget terwijl de backend live blijft, zodat een redacteur nieuwe lezersantwoorden onmiddellijk kan stoppen tijdens een breaking story of een incident, zonder het archief offline te halen. Gecombineerd met het auditbewijs per antwoord is dit het bedienbare governance-oppervlak dat een standaardenredactie daadwerkelijk nodig heeft: pauzeer de voorkant, bewaar het bewijs, beoordeel de wachtrij.
The Standards Desk is geen andere conversationele engine. Het is de laag die beslist wat veilig is om te publiceren onder uw vlag.
| Dimensie | Vanilla vector-RAG-widget | De herkomstpoort van The Standards Desk |
|---|---|---|
| Gefabriceerd citaat | Wordt onopgemerkt onder uw vlag gepubliceerd | Onderschept door een woordelijke stringmatch, achtergehouden voor lezers |
| Niet-onderbouwde claim | Gepubliceerd als feit | Gesnoeid, of het hele antwoord wordt vastgehouden, met gemeten dekking |
| Een vraag die jaren omspant | Een antwoord uit één passage of niets | Gepland over tijdvensters, chronologisch samengesteld met citaten |
| Niets in het archief | Een zelfverzekerde gok | OUTSIDE COVERAGE, een eerlijke onthouding |
| Wie beslist tot publiceren | De zekerheid van het model | Een deterministische beleidspoort in gewone Python |
| Auditspoor | Geen | Een JSON-bewijs per antwoord in één klik |
Geen van beide. The Standards Desk is een herkomstpoort die om de conversationele engine zit die u al over uw archief draait. Het concurreert niet met Google, Perplexity of een nieuwsredactie-zoekvak. De taak is deterministisch te beslissen welke gegenereerde antwoorden veilig zijn om te publiceren onder uw vlag, welke een niet-onderbouwde zin gesnoeid krijgen, en welke worden vastgehouden voor een mens, en in beide gevallen een auditbewijs achter te laten.
De antwoordmodule kan en doet confabuleren. Ons citaatvalvoorbeeld toont hoe het een citaat verzint dat een vanilla RAG-widget zou hebben gepubliceerd. Wat The Standards Desk stopt, is dat dat antwoord een lezer bereikt. Elk citaat wordt woordelijk getoetst aan de aangehaalde bron en elke claim wordt beoordeeld tegen een echt fragment, zodat een gefabriceerd citaat of een niet-onderbouwde claim wordt onderschept en doorgestuurd naar de standaardenredactie vóór publicatie in plaats van na een correctie.
Er is geen Section 230-bescherming voor content die uw eigen systeem genereert vanuit uw eigen archief, dus een gefabriceerd citaat is uw aansprakelijkheid, niet die van een derde. De poort geeft nooit automatisch een antwoord vrij dat een niet-verifieerbaar citaat of een niet-onderbouwde claim bevat, en exporteert een JSON-auditbewijs dat elke claim, de aangehaalde bron en het oordeel, en elke woordelijke-citaattoets vastlegt. U publiceert een antwoord dat u kunt bewijzen, of u hebt het nooit gepubliceerd.
Nee, omdat veilig om te publiceren een governance-eigenschap is, geen modeleigenschap. Een eiser in een lasterzaak geeft niet om hoe zeker het model was; het gaat erom of het citaat echt was en of het archief het daadwerkelijk zei. De duurzame waarde — elke claim verankeren, citaten woordelijk afdwingen, en zich eerlijk onthouden — geldt bij elke modelkwaliteit, daarom leven de woordelijke-citaatregel en de beleidspoort in gewone Python buiten de agents.
Het is een uitvoerbare demo die het mechanisme bewijst, geen uitrol. The Riverbend Ledger, Mayor Reyes en alle 200 artikelen van 2014 tot 2025 zijn als synthetisch gelabeld, zonder echte uitgeversdata en zonder live accounts. Wat echt is: de deterministische poort, de woordelijke-citaatregel, de temporele planning, de opvraging, en de 13 geslaagde tests draaien precies zoals getoond, volledig offline. Entiteitsresolutie in productie, de temporele knowledge graph en CMS-sync zijn als fixtures gestubd en als zodanig benoemd.
Eén klik exporteert een JSON-bewijs per antwoord: de query, de opgesplitste deelvragen, de opgehaalde bronnen met article id, date en url, het gepubliceerde antwoord, een record per claim van de claim, aangehaalde bron, oordeel en bewijsfragment, een record per citaat van het citaat, de woordelijke match en de bron, de poortbeslissing en reden, de engine en het model, en een UTC-tijdstempel. Wat een handmatige sessie-audit een uur kan kosten om te reconstrueren, exporteert in seconden.
Het onderzoek achter deze demo — de architectuur, het verificatieontwerp en de enterprise-blauwdruk.
Volledige oplossing
Bekijk de oplossing Conversational AI for Publishers →De herkomstpoort is het moeilijke deel. Wij bouwen die.
Als uw nieuwsredactie uitzoekt hoe lezers vanuit het archief te beantwoorden zonder een citaat te publiceren dat nooit is uitgesproken, horen wij graag hoe u daarover nadenkt. Het probleem is branchebreed en de antwoorden zullen dat ook zijn.