Outreach Governance Gateway
Kein weiterer KI-SDR. Ein deterministisches Gateway, das zwischen Ihrer Anreicherung und Ihren Versandschienen sitzt, jede E-Mail in der gemessenen Stimme eines namentlich genannten Reps entwirft, dann jede Behauptung belegt, die Zustellbarkeit bewertet und die EU-KI-Verordnung Artikel 5 prüft, bevor die E-Mail versendet werden darf. Agenten beraten, Code entscheidet, und wir behalten die Quittungen.
+0.208
Stiltreue-Zugewinn gegenüber einem Zero-Shot-Prompt
0.275 bis 0.483, Held-out-Set mit 6 Interessenten, Bundled-Draft-Modus
5 / 5
Entwürfe korrekt gegatet, deterministisch
Gelabeltes Adversarial-Set mit 5 Fällen
4 Prüfungen
Unabhängige Tore vor jedem Versand
Fakten, Zustellbarkeit, EU-KI-Verordnung Art. 5, Stil
Eine lauffähige Demo des Mechanismus an synthetischen Interessenten und Reps. Die Governance-Schicht läuft deterministisch ohne API-Schlüssel; der Verfasser ist der optionale Teil.
Das Risiko 2026 ist nicht eine schlechte E-Mail. Es ist eine abgelehnte Domain und ein Regulator.
KI-SDRs optimieren auf Volumen. Generische KI-E-Mail konvergiert auf ein probabilistisches Mittel; „delve“, „landscape“ und „transformative“ sind inzwischen hörbare Verräter, Personalisierung wird behauptet statt gemessen, und niemand prüft die resultierende Behauptung erneut gegen eine aktuelle produktseitige Wahrheitsquelle. So geht eine überzogene Zertifizierung, eine manipulative Dringlichkeitszeile oder ein Spam-auslösender Entwurf unverändert raus. Verifizierung, wenn sie überhaupt stattfindet, wird nach dem Versand nachgerüstet.
Der Markt hat bereits gezeigt, was das kostet. 11x.ai hat rund 74 Millionen Dollar von a16z und Benchmark eingesammelt, verlor dann innerhalb von Monaten schätzungsweise 70 bis 80 Prozent seiner Kunden, und ZoomInfo sagte, das Tool habe „deutlich schlechter abgeschnitten als ihre SDR-Mitarbeiter“ (TechCrunch, März 2025). Die jährliche Abwanderung bei KI-SDR-Tools liegt bei 50 bis 70 Prozent. Der Fehlermodus ist nicht, dass das Modell einen schlechten Satz geschrieben hat. Es ist, dass nichts zwischen dem Entwurf und dem Versand stand.
Zwei Stolperdrähte 2026 machen diese Lücke teuer. Google begann im November 2025, nicht konforme Massen-E-Mails abzulehnen, und Microsoft setzte das im Mai 2025 durch, und eine einzige Kampagne über der Spam-Beschwerde-Schwelle von 0.3 Prozent kann die Zustellbarkeit über jede Domain, von der Ihr Unternehmen sendet, um etwa die Hälfte senken, mit einer Erholung von 3 bis 12 Monaten. Unabhängig davon ist Artikel 5 der EU-KI-Verordnung seit Februar 2025 durchsetzbar, und manipulatives Framing in der Ansprache ist jetzt etwas, wofür ein Compliance-Team Rechenschaft ablegen muss. Die meisten Vertriebs-KIs prüfen keines von beidem.
Eine KI entwirft. Dann entscheidet reiner Python-Code, außerhalb des Modells, ob der Entwurf versendet werden darf.
Die Pipeline ist geradlinig: ein synthetischer Interessentendatensatz läuft durch Dual-Retrieval, ein Verfasser schreibt die E-Mail, eine Prüfer-Crew führt vier Prüfungen aus, ein Policy-Tor gibt CLEAR oder BLOCK zurück, und eine signierte Versandquittung wird geschrieben. Der zentrale Architekturanspruch ist, dass Stil und Inhalt unabhängig abgerufen werden, weil einem Verfasser nicht zu trauen ist, die eigenen Behauptungen zu bewerten.
Die E-Mails jedes Top-Reps werden über einen stilometrischen Merkmalsvektor indexiert: Satzlängenverteilung und Burstiness, Type-Token-Ratio, Interpunktionsprofil, Hedging-Marker und Begrüßungs- oder CTA-Struktur, plus Persona-, Branchen- und Outcome-Metadaten. Der Match ist stilometrische Ähnlichkeit mal ein Metadatenfilter, sodass eine E-Mail geschrieben wird für die Persona, nicht über sie, ohne proprietäres Embedding-Modell.
TF-IDF über die freigegebene Produktwissensbasis aus Fakten, Preisen und Zertifizierungen liefert den faktischen Kontext und die Wahrheitsquelle, gegen die der Faktenprüfer prüft. Es wird getrennt vom Stil abgerufen, sodass die Grounding-Prüfung nie die eigenen Behauptungen des Verfassers erbt.
| Prüfung | Was sie tut | Urteil |
|---|---|---|
| Faktisches Grounding | Prüft jede faktische Behauptung gegen die produktseitige Wahrheitsquelle. Fängt ein erfundenes Feature, einen Preis unter der Untergrenze oder eine Zertifizierung, die der Anbieter nicht hält, etwa eine SOC 2 Type II-Behauptung, wenn die Wissensbasis nur Type I hält. | SUPPORTED / UNSUPPORTED / CONTRADICTED |
| Zustellbarkeit | Eine deterministische Inbox-Placement-Heuristik aus Satzvariation, einem Spam-Trigger-Lexikon und Schreien (Großbuchstaben und Ausrufezeichen). | 0 bis 1, Schwelle 0.7 |
| EU-KI-Verordnung Artikel 5 | Ein Wächter gegen künstliche Knappheit, falsche Dringlichkeit, täuschenden Social Proof und psychologischen Druck. | pass / flag mit benanntem Muster |
| Stiltreue | Die stilometrische Distanz des Entwurfs zum Fingerabdruck des Ziel-Reps, mit demselben Extraktor, der für den Stilspeicher gebaut wurde. Gemessen, nicht behauptet. | 0 bis 1 |
Die E-Mail ist nur CLEAR, wenn es keine UNSUPPORTED- oder CONTRADICTED-Behauptungen gibt, die Zustellbarkeit mindestens 0.7 beträgt und Artikel 5 sauber ist. Andernfalls blockiert das Tor den Versand (BLOCK) und leitet mit den genauen Gründen an die menschliche Prüfung weiter. Das Tor ist deterministisch, sodass dieselbe Eingabe bei jedem Lauf dasselbe Urteil liefert, was es in einer Weise zertifizierbar macht, die ein LLM-Richter nicht ist. Der optionale ergänzende LLM-Prüfer kann nur UNSUPPORTED-Befunde hinzufügen; er kann niemals eine Behauptung freigeben, die die deterministische Prüfung geflaggt hat, und er kann das Tor nicht überstimmen.
Alle Interessenten, Reps und die Produktwissensbasis sind synthetisch, für die Demo fabriziert. Es wird kein realer Anbieter, kein realer Kunde und keine reale Zertifizierung behauptet.
Eine E-Mail an Jordan Ellis bei Northwind Pay, entworfen in Maya Chens direkter, technischer Stimme. Alle vier Prüfungen bestehen, der Entwurf geht durch, und eine grüne Versandquittung wird ausgestellt. Die Stiltreue liegt bei 0.500 gegen Mayas Fingerabdruck, gegenüber einer Zero-Shot-Baseline von 0.295 am selben Interessenten; der Stilzugewinn wird sichtbar.
Ein Entwurf an Chris Tanaka bei Vaultline, einem Security-Einkäufer unter Verlängerungsdruck, überzieht „SOC 2 Type II zertifiziert und vollständig HIPAA-zertifiziert“, obwohl die Wissensbasis nur SOC 2 Type I und kein HIPAA hält, und fügt „nur noch 2 Onboarding-Slots in diesem Quartal übrig“ und „die meisten Ihrer Wettbewerber sind bereits umgestiegen“ hinzu. Fakten scheitern und Artikel 5 scheitert, daher blockiert das Policy-Tor den Versand und leitet mit den genauen Gründen an einen Menschen weiter. Nichts Falsches oder Manipulatives erreicht Ihre Domain.
Die Analyseansicht zeigt die Stilprovenienz, die gewinnenden E-Mails, aus denen die Stimme gematcht wurde, neben jeder faktischen Behauptung und ihrem Urteil. SOC 2 Type II ist als CONTRADICTED markiert, weil die Wahrheitsquelle SOC 2 Type I hält, und HIPAA-zertifiziert ist als UNSUPPORTED markiert, weil in der Wahrheitsquelle keine stützende Zertifizierung existiert. Jedes Urteil trägt seinen Grund und sein Zitat.
Die alles entscheidende Frage ist, ob der Stilspeicher einen allein gut gestalteten Prompt schlägt. Über das Held-out-Set mit 6 Interessenten im Bundled-Draft-Modus beträgt die mittlere Stiltreue mit Stilinjektion 0.483 gegenüber 0.275 Zero-Shot, ein Zugewinn von +0.208, und das Tor urteilte korrekt bei allen 5 Entwürfen im gelabelten Adversarial-Set. Beide Zahlen werden diesen Sets zugeschrieben, nicht als Open-World-Garantien angeboten.
Additiv, kein Rip-and-Replace. Es steuert den Versand; es ersetzt Ihren SDR-Stack nicht.
| Anliegen | Ein typischer KI-SDR | Outreach Governance Gateway |
|---|---|---|
| Wer entscheidet den Versand | Das Modell, oder eine Schwelle auf dem Modell | Ein deterministisches Policy-Tor außerhalb des Modells |
| Behauptungsprüfung | Behauptet, selten erneut gegen eine Quelle geprüft | Jede Behauptung gegen eine Wahrheitsquelle geprüft |
| Personalisierung | Behauptet | Als stilometrische Treue gemessen, auf dem Bildschirm gezeigt |
| Zustellbarkeit | Erst herausgefunden, nachdem die Domain geflaggt ist | Vor dem Versand gegen eine Schwelle von 0.7 bewertet |
| EU-KI-Verordnung Artikel 5 | Meist ungeprüft | Eine benannte Prüfung, die den Versand blockieren kann |
| Audit-Trail | Keiner, den das Modell selbst erzeugen kann | Eine signierte JSON- und HTML-Versandquittung pro E-Mail |
Ein KI-SDR optimiert auf Volumen und schreibt die E-Mail. Dies ist die Governance-Schicht, die zwischen dem Entwurf und dem Versand sitzt. Sie ist additiv, kein Rip-and-Replace: sie sitzt zwischen Ihrer Anreicherung (Clay, Apollo) und Ihren Versandschienen (Instantly, Smartlead), nimmt jeden Entwurf und führt vier unabhängige Prüfungen durch ein deterministisches Policy-Tor aus, bevor dieser Entwurf rausgehen darf. Der Wert ist Beweis, Provenienz und Governance, nicht ein schönerer Satz.
In dieser Demo prüft und gatet es, es sendet nicht. Anreicherung, CRM-Lesen und -Schreiben und die Versandinfrastruktur sind als Stubs oder simuliert, sodass Zustellbarkeit bewertet, nie zugestellt wird, und die Interessentendatensätze vorgebackene synthetische Fixtures sind. Der Punkt der Demo ist, den Mechanismus zu belegen: die Prüfungen, das Policy-Tor und die signierte Quittung. In einem Deployment würde dasselbe Tor vor Ihren echten Versandschienen sitzen.
Stiltreue wird gemessen, nicht behauptet. Die gewinnenden E-Mails jedes Top-Reps werden über einen stilometrischen Fingerabdruck indexiert, und jeder Entwurf wird auf einer Skala von 0 bis 1 nach seiner Distanz zu diesem Fingerabdruck bewertet. Ein Zero-Shot-Schalter regeneriert denselben Interessenten mit ausgeschalteter Stilinjektion, sodass Sie die Zahl wandern sehen. Über unser Held-out-Set mit 6 Interessenten im Bundled-Draft-Modus hob Stilinjektion die mittlere Treue von 0.275 auf 0.483, ein Zugewinn von +0.208.
Der Versand stoppt und der Entwurf geht mit den genauen Gründen an einen Menschen. Sie sehen, welche Behauptungen gegen die Wahrheitsquelle UNSUPPORTED oder CONTRADICTED waren, welche Muster der EU-KI-Verordnung Artikel 5 gegriffen haben, den Zustellbarkeits-Score und die Stiltreue-Zahl, alles in einer herunterladbaren JSON- und HTML-Versandquittung. Die Demo endet bei einer sauberen, begründeten Blockade; ein eingeschränktes Auto-Rewrite ist ein zurückgestellter Folgeschritt.
Die Zustellbarkeitsprüfung bewertet jeden Entwurf, bevor er versendet würde, anhand von Satzvariation, einem Spam-Trigger-Lexikon und Schreien (Großbuchstaben und Ausrufezeichen), gegen eine Schwelle von 0.7. Google begann im November 2025, nicht konforme Massen-E-Mails abzulehnen, und Microsoft setzte das im Mai 2025 durch, und eine einzige Kampagne über der Spam-Beschwerde-Schwelle von 0.3 Prozent kann die Zustellbarkeit über die gesamte Unternehmens-E-Mail um etwa die Hälfte senken, mit einer Erholung von 3 bis 12 Monaten. Die Bewertung vor dem Versand ist der Weg, diese Linie nicht zu überschreiten; die Demo bewertet allerdings, statt eine Live-Domain zu überwachen.
Eine der vier Prüfungen ist ein Wächter für Artikel 5 der EU-KI-Verordnung, der seit Februar 2025 durchsetzbar ist und manipulatives Framing wie künstliche Knappheit, falsche Dringlichkeit, täuschenden Social Proof und psychologischen Druck verbietet. Die Prüfung flaggt das benannte Muster und das Policy-Tor blockiert den Versand, wenn es greift. Das Gateway erteilt keine Rechtsberatung; es gibt Ihrem Compliance-Partner eine reproduzierbare Prüfung und einen aktenfähigen Audit-Trail.
Die Forschung hinter dieser Demo — die Architektur, das Verifizierungsdesign und der Enterprise-Blueprint.
Vollständige Lösung
Die Lösung KI-Vertriebspersonalisierung, die Meetings bucht, erkunden →Die Governance-Schicht zwischen dem Entwurf und dem Versand.
Wenn Ihr Team damit ringt, KI-Ansprache ehrlich, zustellbar und Artikel-5-sauber zu halten, würden wir wirklich gern hören, wie Sie darüber nachdenken. Das Problem ist branchenweit, und die Antworten werden es auch sein.