合成内容与虚假评价检测
Campaign Firewall 展示了当仅凭措辞无法发现异常模式时,关联证据如何支持人工审核路由。此处展示的所有评价与账号历史记录均为合成数据。
4 of 15
被本地仅基于文本的基准标记
模拟全人工操作活动,相同测试夹具
15 of 15
被集成模型路由至人工审核
合成记录,无平台操作
105 account pairs
通过共享商品历史关联
同一聚类内的关联证据
这些测试夹具观察结果阐明了一项设计抉择。两种方法均使用从语料库得出的文本百分位数,且集成审核阈值是在相同的标签上拟合的;这并不代表在未见数据上的性能表现。
品牌保护团队在决定升级处置之前,需要明确评价为何显得互相关联。仅凭流畅措辞无法确立账号是独立运作的,而仅凭负面意见也无法确立存在欺诈。
我们的合成示例模拟了针对竞品商品页面的 15-review 虚假活动。11 条记录几乎没有文体计量异常,但它们重叠的商品历史将各账号联系在一起。本地仅基于文本的基准标记了 15 条中的 4 条;集成模型则将全部 15 条路由至审核。
该路由保留了不确定性。模拟的全人工标签是测试夹具基准真值,并非证明这些评价是由真人撰写或有人收受了报酬的证据。
写作模式、账号行为、高峰时序及账号关联共同计入封顶的启发式评分。测试夹具模拟了 90 days 的历史记录;时序检测器则审查 72-hour 高峰时间窗口。该评分并非校准概率。
共享设备或充分重叠的商品历史在图谱中生成边。商品重叠要求在同一商品页面内至少达到 0.5 Jaccard 相似度,且记录间隔不超过 72 hours。仅凭时序不会创建链接。
当规模与凝聚度符合配置规则时,连通分量即成为活动聚类。确定性评分在撰写描述性文字之前分配 CLEAR、REVIEW 或模拟的 AUTO 资格。REVIEW 始终是供人工研判的路由,而非已完成的调查。
记录的调查在评分后重放缓存的 Codex 响应。确定性过滤器检查数字、Token 重叠及结论逆转;它并不确立保留的每句话均为真实。JSON 保留活动归属、数值组件分值及未提交的申诉草稿。可打印 HTML 展示活动画像、单条评价信号名称及草稿;它不展示数值组件明细。
图谱采用可解释的连通分量聚类。本演示中未实现训练好的图神经网络或生产平台集成。
在这些实际应用抓图中,所有评价、账号历史、设备及平台数据流均为合成数据。主示例追踪针对竞品的 15 条模拟评价,贯穿活动发现、人工审核路由直至导出的记录。
测试夹具将本案例标记为全人工付费活动,但检测器既未确立作者身份,也未确立报酬给付。其 15 条评价中有 11 条的文体计量组件至多为 4:在此实现中几乎没有写作模式异常。它们的账号历史提供了将它们放在一起审查的依据。

这 15 条评价在配置的 72-hour 限制内,在同一商品页面上共享充分重叠的商品历史。这生成了 105 product-overlap pair edges,连接聚类中的每一对,凝聚度为 1.0。本案例中不存在共享设备边;此发现不依赖设备复用。仅凭时序不会生成边。

本地仅基于文本的基准标记了 15 条记录中的 4 条。因此,在该测试套件要求至少标记植入标签的 60% 的规则下,它未能实现活动级检测。集成模型结合写作、行为、时序与网络组件,将全部 15 条路由至 REVIEW,而非 AUTO。
| 证据或决策 | 观察结果 | 解读 |
|---|---|---|
| 写作模式信号 | 11 of 15 的文体计量组件至多为 4 | 低异常并非真人撰写凭证。 |
| 账号关联 | 105 product-overlap pair edges;无共享设备边 | 共享历史模式支持将这些账号一起审查。 |
| 本地仅基于文本的基准 | 4 of 15 被标记 | 此已实现的对照基准在 60% 规则下遗漏了该活动。 |
| 集成模型路由 | 15 REVIEW;0 AUTO | 全部 15 条均路由至人工研判。未移除任何评价。 |

在可选模型描述发现之前,确定性评分已设定层级。记录的调查重放来自真实 Codex 桥接的缓存响应。其事实性过滤器检查数字、Token 重叠及结论逆转;保留的文案仍需分析师审核,且无法更改分值或层级。

实际导出的 JSON 保留了活动归属、层级构成、贡献信号及每条记录的组件分值。可打印 HTML 呈现活动画像、缓存叙述、指示性规则映射、未提交的申诉草稿及全部 15 个被标记行。分析师可核查记录为何被路由,而无需仅依赖描述性叙述。原生申诉草稿夸大了时间戳覆盖范围:JSON 和可打印报告包含记录生成时间戳,但不含单条评价时间戳。在外部使用之前,需要补充并核实这些信息。

另一个独立的合成聚类关联了 67 条记录:模拟 Amazon 竞品商品页面上的 47 条五星好评,加上针对模拟品牌的 12 条 Google 评价和 8 条 Yelp 评价。跨越 71.8 hours,该聚类拥有 90 shared-device pair edges 以及 1,175 product-overlap pair edges。它包含 24 AUTO 和 43 REVIEW 记录;AUTO 是模拟策略下的合格状态,并非自动移除。
此案例展示了为何审核人员可能需要跨模拟数据流的关联关系,而非仅仅统计负面言辞的数量。67 条记录中有 31 条几乎没有文体计量异常。即便存在连通模式,检测器也无法确立实际付款、顾客身份或过错归责。

模拟的 Amazon 竞品商品页面在 72-hour 时间窗口内评价达到 69 条的高峰,而预期仅为 7.8 条,约为配置基准的 8.85 倍。该商品页面窗口计数并非 67 条记录的跨平台聚类规模。突增贡献了时序信号;账号关联则提供了图谱链接。

更广泛的测试夹具包含模拟 90 天历史中的 1,530 条合成记录。以下结果在相同的带标签语料库上复现了当前加载的阈值。两种方法均从中推导文本百分位数,且集成 REVIEW 阈值也是在其标签上拟合的。这些并非留出集或生产环境准确率结果。
| 度量指标 | Campaign Firewall 集成模型 | 本地仅基于文本的基准 |
|---|---|---|
| 被标记的植入评价记录 | 82 of 82 | 40 of 82 |
| 被错误标记的带真实标签记录 | 0 of 1,448 | 306 of 1,448 |
| 检测到的植入活动标签 | 3 of 3 | 0 of 3 |
标记包含 REVIEW 与 AUTO,并非实际移除。三个植入标签构成两个图谱聚类,因为刷好评与镜像标签连接到了同一个跨平台聚类中。假阳性对比仅适用于此已实现的基准和拟合测试夹具,不适用于商业检测器或新评价。
| 层级 | 有用证据 | 边界限制 |
|---|---|---|
| 本地仅基于文本的基准 | 单条记录中的写作模式异常 | 在模拟活动中标记 15 条中的 4 条;不作商业检测器主张 |
| Campaign Firewall 集成模型 | 写作、行为、时序与账号关联 | 在此拟合的合成测试夹具中将全部 15 条路由至审核 |
| 调查文档记录 | 成员归属、组件分值、叙述及申诉草稿 | 支持检查;既未提交申诉,亦未证实违法违规 |
所有评价记录、账号历史、设备指纹及平台连接均为合成数据。数据流均为模拟生成,无实时连接器或抓取的评价。本演示不对真实作者进行鉴真,不移除评价,不完成人工调查,亦不提交申诉。
未衡量留出评估、生产假阳性率、分析师工时节省、ROI 或申诉成功率。相同测试夹具结果展示的是可复现的配置行为;它们并不确立泛化能力。
Campaign Firewall 将写作模式与账号行为、时序及关联证据相结合。在单个合成 15-review 活动中,本地仅基于文本的基准标记了 4 条记录,而集成模型将全部 15 条路由至人工审核。此模拟案例展示了协同操作检测;它并不确立真实人类作者身份或在全新评价上的表现。
在模拟数据中,共享设备指纹与重叠商品历史构建了账号关联。商品历史链接需要共享商品页面、至少 0.5 Jaccard 相似度且时间戳相隔不超过 72 hours;仅凭时序不会生成边。活动成员归属、组件分值及贡献信号在证据导出中完整保留。
本演示使用标有 Amazon、Google 和 Yelp 标签的合成记录与模拟历史。它没有实时平台连接器、抓取的评价,亦无法访问真实账号、设备或购买历史。生产数据访问权限、许可及集成需要单独实施与验证。
Campaign Firewall 导出包含未提交申诉草稿的描述性 JSON 及可打印 HTML 证据。REVIEW 代表人工审核路由,而 AUTO 代表模拟策略下的合格状态。两种状态均不会移除评价、提交申诉或完成调查。
当前集成模型在此测试夹具中排除了全部 1,448 条带有真实标签的合成记录。其审核阈值是在相同的标签上拟合的,且两种方法均从该语料库中得出文本百分位数,因此该结果无法确立未见数据的假阳性率。在将这些路由投入实际业务运行前,仍需在独立数据上进行评估。
协同信号并不确立付款、指定情绪要求、顾客身份或法律违规。FTC 将虚假或不实评价与以正面或负面情绪为条件的奖励以及评价压制区分开来。本演示提供指示性规则映射及未提交的草稿以供实质性审查;它不对合规性作出认证。
法律背景: Federal Trade Commission, Consumer Reviews and Testimonials Rule Q&A (已核对 2026 年)。该映射属于描述性内容,在外部使用前需经过实质性法律审查。
与 Veriprajna 讨论您的证据与升级处置需求。
我们可以界定针对您的用例所需的数据访问、独立评估与审核工作流范围。本演示为该讨论提供了具体基础。