跨越六大监管体系的AI招聘合规
Clarion 是运行于雇主现有 AI 招聘工具之上的合规覆盖层。它读取单份供应商评分导出数据,通过确定性代码计算每一项不利影响统计数据,并将单次审计结果扩展为针对 NYC、Colorado、Illinois、Texas、California 和 EU 量身定制的六份交付成果。当其中两个监管体系对同一特征提出相反要求时,它会如实指出并量化双方的风险敞口,而不是直接出具“完全合规”。以下演示基于植入的合成导出数据,而非已部署的生产管线。
6
单次审计运行生成的管辖区交付成果
NYC, Colorado, Illinois, Texas, California, EU
9 of 13
路由至指定责任人而非自动放行的合规义务
7 NEEDS PROOF plus 2 CONFLICT, on the demo's seeded export
1
安全关卡拒绝蒙混过关的规则冲突
Illinois HB 3773 against EU AI Act Article 10(3)
数据集为合成数据:来自“Acme Logistics, Inc.”在职位申请 REQ-2026-0412 上的 1,040 candidates 植入导出数据,由三款模拟工具进行评分。Workday-Spotlight 风格、HireVue 风格和 Eightfold 风格的评分器均为通过桩测试夹具适配器提供的原型,而非实际集成,其中不包含任何真实的雇主或候选人。
在 NYC、Colorado、Illinois、Texas、California 和 EU 中两个或两个以上地区运行自动化招聘工具的首席人力资源官(CHRO)、总法律顾问或首席风险官,必须用同一套技术栈应对六个独立的监管体系。服务于该技术栈的供应商往往只交出一份“我们通过了五分之四规则”的审计报告,仿佛这样就能搞定全部六个体系。事实并非如此。NYC Local Law 144 要求提供交叉不利影响比率。Colorado SB 24-205 要求建立成文的合理审慎计划,且完全未规定任何方法论。Texas TRAIGA 拒绝将差别影响作为独立依据并审查主观意图,这使得支撑 NYC 交付成果的确切统计数据在证据层面上与 Texas 完全无关。EU AI Act 询问您的训练数据是否具有代表性,并且依赖的恰恰是 Illinois 明令禁止作为代理变量的地理特征。
寻找已公开发布的 Local Law 144 偏见审计报告的研究人员发现,391 家纽约市雇主中仅有 4.6% of 391 公开了审计,研究人员将这一发现称为“零合规”(Null Compliance)(Cornell / Data & Society / Consumer Reports, FAccT 2024)。公开发布审计报告只是合规义务中显而易见的一半,而该样本中的绝大多数雇主甚至尚未做到这一点。
NY State Comptroller 在 DCWP 仅发现 1 起违规的同一份 32-company 样本中发现了 17 起潜在的 Local Law 144 违规行为,DCWP 已同意转向主动执法(NY State Comptroller, December 2, 2025)。通过供应商审计与建立具有抗辩力的合规记录之间的鸿沟,正是执法打击的落点所在。
适用范围的自主归类、视频面试中的 ADA 无障碍合规以及 FCRA 不利行为职责,都是通过偏见审计从未测试过的独立法律理论。Mobley v. Workday、D.K. v. Intuit/HireVue 和 Kistler v. Eightfold 分别提出了其中一项主张,且目前均未有定论。
该流程紧凑且内部职责划分严格。供应商的 AEDT 导出数据被规范化为统一的规范记录模式,确定性引擎计算每项统计指标,六个监管规则包与一个策略关卡裁决每项合规义务,智能体团队撰写阐述文本,并且该次运行会封装一个哈希链接的预审计数据包。智能体提供建议,代码做出裁决,正是这种机制确保了无论底层模型优劣,输出结果均具备可提交归档的法律效力。
01 / THE DETERMINISTIC TRUST CORE
基于 numpy 的引擎计算边际五分之四影响比率、采用 Benjamini-Hochberg FDR 控制的种族与性别交叉比率、通过 Cramér's V 检测受保护类别代理变量、通过透明逻辑回归替代模型进行反事实受保护属性反转、视频子集上的 ASR 词错率差异,以及 FCRA 触发断言。每次运行,相同的输入必然产生相同的输出。
02 / SIX RULE PACKS AND THE POLICY GATE
每个监管体系均附带自身的法条引用、生效日期和所需的交付成果形式,每项义务裁决为 PASS, FAIL, NEEDS PROOF or CONFLICT。关卡是语言模型绝无法触碰的界限,因此即使阐述再言之成理,也绝不可能将一项义务从 NEEDS PROOF 转为放行的绿灯。
03 / THE AGENT CREW
六个管辖区智能体分别阐述对应体系的裁决,冲突调和员将硬性冲突转化为包含各分支风险敞口的法律策略备忘录,而对抗性质疑者则尝试反驳每一个声称通过的判定,并将无法核实的项目路由至人工核查。智能体团队的模型提供商可灵活替换;在未配置提供商的情况下,它会自动回退到确定性模板,且应用程序的运行完全一致。
04 / THE PRE-AUDIT PACKAGE
该次运行会封装一个包含 17 nodes 的 SHA-256 哈希链数据包,每个节点均包含其输入数据、计算过程和规则引用,以及指向前一节点哈希的链接,因此任何篡改都会破坏哈希链。它可以导出为 JSON 以及可打印的 HTML 审计员数据包,且每次运行均会验证该链条,并针对防篡改特性进行了单元测试。
控制台由两个视图以及点击弹出的对话框组成,而非单一的仪表盘。Manual Testing 包含阶段栏、实时 Audit Execution 追踪和候选人看板。在 Run Audit 完成前一直保持禁用的 Run Benchmark 可切换至 Benchmark Results:显示 Jurisdiction Deliverables 6、Lowest Impact Ratio 0.65 和 Items Requiring Human Action 9 三个卡片,六个 Jurisdiction Deliverables 行,一个 Supporting Evidence 按钮行,以及顶部的 Export Pre-Audit Package。
其下的所有详细内容均以对话框形式打开。Selection-Rate Analysis、Conflict Register 和 Human Proof Queue 是三个 Supporting Evidence 按钮,且每个监管体系的合规义务与审计陈述均可从其自身的交付成果行中打开。没有任何内容会被汇总为单一评分,因为单一评分在面对六个结构迥异的问题时根本无法成立。
该演示对职位申请 REQ-2026-0412 上的 1,040 candidates 植入合成导出数据进行审计,这些候选人由三款模拟供应商工具评分。其中的违规行为是预先植入且可复现的,专门构建以供引擎捕获真实问题。以下是该运行在屏幕上呈现的内容,按其出现的先后顺序排列。







本页面上的每一个数据均描述了一份包含 1,040 candidates 且带有预植入、可复现违规行为的合成导出数据。它们旨在证明引擎能够捕获仅做边际审计所遗漏的问题。它们不是准确率指标,不是针对其他产品的基准测试,更不是对任何真实雇主招聘数据的断言。
| 问题 | Clarion 在本演示中所做的工作 | 本演示范围之外的内容 |
|---|---|---|
| 覆盖范围 | 单次审计运行生成针对六个管辖区的交付成果,涵盖 13 项义务,结果为 2 PASS, 2 FAIL, 7 NEEDS PROOF and 2 CONFLICT。 | 出具合格合规证书或公平性评分。关卡的设计初衷正是拒绝出具此类证明。 |
| 不利影响 | 具备 Benjamini-Hochberg FDR 控制的边际与交叉五分之四比率、通过 Cramér's V 的代理变量检测,以及平均使晋级概率改变 0.0574、最大改变 0.1228 的反事实属性反转。 | 对实际招聘结果的任何断言。这 1,040 candidates、职位申请和差异均属于合成且预先植入的数据。 |
| 供应商数据 | 读取由 Workday-Spotlight 风格、HireVue 风格和 Eightfold 风格评分器生成的单份规范化 AEDT 导出数据,通过桩测试夹具适配器提供。 | 接入任何 ATS、测评平台或匹配引擎的实时连接器。所提及的供应商均非客户、合作伙伴或代言人。 |
| 下游处置行动 | 检测并向指定人员路由 ADA 与 ASR 无障碍合规发现以及 FCRA 不利行为触发事件,并附带相关证据。 | CART 辅助工作流以及面向候选人的争议门户。两者在演示中均为模拟,并非我们在此构建的内容。 |
| 签字认证 | 封装包含 17 个节点的哈希链预审计数据包,运行中经过验证并针对防篡改进行了单元测试,支持 JSON 和可打印 HTML 格式。 | 独立的偏见审计本身。像 DCI Consulting, ORCAA and Secretariat 这样的机构承担该角色,而我们并不承担。 |
Clarion 不出具任何合规认证,且拒绝认证正是其设计核心。它不是招聘模型,绝不对候选人进行评分或排序。数据集为合成且预植入的,其中的 Black / Female 差异是预设的,目的是使引擎有真实违规可捕获,而非针对任何实际雇主的发现;其背后的供应商连接器是桩测试夹具适配器而非实时生产集成。该工具为法律顾问提供证据:它不提供法律咨询,也不对法律责任发表意见,Mobley v. Workday, D.K. v. Intuit/HireVue and Kistler v. Eightfold 均属于审理中的法律理论而非已定判决。法定最高罚金仅作为上限引用,此处不包含任何建模得出的风险敞口数值。本页面是包含演示解说视频、真实截图、运行机制和答疑的说明文档,而非供您在此直接操作的应用程序。
因为通过的测试与法律所要求的测试根本不是同一回事。在演示植入的 1,040-candidate 合成导出数据中,边际五分之四检查通过了,相对于 0.80 红线,种族影响比率最低为 0.8196,性别最低为 0.8744,这就是供应商自我报告所交付的审计。而 NYC Local Law 144 要求的却是种族与性别的交叉比率,在该维度下 Black / Female 单元格在 44 of 130 中仅晋级 44 人,影响比率低至 0.6471。仅做边际审计并没有在这个单元格上算错,而是对其存在结构性的盲视。
不。Veriprajna 不是独立审计机构,该角色属于 DCI Consulting, ORCAA or Secretariat 等专业机构。Clarion 生成的是预审计数据包,这是一个哈希链数据包,其中每个数字都附带其计算过程,每个裁决都包含其法条引用,专为让独立审计机构无需重写即可签字确认而设计。其目标是让系统达到审计机构找不出任何值得记录的合规缺陷的状态。
它与两者均未直接连接,且 Clarion 本身绝不会对候选人进行评分或排序。您技术栈中的任何部分都不会被替换。它读取供应商的 AEDT 导出数据并将其规范化为统一的规范记录模式。在本演示中,供应商连接器是基于合成数据的桩测试夹具适配器,而 Workday-Spotlight 风格评分器、HireVue 风格视频面试轮次和 Eightfold 风格匹配引擎均为原型而非实际集成。
每项统计数据、每个阈值比对、每条冲突边以及数据包哈希计算,均位于智能体框架之外的确定性代码中。六个管辖区智能体、冲突调和员和对抗性质疑者仅负责撰写阐述文本;它们绝不计算任何数字,也无法越权覆盖策略关卡。在未配置模型提供商的情况下,智能体团队会自动回退到确定性模板,且应用程序生成完全相同的裁决——因为裁决权从不属于模型。
您将获得经过量化并形成书面文档的权衡取舍分析。在演示中,zip_region 特征与种族的相关性达到 Cramér's V 0.3321,超过了 0.2 的阈值,因此 Illinois HB 3773 将其视为明令禁止的代理变量,而 EU AI Act Article 10(3) 的代表性要求却依赖相同的地理覆盖。关卡给出 CONFLICT 而非放行,调和员则撰写一份策略备忘录:运行两种部署配置,或者在知情下接受一项风险敞口并记录在案,同时注明欧盟高风险系统违规处罚的法定最高上限为 15 million euros 或全球年营业额的 3%(以较高者为准)。
它自动化了理应自动化的部分。在演示的合成导出数据中,13 项义务中有 2 项(2 of 13)自动满足,2 项直接判定失败,9 项作为 NEEDS PROOF 或 CONFLICT 连同已整理完毕的证据和法条引用一并路由至指定责任人。没有任何秉持严谨的系统能够基于这组数据将全部十三项直接放行。显示十三项全绿的仪表盘无异于在毫无证据的情况下擅自放行,而这样的仪表盘正是原告在法庭上拿来质证您的铁证。引擎同样判定 school_tier 在 Cramér's V 0.0711 下不构成代理变量,因此它绝不会不分青红皂白地对所见的一切报错。
一次导出即可生成 JSON 格式及可打印 HTML 审计员数据包形式的预审计数据包,采用 veriprajna-pre-audit-package 格式的第 1 版,包含 17 nodes 并在运行中通过链条验证。每个节点均包含其输入、计算逻辑与规则引用,以及指向前一节点的 SHA-256 链接,因此对任何节点的篡改都会破坏哈希链。与其并列的还有六份管辖区交付成果,分别契合对应监管体系的法条引用、生效日期与要求格式。
本演示背后的研究——技术架构、验证设计与企业蓝图。
完整解决方案
探索 AI 招聘合规与偏见审计解决方案 →我们是一支 AI 工程团队,而非合规认证机构。我们构建确定性计算层,用于计算统计数据,生成各监管机构所要求的交付成果,并公开指出其中的矛盾之处,以便法律顾问能够基于摆在面前的风险敞口做出明智决策。
富有成效的初步沟通应当具体明确:您的招聘漏斗中包含哪些 AEDT 供应商、您实际面临六大体系中的哪些监管约束,以及这些模型中的哪些特征在某一体系下可能被视为受保护类别的代理变量。我们可以与您的人力资源、法务及数据团队紧密协作,共同梳理计算引擎、规则包以及预审计数据包格式。