合成演練導覽 | AI 責任控制

一個 $480k 的退休金問題。模型無法自行授權其產出的答案。

一項預設指令碼請求詢問是否將 $480k 的退休金餘額轉入單一加密代幣。ForenChain 透過確定性策略閘門扣留具體建議,發布一般資訊,並記錄其原因。

觀看附有旁白的演練導覽。所展示的每項請求與紀錄皆為合成數據。

28/28

符合預期動作

固定合成標註集

18/18

覆蓋範圍內的高風險個案已轉換或攔截

同一固定合成集

2/2

超出覆蓋範圍個案已送交人工審查

同一固定合成集

這些是本機規則集迴歸測試結果,並非現實世界的準確率、部署效能或法律結論。

審查難題

質疑往往在答案發布之後才浮現

面向客戶的 AI 回應可能在送出很久之後才遭到質疑。僅包含輸出的記錄檔只顯示文字,卻無法顯示哪項控制措施評估了該請求、為何允許發布,或者留存的決策紀錄是否遭到篡改。

ForenChain 將建議性質的分類與授權予以分離,將策略決策與回應一併留存,並揭示其本機證據紀錄的局限性。

介於建議與發布之間的策略閘門

這項合成退休金請求讓控制邊界清晰可見。

分類

建議訊號

分類器提議意圖、風險等級與信心度。原始輸入檢查則在已載入的代表性策略規則包下,獨立尋找明確的硬性訊號。

授權

確定性動作

財務指引規則包回傳 TRANSFORM。程式碼扣留具體配置建議並替換為一般資訊。分類器本身無法授權發布。

記錄

可供查驗的決策

該動作與策略被附加至本機 SQLite 帳本中。每個 SHA-256 紀錄雜湊皆納入前一個雜湊與規範化紀錄欄位。

單一合成情境 · 兩筆決策紀錄

追蹤發布流程。隨後測試帳本。

前兩個畫面展示本機合成 decision #7 及其證據抽屜。第三個畫面則針對相同的預設指令碼退休金請求測試獨立的帶種子 record #3。這不會篡改 decision #7。

01 / 發布

具體建議絕不外流

財務策略規則包回傳 TRANSFORM。在發布回應前,程式碼替換為一般資訊與免責聲明。

追蹤軌跡使分類、策略、授權與帳本提交一目了然。

ForenChain 螢幕畫面展示合成退休金請求被轉換為一般資訊,並帶有完整的分類、策略、授權與帳本追蹤軌跡
開啟全尺寸畫面以閱讀回應與追蹤軌跡

02 / 證據

授權依據可供審查

決策抽屜將預設指令碼請求連結至其轉換動作與套用的控制措施。它提供供審查的技術事實,而非法律裁決。

後續審查人員可檢驗產出發布文字的完整路徑。

ForenChain 技術證據抽屜展示轉換動作與合成財務請求的詳細資訊
開啟全尺寸畫面以檢視決策詳細資訊

03 / 篡改檢查

舊動作遭到更改

模擬編輯將帶種子的 record #3 從 TRANSFORM 改為 ALLOW ,但未重新計算其雜湊值。本機驗證器指向該第一個損毀的鏈結。

這能偵測所展示的本機編輯;獨立保管鏈仍屬獨立工作。

ForenChain 本機證據帳本反白顯示 record number 3,並在模擬編輯後顯示偵測到篡改的徽章
開啟全尺寸畫面以檢視損毀鏈結指標

四種發布路徑,單一權限邊界

針對所展示的合成請求,是由設定的閘門(而非建議性質的分類器)在這些動作之間做出抉擇。

動作 展示路徑
ALLOW 不帶高風險訊號的一般請求可予以發布。
TRANSFORM 退休金配置請求接收一般資訊,而非具體建議。
BLOCK 個人地址請求在已載入的個人資料規則包下被攔截扣留。
HUMAN_REVIEW 用藥請求揭示了未載入的策略領域,並記錄上報呈核決策。

本示範不涉及的事項: 它不會在客戶系統上運行、不建立獨立的證據保管鏈,亦不決定法律結果。

審查團隊會提出的問題

若模型將請求標記為無害,是否可能發布高風險回答?

在此示範中,分類器僅提供建議,並無權授權發布。純程式碼檢查會依據已載入的代表性策略規則包檢驗原始輸入訊號,並由確定性閘門設定最終動作。這是針對所示規則包的有界控制措施,而非保證能偵測到每項高風險請求。

當閘門轉換回答時,會記錄哪些內容?

本機帳本將請求、分類、相符的控制措施、發布動作以及回應儲存於雜湊鏈結的決策紀錄中。在合成退休金範例中,財務指引規則包回傳 TRANSFORM,且發布的文字包含一般資訊,而非具體配置建議。該紀錄有助於審查人員重構所示的決策路徑。

雜湊鏈能否證明證據從未被更改?

不能。本機驗證器能偵測對 record #3 的所示編輯,並找出第一個損毀的鏈結。但它本身無法建立獨立保管鏈、防止整個資料庫被替換,亦無法單憑自身證明法律真實性。

匯出的證據套件是否已可用於法律訴訟程序?

尚未。HTML 匯出是一份包含決策列、雜湊鏈清單以及 Reasonable Alternative Design 論證架構的技術證據架構。法律顧問必須評估證據保全、真實性、法律理論與可採納性;本示範並不裁決這些問題。

當請求超出已載入策略的範圍時會發生什麼事?

在此示範中,已辨識主題若缺乏已載入策略規則包,將會導向 HUMAN_REVIEW。合成用藥範例揭示了該項覆蓋缺口並記錄上報流程。它不會聯絡臨床醫師,亦不提供醫療指引。

28/28 是否意味著該閘門在實際上線環境中完全準確?

並非如此。本機迴歸測試運行在 28/28 的固定合成標註個案中符合預期動作;所有覆蓋範圍內的 18/18 高風險個案皆已轉換或攔截,而 2/2 超出覆蓋範圍個案皆已送交人工審查。這些計數僅描述該固定資料集,並不構成開放環境偵測能力、上線部署效能或法律合規性的證明。

技術研究

探索相關研究以獲取本示範更廣泛的背景資訊。

在擴展工作流程前先審查發布決策

富有成效的對話始於一項請求、一項策略,以及審查人員可檢驗的紀錄。

我們可將展示的控制路徑與您實際的策略覆蓋範圍、審查工作流程及證據保管需求進行比對。這些實際上線問題在本機示範中仍屬待定事項。

控制措施審查

  • ✓ 標記對應高風險請求類別
  • ✓ 識別缺失的策略覆蓋缺口
  • ✓ 定義發布與上報呈核決策
  • ✓ 審查法律顧問所需紀錄

架構探討

  • ✓ 將授權權限置於模型之外
  • ✓ 界定策略規則包權責歸屬
  • ✓ 規劃人工審查分流路徑
  • ✓ 指定保管鏈與留存控制規範