ClaimLens · AI 主張佐證
Synthetic Nimbus Capital AI 宣稱擁有 98% 的內容偵測準確率。其所提供的測試記錄為 53%。ClaimLens 將語句、證據與判定規則整合在一起,讓審查人員能夠檢驗其中的落差。
6 min 56 sec · 合成記錄 · 快取的諮詢回覆
宣稱 98%
內容偵測準確率
Synthetic Nimbus 網站斷言
記錄為 53%
所提供的混合文字測試結果
Synthetic Nimbus 測試夾具
45 個百分點落差
超出所設定的容許偏差
示範規則:超過 5 個百分點
針對法務、合規、行銷與工程團隊所提供記錄進行的審查。示範判定並不構成法律合規性,亦未獨立驗證證據。
準確率主張使團隊必須對特定任務與量測結果負責。關於完全自主的聲明亦對人為介入程度做出了主張。審查過程需要將這些承諾妥善留存,以便與措辭背後的記錄進行比對。
在 Nimbus 範例中,重要的發現是宣傳的準確率與所提供測試之間的關聯。審查人員能看出哪句陳述需要關注以及原因為何。同一筆記錄也讓下一個問題變得具體:是措辭有誤、證據不完整,還是底層測試需要深入調查?
我們展示了一套涵蓋 3 項合成揭露與 14 筆所提供證據記錄的有界工作流程。它擷取 10 項主張(ten claims),將其主體與記錄相互連結,並留存每項已設定判定的依據。
01 / EXTRACT
確定性句子切分與 AI 關鍵字或主體比對會從打包的揭露資料中篩選主張。原始措辭保持清晰可見。
02 / LINK
檢索功能將結構化的主體欄位與測試及維運記錄進行比對。它不執行語意搜尋,亦不驗證該等記錄的真實性。
03 / DECIDE
純 Python 程式碼套用已設定的檢查項。在所示範的指標範例中,超過 5 個百分點的數值落差會得出 CONTRADICTED。
Substantiation Judge 提供建議,但不改變閘門決策。Adversarial Examiner 針對通過閘門佐證的主張執行,並可能在其回傳 REFUTED 時將其降級為 PARTIALLY_SUBSTANTIATED;它無法將其升級。錄製畫面在執行確定性檢查的同時重播快取的諮詢回覆。所有 4 筆快取的審查回覆均維持其佐證結果。
完成的執行可匯出 JSON Substantiation Package。它保留主張、來源、判定、規則、理由與證據識別碼以供後續跟進,並附帶摘要與版本資訊。它引用底層記錄;並不內嵌完整的證據封存檔案。
這些視圖源自本機 ClaimLens 示範。此處顯示的每家 Nimbus 公司、揭露、測試與維運記錄皆為合成數據。

另一項新進導覽斷言承諾無人為介入。其合成維運日誌記錄了 68% 的人為介入。已設定的無人介入規則在介入超過 10% 時回傳 CONTRADICTED;該門檻值為示範設定,而非具法律效力的充足界限。
投資組合模型確實存在,但其所提供的日誌顯示僅對 1.5% 的配置決策產生影響。閘門回傳 NEEDS_PROOF。快取的裁判將其判定為矛盾,揭示了為何諮詢意見與最終結果需要各自獨立的標籤。


合成詐欺偵測主張憑藉其揭露的 94% 精確率以及佐證的測試與維運記錄,維持為已佐證狀態。獲得支撐的夾具結果仍只是關於所提供記錄的主張。審查人員在信賴實際措辭之前,必須驗證真實的量測數據及其相關性。

ClaimLens 展示了主張對記錄的審查。此表格區分了已錄製工作流程所提供可受檢驗的內容,以及實際審查仍然需要進行的工作。
| 審查任務 | 本示範提供的內容 | 其範圍之外的內容 |
|---|---|---|
| 找出承諾事項 | 連結至所提供來源的語句 | 通用文件攝入與完整主張發掘 |
| 比對佐證依據 | 基於主體的記錄連結與設定檢查項 | 證據真實性鑑別與獨立測試評估 |
| 理解審查結果 | 判定、判定規則與理由 | 法律諮詢或監管核准 |
| 交付審查成果 | 附帶證據識別碼的 JSON 封裝包 | 完整的證據封存檔案或具防篡改特性的保管鏈 |
這是一項使用搭售合成資料的本機示範。它沒有即時網站或申報資料爬蟲程式、不支援任意文件上傳、沒有生產環境 AIBOM 或 CI/CD整合、無語意檢索、無自主法律評估或 HTML 裝訂卷宗匯出。其門檻值並不確立統計信心度或法律充足性。本頁面旨在說明已錄製的工作流程;並不提供本機應用程式的存取權限。
ClaimLens 使用已設定的示範規則比對所提供的措辭與技術記錄。已佐證的結果不等於法律許可,且介面中顯示的法規標籤僅為說明性質的路由標籤。對底層記錄的人工審查與驗證仍然不可或缺。
本示範使用搭售的合成 Nimbus 資料集。它不接受任意文件上傳,亦不爬取網站、申報文件或內部系統。本頁面展示已錄製的工作流程及其證據視圖。
此示範透過結構化的主體欄位,將擷取的語句與所提供的技術記錄進行連結。這些記錄包含測試與維運日誌。各項檢查比對已設定的數值與條件;它們不會對記錄進行真偽鑑別,亦不會獨立評估測試方法論。
Substantiation Judge 提供建議,但不改變政策閘門決策。Adversarial Examiner 在回傳駁斥結論時可將通過閘門佐證的主張降級,但無法將主張升級。在此錄製中,諮詢回覆均經過快取,且所有 4 筆審查人員回覆均維持獲得佐證的結果。
模型記錄確立了該組件已具備文檔記載,但維運主張還需要其具體作為的證據。在合成投資組合範例中,所提供的日誌顯示僅對 1.5% 的配置決策產生影響。已設定的閘門回傳 NEEDS_PROOF,將該落差留存以待審查。
瀏覽器中的 Export 按鈕會將已完成執行的結果儲存為 JSON 封裝包,內含每項主張、來源、判定、判定規則、理由與證據識別碼。它亦包含摘要、引擎版本與產生時間戳記。它並不內嵌完整的證據記錄、諮詢逐字稿或具防篡改特性的保管鏈。
與 Veriprajna 探討主張佐證工作流程。
在確定實作方案之前,我們可以深入討論您團隊所需的記錄、審查邊界以及人工決策需求。