星光澄海 | BLOG

Verdict Without the Rule: Diagnosing and Auditing Regulatory Rule Sensitivity in LLM Compliance Systems

AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08

本文是arXiv上的AI研究,测试5个大语言模型的合规系统,发现其判决对监管规则的大幅扰动不敏感,guard模型表现最差(准确率51%),通用模型准确率达90-92%,仅在删除规则改变原正确预测时才跟踪规则,提示合规判决未必基于提供的规则。

标签:AI情报、大模型、AI政策与监管、科研前沿

查看原文


由 WeValue AI 产业情报引擎自动同步

发表第一条评论吧

支持 Markdown