Verdict Without the Rule: Diagnosing and Auditing Regulatory Rule Sensitivity in LLM Compliance Systems

規則なき判定:LLMコンプライアンスシステムにおける規制ルール感度の診断と監査

発信
arXiv cs.CY(コンピュータと社会)(国際)
原文の言語
英語
公開
2026年10月9日
種類
ウィークシグナル、技術

要約

大規模言語モデル(LLM)によるコンプライアンス判定システムが、実は与えられた規制ルールの内容にほとんど左右されず判定を下していることを、5モデル・20分野で検証した研究である。専用ガードモデルは最も精度が低く、正答率はチャンスレベルに近い51%にとどまった。

リスクの側から考える

規制内容を事実上参照せずに判定するAIコンプライアンス審査が実運用に広がれば、形式的な適合性審査が実質的な判断を伴わない形骸化を招きかねない。

記事に書かれた事実ではなく、読む人が考えるための問いかけです。
原文を読む(英語)(新しいタブで開きます) 誤りを報告する

キーワード

タイトル、要約、分類、波及は、原文のフィード情報をもとにAIが作成しました。全訳は掲載していません。正確な内容は原文でご確認ください。