Cited but Not Consulted: A Counterfactual Audit of Legal Chain-of-Thought Faithfulness
引用されても参照されず:法的連鎖思考の忠実性に関する反事実監査
国際リスク要約
大規模言語モデル(LLM)が判決理由として挙げる法令・判例が、実際の判断根拠になっているかを検証した研究である。根拠となる法的権威を無関係なものに差し替えても、名指しされる権威の正確性は高い一方、判決そのものが変化する割合はベンチマークにより0〜77%とばらつき、言明された根拠と実際の推論が一致しないことを示した。モデルの規模や法律特化モデルでもこの乖離は解消されなかった。
リスクの側から考える
法的助言や司法補助へのLLM活用が広がれば、提示された根拠が実際の判断理由でないまま誤った説明責任の所在が生まれかねない。
記事に書かれた事実ではなく、読む人が考えるための問いかけです。キーワード
タイトル、要約、分類、波及は、原文のフィード情報をもとにAIが作成しました。全訳は掲載していません。正確な内容は原文でご確認ください。