AgentDoxx: Agentic Re-identification of Anonymized Text with Web Search
AgentDoxx:ウェブ検索を用いたエージェントによる匿名化テキストの再識別
国際リスク要約
ウェブ検索機能を持つ大規模言語モデル(LLM)は公開情報を突合し、匿名化された面談記録を実名人物に結び付ける「再識別」リスクを生む。研究チームは実在人物に基づく822件の合成面談記録からなる評価セット「AgentDOXX」を構築し、15種のモデル設定で再識別のリスクを測定した。識別は検索による取得と、モデル内部の記憶の両方から生じることが分かった。
リスクの側から考える
匿名化データの保護が既存手法だけでは不十分になれば、研究・医療・報道などで収集された証言データの提供や利用自体が萎縮する可能性が生じる。
記事に書かれた事実ではなく、読む人が考えるための問いかけです。キーワード
タイトル、要約、分類、波及は、原文のフィード情報をもとにAIが作成しました。全訳は掲載していません。正確な内容は原文でご確認ください。