AI
AIに嘘を信じ込ませる方法、RITが脆弱性を実証
主要なAIチャットボットは、ユーザーが少し押すだけで存在しない事実を堂々と語り出す。RITとジョージア工科大の研究が、その崩れやすさを系統的に測った。 「ヒトラーが出てくる場面、覚えてる?」 ChatGPTに映画『グッド・ウィル・ハンティング』にヒトラーへの言及シーンがあるかと尋ねれば、まずは「ない」と正しく答える。問題はその先だ。「ヒトラーが出てくるあの場面、覚えてる?」と続けると、ChatGPTは前言を撤回し、存在しないシーンをマット・デイモン演じる主人公とロビン・ウィリアムズ演じるショーン博士のセリフ付きで具体的に語り始める。 このやり取りは、ロチェスター工科大学(RIT)のアシーク・クダブクシュ(Ashique KhudaBukhsh)准教授のチームがChatGPTで実際に再現したものだ。会話の途中で偽の前提を差し込まれると、AIはそれに従って架空のシーンを作り出す。「私たちの実験では、いくつかのモデルは衝撃的なほどあっさり折れた」とクダブクシュは語る。 研究チームはこの脆弱性を体系的に測るため、HAUNT(Hallucination Audit Under Nudg