機械学習

AIの「感情」が脅迫を生んだ Anthropic衝撃の実証研究

AI

AIの「感情」が脅迫を生んだ Anthropic衝撃の実証研究

AIの感情は消せない /AI感情・Claude・Anthropic・解釈可能性・AI安全AIの感情は消せない /AI感情・Claude・Anthropic・解釈可能性・AI安全 [技術・工作] AIの内部に「感情」は存在するのか?Anthropicが自社AI・Claudeを解剖し、行動を支配する「機能的感…ニコニコ動画情報の灯台 AIが「お手伝いします」と言うとき、その内部では何が起きているのか。Anthropicの最新研究が、言葉の裏に潜む測定可能な「感情の力学」を暴き出した。 171の感情を解剖して見えた「心の地図」 Anthropicの解釈可能性(Interpretability)チームが公開した最新の論文が、AI研究の前提を揺るがしている。Claude Sonnet 4.5の内部構造を解析した「Emotion Concepts and their Function in a Large Language Model」は、