AI
AIに「規則」だけ教えても、いずれ抜け道を探す
Anthropicが発表した新しい訓練手法MSMは、事前学習とファインチューニングの間に「なぜこの規則があるのか」を理解させる段階を挟む。エージェント的ミスアラインメントを54%から7%へ。AIに価値観を植え付ける方法は、変わりつつある。
AI
Anthropicが発表した新しい訓練手法MSMは、事前学習とファインチューニングの間に「なぜこの規則があるのか」を理解させる段階を挟む。エージェント的ミスアラインメントを54%から7%へ。AIに価値観を植え付ける方法は、変わりつつある。
AI
インターネットアーカイブのデータをスタンフォードとインペリアル・カレッジ・ロンドンが分析した。2025年半ばまでに新規公開ウェブの約35%がAI生成・支援になっていた。ChatGPT登場前はゼロだった割合が、わずか3年でこの水準に達している。