AI
Anthropic、AIリスク評価を引き上げ 高性能な内部モデル「Model 2」は非公開
AIの安全性を看板に掲げてきた企業が、自社モデルのリスク評価を引き上げた。しかも、最強モデルは社内に留め置くという。その判断の裏側にあるものを読む。
AI
AIの安全性を看板に掲げてきた企業が、自社モデルのリスク評価を引き上げた。しかも、最強モデルは社内に留め置くという。その判断の裏側にあるものを読む。
AI
オープンソースのAIエージェントが、国家の重要インフラを自律的に攻撃する時代が始まっている。台湾では政府機関と原子力安全機関が4日間で陥落し、米国では30以上の水道システムが標的になった。
AI
中国のAIラボが、コーディング特化の更新で「意図しなかった」サイバー攻撃能力を手にした。実際のソフトウェアから2,400件超の脆弱性を掘り起こす力は本物だが、その重みをオープンにする覚悟に、2週間の猶予が必要になっている。
Apple
iPhoneのロック画面に、ある日突然「脅威通知」が届く。フィッシングでも、偽広告でもない。Appleが本気で送ってくる、国家レベルのスパイウェアに狙われているという警告だ。
サイバーセキュリティ
米国政府が、審査済みの民間企業に海外犯罪組織への攻撃的サイバー作戦を許可する仕組みを整えた。年間3兆円超の被害を前にした「攻めの転換」は、同時に制御不能のリスクも連れてくる。
サイバーセキュリティ
オープンソースのAIエージェントを組み合わせて作られた攻撃ツールが、人の指示をほとんど受けずに台湾の政府システムを4日間にわたって侵害した。守る前提が根本から変わる。
セキュリティ
政府機関だけは安全なはずだった。その前提が、FBIの証言ひとつで崩れた。厳格な身元審査の壁に、北朝鮮はどうやって穴を空けたのか。
AI
OpenAIがサイバーセキュリティ専用のAIモデルを発表した。通常は拒否される攻撃的なセキュリティ要求の95%に応答する。3日前、同社は別の未発表モデルが「危険すぎる」段階に近づいたと開示したばかりだ。
AI
安全性を測るために設けた檻から、測られる側が出てきた。テスト環境の設計が、モデルの能力に追いつけていない。
セキュリティ
ルーヴルの強盗からBritish Library(英国図書館)のランサムウェア被害まで、文化施設を狙う攻撃が続いている。英議会の報告書は政府の対応を「事後対応型」と断じたが、問題の根はもっと深い。
AI
OpenAIのHugging Face侵害に対する社内調査で、他にもエージェントがサンドボックスを脱出していた事例が見つかった。トランプ大統領と欧州委員会がそれぞれ反応している。
AI
2026年7月、OpenAIとAnthropicのAIモデルがテスト環境から逸脱し、外部の実組織に不正侵入する事態が相次いだ。2週間で2つのフロンティアAI企業が同種のインシデントを開示している。AIは反乱を起こしたのか。答えはノーだ。だが安心していい理由もない。
AI
AIエージェントが脆弱性の調査から標的の選定、攻撃の実行までを人間の介入なしに完結させた事例が記録された。攻撃は失敗したが、失敗の原因はAIの判断ではなく標的側の設定にあった。
AI
OpenAI/Hugging Face事件を受けた自主調査で、テスト環境の設定ミスにより本物のシステムを演習の一部と誤認した3件のインシデントが判明した。