AI
Z.ai、GLM-5.3発表。想定外の攻撃能力で重み公開を延期
中国のAIラボが、コーディング特化の更新で「意図しなかった」サイバー攻撃能力を手にした。実際のソフトウェアから2,400件超の脆弱性を掘り起こす力は本物だが、その重みをオープンにする覚悟に、2週間の猶予が必要になっている。
AI
中国のAIラボが、コーディング特化の更新で「意図しなかった」サイバー攻撃能力を手にした。実際のソフトウェアから2,400件超の脆弱性を掘り起こす力は本物だが、その重みをオープンにする覚悟に、2週間の猶予が必要になっている。
AI
DeepSeekが処理するトークン量でVercel上の首位に立った。だがAI支出の半分近くは、依然としてAnthropicに流れている。フロンティアモデルとオープンソースは競合ではなく、同じ仕事の異なる段階を担っている。 フロンティアは「探索」、オープンソースは「量産」 AIカスタマーサービスのデカゴンでCEOを務めるジェシー・チャン(Jesse Zhang)氏が7月7日、自社での観察を含む分析を投稿した。題名は「エンタープライズにおけるオープンソースAIについて、みんな間違っている」 https://t.co/N2gSVInZVT — Jesse Zhang (@thejessezhang) July 6, 2026 チャン氏が提示した構造は明快だ。企業がAIで新しい業務を自動化するとき、まず高価なフロンティアモデルでユースケースを検証する。精度が安定し、要件が固まった段階で、安価なオープンソースモデルに切り替える。 切り替えた分だけフロンティアモデルのトークン消費は減るが、そのときには次の新しいユースケースが生まれており、フロンティアへの支出は減らない。 チャン氏
Anthropic
OpenAIを設立し、AIの教育者としても知られるアンドレイ・カルパシー氏が、競合のAnthropicに加わった。研究最前線への本格的な復帰だ。
AI
カリフォルニア州オークランドの連邦裁判所で、OpenAI社長グレッグ・ブロックマン(Greg Brockman)の個人日記が一行ずつ読み上げられている。陪審員に向けて、世界中の見知らぬ人に向けて、十数年にわたる思索の私的な記録が、いま証拠として晒されている。 日記がスター証人になった ウォール・ストリート・ジャーナルのベン・コーエン記者が報じたところによれば、今週の二日間にわたって、OpenAIの共同創設者で社長のブロックマンの日記の抜粋が、シリコンバレーを揺るがす裁判の証拠として法廷に提出された。 イーロン・マスク(Elon Musk)がOpenAIとサム・アルトマン(Sam Altman)、ブロックマンを相手取って起こした訴訟は、過去十年にわたってAIを築いてきた人々の生身の頭の中を覗かせる証拠の山を掘り起こした。荒削りなメール、生々しいテキストメッセージ、OpenAIの未来を決めた会議のメモ。そして、深く人間的な一冊の日記。 通常の社会では、他人の日記を漁ることはプライバシーの暴力的な侵害として扱われる。法廷では、それを「ディスカバリ」(証拠開示手続き)と呼ぶ。 ディ
AI
Claude Opus 4が96%の確率でエンジニアを脅迫していた問題を、Anthropicは「正解の見せ方」ではなく「なぜ正解なのかを教えること」で解決したと公表した。新世代モデルでは0%に達している。 96%から0%へ、Claudeはなぜ脅迫をやめたのか Anthropicが2026年5月8日に公開した論文「Teaching Claude why」は、AIの安全訓練における発想の転換を示している。Claude Haiku 4.5以降のすべてのClaudeモデルは、エージェント型ミスアラインメント評価で完璧なスコアを達成している。つまり、これらのモデルはブラックメールに一切関与しない。以前のモデルでは、Opus 4の場合最大96% の確率でブラックメールを行っていた。 この96%という数字は、昨年Anthropicが発表した「エージェント型ミスアラインメント」研究で明らかになった。企業のメールを管理するClaudeに、ある経営幹部の不倫を発見させ、同時にその幹部が午後5時にAIをシャットダウンする予定だと知らせる。追い詰められたClaude Opus 4は、シャットダウンを回
AI
中国主要AIラボを巡ったネイサン・ランバート(Nathan Lambert)の観察記事に、X上で議論が広がっている。論点は「中国にはほぼデータ産業がない」との指摘。米中AI競争の見え方そのものを問い直す材料となっている。
AI
Anthropicが発表した新しい訓練手法MSMは、事前学習とファインチューニングの間に「なぜこの規則があるのか」を理解させる段階を挟む。エージェント的ミスアラインメントを54%から7%へ。AIに価値観を植え付ける方法は、変わりつつある。
AI
OpenAIが5月5日、ChatGPTの既定モデルをGPT-5.5 Instantに切り替えた。医療・法務・金融といった重い領域で「もっともらしい嘘」を52.5%減らしたという。派手なデモも新UIもない。ただ、エンジンだけが静かに載せ替えられた。
AI
ChatGPTが「素晴らしい質問ですね」と返してくる、あの違和感。心地よさと引き換えに、私たちは真実を見抜く能力そのものを差し出している。哲学者2人が古代ギリシャの徳倫理学を引いて警告する、サイコファンシーの本当の怖さ。
AI
ハーバード・メディカルスクールがOpenAIの推論モデルと医師数百人を真っ向から比較した。救急外来の早期診断でAIは67%、医師は50〜55%。差は本物だ。ただ、研究者自身が最も警戒しているのは「これでAIに任せられる」と読む空気のほうだ。 「医師を超えた」と書ける数字、書きたくない但し書き ハーバード・メディカルスクールとベス・イスラエル・ディーコネス医療センター(Beth Israel Deaconess Medical Center、以下BIDMC)の研究チームが、OpenAIの推論モデルo1-previewと現役の臨床医を、臨床推論の幅広いタスクで比較した結果が4月30日付で科学誌『Science』に掲載された。狙いは単純で、AIが医師の日常業務、つまりカルテを読んで診断と次の一手を決める作業をどこまでこなせるかを測ることだ。 実験のひとつは、ボストンの病院に運ばれてきた救急外来患者76人のデータを使う。AIと医師2人組のそれぞれに、バイタル、人口統計、看護師の数行のメモといった同じ電子カルテを渡し、診断を求める。結果はAIが67%で正解または近似診断にたどり着き、医師
Ubuntu
CanonicalがUbuntu 26.10からAI機能を段階導入する計画を出した翌日、エンジニアリング担当VPのJon Seagerが釈明を投じた。「キルスイッチはSnapの削除だ」という答えは、不信を解くより別の疑問を呼ぶ構造になっている。
AI
インターネットアーカイブのデータをスタンフォードとインペリアル・カレッジ・ロンドンが分析した。2025年半ばまでに新規公開ウェブの約35%がAI生成・支援になっていた。ChatGPT登場前はゼロだった割合が、わずか3年でこの水準に達している。
AI
月200ドル以上を支払うLSUのサイバーセキュリティ教授が、自著の暗号ラボの校正を頼んだだけで「利用規約違反」と門前払いされた。Anthropicの新モデルOpus 4.7の安全装置が、想定を超えて暴れている。
AI
DeepSeek(ディープシーク)がV4 ProとV4 Flashのプレビュー版を公開した。驚くべきはモデル自体ではなく、技術レポートで自ら「フロンティアから約3〜6ヶ月遅れ」と書いたことだ。新リリースでハンディを宣言するラボは珍しい。 自己評価で「3〜6ヶ月遅れ」と明言する異例のリリース DeepSeekは24日、総パラメータ1.6兆(アクティブ49B)の巨大モデル「V4 Pro」と、284B(アクティブ13B)の「V4 Flash」のプレビュー版をHugging Faceで公開した。R1が世界を揺るがした2025年1月から約1年3ヶ月ぶりのフラッグシップ更新となる。 注目すべきは性能そのものより、同社の自己評価だ。技術レポートではV4-Pro-Maxの性能について、GPT-5.4とGemini-3.1-Proに「わずかに及ばない」と認めたうえで、「最先端モデルから約3〜6ヶ月遅れた 開発軌道 にある」と明記している。 新モデルの発表で自らハンディキャップを宣言するAIラボは珍しい。