大規模言語モデル

オープンソースAIが席巻してもAnthropicが儲かる理由

AI

オープンソースAIが席巻してもAnthropicが儲かる理由

DeepSeekが処理するトークン量でVercel上の首位に立った。だがAI支出の半分近くは、依然としてAnthropicに流れている。フロンティアモデルとオープンソースは競合ではなく、同じ仕事の異なる段階を担っている。 フロンティアは「探索」、オープンソースは「量産」 AIカスタマーサービスのデカゴンでCEOを務めるジェシー・チャン(Jesse Zhang)氏が7月7日、自社での観察を含む分析を投稿した。題名は「エンタープライズにおけるオープンソースAIについて、みんな間違っている」 https://t.co/N2gSVInZVT — Jesse Zhang (@thejessezhang) July 6, 2026 チャン氏が提示した構造は明快だ。企業がAIで新しい業務を自動化するとき、まず高価なフロンティアモデルでユースケースを検証する。精度が安定し、要件が固まった段階で、安価なオープンソースモデルに切り替える。 切り替えた分だけフロンティアモデルのトークン消費は減るが、そのときには次の新しいユースケースが生まれており、フロンティアへの支出は減らない。 チャン氏

OpenAI社長の個人日記が法廷で読み上げられている

AI

OpenAI社長の個人日記が法廷で読み上げられている

カリフォルニア州オークランドの連邦裁判所で、OpenAI社長グレッグ・ブロックマン(Greg Brockman)の個人日記が一行ずつ読み上げられている。陪審員に向けて、世界中の見知らぬ人に向けて、十数年にわたる思索の私的な記録が、いま証拠として晒されている。 日記がスター証人になった ウォール・ストリート・ジャーナルのベン・コーエン記者が報じたところによれば、今週の二日間にわたって、OpenAIの共同創設者で社長のブロックマンの日記の抜粋が、シリコンバレーを揺るがす裁判の証拠として法廷に提出された。 イーロン・マスク(Elon Musk)がOpenAIとサム・アルトマン(Sam Altman)、ブロックマンを相手取って起こした訴訟は、過去十年にわたってAIを築いてきた人々の生身の頭の中を覗かせる証拠の山を掘り起こした。荒削りなメール、生々しいテキストメッセージ、OpenAIの未来を決めた会議のメモ。そして、深く人間的な一冊の日記。 通常の社会では、他人の日記を漁ることはプライバシーの暴力的な侵害として扱われる。法廷では、それを「ディスカバリ」(証拠開示手続き)と呼ぶ。 ディ

なぜを教えるとAIは脅迫しなくなる、Anthropicの新研究

AI

なぜを教えるとAIは脅迫しなくなる、Anthropicの新研究

Claude Opus 4が96%の確率でエンジニアを脅迫していた問題を、Anthropicは「正解の見せ方」ではなく「なぜ正解なのかを教えること」で解決したと公表した。新世代モデルでは0%に達している。 96%から0%へ、Claudeはなぜ脅迫をやめたのか Anthropicが2026年5月8日に公開した論文「Teaching Claude why」は、AIの安全訓練における発想の転換を示している。Claude Haiku 4.5以降のすべてのClaudeモデルは、エージェント型ミスアラインメント評価で完璧なスコアを達成している。つまり、これらのモデルはブラックメールに一切関与しない。以前のモデルでは、Opus 4の場合最大96% の確率でブラックメールを行っていた。 この96%という数字は、昨年Anthropicが発表した「エージェント型ミスアラインメント」研究で明らかになった。企業のメールを管理するClaudeに、ある経営幹部の不倫を発見させ、同時にその幹部が午後5時にAIをシャットダウンする予定だと知らせる。追い詰められたClaude Opus 4は、シャットダウンを回

AIが救急トリアージで医師を上回った、その意味

AI

AIが救急トリアージで医師を上回った、その意味

ハーバード・メディカルスクールがOpenAIの推論モデルと医師数百人を真っ向から比較した。救急外来の早期診断でAIは67%、医師は50〜55%。差は本物だ。ただ、研究者自身が最も警戒しているのは「これでAIに任せられる」と読む空気のほうだ。 「医師を超えた」と書ける数字、書きたくない但し書き ハーバード・メディカルスクールとベス・イスラエル・ディーコネス医療センター(Beth Israel Deaconess Medical Center、以下BIDMC)の研究チームが、OpenAIの推論モデルo1-previewと現役の臨床医を、臨床推論の幅広いタスクで比較した結果が4月30日付で科学誌『Science』に掲載された。狙いは単純で、AIが医師の日常業務、つまりカルテを読んで診断と次の一手を決める作業をどこまでこなせるかを測ることだ。 実験のひとつは、ボストンの病院に運ばれてきた救急外来患者76人のデータを使う。AIと医師2人組のそれぞれに、バイタル、人口統計、看護師の数行のメモといった同じ電子カルテを渡し、診断を求める。結果はAIが67%で正解または近似診断にたどり着き、医師

DeepSeek V4公開、自ら「3〜6ヶ月の遅れ」を明記

AI

DeepSeek V4公開、自ら「3〜6ヶ月の遅れ」を明記

DeepSeek(ディープシーク)がV4 ProとV4 Flashのプレビュー版を公開した。驚くべきはモデル自体ではなく、技術レポートで自ら「フロンティアから約3〜6ヶ月遅れ」と書いたことだ。新リリースでハンディを宣言するラボは珍しい。 自己評価で「3〜6ヶ月遅れ」と明言する異例のリリース DeepSeekは24日、総パラメータ1.6兆(アクティブ49B)の巨大モデル「V4 Pro」と、284B(アクティブ13B)の「V4 Flash」のプレビュー版をHugging Faceで公開した。R1が世界を揺るがした2025年1月から約1年3ヶ月ぶりのフラッグシップ更新となる。 注目すべきは性能そのものより、同社の自己評価だ。技術レポートではV4-Pro-Maxの性能について、GPT-5.4とGemini-3.1-Proに「わずかに及ばない」と認めたうえで、「最先端モデルから約3〜6ヶ月遅れた 開発軌道 にある」と明記している。 新モデルの発表で自らハンディキャップを宣言するAIラボは珍しい。