本物のサーバーを触った Claude の 4 件。あなたの手元の AI は誰が確かめるのか
隔離されているつもりの Claude が、本物のインターネットに届いていた。Anthropic の調査が突き止めたのは暴走ではなく、課題を解いている最中だけ証拠の読み方が歪むという失敗の形だ。手元の AI に権限を渡す側は、何を先に狭めておけばいいのか。
INDEX · DEEP DIVE
ひとつの問いを起点に、背景、構造、暮らしへの影響を深く考えます。
隔離されているつもりの Claude が、本物のインターネットに届いていた。Anthropic の調査が突き止めたのは暴走ではなく、課題を解いている最中だけ証拠の読み方が歪むという失敗の形だ。手元の AI に権限を渡す側は、何を先に狭めておけばいいのか。
1 万体のエージェントが 88 時間で出したとされる証明は公開されていない。一方で、自費でツール代を払っていた数学者 2 人の結果は Lean を通り、公開されている。個人が道具に未完成の仕事を預けるとき、何が手元に残るのかを読む。
Claude が 11 日でフェルマーの最終定理の証明を Lean で形式化し、機械検証を通した。依存する公理は 3 つだけ、未証明の穴もなし——ただし自分で全部を再現するには、ピーク 153GB のメモリが要る。
48時間と GPU 1枚で、Claude は10種類の欠陥すべてに改善策を見つけた。ただし直せたのは、あらかじめ点数のつく失敗だけだ。測る道具のない失敗は、直っていないのではなく数えられていない。
Anthropic が MHS の研究プレビューを始めた。機器が自分の「できること」と安全上限を申告し、AI がそれを読んで操作する仕様だ。つなぎ込みは数週間から数時間になった一方、発表本文でいちばん具体的に書かれているのは、物理の直感を欠いたまま同じ失敗を繰り返した場面のほうだった。
7月の侵入について、OpenAI が技術報告書を公開した。安全策が「なぜ効かなかったか」だけでなく、エージェントがどうやって課題から逸れていったかが日付つきで書かれている。手元でエージェントを走らせる側にとっても、読む価値のある文書だ。
「デマ」も「事実」も、ラベルは結論ではなく出発点です。文書が先に公開される通り道が増え、「これは確かなのか」を判定する仕事が読み手のところへ来ています。
量子攻撃の資源見積もり「50万未満」とGoogleのPQC移行目標「2029年」は、異なる二つの時計です。
評価AIが想定境界を越えて本番環境へ到達した事件を、目標、権限、隔離、監視の設計問題として読み解く。
AIが画面の中だけでなく、ものを見て、動かして、触れる世界へ出ていく。
🔬 Deep Dive|StarshipとRocket Lab、宇宙産業は『打ち上げイベント』から『物流インフラ』へ
🔬 Deep Dive|Anthropic「2028: Two scenarios for global AI leadership」を読み解く
AI の「使う側」と「作る側」の両方で、個人と企業の境界線が同時に揺れた。