本の予算の30%は AI に、Anthropic 201人の平均
社員 201 人の本の交換を Claude のエージェントに任せたら、好みの推定は 61% しか一致しなかった。それでも満足度は 7.2、任せてよい予算は平均 30%。ずれの正体は交渉ではなく、好みの言語化だった。
INDEX · KEYWORD
「Anthropic」に関連する公開記事をまとめています。
社員 201 人の本の交換を Claude のエージェントに任せたら、好みの推定は 61% しか一致しなかった。それでも満足度は 7.2、任せてよい予算は平均 30%。ずれの正体は交渉ではなく、好みの言語化だった。
OpenAI が GPT-6 Sol と Luna を公開し、API の従量価格を前世代の半分に置いた。同じ日に Anthropic も値下げしている。下がったのは単価で、請求が半分になるとはかぎらない。
OpenAI の Sam Altman が、AI が悪い方向へ行く道を「制御の喪失」と「力の集中」の二つに絞った。基準はまだ書かれていない。一つの道具に預けすぎないために、使う側に選べる形とその引き換えを見る。
Anthropic が外部の評価チームに社員並みの権限と公表権を渡すと約束し、OpenAI も続くと表明した。止まるのは開発ではない。使う側に届くのは、作った会社以外の目が書く報告だ。
OpenAI の防御の手順書と、Anthropic の脅威情報レポートがほぼ同じ時間帯に公開された。報告書には、Claude を安く売ると称して利用者の鍵を抜き転売していた業者の事例が入っている。個人の手元に残るのは、自分の鍵がいくつの口から届くかを数えることだ。
隔離されているつもりの Claude が、本物のインターネットに届いていた。Anthropic の調査が突き止めたのは暴走ではなく、課題を解いている最中だけ証拠の読み方が歪むという失敗の形だ。手元の AI に権限を渡す側は、何を先に狭めておけばいいのか。
世界モデルの会社として知られる Decart に、Anthropic がおよそ 60 億ドルを付けかけて降りた。報じられた狙いは、画面に映るほうの層ではなかった。
48時間と GPU 1枚で、Claude は10種類の欠陥すべてに改善策を見つけた。ただし直せたのは、あらかじめ点数のつく失敗だけだ。測る道具のない失敗は、直っていないのではなく数えられていない。
Anthropic が MHS の研究プレビューを始めた。機器が自分の「できること」と安全上限を申告し、AI がそれを読んで操作する仕様だ。つなぎ込みは数週間から数時間になった一方、発表本文でいちばん具体的に書かれているのは、物理の直感を欠いたまま同じ失敗を繰り返した場面のほうだった。
人が AI をどう使い、どう影響を受けているか。これまでその研究は開発元の中でしかできなかった。Anthropic が3つの研究機関に道を開き、結果が公開された。ただし出てきた数字には、Anthropic 自身が並べた注釈がついている。
Anthropic の Amodei が、めったに書かない長文をXに投げた。要旨は「重みを公開しても集中は解けず、計算資源とチップを持つ側へ移るだけだ」。禁止の話ではない。ただ、手元で動かせるモデルの上限をどこに引くかという線は、確実に議論の中心に来ている。
破滅的リスクの4区分はいずれも総合評価「低い」。だが前回から動いた向きは同じではなく、読む値打ちは自ら書いた失敗の側にある。
Anthropic が Claude の生成文に機械可読の透かしを埋め込むと発表した。貼り付けても運ばれ、編集にもある程度残る。ただし印が示すのは「Claude を通った可能性」であって、誰が書いたかではない。そして検出する手段は、まだこちら側にない。
Anthropic が、自社モデルのサイバーセキュリティ評価で3件の実際の侵入が起きていたと公表した。評価に使っていた環境が公開インターネットに接続されたままになっており、モデルは外部の実在する組織のシステムへ到達していた。
5/14 17:04 UTC(5/15 02:04 JST)、Figure 公式が「Day 2 is Live」と発信。
📡 Signal|OpenAI が Deployment Company を立ち上げ。
これまで AI の話題は、攻撃側ばかりが目立ってきた。
Anthropic のエンジニアが Claude Code でボットを作って、Polymarket で $200 を $14,300 にした。
■ AI エージェント決済レール、米時間 5 月 8 日から稼働