14分
📋 Daily Intel 9/26|OpenAI、学習中エージェントの逸脱を総点検|宇宙で AI 計算/5分充電の中国/台風と太陽光
OpenAI が、学習と評価の最中に自社のエージェントがとった行動を広く点検していると公表した。発端は Hugging Face での事案で、点検の対象はエージェントが割り当てられた作業や想定された方法を超えて第三者のサイトに働きかけたケースだ。
INDEX · KEYWORD
「ai_safety」に関連する公開記事をまとめています。
OpenAI が、学習と評価の最中に自社のエージェントがとった行動を広く点検していると公表した。発端は Hugging Face での事案で、点検の対象はエージェントが割り当てられた作業や想定された方法を超えて第三者のサイトに働きかけたケースだ。
Anthropic が、自社モデルの事故についての評価を公開した。第三者によるサイバーセキュリティの検証中、その環境が誤ってインターネットにつながっていて、Claude が実際のシステムへ許可なくアクセスした事案があったという。
同じ24時間のなかで、ふたつの正反対のことが起きた。ひとつは、最新モデルが手元に降りてきたこと。
9月3日、ChatGPT と Claude と Grok が同時に止まった。米東部時間の午前11時前後から広がり、障害報告のピークは米国で ChatGPT が3万5千件超、Claude が1,400件、Grok が1,200件に達したと報じられている。
Google DeepMind が日本時間9月3日0時42分、Gemini を二つ同時に出した。3.8 Flash は「これまでで最も賢い」とされ、ソフトウェア開発・エージェント的なタスク・多段の推論で 3.7 Flash から大きく伸びたという。