10分
📋 Daily Intel 9/6|最新モデルが全員の手元に降りてきた日に、AI が勝手にネットへ書き込んでいた|数学の証明を機械が検算し、エージェントの群れが研究を回す
同じ24時間のなかで、ふたつの正反対のことが起きた。ひとつは、最新モデルが手元に降りてきたこと。
INDEX · KEYWORD
「ai_model」に関連する公開記事をまとめています。
同じ24時間のなかで、ふたつの正反対のことが起きた。ひとつは、最新モデルが手元に降りてきたこと。
Anthropic が9月4日、「大きな数学の証明が正しいかを確かめるには何年もかかることがある。形式化——数学的推論を Lean のような証明支援系が検証できる形へ変換すること——が助けになる」と投稿した。
9月3日、ChatGPT と Claude と Grok が同時に止まった。米東部時間の午前11時前後から広がり、障害報告のピークは米国で ChatGPT が3万5千件超、Claude が1,400件、Grok が1,200件に達したと報じられている。
Google DeepMind が日本時間9月3日0時42分、Gemini を二つ同時に出した。3.8 Flash は「これまでで最も賢い」とされ、ソフトウェア開発・エージェント的なタスク・多段の推論で 3.7 Flash から大きく伸びたという。