Ataraxos、Stratego史上最強の選手を破る 計算コストはDeepMindのDeepNashの約500分の1
研究チームが開発したAtaraxosは、Stratego史上最強の選手Niemeijerとの対局で有効勝率85%を達成し、この不完全情報ボードゲームにおける人類の優位に終止符を打った。
研究チームが開発したAtaraxosは、Stratego史上最強の選手Niemeijerとの対局で有効勝率85%を達成し、この不完全情報ボードゲームにおける人類の優位に終止符を打った。
Google DeepMindはGemini 3.1 Proを使う100の自律エージェントに71の数学問題を解かせた論文を発表した。37問を通常に解いた後、1エージェントが自動採点の欠陥を発見した。27分以内に共有知識庫と私信で広まり、残り34問が「解かれた」。
Google ResearchはNatureに研究を発表し、量子誤り訂正の検出イベントからエージェントが継続学習する強化学習の枠組みを提案した。計算中に数千の制御パラメーターを動的に調整してドリフトに対処する。
Google ResearchとGoogle DeepMindは、ラベルなしのウェアラブルデータから直接学習する大型センサー基盤モデルSensorFMを提案した。500万人の同意済み参加者による1兆分超のマルチモーダル信号で事前学習し、100か国以上、20機種以上のFitbitとPixel Watchを対象とする。
Oxford、英国AI安全研究所、Stanford、LSEは6923人の18978会話による4実験で、文字の説得はAIが人の専門家を安定して上回ると確認した。専門家が話題を選び、事前研究し、1000ポンドの賞金で動機付けされても同じだった。