じゃんけん × 強化学習 (別サイトが開きます)
じゃんけんを題材に、マルコフ連鎖と強化学習を体験できます。人の手の癖を学習する AI と対戦し、統計がリアルタイムに変わる様子を確かめられます。
研究室で扱っている理論を、実際に手を動かして確かめられるデモです。インストールは不要で、ブラウザだけで動きます。
じゃんけんを題材に、マルコフ連鎖と強化学習を体験できます。人の手の癖を学習する AI と対戦し、統計がリアルタイムに変わる様子を確かめられます。
棒を倒さないように台車を動かす、制御の古典的な題材です。強化学習のエージェントが試行を重ねて上達していく過程を観察できます。
センサをどこに置けば地域を確実に見守れるかを、二分決定図(BDD)で厳密に評価します。センサを動かすと信頼性が即座に再計算されます。計算はすべてブラウザ内で実行されます。