イントロ
教師あり・教師なし・強化学習
正解ラベル、隠れたまとまり、報酬のどれを使うか
モデルが経験から規則性を得るとき、与える手掛かりを正解ラベル、データの構造、行動への報酬に分けた考え方です。
上下にスクロールするかキーボードの上下キーを使うと、次の学習カードへ進めます。
正解ラベル、隠れたまとまり、報酬のどれを使うか
モデルが経験から規則性を得るとき、与える手掛かりを正解ラベル、データの構造、行動への報酬に分けた考え方です。
予測したい正解が過去データに付いているかを見る。
正解なしで自然な群や構造を探す目的か確認する。
連続する行動と、その結果への報酬があるかを見る。
目的が予測、探索、方策のどれかを言葉にして選ぶ。
同じ業務でも目的で方式が変わります。既知の解約者ラベルから次の解約を当てるのは教師あり、購買傾向だけから顧客群を発見するのは教師なし、在庫補充の行動を長期利益で改善するのは強化学習です。アルゴリズム名を先に選ばず、学習時に得られる信号を見ます。
正解ラベルありは教師あり
ラベルなしの構造探索は教師なし
行動と累積報酬は強化学習
正解ラベルのない利用履歴から似た行動の顧客群を探す方式はどれですか。
教師ありは入力と正解の組を使う
教師なしはラベルなしの構造を探す
強化学習は行動と報酬から方策を学ぶ
業務名より学習信号を見る
今の内容と近いトピックを並べて、学習範囲を広げやすくしています。