技術要素
基本情報技術者試験|エージェントが環境の中で行動し、その結果として得られる報酬を最大化するように試行錯誤を通じて方策を学習する手法は…
エージェントが環境の中で行動し、その結果として得られる報酬を最大化するように試行錯誤を通じて方策を学習する手法はどれか。
ア強化学習
イ教師あり学習
ウ教師なし学習
エアンサンブル学習
正解
ア.強化学習
強化学習はエージェントが環境内で行動し、得られる報酬の累積を最大化する方策を試行錯誤で学ぶ。設問の説明に一致するため正しい。
?選択肢ごとの解説
ア ○強化学習はエージェントが環境内で行動し、得られる報酬の累積を最大化する方策を試行錯誤で学ぶ。設問の説明に一致するため正しい。
イ ×教師あり学習は正解ラベル付きデータから入力と出力の対応を学ぶ手法で、報酬による試行錯誤を行うものではない。
ウ ×教師なし学習はラベルのないデータからクラスタや構造を見つける手法で、報酬を最大化する仕組みではない。
エ ×アンサンブル学習は複数モデルの予測を統合して精度を高める技法で、報酬に基づく方策学習とは枠組みが異なる。
技術要素の他の問題
ニューラルネットワークを多層化した機械学習の手法であるディープラーニング(深層学習)に関する記述として、最も適切なものはどれ…機械学習モデルが訓練データには非常によく適合する一方、未知の新しいデータに対しては精度が低くなる現象を何というか。大量のテキストを学習し、入力された文章に続く自然な文を確率的に予測して新しい文章を生成する技術を最もよく表すものはどれか。IoTシステムにおいて、コンピュータからの指示を受けて物理的な動作(モータの回転や弁の開閉など)を行う機器を何というか。多数のIoT機器が生成するデータを、クラウドへ送る前に機器側や近傍の装置で処理することにより、応答の遅延と通信量を抑える方式…ビッグデータの特性を表す3Vのうち、データが生成・流入する速さに着目した要素はどれか。小売店の大量の購買履歴を分析し『商品Aを買う客は商品Bも一緒に買う傾向が強い』といった併買の規則性を見つけ出す手法はどれか。あらかじめ正解ラベルを与えず、データ間の類似度に基づいて自動的にいくつかの群に分ける機械学習の手法はどれか。
この問題の「深掘り・誤答の完全解説・覚え方」は、登録すると読めます。
基本情報技術者試験は全4,036問。公開しているのはその一部で、登録すると残りも一問ごとにAI解説つきで解けます。SRS暗記カード・全真模試・弱点診断まで。
登録は1分・クレジットカード不要。無料のまま練習・暗記カード・模試まで使えます。
作成・校閲:ukamiru編集部 · 基本情報技術者試験 過去問 · fe-a3-0307
