Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
楽しみながら機械学習を学べる!DeepRacer入門
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
MasahiroKawahara
September 18, 2019
Technology
1.2k
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
楽しみながら機械学習を学べる!DeepRacer入門
https://dev.classmethod.jp/news/higobashi-aws-190918/
MasahiroKawahara
September 18, 2019
More Decks by MasahiroKawahara
See All by MasahiroKawahara
GuardDuty 検知対応を DevOps Agent で効率化しようとしている話 / GuardDuty Investigations with DevOps Agent
masahirokawahara
1
300
【セミナー資料】Claude Code をセキュアに使うための考え方と設定の勘どころ / Claude Code Webinar 20260616
masahirokawahara
2
810
Claude Code で使える DuckDB Skills を試してみた / DuckDB Skills and Claude Code
masahirokawahara
2
2.9k
Claude Code を安全に使おう勉強会 / Claude Code Security Basics
masahirokawahara
20
49k
Claude Code Skills 勉強会 (DevelersIO向けに調整済み) / claude code skills for devio
masahirokawahara
1
33k
新 Security HubがついにGA!仕組みや料金を深堀り #AWSreInvent #regrowth / AWS Security Hub Advanced GA
masahirokawahara
1
4.1k
AWS環境のリソース調査を Claude Code で効率化 / aws investigate with cc devio2025
masahirokawahara
2
2.3k
ここ一年のCCoEとしてのAWSコスト最適化を振り返る / CCoE AWS Cost Optimization devio2025
masahirokawahara
1
2.7k
生まれ変わった AWS Security Hub (Preview) を紹介 #reInforce_osaka / reInforce New Security Hub
masahirokawahara
0
1.7k
Other Decks in Technology
See All in Technology
[RSJ26] NarrativeFlow: Flow-Based Vision-Language-Action Model Using Robot Velocity Fields
keio_smilab
PRO
0
150
設計の世代交代を乗り越える、14年続くAndroidアプリの開発戦略
sansantech
PRO
1
120
現場に行くだけでは足りない——プロダクトエンジニアが業務の流れを捉える観点と、その鍛え方
takumiengineering
0
280
[RSJ26] AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation
keio_smilab
PRO
0
120
作り直せるコードは迅速に 作り直せないDBは慎重に - AI時代のプロダクトエンジニアが「判断の不可逆性」で開発速度を変える話
kinosuke01
0
230
どんな手を使っても絶対間に合わせるスケジューラ
asari194617
0
1.6k
2026-09-04 SRE Tech Talk #15 怠惰なTerraform / Lazy Terraform
masasuzu
0
190
Autonomous AI Databaseサービス・アップデート(FY27)/ adb-service-update-jp-fy27
oracle4engineer
PRO
0
110
AIエージェントの開発・提供におけるセキュリティリスクの論点と対策
flatt_security
1
570
AI時代のAPI品質を支えるガードレール / API Guardrails for API quality in the AI era
yokawasa
1
110
コスト最適化の「めんどくさい」を AWS FinOps Agent でチョット楽にする
classmethod_kaz
0
160
Benchmarking Vector Databases: pgvector vs. LanceDB
tsho
0
140
Featured
See All Featured
Become a Pro
speakerdeck
PRO
31
6.2k
Why Mistakes Are the Best Teachers: Turning Failure into a Pathway for Growth
auna
0
240
CSS Pre-Processors: Stylus, Less & Sass
bermonpainter
360
30k
Build The Right Thing And Hit Your Dates
maggiecrowley
39
3.4k
Information Architects: The Missing Link in Design Systems
soysaucechin
1
1.1k
Understanding Cognitive Biases in Performance Measurement
bluesmoon
32
3k
Documentation Writing (for coders)
carmenintech
77
5.5k
Gemini Prompt Engineering: Practical Techniques for Tangible AI Outcomes
mfonobong
2
510
職位にかかわらず全員がリーダーシップを発揮するチーム作り / Building a team where everyone can demonstrate leadership regardless of position
madoxten
69
65k
A Soul's Torment
seathinner
7
3.5k
KATA
mclloyd
PRO
35
15k
The Curious Case for Waylosing
cassininazir
1
490
Transcript
1 楽しみながら機械学習を学べる︕ DeepRacer⼊⾨ 川原 征⼤
スライドは後で⼊⼿することが出来ますので 発表中の内容をメモする必要はありません。 写真撮影をする場合は フラッシュ・シャッター⾳が出ないようにご配慮ください Attention
3 ⽬次 ü DeepRacerとは ü DeepRacer 各プロセス Ø 学習フェーズ Ø
評価フェーズ Ø リーグ参戦 ü DeepRacer やってみた
4 ⾃⼰紹介 川原 征⼤ AWS事業本部 コンサルティング部 AWSエンジニア ü 職歴 Ø
2017/04 SE会社 ⼊社 • 主にオンプレネットワーク • 少しAWS Ø 2019/06 クラスメソッド ⼊社 ü 好きなもの︓
5 DeepRacerとは
6 DeepRacer TV https://www.youtube.com/watch?v=JGMNk_HfruY
7 DeepRacerとは ü AWSが提供する機械学習の1サービス ü レーシングカーの⾃動⾛⾏を⽬指す ü 強化学習を楽しみながら習得できる https://aws.amazon.com/jp/deepracer/
8 DeepRacer のプロセス
9 1. 学習
10 2. 評価
11 3. リーグ
12 DeepRacerのプロセス https://dev.classmethod.jp/cloud/aws/relay_looking_back_aws-deepracer/
13 DeepRacerのプロセス https://dev.classmethod.jp/cloud/aws/relay_looking_back_aws-deepracer/ ・AWSマネコンからの GUI 操作 ・仮想サーキット上で⾞両を⾛らせる ・強化学習モデルをトレーニング
14 DeepRacerのプロセス https://dev.classmethod.jp/cloud/aws/relay_looking_back_aws-deepracer/ ・仮想環境上で評価 →結果を Jupyter Notebook等で分析 ・実環境マシンに学習モデルを転送 → ⾛らせてみる
15 DeepRacerのプロセス https://dev.classmethod.jp/cloud/aws/relay_looking_back_aws-deepracer/ ・仮想環境 → DeepRacer Virtual Circuit ・実環境 →
AWS Summit → AWS re:Invent
16 学習フェーズ
17 DeepRacerで学ぶ強化学習
18 強化学習とは (wikipedia より) ü 強化学習とは、ある環境内におけるエージェントが、現在の状態を 観測し、取るべき⾏動を決定する問題を扱う機械学習の⼀種 ü エージェントは⾏動を選択することで報酬を得る ü
強化学習は⼀連の⾏動を通じて報酬が最も多く得られるような⽅策 (policy)を学習する
19 強化学習とは (⽤語) ü DeepRacerにおけるエージェント(Agent) Ø レーシングカー
20 強化学習とは (⽤語) ü DeepRacerにおける環境(Environment) Ø サーキット
21 強化学習とは (⽤語) ü DeepRacerにおける状態(State) Ø カメラ画像
22 強化学習とは (⽤語) ü DeepRacerにおける⾏動(Action) Ø レーシングカーの⾏動 • Steering: 直進・右折・左折
• Speed: 加速・減速
23 強化学習とは (⽤語) ü DeepRacerにおける報酬(Reward) Ø レーシングカーが取った⾏動の良さ • コースアウトせずに⾛れているか •
速く⾛れているか
24 強化学習とは (再) ü 強化学習とは、ある環境内におけるエージェントが、現在の状態を観測し、取 るべき⾏動を決定する問題を扱う機械学習の⼀種 ü エージェントは⾏動を選択することで報酬を得る ü 強化学習は⼀連の⾏動を通じて報酬が最も多く得られるような⽅策(policy)を
学習する
25 学習フェーズ (再)
26 学習フェーズですること ü 強化学習モデルの作成 1. 環境(サーキット) の設定 2. ⾏動空間(速度・ステアリング) の設定
3. 報酬関数の設定 4. ハイパーパラメータ の設定 5. 学習時間の設定
27 学習中・・・ ü トレーニングの様⼦を確認できます
28 (補⾜) バックグラウンド AWSサービス https://www.youtube.com/watch?v=EUBYDkbgBrM
29 評価フェーズ
30 評価フェーズ ü トレーニングしたモデルを評価する Ø 仮想空間上で評価 • 後述 Ø 現実空間上で評価
• 実機にモデルを転送 • 物理サーキット上で⾛らせてみる (引⽤) DNPオリジナル・コースによる「AWS DeepRacer GP powered by DNP」を初公開 https://www.dnp.co.jp/news/detail/1192345_1587.html
31 仮想空間上で評価︓⾛らせてみる ü モデル・サーキットを指定 ü 3〜5回 試⾏
32 仮想空間上で評価︓ログを分析
33 仮想空間上で評価︓ログを分析 ü トレーニングや試⾛のログは CloudWatchに保存
34 仮想空間上で評価︓ログを分析 ü ログを分析する⽅法 Ø CloudWatch Logs Insights Ø Python
Ø Tableau Ø Jupyter Notebook Ø ...など
35 (分析例) CloudWatch Logs Insights Ø 各エピソードの⾛⾏結果表⽰ (コースアウト or 完⾛、タイム)
Ø 完⾛率の表⽰ Ø CSV保存 → 分析ソフトウェア ...など DeepRacerのモデルの学習状況をCloudWatch Logs Insightsで確認する https://dev.classmethod.jp/machine-learning/deepracer-cwlogsinsights/
36 (分析例) Python DeepRacerの⾛⾏ログを Matplotlibで可視化する https://dev.classmethod.jp/server-side/python/deepracer-matplotlib-pandas/
37 (分析例) Tableau DeepRacerの⾛⾏ログをTableauで分析してみた https://dev.classmethod.jp/etc/analysis_sim_trace_log/
38 (分析例) Jupyter Notebook ü https://github.com/aws-samples/aws-deepracer-workshops Ø AWSが提供しているログ分析ツール AWS DeepRacerのログ分析ツールを使ってみた
https://qiita.com/dnp-ayako/items/d4e1378bef45cd0994dd
39 リーグ参戦
40 DeepRacerリーグ概要 ü “世界初のグローバル⾃⾛型レーシングリーグ” ü 今は re:Invent 本戦に向けた予選中 Ø 仮想:
バーチャル サーキット・リーグ Ø 実機: サミット サーキット・リーグ https://aws.amazon.com/jp/summits/tokyo-2019/deepracer-league-guide/ Now!!
41 バーチャル サーキット・リーグ ü ⽉替りで開催 ü トレーニングさせたモデルを提出 (Submit) する Ø
5回試⾛。完⾛したベストタイムがリーダーボードに登録 Ø Submit は 30分に 1回 7⽉: Empire City Circuit 8⽉: Shanghai Sudu 今⽉(9⽉) : Cumulo Carerra
42 バーチャル サーキット・リーグ (画⾯)
43 サミット サーキット・リーグ ü 各 AWS Summitの現地で開催 【参加レポート】AWS DeepRacer リーグに参加してきました
https://dev.classmethod.jp/cloud/awssummit2019-deepracer-league/
44 リーグの報酬 ü DeepRacer 賞 Ø 対象︓10位以内の⼊賞 Ø 賞品︓DeepRacer レーシングカー実機
ü re:Invent 賞 Ø 対象︓1位 + α (※) Ø 賞品︓re:Invent リーグへの参戦権 • 参加費、交通費、宿泊費は AWS が負担︕ ※ 各サーキットを通じて所定の⽅法で評価された「ポイントゲッター」 https://aws.amazon.com/jp/summits/tokyo-2019/deepracer-league-guide/
45 やってみた
46 7⽉の仮想リーグに参戦
47 公式の Getting started をやる
48 Get started with reinforcement learning https://console.aws.amazon.com/deepracer/home?region=us-east-1#getStarted
49 モデルの作成
50 (再掲) 学習フェーズですること ü 強化学習モデルの作成 1. 環境(サーキット) の設定 2. ⾏動空間(速度・ステアリング)
の設定 3. 報酬関数の設定 4. ハイパーパラメータ の設定 5. 学習時間の設定
51 環境 ü トレーニング⽤コースを選択
52 ⾏動空間 ü フィーリングで決定
53 報酬関数 ü ⼊⼒パラメータについて学ぶ Ø distance_from_center Ø steering_angle Ø speed
... など https://docs.aws.amazon.com/ja_jp/deepracer/latest/developerguide/deepracer-reward-function-input.html
54 報酬関数 ü 作成してみる
55 ハイパーパラメータ ü ???
56 ハイパーパラメータ ü 勉強会で⼤雑把に理解。とりあえずデフォルト設定で ← 1学習で使⽤するデータ量 ← 学習回数 ← 学習しやすさ
← ⾏動選択のランダムさ ←どれだけ将来のステップを考慮するか ←損失関数の選択。Huberの⽅が収束がいいらしい ←どれだけ経験を積んでから更新するか
57 学習時間 ü とりあえず 1時間
58 トレーニング開始
59 トレーニング中 ü ⾒ているだけで楽しい
60 モデル完成︕
61 トレーニング⇔評価 繰返しながら ひたすらサブミット
62 ⼀番輝いていたとき
63 過学習に苦しむ
64 過学習に苦しむ ← 直進するところを 左にコースアウトしてしまう
65 過学習に苦しむ ü 原因︓トレーニング/本番 コースの形状の違い
66 結果
67 13位で Finish
68 感想
69 感想 ü DeepRacer 楽しい︕ Ø ⾞の(⾃動)運転という親しみやすいお題 Ø 知らず知らずのうちに各専⾨⽤語が頭に⼊っていく ü
分析で得られたスキルが多い Ø AWS (CloudWatch Logs Insights) Ø Python (pandas, matplotlib, JupyterNotebook) ü 機械学習を学ぶモチベーションができた Ø 現在勉強中・・・
70 まとめ
71 まとめ ü DeepRacerは楽しみながら強化学習を学べるコンテンツ ü 仮想/Summit リーグは報酬あり Ø 10位以内 ...
実機レーシングカー Ø 1位 ... re:Invent (ラスベガス) 招待 ü 機械学習未経験者にこそオススメ Ø 実体験を通して⾃然と知識が⼊っていく Ø 機械学習に DeepDive するきっかけに
72 補⾜︓ほか参考資料
73 ほか参考資料 ü 料⾦・無料利⽤枠について Ø https://aws.amazon.com/jp/deepracer/pricing/ ü DevelopersIOの DeepRacer関連のブログ⼀覧 Ø
https://dev.classmethod.jp/referencecat/aws-deepracer/ ü DeepRacer リーグのルール詳細 Ø https://aws.amazon.com/jp/summits/tokyo-2019/deepracer-league-guide/ ü AWS DeepRacer workshop Ø https://github.com/aws-samples/aws-deepracer- workshops/blob/master/Workshops/2019-AWSSummits- AWSDeepRacerService/Lab1/Readme-Japanese.md