Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
第五章-交差検証と再標本化【数学嫌いと学ぶデータサイエンス・統計的学習入門】
Search
Ringa_hyj
June 15, 2020
Technology
0
270
第五章-交差検証と再標本化【数学嫌いと学ぶデータサイエンス・統計的学習入門】
第五章【数学嫌いと学ぶデータサイエンス・統計的学習入門】
Ringa_hyj
June 15, 2020
Tweet
Share
More Decks by Ringa_hyj
See All by Ringa_hyj
DVCによるデータバージョン管理
ringa_hyj
0
210
deeplakeによる大規模データのバージョン管理と深層学習フレームワークとの接続
ringa_hyj
0
88
Hydraを使った設定ファイル管理とoptunaプラグインでのパラメータ探索
ringa_hyj
0
170
ClearMLで行うAIプロジェクトの管理(レポート,最適化,再現,デプロイ,オーケストレーション)
ringa_hyj
0
160
Catching up with the tidymodels.[Japan.R 2021 LT]
ringa_hyj
3
860
多次元尺度法MDS
ringa_hyj
0
320
因子分析(仮)
ringa_hyj
0
170
階層、非階層クラスタリング
ringa_hyj
0
140
tidymodels紹介「モデリング過程料理で表現できる説」
ringa_hyj
0
510
Other Decks in Technology
See All in Technology
戰略轉變:從建構 AI 代理人到發展可擴展的技能生態系統
appleboy
0
180
AI with TiDD
shiraji
1
340
2025年のデザインシステムとAI 活用を振り返る
leveragestech
0
700
_第4回__AIxIoTビジネス共創ラボ紹介資料_20251203.pdf
iotcomjpadmin
0
170
Everything As Code
yosuke_ai
0
490
AI: The stuff that nobody shows you
jnunemaker
PRO
1
160
フルカイテン株式会社 エンジニア向け採用資料
fullkaiten
0
10k
AWS re:Invent2025最新動向まとめ(NRIグループre:Cap 2025)
gamogamo
0
150
あの夜、私たちは「人間」に戻った。 ── 災害ユートピア、贈与、そしてアジャイルの再構築 / 20260108 Hiromitsu Akiba
shift_evolve
PRO
0
430
Oracle Cloud Infrastructure:2025年12月度サービス・アップデート
oracle4engineer
PRO
0
190
モノタロウ x クリエーションラインで実現する チームトポロジーにおける プラットフォームチーム・ ストリームアラインドチームの 効果的なコラボレーション
creationline
0
440
1万人を変え日本を変える!!多層構造型ふりかえりの大規模組織変革 / 20260108 Kazuki Mori
shift_evolve
PRO
5
820
Featured
See All Featured
Jamie Indigo - Trashchat’s Guide to Black Boxes: Technical SEO Tactics for LLMs
techseoconnect
PRO
0
37
The SEO Collaboration Effect
kristinabergwall1
0
320
The B2B funnel & how to create a winning content strategy
katarinadahlin
PRO
0
220
DevOps and Value Stream Thinking: Enabling flow, efficiency and business value
helenjbeal
1
76
Visualization
eitanlees
150
16k
More Than Pixels: Becoming A User Experience Designer
marktimemedia
2
280
Creating an realtime collaboration tool: Agile Flush - .NET Oxford
marcduiker
35
2.3k
Principles of Awesome APIs and How to Build Them.
keavy
127
17k
Pawsitive SEO: Lessons from My Dog (and Many Mistakes) on Thriving as a Consultant in the Age of AI
davidcarrasco
0
41
Designing Dashboards & Data Visualisations in Web Apps
destraynor
231
54k
Fireside Chat
paigeccino
41
3.8k
Side Projects
sachag
455
43k
Transcript
1 第五章 1 第五章 @Ringa_hyj 日本一の数学嫌いと学ぶ データサイエンス ~第五章:交差検証・再標本化~
2 第五章 2 第五章 対象視聴者: 数式や記号を見ただけで 教科書を閉じたくなるレベル
3 第五章 3 第五章 リサンプリング ・訓練・検証・テスト ・交差検証(ホールドアウト・一つ抜き・k分割) ・ブートストラップ
4 第五章 4 第五章 訓練・検証・テスト データ 交差検証
5 第五章 5 第五章 ・訓練・検証・テスト データ 予測モデルを作るのは 未知(将来得られる予定)のデータを予測したい 手元のデータからモデルを作っても 未知のデータに対応できているか確認はできない
データ Full dataset (sample) 学習 ロジスティック回帰 最小二乗法 モデル 未知のデータ データに対して 95%正解できる 何%?? 未知のデータに 対応している??
6 第五章 6 第五章 ・訓練・検証・テスト データ データを分割して学習用と、 未知データに対する精度の確認用として扱う データ 学習用データ
(訓練データ) train テストデータ test 学習 モデル
7 第五章 7 第五章 ・訓練・検証・テスト データ 機械学習の”学習”は何回も行い精度向上させる テストデータでの性能 & 訓練データの性能
どちらも下げるように学習 交差検証(cross-validation) 学習用データ (訓練データ) train テストデータ test 学習 モデル 精度 確認 train 学習 まだ? 終わり
8 第五章 8 第五章 ・訓練・検証・テスト データ テストデータの性能も見せてしまっているから、 未知のデータをカンニングした状態 学習用データ (訓練データ)
train テストデータ test 学習 モデル 精度 確認 train 学習 まだ? 終わり
9 第五章 9 第五章 ・訓練・検証・テスト データ さらにもう一つ分割する 検証データをカンニングさせ、 最後にテストで性能を確認する データ
学習用データ (訓練データ) train 検証データ valid 学習 モデル テストデータ test
10 第五章 10 第五章 データ Full dataset (sample) ・訓練・検証・テスト データ
未知のデータ (母集団) モデル 推定 未知のデータ (母集団) 抽出 sampling train valid test 再標本化 resampling
11 第五章 11 第五章 交差検証の手法(分割・確認) (ホールドアウト・一つ抜き・k分割・ブートストラップ)
12 第五章 12 第五章 ・ホールドアウト法(hold-out) データ だいたい半分 順番に関係がないならランダムに再標本化
13 第五章 13 第五章 ・1つ抜き法(LOOCV) leave one out cross validation
データ 一つだけのデータで性能を確認する ※たまたま外れ値のデータで検証してしまう可能性あり
14 第五章 14 第五章 ・K分割法(k-fold CV) データ データをK個(5~10くらい)に分割し、1つを検証用、残りを学習用 これでK-1回学習を行う ※一つ抜きよりも計算コストが少なく、
たまたまの外れ値を選ぶリスクも減る
15 第五章 15 第五章 ・ブートストラップ データ 重複を許す無作為抽出 ※標本データの性質を反映させやすい (多頻度登場するデータ) ブートストラップ標本
16 第五章 16 第五章
17 第五章 17 第五章
18 第五章 18 第五章
19 第五章 19 第五章
20 第五章 20 第五章
21 第五章 21 第五章
22 第五章 22 第五章
23 第五章 23 第五章
24 第五章 24 第五章
25 第五章 25 第五章
26 第五章 26 第五章
27 第五章 27 第五章
28 第五章 28 第五章
29 第五章 29 第五章
30 第五章 30 第五章
31 第五章 31 第五章