Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
データハンドリング/data_handling
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
florets1
July 11, 2024
Education
2
260
データハンドリング/data_handling
florets1
July 11, 2024
Tweet
Share
More Decks by florets1
See All by florets1
なぜSQLはAIぽく見えるのか/why does SQL look AI like
florets1
0
440
Tableauとggplot2の背景/Background_of_Tableau_and_ggplot2
florets1
0
50
Rで学ぶデータハンドリング入門/Introduction_to_Data_Handling_with_R
florets1
0
130
人工知能はクロスジョインでできている/AI_Is_Built_on_Cross_Joins
florets1
0
83
仮説の取扱説明書/User_Guide_to_a_Hypothesis
florets1
4
430
複式簿記から純資産を排除する/eliminate_net_assets_from_double-entry_bookkeeping
florets1
1
450
カイ二乗検定は何をやっているのか/What_Does_the_Chi-Square_Test_Do
florets1
7
2.5k
直積は便利/direct_product_is_useful
florets1
3
450
butterfly_effect/butterfly_effect_in-house
florets1
1
270
Other Decks in Education
See All in Education
Cifrado asimétrico
irocho
0
380
React完全入門
mickey_kubo
1
110
俺と地方勉強会 - KomeKaigi・地方勉強会への期待 -
pharaohkj
1
1.6k
沖ハック~のみぞうさんとハッキングチャレンジ☆~
nomizone
1
570
国際卓越研究大学計画|Science Tokyo(東京科学大学)
sciencetokyo
PRO
0
47k
【洋書和訳:さよならを待つふたりのために】第1章 出会いとメタファー
yaginumatti
0
220
2025-10-30 社会と情報2025 #05 CC+の代わり
mapconcierge4agu
0
110
子どものためのプログラミング道場『CoderDojo』〜法人提携例〜 / Partnership with CoderDojo Japan
coderdojojapan
PRO
4
18k
Web Search and SEO - Lecture 10 - Web Technologies (1019888BNR)
signer
PRO
2
3.1k
Web 2.0 Patterns and Technologies - Lecture 8 - Web Technologies (1019888BNR)
signer
PRO
0
3k
Use Cases and Course Review - Lecture 8 - Human-Computer Interaction (1023841ANR)
signer
PRO
0
1.4k
Security, Privacy and Trust - Lecture 11 - Web Technologies (1019888BNR)
signer
PRO
0
3.2k
Featured
See All Featured
Improving Core Web Vitals using Speculation Rules API
sergeychernyshev
21
1.4k
Mind Mapping
helmedeiros
PRO
0
77
Mobile First: as difficult as doing things right
swwweet
225
10k
Applied NLP in the Age of Generative AI
inesmontani
PRO
4
2k
A brief & incomplete history of UX Design for the World Wide Web: 1989–2019
jct
1
290
Jess Joyce - The Pitfalls of Following Frameworks
techseoconnect
PRO
1
63
Six Lessons from altMBA
skipperchong
29
4.1k
Leadership Guide Workshop - DevTernity 2021
reverentgeek
1
200
Bridging the Design Gap: How Collaborative Modelling removes blockers to flow between stakeholders and teams @FastFlow conf
baasie
0
440
The Hidden Cost of Media on the Web [PixelPalooza 2025]
tammyeverts
2
170
Stop Working from a Prison Cell
hatefulcrawdad
273
21k
The MySQL Ecosystem @ GitHub 2015
samlambert
251
13k
Transcript
1 2024.07.13 Tokyo.R #114 データハンドリング
2 応募者の選考データ 雑然データ.csv 整然データ.csv
3 整然データは扱いやすい(1)
4 整然データは扱いやすい(2)
5 整然データは扱いやすい(3)
6 整然データは扱いやすい(4)
7 整然データは扱いやすい(5) いいところ:選考段階が三次、四次と増えてもコード変更なしで通過率を求めることができる
8 雑然データは扱いにくい(1)
9 雑然データは扱いにくい(2)
10 雑然データは扱いにくい(3) つらいところ:選考段階が増えるごとにコード変更が必要
11 雑然データを整然データに変換 整然データ.csv 雑然データ.csv pivot_longer
12 変換できたら後は同じ
13 整然データの定義(1) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。
14 整然データの定義(2) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。 定義を満たしていない 変数が1つの列をなしていない
15 整然データの定義(3) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。 定義を満たしていない 応募者NO.1、選考段階「一次」の観測で1行 応募者NO.1、選考段階「二次」の観測で1行 となってほしい
16 整然データの定義(4) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。 定義を満たしている
17 整然データの定義(5) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。 分ける ・一つの事実は一つの場所へ ・矛盾した登録を防げる
18 整然データの定義(6) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。 1月応募.csv 2月応募.csv 3月応募.csv つなげる
19 整然データの定義(7) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。 定義を満たしていない 1つのセルに複数の値が入っている
20 整然データの定義(8) 1.個々の変数が1つの列をなす。 2.個々の観測が1つの行をなす。 3.個々の観測の構成単位の類型が1つの表をなす。 4.個々の値が1つのセルをなす。 分ける
雑然データに気を付けて データハンドリングが難しいなあ と感じたら、それは 雑然データかもしれません。 雑然データのままがんばるのではなく 整然データに変換できないか 検討してみましょう。