Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
データチームを率いる現場マネージャーが語る、市場が求めるデータエンジニアに爆速で成長する方法
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
Takaya Nakanishi
September 28, 2022
Technology
820
0
Share
データチームを率いる現場マネージャーが語る、市場が求めるデータエンジニアに爆速で成長する方法
2022年9月27日に開催した Cloud Native DataEngineer Community での登壇資料です。
Takaya Nakanishi
September 28, 2022
More Decks by Takaya Nakanishi
See All by Takaya Nakanishi
AI がコードを書く時代で エンジニアであるために - ハーネスエンジニアリングの、その先へ
kc_nakanishi
0
120
DAIS 2025 で感じた データ + AI の“イマ”
kc_nakanishi
1
470
Databricks Data+AI Summit 2024 最新動向座談会
kc_nakanishi
0
340
20240330_LT資料「エンジニアに求められるマネジメント」
kc_nakanishi
2
390
ナレコム CULTURE DECK
kc_nakanishi
1
2.3k
AI業界をリードする企業のエンジニアが語る:クラウド & AI でキャリアを作る魅力
kc_nakanishi
1
490
受託クラウド AI ベンチャーで働く自分から見た 誰も言わない成功プロジェクトの共通点
kc_nakanishi
0
400
ChatGPTがある時代にわたしたちはどう生きるか
kc_nakanishi
2
250
「AWS 上で始めるモダンデータアアーキテクチャと データ活用に向けたアプローチ」
kc_nakanishi
0
740
Other Decks in Technology
See All in Technology
AI駆動開発でなんでもハンズオン環境をつくってみた
yoshimi0227
0
180
Diagnosing performance problems without the guesswork
elenatanasoiu
0
130
基礎から解説!Icebergで紐解くSnowflake×Databricks連携の現在地
cm_yasuhara
0
400
Kiro CLI v2.0.0がやってきた!
kentapapa
0
220
開発を止めない CI/CD ~CI Visibilityによる継続的最適化~
pensuke628
0
210
個人の発見を、組織の知恵に 〜生成AI活用を"探索"から"組織の仕組み"へ〜
kintotechdev
2
170
食べログのサーキットブレーカー導入を振り返って
atpons
1
150
Spring AI × MCP 入門〜AIエージェントへのツール公開、境界設計から始める最小構成 〜
yuyamiyamoto
0
190
AI Adaptable なテストを整える工夫 / Ways to Make Your Tests AI-Adaptable
bitkey
PRO
2
180
AI時代から振り返るTerraform drift運用の歴史 / AI Age Reflections on the History of Terraform Drift Operations
aeonpeople
0
600
AI時代の私の技術インプットとアウトプット術
tonkotsuboy_com
15
7.9k
Cloud Run のアップデート 触ってみる&紹介
gre212
0
250
Featured
See All Featured
Improving Core Web Vitals using Speculation Rules API
sergeychernyshev
21
1.5k
Are puppies a ranking factor?
jonoalderson
1
3.4k
The Power of CSS Pseudo Elements
geoffreycrofte
82
6.3k
Measuring Dark Social's Impact On Conversion and Attribution
stephenakadiri
2
200
Building a Modern Day E-commerce SEO Strategy
aleyda
45
9.1k
Neural Spatial Audio Processing for Sound Field Analysis and Control
skoyamalab
0
310
Skip the Path - Find Your Career Trail
mkilby
1
130
Refactoring Trust on Your Teams (GOTO; Chicago 2020)
rmw
35
3.5k
The Illustrated Guide to Node.js - THAT Conference 2024
reverentgeek
1
370
Future Trends and Review - Lecture 12 - Web Technologies (1019888BNR)
signer
PRO
0
3.6k
The Myth of the Modular Monolith - Day 2 Keynote - Rails World 2024
eileencodes
28
3.5k
We Are The Robots
honzajavorek
0
230
Transcript
データチームを率いる現場マネージャーが語る、 市場が求めるデータエンジニアに爆速で成長する方法 株式会社ナレッジコミュニケーション ビジネス・デベロップメント部 中西 貴哉 2022年9月27日 Cloud Native DataEngineer
Community 第1回イベント
自己紹介 氏名 : 中西 貴哉 (なかにし たかや) 所属 : ビジネス・デベロップメント部
マネージャー (何でもやる) 担当 : セールス-運用までのエンジニアリングチームのマネジメント 2 データエンジニアを目指す方にオススメな資格 (自分が保有しているもの)
1 2 3 Agenda データエンジニアの ニーズ クラウドネイティブ になるメリット 経験 をどう獲得するか?
3
市場が求めるデータエンジニアになる3つのキーワード クラウド 経験 ニーズ 4
ニーズ
データプロジェクトの実情 6 85% のビッグデータプロジェクトは失敗 実は・・・
7 ML code データ収集 データ検証 環境構築 自動化 特徴量エンジニアリング テストと デバッグ
モデル評価 プロセス設計 モデル提供 インフラ構築 メタデータ管理 リソース マネジメント Hidden Technical Debt in Machine Learning Systems (Sculley et al. 2015) より作成 「分析」そのものは全体のごく一部
データプロジェクトの登場人物 8 ▪ コラボレーション、機械学習の実 験、再現性・再利用性を担保 ▪ データプレパレーション、特徴量 抽出 ▪ 機械学習時間、モデル精度に
対する最適化 ▪ 最新のツールや最新アルゴリズ ムの導入と適用 ▪ 常に正確で信頼できる最新 データにアクセスすることを担保 ▪ データチームがアクセスするデータ の定義と管理者の明確化を推 進 ▪ データガバナンスの統合的な管 理を推進 ▪ 各プロセス処理の動作担保 ▪ 各種ユースケースへの対応 (リア ルタイム, バッチ) ▪ 性能、データ品質の担保 ▪ 新しいデータソースへの対応 ▪ スキーマチェックとカラム変更時の 対応 ▪ 変更時のデプロイ先アプリへの対 応 ▪ ニーズに合わせた環境構築 ▪ 環境ごとの一貫性の担保 ▪ コアデータの複数チームへの共有 ▪ テスト、ダウンタイム、品質管理 ▪ 各種コンフィギュレーション管理 ▪ コスト管理、各種自動化 ▪ システム環境の運用保守 データ/MLエンジニア データスチュアード 運用管理担当 データサイエンティスト
9 ML code データ収集 データ検証 環境構築 自動化 特徴量エンジニアリング テストと デバッグ
モデル評価 プロセス設計 モデル提供 インフラ構築 メタデータ管理 リソース マネジメント Hidden Technical Debt in Machine Learning Systems (Sculley et al. 2015) より作成 広範な技術領域をカバーする必要がある データ/MLエンジニア データサイエンティスト 運用管理担当 運用管理担当 データスチュアード
実際のところ・・・ 10 ML code データ収集 データ検証 環境構築 自動化 特徴量エンジニアリング テストと
デバッグ モデル評価 プロセス設計 モデル提供 インフラ構築 メタデータ管理 リソース マネジメント Hidden Technical Debt in Machine Learning Systems (Sculley et al. 2015) より作成 データ/MLエンジニア
クラウド
なぜクラウドネイティブか? 12 ML code データ収集 データ検証 環境構築 自動化 特徴量エンジニアリング テストと
デバッグ モデル評価 プロセス設計 モデル提供 インフラ構築 Hidden Technical Debt in Machine Learning Systems (Sculley et al. 2015) より作成 リソース マネジメント メタデータ管理
クラウドの理解と活用で大半はカバー可 13 ML code データ収集 データ検証 環境構築 自動化 特徴量エンジニアリング テストと
デバッグ リソース マネジメント モデル評価 プロセス設計 モデル提供 インフラ構築 メタデタ管理 メタデータ管理 Hidden Technical Debt in Machine Learning Systems (Sculley et al. 2015) より作成
クラウドネイティブで始めるメリット 14 「答え」が提供されている 価値のある課題に集中できる
アーキテクチャの模範解答 15 Azure Machine Learning を使用した Python モデル用の MLOps AWS
ソリューションライブラリー MLOps Workload Orchestrator AWS Azure
ビジネス領域へのアプローチ 16 製薬 流通 流通 All All All All All
金融 金融 製造 金融 製造 通信 公共 製薬 製薬 All All All All All All 金融 All データブリックス社の公開するソリューションアクセラレータ 現場の分析アプローチが Notebook 形式で公開
経験
不確実性の高い時代に求められる学び 18 これまで これから 絶対解 知識の蓄積 計画的な学習 資格取得 最適解 知識の更新
スピード学習 ラーニング
市場価値を上げる人のアプローチ 経 験 多 少 少 多 学習の量 経験偏重 発展途上
学習偏重 成長する 働き方 仕事から学び 学 び か ら 仕 事
どんな経験も活かせます 20 経験 活きる場面 営業 運用 数理知識 ドメイン理解 MLOps モデル開発
チーム内での経験と学習の両立 21
まとめ クラウドネイティブになれる データプロジェクトに飛び込もう!
カジュアル面談やってます エントリーページ