Lock in $30 Savings on PRO—Offer Ends Soon! ⏳
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
清水宏太_ポートフォリオ資料_2023年11月時点
Search
Lemio
November 06, 2023
Programming
0
110
清水宏太_ポートフォリオ資料_2023年11月時点
Lemio
November 06, 2023
Tweet
Share
More Decks by Lemio
See All by Lemio
20250520_Dify_Meetup_Tokyo__5_LT資料_アプリケーションが動かなくなったらバージョンを見よう_.pdf
lemio
1
1.1k
0からDifyを学ぶには_Dify Meetup Tokyo #4
lemio
0
2k
生成AIの社内導入やってみて_SaySyaMeetUpVol3
lemio
0
96
第2回saysayオフ会LT_清水れみお
lemio
0
220
開発した生成AI活用アプリ
lemio
0
190
遅刻しなAI_LT資料
lemio
0
120
Other Decks in Programming
See All in Programming
Pythonではじめるオープンデータ分析〜書籍の紹介と書籍で紹介しきれなかった事例の紹介〜
welliving
3
580
Rubyで鍛える仕組み化プロヂュース力
muryoimpl
0
160
Flutter On-device AI로 완성하는 오프라인 앱, 박제창 @DevFest INCHEON 2025
itsmedreamwalker
1
150
ゆくKotlin くるRust
exoego
1
160
TerraformとStrands AgentsでAmazon Bedrock AgentCoreのSSO認証付きエージェントを量産しよう!
neruneruo
4
1.8k
AIコーディングエージェント(NotebookLM)
kondai24
0
230
Spinner 軸ズレ現象を調べたらレンダリング深淵に飲まれた #レバテックMeetup
bengo4com
0
170
HTTPプロトコル正しく理解していますか? 〜かわいい猫と共に学ぼう。ฅ^•ω•^ฅ ニャ〜
hekuchan
2
360
20251212 AI 時代的 Legacy Code 營救術 2025 WebConf
mouson
0
210
脳の「省エネモード」をデバッグする ~System 1(直感)と System 2(論理)の切り替え~
panda728
PRO
0
120
【卒業研究】会話ログ分析によるユーザーごとの関心に応じた話題提案手法
momok47
0
120
re:Invent 2025 トレンドからみる製品開発への AI Agent 活用
yoskoh
0
140
Featured
See All Featured
Faster Mobile Websites
deanohume
310
31k
jQuery: Nuts, Bolts and Bling
dougneiner
65
8.3k
Improving Core Web Vitals using Speculation Rules API
sergeychernyshev
21
1.3k
Responsive Adventures: Dirty Tricks From The Dark Corners of Front-End
smashingmag
254
22k
A designer walks into a library…
pauljervisheath
210
24k
Mozcon NYC 2025: Stop Losing SEO Traffic
samtorres
0
90
Self-Hosted WebAssembly Runtime for Runtime-Neutral Checkpoint/Restore in Edge–Cloud Continuum
chikuwait
0
230
Site-Speed That Sticks
csswizardry
13
1k
ピンチをチャンスに:未来をつくるプロダクトロードマップ #pmconf2020
aki_iinuma
128
55k
Game over? The fight for quality and originality in the time of robots
wayneb77
1
66
The Impact of AI in SEO - AI Overviews June 2024 Edition
aleyda
5
680
The Pragmatic Product Professional
lauravandoore
37
7.1k
Transcript
AIは 考える×作る×聞く×話す×見る =無限∞のアイデア そして私はアイデアマンです。
アイデアに価値はない 形にできなければそれは寝言と同じだ。 by 清水 亮 出典
なので作りました。
考える×作る
5 遅刻しなAI アプリ紹介 自然言語からスケジュール登録と 移動スケジュールも同時に登録 LINE友達登録URL WEB簡易版
スケジュールURL生成 アーキテクチャ図 6 GPT-3.5-turbo-instruct スケジュール情報 Googleカレンダー 登録URL プロンプトにて 日付/時間/場所/イベント 名/イベント内容を分類
URLをZero Shotで生成 https://www.google.com/calendar/event?action=TEMPLATE&text=LLM+Application+Meetup+vol.99&dates =20231212T100000Z/20231212T120000Z&details=https://llm-app.connpass.com/event/297732/&location= 品川グランドセントラルタワー+日本マイクロソフト品川本社+31F+セミナールーム+A&trp=false <URL生成例> Olemi-llm-apprentice/Dont_be_late_AI: 遅刻しなAI (github.com)
乗換経路生成 アーキテクチャ図 7 GPT-3.5-turbo-instruct スケジュール情報 + 出発地 出発地 目的地 緯度経度
到着時刻 (日本標準時) URL合成 https://www.google.com/maps/dir/35.6896067,139.7005713/35.6267695,139.7404376/am=t/ data=!4m9!4m8!1m1!4e1!1m0!2m3!6e1!7e2!8j1702407000!3e3?entry=ttu <URL生成例>
プロンプトの一部
現状見えている課題と対応策 ・音声認識機能追加→ Whisper ・複数人同時で扱うとバグが発生→UserIDをDBで管理 ・車やサイクリング経路探索機能追加→GoogleMap API ・スクリーンショットや画像からスケジュール作成→日本語OCRモデルの勉強 ・セキュリティ設定→これから
聞く×考える×作る
動画→議事録化AIエージェント(11月末無料公開目標) Web会議 録画 レポート 議事録 現場打合せ 録音 様々な動画や音声データ
動画→議事録化AI アーキテクチャ図 12 GPT-3.5-turbo 動画 .mp4 音声 .mp3 文字起こし 全文
テキスト 分割 テキスト 要約 要約 テキスト 合成 合成 テキスト マークダウン 記事化 議事録化 全体要約 テキスト 分割 テキスト 分割 テキスト 分割 テキスト 要約 テキスト 要約 テキスト 要約 ffmpeg GPT-3.5-turbo Olemi-llm-apprentice/-whisper_test- (github.com)
生成例
動画に一語一語字幕(形態素解析) カラオケのように字幕が単語ごとに強調 (形態素解析したものは日本初?) 出展:https://www.youtube.com/watch?v=Gh0xzbgCIgg&pp=ygUc44K944OV44OI44OQ44Oz44KvIOWtq-ato-e-qQ%3D%3D
一語一語字幕 アーキテクチャ図 動画 .mp4 文字 起こし .json フォント 付字幕 .ass
ffmpeg WhisperX 単語から 形態素解析 .json janome 字幕付き 動画 .mp4
二つを合成して目指す最終系 M365 CopilotのTeams会議議事録機能 <機能> ・動画記録 ・議事録、タスク化 ・話者認識 ・会議内容をRAGでAI チャット ・議事録から動画の再生
場面へジャンプ ・ネガポジ発言探知
現状見えている課題と対応策 ・話者認識機能→ WhisperX ・文字起こしテキストをベクトル化→LangChain ・RAG_AIチャット機能→LangChain ・議事録からと動画のタイムスタンプ動機→これから ・ネガポジ発言探知モデルの追加→これから ・文字起こしおよび字幕焼き付け処理をローカルに飛ばすためのサーバー設定 およびセキュリティ設定→これから ・UI作成→これから(VercelV0を試したい)
生成AI系 MeetUpイベント 参加実績 ※オンライン含む
生成AI系 MeetUpイベント LT登壇実績 MicrosoftにてLT登壇 生成AI高専人会を 主催しLT登壇
今後つくりたいもの(個人として) 聞く×考える×話す ・3歳児向けおしゃべりぬいぐるみ(クリスマス目標) ・どんな時でも肯定的に励ましてくれる話せるAIアシスタント(12月末目標) 見る×考える×作る ・プラモデルの棚卸アプリ(1月末目標) ・チラシからお買い得商品通知+献立レシピ提供アプリ(3月末目標) 見る×考える×作る ・リアルおままごとレジ打ち(1月末目標)
考える×作る×聞く×話す×見る AIで 日本の生産性を革命的に向上させる プロダクトを作りたい