Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
論文紹介-AutoHyde
Search
tomatolian
June 24, 2024
Research
0
33
論文紹介-AutoHyde
tomatolian
June 24, 2024
Tweet
Share
More Decks by tomatolian
See All by tomatolian
24時間AIハッカソン- HEAT
tomatolian
0
14
うみがめのスープを利用した学習アプリ - RSS ハッカソン
tomatolian
0
100
論文紹介 - Emotion Bench
tomatolian
0
21
Other Decks in Research
See All in Research
Trust No Bot? Forging Confidence in AI for Software Engineering
tomzimmermann
1
240
なめらかなシステムと運用維持の終わらぬ未来 / dicomo2025_coherently_fittable_system
monochromegane
0
430
大規模な2値整数計画問題に対する 効率的な重み付き局所探索法
mickey_kubo
1
260
【緊急警告】日本の未来設計図 ~沈没か、再生か。国民と断行するラストチャンス~
yuutakasan
0
130
データサイエンティストの就労意識~2015→2024 一般(個人)会員アンケートより
datascientistsociety
PRO
0
690
Adaptive Experimental Design for Efficient Average Treatment Effect Estimation and Treatment Choice
masakat0
0
130
Principled AI ~深層学習時代における課題解決の方法論~
taniai
3
1.2k
線形判別分析のPU学習による朝日歌壇短歌の分析
masakat0
0
130
SSII2025 [SS2] 横浜DeNAベイスターズの躍進を支えたAIプロダクト
ssii
PRO
7
3.5k
RHO-1: Not All Tokens Are What You Need
sansan_randd
1
110
EarthSynth: Generating Informative Earth Observation with Diffusion Models
satai
3
100
EarthMarker: A Visual Prompting Multimodal Large Language Model for Remote Sensing
satai
3
340
Featured
See All Featured
The Invisible Side of Design
smashingmag
300
51k
Principles of Awesome APIs and How to Build Them.
keavy
126
17k
The Art of Programming - Codeland 2020
erikaheidi
54
13k
Building Better People: How to give real-time feedback that sticks.
wjessup
367
19k
Put a Button on it: Removing Barriers to Going Fast.
kastner
60
3.9k
Making Projects Easy
brettharned
116
6.3k
Large-scale JavaScript Application Architecture
addyosmani
512
110k
Design and Strategy: How to Deal with People Who Don’t "Get" Design
morganepeng
130
19k
"I'm Feeling Lucky" - Building Great Search Experiences for Today's Users (#IAC19)
danielanewman
229
22k
Measuring & Analyzing Core Web Vitals
bluesmoon
7
500
Fireside Chat
paigeccino
37
3.5k
Build your cross-platform service in a week with App Engine
jlugia
231
18k
Transcript
HyDEの網羅性を上げる Auto-HyDE手法の提案 (2024/4/5投稿) 芸術工学府一年 鈴木醇
ユーザレビュー レビューDB ユーザのレビューに 似たもの タイトルが わからな かった タイトルの 意味は理解 できなかった
タイトルが 意味不明 結局タイトル はどう関連 する? 通常のRAGだと 01 意味的に似ているものではなく説明が欲しい
HyDE手法 02 ユーザレビュー LLM タイトルが わからな かった タイトルは、 ラストの... という意味
と思った。 タイトルの 意味は... という考え がしっくり。 タイトルは 文字通り... 仮説解説 タイトルの 意味は.... である。 仮説的文書埋め込み(HyDE): 疑似的に文書を生成することによって、目的の文書を取得する 解説文書
HyDEの課題 03 HyDE手法には限界がある 疑似文書を生成するプロンプト依存が大きい ユーザの入力クエリに対して一つのプロンプトは非現実的 DBの性質によって、スタイルやトーン、構造が一意でない場 合、疑似文書を生成するプロンプトによって検索が偏る
AutoHyDE 04 HyDEの網羅性を上げるために、どのような疑似的文章を生成すれ ばよいかを判別 検索結果 TOP100 keyword含む文書群 (重要かも) TOP20 TOP21~100
検索クエリ ヒロがミカに恋した理由 キーワード [”ヒロ”,”ミカ”,”恋”] キーワード抽出 ベクトル類似度検索 クラスタ1 クラスタ2 クラスタ3 疑似文書1 疑似文書2 疑似文書3 通常のRAG Auto-HyDE 類似度検索を信頼する数xn 20x5 =100 類似度検索で取得する文書
AutoHyDEへの所感 05 レビューは、HyDEの手法の課題で紹介されたスタイルやトーン、 構造が一意でないという最たる例 素のHyDEでは必要な、プロンプト調整の部分が自動化される 多視点を取ってくるということに対してクリティカル(な気がする) 懸念点 提案のみで精度評価がされていない 応答は遅くなる
参考文献 https://note.com/ippei_suzuki_us/n/n94cea16ac02e https://towardsdatascience.com/autohyde-making-hyde- better-for-advanced-llm-rag-619e58cdbd8e