Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
テキスト埋め込み色々あるけどどれがいいの?
Search
Sponsored
·
Ship Features Fearlessly
Turn features on and off without deploys. Used by thousands of Ruby developers.
→
ディップ株式会社
PRO
June 18, 2025
Technology
40
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
テキスト埋め込み色々あるけどどれがいいの?
ディップ株式会社
PRO
June 18, 2025
More Decks by ディップ株式会社
See All by ディップ株式会社
_型ガードしたのにnullable_から卒業する.pdf
dip_tech
PRO
0
49
はじめての環境構築!デプロイ〜Docker基礎を学べるワークショップ!
dip_tech
PRO
0
46
【TSKaigi2026登壇資料】決定論的な型チェックへ Go 製コンパイラによる10倍速の裏側で stableTypeOrdering から見える並列化への挑戦
dip_tech
PRO
2
440
【TSKaigi2026登壇資料】バイトル」のTypeScriptリニューアル — 積み上がったレガシーとパフォーマンスに挑む現在地
dip_tech
PRO
1
780
【新卒研修】ライブデモ + compose.yaml読解_講義資料
dip_tech
PRO
0
310
【ディップ|26年新卒研修資料】OpenAPI/Swagger REST API研修
dip_tech
PRO
0
460
【ディップ|26年新卒研修資料】Docker_ハンズオン研修
dip_tech
PRO
0
430
【ディップ|26年新卒研修資料】TDD実装演習
dip_tech
PRO
0
480
ハッカソンや個人開発で何作る? テーマ発見〜アイデア発想ハンズオン! 技育CAMPアカデミア
dip_tech
PRO
0
100
Other Decks in Technology
See All in Technology
地域 SRE コミュニティ最前線 / SRE NEXT 2026 Discussion Night Track C
muziyoshiz
0
220
SREとQA 二人三脚で進めるSLO運用/sre-qa-slo
sugitak
0
540
AI時代の開発生産性は、個人技からチーム設計へ
moongift
PRO
3
340
ヘルスケア領域における AI 活用と その安全性担保のための取り組み (Leveraging AI in Healthcare and Our Efforts to Ensure Its Safety) - Google I/O Extended Tokyo 2026, July 11, 2026
zettaittenani
0
320
Claude Codeとハーネスについて考えてみる
oikon48
19
9.4k
LLM/Agent評価:トップ営業の発言を「正解」にする 〜暗黙的正解による評価を営業資産に変える〜
takkuhiro
1
220
インフラ寄りSREでも 開発に踏み出せる〜境界を越えてユーザー体験に向き合いたい〜
sansantech
PRO
2
3.8k
[2026-07-15] AI Ready なはずだったアーキテクチャと、見えてきた課題・次に目指す状態
wxyzzz
6
3.2k
Kaggleで成長するために意識したこと
prgckwb
2
330
あなたの『Site』はどこですか? — xREという考え方
miyamu
0
1.2k
Control Planeで育てるBtoB SaaSの認証基盤 - SRE NEXT 2026
pokohide
1
2.3k
ゴールデンパスは敷いただけでは道にならない ─ 企画部門のエンジニアが技術標準を事業価値に変えるまで
mhrtech
0
140
Featured
See All Featured
It's Worth the Effort
3n
188
29k
Claude Code どこまでも/ Claude Code Everywhere
nwiizo
65
56k
Fireside Chat
paigeccino
42
4k
ピンチをチャンスに:未来をつくるプロダクトロードマップ #pmconf2020
aki_iinuma
128
56k
The Curse of the Amulet
leimatthew05
2
13k
Why Your Marketing Sucks and What You Can Do About It - Sophie Logan
marketingsoph
0
230
Responsive Adventures: Dirty Tricks From The Dark Corners of Front-End
smashingmag
254
22k
How to make the Groovebox
asonas
2
2.3k
Side Projects
sachag
455
43k
What’s in a name? Adding method to the madness
productmarketing
PRO
24
4.1k
Utilizing Notion as your number one productivity tool
mfonobong
4
380
How To Speak Unicorn (iThemes Webinar)
marktimemedia
1
500
Transcript
テキスト埋め込み色々あるけどどれがいいの? ディップ株式会社 AI Embedded課 有田智也 (ARITA Tomoya) 1
アジェンダ 2 1. 良いテキスト埋め込みを求めるモチベーション 2. 良いテキスト埋め込みを得るための事例紹介
3. テキスト埋め込みモデルの評価
dip AI とは? • AIとの対話を通じて求職者が自分にあったバ イトを探せるサービス ◦ 検索ロジックはフィルタリングとベクトル検索の ハイブリッド
3
dip AI の検索のつらみ 4 1. フィルタ条件の影響が支配的 • ベクトル検索のうまみを活かせていない •
思ったような案件を出そうとするとどうしてもフィルタになる 2. 検索クエリとお仕事内容のギャップ • シンプルにcos類似度をとってもうまくいかない この課題 に着目
検索クエリとお仕事内容のギャップ 5 ベクトル検索の課題 • 意味的な類似度で検索してくるだけではうまくいかないことが多い ◦ クエリとコーパスの埋め込み空間にはギャップがある
*text embedding3 smallで評価
Retrieval でのギャップを埋める方法 6 1. クエリの内容をコーパスに寄せる HyDE:クエリに回答する仮の文章をLLMで生成してベクトル検索 2. モデルを学習させる
• クエリと回答のペアを学習させる • 最近はLLMで作成した合成データセットを学習して、LLMの知識を蒸留す るのがブーム ◦ 最近公開されたAmber, Ruri, GeckoなどのEncoderモデルは合成 データセットを利用している
アジェンダ 7 1. 良いテキスト埋め込みを求めるモチベーション 2. 良いテキスト埋め込みを得るための事例紹介
3. テキスト埋め込みモデルの評価
Gecko: Versatile Text Embeddigs from Lage Language Models 概要
8 • LLMで合成データを作成(FRet)、Transfromer言語モデルを Pre-finetuningとfine-tuningで学習 ◦ Pre-finetuning: 様々な形式の教師なしのテキストペアを Contrastive Learningで学習 ▪ query側テキストの先頭には”question answering“や”search result”などの 識別子がデータセットに基づいて付与される ◦ fine-tuning:後述のFRetデータセットと学術的データセットを混ぜて教師あり 学習
FRet 9 モチベーション • ラベルづけされた大量のデータを用意する のはコストが高い😢 →LLMを活用して擬似データセット作成 1.
LLMにWebの文書を与えタスクの説明と関 連するクエリを生成させる 2. embedding modelをRetriverとして1.の クエリに関連するパッセージを検索し正例、 負例を作成 • 検索結果とパッセージの関連性を LLM で計算 • 関連性がより高いパッセージが存在す る場合正例を変える(約15%) →660万件のデータセットを作成 https://arxiv.org/pdf/2403.20327より引用
Gecko でテキストのギャップは埋まるのか 10 *text-multilingual-embedding-002で評価 完璧に解ける訳ではないものの相対的な類似度は気持ち上がっている
アジェンダ 11 1. 良いテキスト埋め込みを求めるモチベーション 2. 良いテキスト埋め込みを得るための事例紹介
3. テキスト埋め込みモデルの評価
Retrieval 性能評価用データセット 12 • 文ベクトルの性能を測るためにJaGovFaqs-22k*を利用 ◦ Questionに対するAnswerの候補を10件予測してNDCGで評価 * JaGovFaqs-22kは日本の官公庁のWebサイトのQAデータセット
参照)https://huggingface.co/datasets/matsuxr/JaGovFaqs-22k
検索評価指標の NDCG簡単解説 13 • アイテムの出現順序を考慮した評価尺度 ◦ 理想的な順序に近いほど値が1に近づく この場合DCGは
1 / log_2(4) = 0.5 NDCGはDCGを理想的な DCGで割った値で 0.5 / 1 = 0.5
Retrieval 性能評価結果 14 • 最近のオープンな日本語に特化した埋め込みモデルはクローズな埋め込みモデ ルに匹敵する能力がある • ruri-v3-310mの検索性能が低パラメータ数にもかかわらず最も高い SentenceTransformerのInformation
Retrieval Evaluatorを利用してcos類似度で評価