Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
node.js for millions of images
Search
Sponsored
·
Ship Features Fearlessly
Turn features on and off without deploys. Used by thousands of Ruby developers.
→
Ivan Babrou
October 25, 2012
Programming
7
1.5k
node.js for millions of images
Ivan Babrou
October 25, 2012
Tweet
Share
More Decks by Ivan Babrou
See All by Ivan Babrou
LXJS 2013: backpack — scalable photo storage
bobrik
2
150
Other Decks in Programming
See All in Programming
Codexに役割を持たせる 他のAIエージェントと組み合わせる実務Tips
o8n
1
480
ふつうの Rubyist、ちいさなデバイス、大きな一年
bash0c7
0
580
Claude Code の Skill で複雑な既存仕様をすっきり整理しよう
yuichirokato
1
300
オブザーバビリティ駆動開発って実際どうなの?
yohfee
3
690
PostgreSQL を使った快適な go test 環境を求めて
otakakot
0
410
LangChain4jとは一味違うLangChain4j-CDI
kazumura
1
150
The Ralph Wiggum Loop: First Principles of Autonomous Development
sembayui
0
3.7k
Codex の「自走力」を高める
yorifuji
0
520
grapheme_strrev関数が採択されました(あと雑感)
youkidearitai
PRO
1
210
encoding/json/v2のUnmarshalはこう変わった:内部実装で見る設計改善
kurakura0916
0
310
CSC307 Lecture 13
javiergs
PRO
0
310
CopilotKit + AG-UIを学ぶ
nearme_tech
PRO
1
130
Featured
See All Featured
B2B Lead Gen: Tactics, Traps & Triumph
marketingsoph
0
68
Are puppies a ranking factor?
jonoalderson
1
3.1k
Navigating the Design Leadership Dip - Product Design Week Design Leaders+ Conference 2024
apolaine
0
220
A better future with KSS
kneath
240
18k
Measuring & Analyzing Core Web Vitals
bluesmoon
9
770
What the history of the web can teach us about the future of AI
inesmontani
PRO
1
450
Highjacked: Video Game Concept Design
rkendrick25
PRO
1
310
The Success of Rails: Ensuring Growth for the Next 100 Years
eileencodes
47
8k
Fireside Chat
paigeccino
42
3.8k
Faster Mobile Websites
deanohume
310
31k
Performance Is Good for Brains [We Love Speed 2024]
tammyeverts
12
1.4k
AI Search: Where Are We & What Can We Do About It?
aleyda
0
7.1k
Transcript
Хранилище для миллинов картинок на node.js (а почему бы и
да) Wednesday, October 24, 12
Что есть 40+ миллионов пользователей 1.5 миллиона уников в сутки
15 пользовательских фоток на главной 60 пользовательских фоток в ленте 60 килобайт на фото в среднем 10 терабайт данных Wednesday, October 24, 12
Роли Frontend Cache Resizer Backend Wednesday, October 24, 12
Frontend nginx SSL termination Upstream hash Смотрят в интернет Wednesday,
October 24, 12
Cache nginx tmpfs proxy_next_upstream Больше ничего Wednesday, October 24, 12
Resizer nginx image_filter proxy_next_upstream lua Wednesday, October 24, 12
А дальше всё становится плохо. Wednesday, October 24, 12
Особенности 99% времени серверов с данными - IO “Long tail”
problem Невозможно выровнять чтения Попасть в кеш в 3Тб данных непросто Wednesday, October 24, 12
Диски тормозят Память в 100 000 раз быстрее диска, но
диски надёжнее и вместительнее. Wednesday, October 24, 12
Решения nginx хватит (btrfs, reiserfs, *fs) Haystack (facebook) Elliptics (yandex)
Wednesday, October 24, 12
Yeah, well, I'm gonna go build my own theme park,
with blackjack and hookers. In fact, forget the park! Wednesday, October 24, 12
backpack Задумка из Haystack Proof of concept + Wednesday, October
24, 12
Backend node.js redis Файлы по 4Gb Wednesday, October 24, 12
Как это изнутри node.js redis disk: - data_XXX (4Gb) -
metadata_XXX Метаданные всегда в памяти. Для чтения всегда только 1 вызов pread Wednesday, October 24, 12
Redis Очень быстрый (даже слишком) Информация в бинарном виде Было:
/u124/z1dg23.jpg Будет:{file:1}{offset:4}{length:4} Минимальная нагрузка на диск (AOF) Wednesday, October 24, 12
node.js javascript Асинхронная работа Постоянно открытые файлы Постоянное соединение к
redis 1 поток (на самом деле нет) Wednesday, October 24, 12
Потоки (streams) Http запросы и ответы: req, res Data Writer:
req.pipe(writer) Data Reader: reader.pipe(res) Wednesday, October 24, 12
Только ультахардкор Выравнивание чтений (O_DIRECT) Посчитать дешевле +50% к пропускной
способности Более ровный график использования IO Модуль для node.js (aligned-buffer) Wednesday, October 24, 12
Грабли O_DIRECT Записи должны быть выровнены Линус не одобряет (fadvice/madvice)
Повторное чтение не идёт в кеш Wednesday, October 24, 12
Тестирование 40Gb данных (малая часть) 500K файлов Случайное чтение в
50 потоков Без записи Wednesday, October 24, 12
Графики: backpack 0 225 450 675 900 backpack-a backpack-a-dc3 backpack
-a: выровненные чтения -dc3: каждые 5 секунд echo 3 > /proc/sys/vm/drop-cache Wednesday, October 24, 12
Графики: nginx 0 225 450 675 900 nginx nginx-dс nginx-dc3
-a: выровненные чтения -dc: каждые 5 секунд echo 1 > /proc/sys/vm/drop-cache -dc3: каждые 5 секунд echo 3 > /proc/sys/vm/drop-cache Wednesday, October 24, 12
Графики: вместе 0 225 450 675 900 backpack-a-dc3 nginx-dс nginx-dc3
-a: выровненные чтения -dc: каждые 5 секунд echo 1 > /proc/sys/vm/drop-cache -dc3: каждые 5 секунд echo 3 > /proc/sys/vm/drop-cache Wednesday, October 24, 12
Где скачать? Доведём до ума и сделаем Open Source! Wednesday,
October 24, 12
Шардинг Фронтенды: dns round-robin Кеши: upstream hash + хаки Ресайзеры:
выбирай любой Данные: (D)HT - почти как в торрентах Wednesday, October 24, 12
Hash map Хеш: (md5(соль + user_id))[0:2] Начальный хеш: [read], [write]
00: [1,2,3], [1,2,3] (от 00 до 39) 40: [5,6,7], [5,6,7] (от 40 до 80) 80: [8,9,10], [8,9,10] (от 80 до ff) Wednesday, October 24, 12
Почему не уникальный hash на картинку Так вышло К тому
же, мы не хостинг скриншотов Сложнее вычислить все урлы картинок Неравномерное использование ресурсов Wednesday, October 24, 12
Как всем рулить Конфигурация Обработка задач Мониторинг Wednesday, October 24,
12
Конфигурация: Zookeeper Отказоустойчивость до конца Hash table для данных Хранение
данных серверов Задачи Wednesday, October 24, 12
Обработка задач: crons Кроны разбиения стораджа Разбиение Очистка Репликация картинок
Кроны скачивания картинок data data data Wednesday, October 24, 12
Мониторинг: zabbix Мониторининг io (сервера данных) Мониторинг cpu (ресайзеры) Сокеты,
сеть, всё что захотите Wednesday, October 24, 12
Миграция Перелопатить весь код Скачать все картинки Нагреть кеш Докачивать
новые Wednesday, October 24, 12
Как переживать падения Падения будут всегда Убрать точки отказа Спокойно
падать Иметь возможность восстановиться Wednesday, October 24, 12
Вопросы? Иван Бобров http://github.com/bobrik @ibobrik Wednesday, October 24, 12
Wednesday, October 24, 12