К содержимому

Люкс · Объёмный eDTL

The Brand Collector — дампы по 120 000 строк, оркестратор на Fastify, воркеры на Go, которые доезжают.

The Brand Collector перепродаёт pre-owned люкс через сеть поставщиков. Тот же класс задачи, что каталожный фид, — только каждый дамп больше 120 000 строк, а CSV, который держат, выше 169 000. Fastify остался оркестратором. Тяжёлые вычисления уехали на воркеры Go. Примерно на 60% быстрее на таксономии, маппинге и pattern-match на таком объёме.

The Brand Collector 2025 5 мин чтения
The Brand Collector кейс
скорость
+60%
строк в дампе
120k+
строк в CSV
169k+

Дамп и есть продукт

Международный pre-owned люкс, сеть поставщиков, одна задача фида, которая не влезает в ноутбук. Каждый входящий дамп — больше 120 000 строк. CSV, который держат, — 169 000+. Бриф — надёжность под этой нагрузкой, не красивый маппер.

Fastify держит контур, Go делает работу

Начали с Fastify, потому что он держится под нагрузкой: API, расписания, отчёты. Этот слой остался. Вычисления — конвертация таксономии, маппинг, pattern-match на наборах 120k+ строк — уехали на воркеры Go. Гибрид нарочно. Node такой объём не жуёт. Go — да. Shopify и Matrixify сидят на магазинной стороне той же трубы.

  • Fastify как оркестратор: API, cron, отчёты
  • Воркеры Go — таксономия, маппинг, pattern-match
  • ~на 60% быстрее на этих шагах при 120k+ строк
  • SQL посередине; Shopify + Matrixify на выходе

Объём — это ограничение

Это не трёхсекундный опрос Sheets. Это дамп, который уже не живёт в памяти так, как жил партнёрский файл. Пайплайн должен доехать, записать и быть на месте к следующему файлу. За эту надёжность и платили.

Технологии

  • Fastify
  • Go
  • SQL
  • Shopify
  • Matrixify

Результаты

  • Таксономия, маппинг и pattern-match ~на 60% быстрее на наборах 120k+ строк
  • Пайплайн держит CSV на 169 000+ строк и не падает
  • Fastify — API, расписания, отчёты; Go — вычисления
Все кейсы