Как мы строим GenAI-платформу в Lamoda: от MVP к production-решениям

Доклад с GenAI MeetUp от hh team и Lamoda Tech 28 мая 2026 года Спикер: Дима Курганский, TeamLead MLOps Lamoda Tech В докладе разберём эволюцию GenAI-инфраструктуры в Lamoda: от быстрого старта на Yandex DataSphere до появления production-требований к latency, стабильности и масштабируемости. Покажем реальные архитектурные компромиссы при построении векторного поиска или почему мы выбрали именно Yandex DataBase. Отдельно разберём инженерные паттерны для GenAI: как с опорой на python-экспертизу команды организовали polling / callback запросов к модели генерации образов внутри Triton Inference Server, когда ответа нужно ждать несколько секунд. В завершении обсудим, как по мере роста платформы трансформируется взаимодействие DS и MLOps, и какие организационные решения позволяют масштабировать разработку без потери скорости.

Иконка канала Code Поинт
26 подписчиков
12+
4 просмотра
15 дней назад
12+
4 просмотра
15 дней назад

Доклад с GenAI MeetUp от hh team и Lamoda Tech 28 мая 2026 года Спикер: Дима Курганский, TeamLead MLOps Lamoda Tech В докладе разберём эволюцию GenAI-инфраструктуры в Lamoda: от быстрого старта на Yandex DataSphere до появления production-требований к latency, стабильности и масштабируемости. Покажем реальные архитектурные компромиссы при построении векторного поиска или почему мы выбрали именно Yandex DataBase. Отдельно разберём инженерные паттерны для GenAI: как с опорой на python-экспертизу команды организовали polling / callback запросов к модели генерации образов внутри Triton Inference Server, когда ответа нужно ждать несколько секунд. В завершении обсудим, как по мере роста платформы трансформируется взаимодействие DS и MLOps, и какие организационные решения позволяют масштабировать разработку без потери скорости.

, чтобы оставлять комментарии