Чем предстоит заниматься
Проектировать и развивать поисковое ядро на базе OpenSearch: схемы индексов, шардирование, ranking и relevance tuning, гибридный (full-text + векторный) поиск
Разрабатывать и развивать высоконагруженные backend-сервисы поиска на Python (FastAPI): API поискового сервиса, оркестрация запросов, интеграция с GigaChat и другими LLM
Проектировать и развивать ML-инфраструктуру для vector search: генерация и хранение embeddings, ANN/HNSW индексы, деплой и обслуживание моделей через Triton Inference Server
Работать с PostgreSQL: проектирование схем, оптимизация запросов, обеспечение консистентности метаданных поискового сервиса
Обеспечивать производительность, надежность и масштабируемость поисковой платформы: мониторинг, контроль SLA, оптимизация latency и throughput
Проводить нагрузочное тестирование, оптимизировать задержку ответа поиска и стоимость инфраструктуры
Внедрять CI/CD, тестирование и observability для сервисов поиска
Работать в связке с data-инженерами, ML-инженерами и продуктовой командой над качеством и релевантностью поиска
Участвовать в код-ревью, влиять на архитектурные решения команды, менторить менее опытных инженеров