Описание вакансии
Обязанности
•Build dataset roadmap for AI team
•Collaborate with scientists to improve dataset quality
•Create datasets for model training operations
•Extend ingestion pipeline cloud infrastructure
•Ingest audio data into ingestion pipeline
Условия
•Asynchronous work culture
•Flexible management approach
Технологии: Bash, Cloud platform, Data Processing, Docker, Google Cloud, Google Cloud Platform, Infrastructure as Code, Large Scale Data, Large-scale, Large-scale Data Processing, Linux, Python, Terraform, Web Crawling, “as-code”