Экспертный опыт администрирования Linux
Опыт сопровождения высоконагруженных distributed systems
Глубокое понимание S3/Object Storage и distributed storage architecture
Опыт сопровождения Kubernetes-платформ
Практический опыт эксплуатации компонентов Data Lake: Apache Spark, Airflow, Flink, Kafka, Apache Iceberg
Опыт эксплуатации MinIO / Object Storage решений
Понимание replication, erasure coding, consistency, fault tolerance
Практический опыт troubleshooting: CPU, RAM, network, disk I/O, latency, throughput
Опыт работы с observability stack: Prometheus, Grafana, alerting, log analysis
Опыт автоматизации: Ansible, Terraform, Bash, Python
Понимание incident/problem management и SRE-практик
Навыки RCA, postmortem analysis и повышения reliability платформ