高级K8S运维专员
岗位职责
Kubernetes 架构与运维
•负责公司 Kubernetes 集群的整体架构设计、部署、运维和优化,确保大规模容器平台的高可用性与可扩展性。
•主导集群升级、扩容及灾备方案设计,构建企业级生产环境标准。
•深入参与微服务架构落地,优化容器化部署流程,提升 CI/CD 自动化能力。
•编写和维护 Kubernetes 资源配置(Deployment、StatefulSet、DaemonSet、Ingress、ConfigMap、Helm Charts 等)。
•监控集群健康状态,分析和排查系统性能瓶颈及故障。
日志平台(EFK/ELK)运维
•负责日志平台的部署、维护、优化及监控,保障日志收集、存储和查询的可靠性。
•制定日志管理策略,包括分级存储、索引优化、数据生命周期管理等,降低日志平台成本(目前月成本约 5 万 USD)。
•解决日志丢失、延迟及查询性能问题,确保生产环境日志的完整性和可追溯性。
•编写日志平台运维文档、操作手册及应急预案。
云原生安全与治理
•制定集群安全策略,包括 RBAC、NetworkPolicy、Pod Security、Secrets 管理及镜像安全策略。
•配置并维护监控告警系统(Prometheus、Grafana 等),提供运维指标和性能分析。
•参与跨团队协作,优化多业务线容器与日志管理流程,提供技术指导和运维标准。
自动化与工具建设
•编写自动化运维脚本(Python、Go、Shell 等),提升日常运维效率。
•研究并引入前沿云原生技术,提高平台可靠性和运维效率。
任职要求
•本科及以上学历,计算机、软件工程或相关专业,5 年及以上运维经验,3 年及以上 Kubernetes 实践经验。
•熟悉 Kubernetes 架构与核心组件,精通 Docker 容器技术及镜像优化。
•精通 Linux 系统及网络原理,能独立进行性能调优与故障排查。
•熟练掌握 EFK/ELK 日志平台运维,包括收集、存储、索引优化及查询性能调优。
•熟悉云原生生态(Prometheus、Grafana、ArgoCD、Istio/Linkerd 等)。
•熟悉云平台(AWS/GCP/阿里云)容器服务与资源管理策略,具备多集群管理经验。
•掌握 CI/CD 工具链及自动化运维脚本(Python、Go、Shell 等),有大规模生产环境部署经验。
•优秀的架构设计能力,能在多业务、高并发场景下规划集群资源、日志策略和运维方案。
•具备良好的团队合作与跨部门沟通能力,能够指导初级运维和开发团队。
•能够阅读英文技术文档、官方手册及社区资料,并快速学习和应用新技术。
加分项
•有 K8S Operator 开发经验或自研运维工具经验。
•有微服务架构优化、服务网格实施或多集群治理经验。
•有大规模日志平台设计经验,能降低成本、提升查询性能及日志可靠性。
•熟悉容器安全、漏洞扫描、策略加固及合规管理。
•对云原生前沿技术(如 Knative、KubeVirt、Kubeflow)有实践经验。
上班时间:8小时、双休+本地假期、薪资面议
办公地点:Serbia 宿舍办公/工签办理好在办公室上班
岗位咨询:@RoseHRD1
Post #392
1.25K